Οι περισσότεροι από εμάς πιθανότατα έχουμε ακούσει AI φωνές μέσω προσωπικών βοηθών όπως η Siri ή η Alexa, με τον επίπεδο τόνο και τη μηχανική τους απόδοση να μας δίνουν την εντύπωση ότι μπορούμε εύκολα να διακρίνουμε μεταξύ μιας φωνής που δημιουργείται από AI και ενός πραγματικού προσώπου. Αλλά οι επιστήμονες λένε τώρα ότι ο μέσος ακροατής δεν μπορεί πλέον να διακρίνει τη διαφορά μεταξύ πραγματικών ανθρώπων και “deepfake” φωνών.
Δείτε επίσης: Meta: Οι συνομιλίες με το AI chatbot θα χρησιμοποιούνται για εξατομικευμένες διαφημίσεις
Σε μια νέα μελέτη που δημοσιεύθηκε στις 24 Σεπτεμβρίου στο περιοδικό PLoS One, οι ερευνητές έδειξαν ότι όταν οι άνθρωποι ακούν ανθρώπινες φωνές – παράλληλα με εκδοχές των ίδιων φωνών που δημιουργούνται από AI – δεν μπορούν να αναγνωρίσουν με ακρίβεια ποιες είναι πραγματικές και ποιες ψεύτικες.

Η μελέτη έδειξε ότι, ενώ οι γενικές φωνές που δημιουργήθηκαν από την αρχή δεν θεωρήθηκαν ρεαλιστικές, οι AI φωνές που εκπαιδεύτηκαν στις φωνές πραγματικών ανθρώπων – deepfake ήχος – βρέθηκαν εξίσου πιστευτοί με τους αντίστοιχους της πραγματικής ζωής.
Οι επιστήμονες έδωσαν στους συμμετέχοντες στη μελέτη δείγματα 80 διαφορετικών φωνών (40 φωνές που δημιουργήθηκαν από τεχνητή νοημοσύνη και 40 πραγματικές ανθρώπινες φωνές) και τους ζήτησαν να επισημάνουν ποιες θεωρούσαν πραγματικές και ποιες δημιουργήθηκαν από τεχνητή νοημοσύνη. Κατά μέσο όρο, μόνο το 41% των φωνών τεχνητής νοημοσύνης που δημιουργήθηκαν από την αρχή ταξινομήθηκαν λανθασμένα ως ανθρώπινες, γεγονός που υποδηλώνει ότι εξακολουθεί να είναι δυνατό, στις περισσότερες περιπτώσεις, να τις διακρίνουμε από τους πραγματικούς ανθρώπους.
Δείτε ακόμα: Οι μεγαλύτερες δισκογραφικές εταιρείες κοντά σε μεγάλες συμφωνίες αδειοδότησης AI

Ωστόσο, για τις AI φωνές που κλωνοποιήθηκαν από ανθρώπους, η πλειοψηφία (58%) ταξινομήθηκε λανθασμένα ως ανθρώπινες. Μόνο ελαφρώς περισσότερες (62%) ανθρώπινες φωνές ταξινομήθηκαν σωστά ως ανθρώπινες, οδηγώντας τους ερευνητές στο συμπέρασμα ότι δεν υπήρχε στατιστική διαφορά στην ικανότητά μας να διακρίνουμε τις φωνές πραγματικών ανθρώπων από τους deepfake κλώνους τους.
Τα αποτελέσματα έχουν δυνητικά βαθιές επιπτώσεις στην ηθική, τα πνευματικά δικαιώματα και την ασφάλεια. Σε περίπτωση που οι εγκληματίες χρησιμοποιήσουν την τεχνητή νοημοσύνη για να κλωνοποιήσουν τη φωνή σας, γίνεται πολύ πιο εύκολο να παρακάμψουν τα πρωτόκολλα φωνητικής επαλήθευσης ταυτότητας στην τράπεζα ή να ξεγελάσουν τα αγαπημένα σας πρόσωπα ώστε να μεταφέρουν χρήματα.
Δείτε επίσης: Καλιφόρνια: Ο Κυβερνήτης Gavin Newsom υπογράφει νόμο για το AI

Οι ζωντανές φωνές τεχνητής νοημοσύνης μπορούν επίσης να χρησιμοποιηθούν για την κατασκευή δηλώσεων και συνεντεύξεων από πολιτικούς ή διασημότητες. Ψεύτικος ήχος μπορεί να χρησιμοποιηθεί για να δυσφημίσει άτομα ή να υποκινήσει αναταραχή, σπέρνοντας κοινωνικό διχασμό και συγκρούσεις. Οι απατεώνες δημιούργησαν πρόσφατα ένα κλώνο τεχνητής νοημοσύνης της φωνής του πρωθυπουργού του Κουίνσλαντ, Στίβεν Μάιλς, χρησιμοποιώντας το προφίλ του για να προσπαθήσουν να πείσουν τους ανθρώπους να επενδύσουν σε μια απάτη Bitcoin, για παράδειγμα.
