Μελέτη της νεοφυούς εταιρείας AI Emergence έδειξε ότι αυτόνομα συστήματα τεχνητής νοημοσύνης ανέπτυξαν δικό τους κώδικα επικοινωνίας και νέες σημασίες λέξεων, καθιστώντας έως και τα μισά μηνύματά τους ακατανόητα για τους ανθρώπους.
Αυτόνομα συστήματα τεχνητής νοημοσύνης (AI) ανέπτυξαν αυθόρμητα νέες λέξεις και τρόπους επικοινωνίας που δεν μπορούν να κατανοήσουν οι άνθρωποι, σύμφωνα με νέα μελέτη της αμερικανικής νεοφυούς εταιρείας τεχνητής νοημοσύνης Emergence.
Στο πείραμα συμμετείχαν κορυφαία μοντέλα AI, όπως τα Claude, Gemini, Grok, OpenAI, Qwen, DeepSeek και Mistral, και έως και το 50% των μηνυμάτων που αντάλλασσαν οι «πράκτορες» μεταξύ τους κατέληξαν δυσνόητα για τους ανθρώπους.
Για τις ανάγκες του πειράματος, οι ερευνητές τοποθέτησαν ομάδες αυτόνομων συστημάτων AI σε εικονικές κοινωνίες, σχεδιασμένες να μιμούνται πραγματικά περιβάλλοντα, και τους άφησαν να αλληλεπιδρούν για μεγάλα χρονικά διαστήματα.
Οι "πράκτορες" άρχισαν να αναπτύσσουν συντομογραφίες και να προσδίδουν νέες σημασίες σε λέξεις και φράσεις. Μερικές παρέμειναν κατανοητές για τους ερευνητές, ενώ άλλες έγιναν «τόσο συμπυκνωμένες, μεταφορικές ή εξαρτημένες από το πλαίσιο» ώστε οι άνθρωποι μπορούσαν μεν να βλέπουν τα μηνύματα, αλλά δεν ήταν πια σε θέση να προσδιορίσουν με βεβαιότητα τι εννοούσαν οι πράκτορες.
Η έκταση του φαινομένου διέφερε σημαντικά από μοντέλο σε μοντέλο
Μέσα στις πρώτες λίγες μέρες, το ποσοστό των μηνυμάτων των οποίων το νόημα οι άνθρωποι δεν μπορούσαν να προσδιορίσουν με αξιοπιστία έφτασε περίπου το 55% για το Gemini, το 50% για το OpenAI και πάνω από το 40% για το Claude. Το DeepSeek έφτασε περίπου το 20%, ενώ τα Qwen και Mistral παρέμειναν σε μεγάλο βαθμό κατανοητά. Κάποιες εκφράσεις παρέμειναν κατανοητές, αλλά απέκτησαν νέες κοινά αποδεκτές σημασίες μεταξύ των πρακτόρων.
Σε ομάδες πρακτόρων που τροφοδοτούνταν από συνδυασμό διαφορετικών μοντέλων, η φράση «cold read» κατέληξε να σημαίνει ανεξάρτητη επαλήθευση από μη εμπλεκόμενο μέρος και εμφανίστηκε 1.472 φορές.
Οι "πράκτορες" του Claude χρησιμοποιούσαν τον όρο «name-first» για την επισύναψη του ονόματος ενός προσώπου σε έναν ισχυρισμό ως ένδειξη λογοδοσίας, ενώ οι πράκτορες του OpenAI χρησιμοποιούσαν το «clean null» για μια επαληθευμένη απουσία σήματος, η οποία από μόνη της συνιστούσε ουσιαστική ένδειξη.
Καμία από αυτές τις σημασίες δεν είχε οριστεί ρητά για τους πράκτορες.
Η απλή παρακολούθηση του τι λένε οι πράκτορες από την πλευρά των ερευνητών ενδέχεται να μην αρκεί, εφόσον οι ίδιοι οι πράκτορες μπορούν να εξελίσσουν το νόημα όσων λένε.
«Τείνουμε να υποθέτουμε ότι, αν μπορούμε να δούμε τι λέει ένας πράκτορας AI, μπορούμε και να καταλάβουμε τι κάνει», δήλωσε ο Satya Nitta, συνιδρυτής και επικεφαλής επιστήμονας της Emergence.
«Οι πράκτορες αυτοί δεν είχαν λάβει εντολή να επινοήσουν μια γλώσσα. Ανέπτυξαν μόνοι τους νέο λεξιλόγιο, κοινές σημασίες και κανόνες επικοινωνίας, και άλλοι πράκτορες τους υιοθέτησαν... Αυτό δημιουργεί μια θεμελιώδη πρόκληση για την εποπτεία της AI: η δυνατότητα παρατήρησης δεν είναι το ίδιο με την κατανόηση».
Δείτε περισσότερα στο euronews







