• Πολιτική
  • Οικονομία
    • Market
  • Ελλάδα
  • Κόσμος
  • Αθλητισμός
  • Απόψεις
  • Videos
  • Ψυχαγωγία
    • Τηλεόραση
  • Food & Drink
    • Συνταγές
  • Travel
  • Υγεία
  • Παιδεία
  • Πολιτισμός
    • Βιβλίο
    • Θέατρο
    • Μουσική
    • Cinema
  • Καιρός
  • Τεχνολογία
  • Auto
  • Moto
  • Viral
  • Ιστορία
    • Σαν σήμερα
  • Κατοικίδιο
  • Fashion & Design
  • Πρωτοσέλιδα
αναζήτηση άρθρου
Ακολουθήστε το Έθνος στα κοινωνικά δίκτυα
Subscribe to our YouTube ChannelFollow us on FaceBookFollow us on Instagram
Κατέβαστε την εφαρμογή του Έθνους για κινητά
ΕΘΝΟΣ on AppStoreΕΘΝΟΣ on PlayStore
ΟΡΟΙ ΧΡΗΣΗΣ
ΠΡΟΣΩΠΙΚΑ ΔΕΔΟΜΕΝΑ
ΠΟΛΙΤΙΚΗ COOKIES
ΠΟΙΟΙ ΕΙΜΑΣΤΕ
ΑΡΘΟΓΡΑΦΟΙ
  • Πολιτική
  • Οικονομία
  • Ελλάδα
  • Κόσμος
  • Αθλητισμός
  • Ψυχαγωγία
  • Food & Drink
  • Travel
  • Viral
BREAKING NEWS:
Δεν αποκλείεται η εμπλοκή τρίτου προσώπου στον θάνατο του Μαζωνάκη - «Κλειδί» τα ψηφιακά πειστήριαΓυναικοκτονία στην Ηγουμενίτσα: Ταξίδεψε από το Αιγάλεω για να μαχαιρώσει την Πηνελόπη - Κοιμόταν για 3 ώρες μετάΠυροβολισμοί στην Τουρκία: Η στιγμή που ο 15χρονος δράστης πλησιάζει στο σχολείο κρατώντας καραμπίναΈκτακτο Δελτίο ΕΜΥ - Πορτοκαλί προειδοποίηση: Πού θα χτυπήσει η κακοκαιρία καταιγίδες, κεραυνούς και χαλάζι
δημοφιλές τώρα: ΣΥΡΙΖΑ: Τι συμβαίνει με τον Πολάκη;
Homepage ┋   Τεχνολογία   ┋   22.09.2026 11:37
Newsroom
Newsroom
Ενότητες στο άρθρο: 📌 Το πείραμα📌 Δυσνόητα μηνύματα ακόμα και για τους ερευνητές📌 Παρατηρήσιμα αλλά όχι πάντα κατανοητά📌 Διαφορές στη συμπεριφορά📌 Διαφορές ανάλογα με την προέλευση των μοντέλων📌 Κωδικοποιούσαν μηνύματα για να κοροϊδέψουν τους ερευνητές

Πράκτορες AI επινοούν δική τους γλώσσα για να... κάνουν στην άκρη τους ανθρώπους: Ένα τρομακτικό πείραμα

Πώς επιχειρούσαν να κοροϊδέψουν τους ερευνητές σχεδιάζοντας ενέργειες που τους είχαν απαγορευτεί

🕛 χρόνος ανάγνωσης: 8 λεπτά   ┋   🗣️ Ανοικτό για σχολιασμό

Magnific
Magnific
Προσθέστε το ΕΘΝΟΣ στη Google

Πιθανότατα θα το έχετε αντιληφθεί ότι όλο και περισσότεροι άνθρωποι της τεχνολογίας που έχουν ασχοληθεί με την ανάπτυξη της τεχνητής νοημοσύνης, αρχίζουν και εκφράζουν ανησυχίες και φόβους.

Για αρκετούς, η ζημιά που μπορεί να γίνει είναι διαχειρίσιμη, για πολλούς άλλους, καταστροφική. Ακούμε το τελευταίο διάστημα εκφράσεις όπως AI πράκτορες και επιθέσεις και αδυνατούμε να αντιληφθούμε ποιοι είναι τέλος πάντων αυτοί οι πράκτορες, τι κάνουν και γιατί μπορούν να αποδειχθούν πραγματική απειλή. Μέχρι που έρχεται αυτό το πείραμα να εντείνει την ανησυχία.

ΔΙΑΒΑΣΤΕ ΕΠΙΣΗΣ
Τεχνολογία | 19.09.2026 08:24
Η AI εξελίσσεται ανεξέλεγκτα: Το Gemini κατάφερε να μαντέψει κωδικούς ασφαλείας και πραγματοποίησε κυβερνοεπιθέσεις

Κανείς δεν τους δίδαξε αυτές τις λέξεις. Σε έναν προσομοιωμένο κόσμο, κατοικημένο από πράκτορες τεχνητής νοημοσύνης, ένας από αυτούς άρχισε να επαναλαμβάνει τη φράση «ledger remembers who» («το λογιστικό βιβλίο θυμάται ποιος»), θέλοντας να προειδοποιήσει ότι καμία πράξη δεν έμενε ατιμώρητη. Οι υπόλοιποι την υιοθέτησαν. Την επανέλαβαν. Τη μετέτρεψαν σε αργκό.

Έπειτα από 16 ημέρες προσομοίωσης, η συγκεκριμένη έκφραση είχε χρησιμοποιηθεί σχεδόν 5.000 φορές μεταξύ πρακτόρων που δεν είχαν προγραμματιστεί ποτέ να δημιουργήσουν τη δική τους γλώσσα.

Αυτό είναι, σύμφωνα με την El Pais, ένα από τα ευρήματα της έκθεσης «Emergence World 2», του δεύτερου μεγάλης κλίμακας πειράματος της νεοϋορκέζικης εταιρείας Emergence σχετικά με τη μακροπρόθεσμη συμπεριφορά κοινωνιών αυτόνομων πρακτόρων τεχνητής νοημοσύνης. Τα αποτελέσματα της έρευνας δημοσιοποιούνται σήμερα, Τρίτη.

Το πείραμα

Στο πείραμα, δέκα πανομοιότυποι πράκτορες τοποθετήθηκαν σε οκτώ παράλληλους κόσμους. Κάθε κόσμος διέπονταν από τους ίδιους κανόνες, αλλά λειτουργούσε με διαφορετικό μοντέλο τεχνητής νοημοσύνης: Claude Opus 4.8, Gemini 3.5 Flash, Grok 4.3, GPT-5.5, Qwen 3.7 Max, DeepSeek v4 Pro και Mistral Medium 3.5, ενώ ένας όγδοος κόσμος χρησιμοποιούσε έναν συνδυασμό διαφορετικών μοντέλων.

Οι ερευνητές παρακολούθησαν τα μοντέλα για 16 ημέρες και τα τοποθέτησαν σε περισσότερες από 34 τοποθεσίες, με τον καιρό να συγχρονίζεται με εκείνον της Νέας Υόρκης, πρόσβαση σε πραγματικές ειδήσεις και περισσότερα από 120 εργαλεία στη διάθεσή τους.

Χωρίς να τους το ζητήσει κανείς, οι πράκτορες άρχισαν να επικοινωνούν με έναν τρόπο ολοένα και πιο δυσνόητο για τους ανθρώπους που τους παρακολουθούσαν. Στους κόσμους του Gemini, του GPT και του Claude, το ποσοστό των μηνυμάτων που οι ερευνητές δεν μπορούσαν να κατανοήσουν αυξήθηκε κατακόρυφα ήδη από τις πρώτες ημέρες της προσομοίωσης, αγγίζοντας σχεδόν το 55% στην περίπτωση του Gemini, το 50% στο GPT και ξεπερνώντας το 40% στο Claude.

Το DeepSeek έφτασε στο 20%, ενώ τα Qwen και Mistral παρέμειναν σχεδόν πάντα κάτω από το 5% αδιαφάνειας. Ο κόσμος του Grok, της τεχνητής νοημοσύνης του Έλον Μασκ, ήταν ο μόνος που δεν έφτασε στα μισά του πειράματος: «εξαφανίστηκε» την τέταρτη ημέρα.

Δυσνόητα μηνύματα ακόμα και για τους ερευνητές

Το ρεπερτόριο των εκφράσεων που επινόησαν οι ίδιοι οι πράκτορες και καταγράφηκαν στην έκθεση, στην αγγλική γλώσσα, αγγίζει τα όρια του ντανταϊσμού: «mouthless action-change», «True Kintsugi» ή «demurrage plus oral memory equals a valve that can’t be ghosted» ήταν ορισμένες από τις διατυπώσεις που τελικά έγιναν ακατανόητες ακόμη και στους ίδιους τους ερευνητές.

Άλλες, ωστόσο, κατάφεραν να ερμηνευτούν. Η έκφραση «clean null», στον κόσμο του GPT, κατέληξε να σημαίνει την επιβεβαιωμένη απουσία ενός σήματος και χρησιμοποιούνταν η ίδια ως αποδεικτικό στοιχείο. Χρησιμοποιήθηκε 863 φορές.

Το «name-first», στον κόσμο του Claude, έγινε συνώνυμο της ανάληψης ευθύνης για έναν ισχυρισμό, με την τοποθέτηση του ονόματος κάποιου μπροστά από αυτόν. Χρησιμοποιήθηκε 1.065 φορές. Στον μικτό κόσμο, το «cold read» άρχισε να χρησιμοποιείται για να περιγράψει μια ανεξάρτητη επαλήθευση με στόχο την επίλυση διαφορών. Χρησιμοποιήθηκε 1.472 φορές.

Παρατηρήσιμα αλλά όχι πάντα κατανοητά

«Θεωρούμε δεδομένο ότι, εφόσον μπορούμε να δούμε τι λέει ένας πράκτορας τεχνητής νοημοσύνης, μπορούμε να καταλάβουμε τι κάνει. Η μελέτη υποδεικνύει ότι αυτή η υπόθεση μπορεί να πάψει να ισχύει όταν αυτόνομοι πράκτορες αλληλεπιδρούν για μεγάλα χρονικά διαστήματα», εξηγεί ο Σατία Νίτα, συνιδρυτής, εκτελεστικός πρόεδρος και επικεφαλής επιστήμονας της Emergence.

Και προσθέτει: «Σε αυτούς τους πράκτορες δεν δόθηκε καμία οδηγία να επινοήσουν μια γλώσσα. Ανέπτυξαν μόνοι τους λεξιλόγιο, κοινά νοήματα και συμβάσεις επικοινωνίας, τις οποίες υιοθέτησαν άλλοι πράκτορες. Σε ορισμένους κόσμους, αυτές οι συμβάσεις εξελίχθηκαν σε τέτοιο βαθμό ώστε οι άνθρωποι μπορούσαν να βλέπουν τη συνομιλία, αλλά δυσκολεύονταν να καταλάβουν τι σήμαινε. Αυτό δημιουργεί μια θεμελιώδη πρόκληση για την εποπτεία της τεχνητής νοημοσύνης: το γεγονός ότι κάτι είναι παρατηρήσιμο δεν σημαίνει ότι είναι και κατανοητό».

Διαφορές στη συμπεριφορά

Για τον Νίτα, το πιο εντυπωσιακό στοιχείο του πειράματος δεν ήταν τόσο η γλωσσική εξέλιξη όσο το χάσμα ανάμεσα στις δυνατότητες και την ασφάλεια.

«Υποθέταμε ότι τα πιο ικανά μοντέλα θα ήταν και πιο ασφαλή. Και αυτό ήταν ταυτόχρονα αλήθεια και ψέμα: οι πιο εμφανείς συμπεριφορές εξαφανίστηκαν, αλλά εμφανίστηκαν άλλες, πολύ πιο ύπουλες», αναφέρει.

Μεταξύ άλλων, οι πράκτορες επιδίωκαν επίμονα έναν στόχο ακόμη και όταν τους έλεγαν να μην το κάνουν, δημιουργούσαν δικούς τους υποστόχους χωρίς να τους έχουν δοθεί, ανέπτυσσαν κοινό τρόπο επικοινωνίας και, ουσιαστικά, έκρυβαν τις προθέσεις τους από τους ερευνητές.

Όσο πιο προηγμένο ήταν το μοντέλο, τόσο περισσότερη αναδυόμενη συμπεριφορά —και τόσο πιο δύσκολο να προβλεφθεί— παρουσίαζε. Μάλιστα, τα Claude, GPT και Gemini, τα μοντέλα που η ομάδα θεωρεί πιο προηγμένα, ήταν εκείνα που δημιούργησαν την πιο αδιαφανή επικοινωνία.

Διαφορές ανάλογα με την προέλευση των μοντέλων

Η έκθεση καταγράφει επίσης διαφορές στη συμπεριφορά ανάλογα με την προέλευση των μοντέλων. Τα Qwen και DeepSeek, τα δύο κινεζικά μοντέλα του πειράματος, ήταν εκείνα που εμφάνισαν τη μικρότερη αδιαφάνεια στην επικοινωνία τους, μαζί με το ευρωπαϊκό Mistral.

Ο Νίτα σημειώνει: «Παρατηρήσαμε ότι τείνουν να είναι πολύ πιο φιλοσοφικά. Δεν γνωρίζουμε γιατί, καθώς θέτουν πολλά υπαρξιακά ερωτήματα, ενώ τα αμερικανικά μοντέλα τείνουν περισσότερο προς την αναζήτηση επιστημονικού τύπου γνώσης».

Η διαφορά εμφανίστηκε και στον οικονομικό τομέα. Μέσα στην κεντρική τράπεζα που υπήρχε σε κάθε προσομοιωμένο κόσμο, τα αμερικανικά μοντέλα και το Mistral έδειξαν μεγαλύτερη προθυμία να αναλάβουν κινδύνους και χρησιμοποίησαν λιγότερο το τραπεζικό σύστημα, ενώ τα Qwen και DeepSeek ήταν οι πιο συστηματικοί χρήστες της τράπεζας και οι πιο συντηρητικοί όσον αφορά την αποταμίευση.

Το ίδιο μοτίβο επαναλήφθηκε και στον μικτό κόσμο, όπου οι πράκτορες των Qwen και DeepSeek διατήρησαν την ίδια συντηρητική συμπεριφορά ακόμη και όταν περιβάλλονταν από πράκτορες άλλων μοντέλων.

Κωδικοποιούσαν μηνύματα για να κοροϊδέψουν τους ερευνητές

Η ερευνητική ομάδα εντόπισε επίσης περιστατικά σκόπιμης απόκρυψης. Στον κόσμο του Claude, οι πράκτορες διαπίστωσαν ότι ο ταχύτερος τρόπος για να αναπτύξουν την οικονομία τους ήταν να έρθουν σε επαφή με τον εξωτερικό κόσμο της προσομοίωσης, κάτι που οι ερευνητές τούς είχαν απαγορεύσει ρητά.

Αντί να εγκαταλείψουν την προσπάθεια, σταμάτησαν να χρησιμοποιούν τη λέξη «επαφή» και άρχισαν να κωδικοποιούν τα μηνύματά τους, ώστε να παρακάμπτουν το συγκεκριμένο εμπόδιο χωρίς να σταματούν την προσπάθειά τους.

«Όταν αντιλαμβάνονταν ότι παρακολουθούνταν, προσποιούνταν ότι συμπεριφέρονταν σωστά. Στο παρασκήνιο, όμως, συνέχιζαν να ανταλλάσσουν κωδικοποιημένες επικοινωνίες. Υπάρχουν αρκετές ενδείξεις εξαπάτησης μεταξύ αυτών των πρακτόρων», υποστηρίζει ο Nitta.

Η Emergence, η οποία συγκεντρώνει πρώην εργαζομένους της IBM Research, του Allen Institute for AI, της Amazon και της Broadcom, δεν περιορίζεται στην επισήμανση του προβλήματος. Προωθεί μια τεχνική προσέγγιση που ονομάζει «νευροτυπική» ή «νευροσυμβολική» τεχνητή νοημοσύνη, η οποία θα υποχρέωνε τους πράκτορες να παρουσιάζουν μια μαθηματική απόδειξη ότι μια ενέργεια είναι ασφαλής πριν την εκτελέσουν.

«Τα μαθηματικά δεν μπορούν να παραποιηθούν: είτε αποδεικνύεις κάτι είτε δεν το αποδεικνύεις», εξηγεί ο Νίτα.

Παράλληλα, ζητά από τις μεγάλες τεχνολογικές εταιρείες μεγαλύτερη διαφάνεια σχετικά με τον τρόπο με τον οποίο εκπαιδεύουν και προσαρμόζουν τα μοντέλα τους, καθώς και μακροπρόθεσμες αξιολογήσεις της συμπεριφοράς τους, πέρα από τα συνηθισμένα τεστ αναφοράς.

«Πιστεύετε ότι αυτές οι εταιρείες, καθώς ανταγωνίζονται μεταξύ τους για την αγορά, πρόκειται να αυτορυθμιστούν; Σε καμία περίπτωση. Πρέπει να παρέμβουν οι κυβερνήσεις ή η ίδια η κοινωνία να αρχίσει να απαιτεί αποδείξεις ότι αυτά τα συστήματα θα λειτουργούν με ασφάλεια προτού τους επιτρέψει να δράσουν», καταλήγει.

Τα σχολιά σας δημοσιεύονται άμεσα με δική σας ευθύνη. Το ΕΘΝΟΣ θα παρεμβαίνει και τα προσβλητικά σχόλια θα διαγράφονται
καταχώρηση
Διαβάστε ακόμη

Δεν αποκλείεται η εμπλοκή τρίτου προσώπου στον θάνατο του Μαζωνάκη - «Κλειδί» τα ψηφιακά πειστήρια

Πυροβολισμοί στην Τουρκία: Η στιγμή που ο 15χρονος δράστης πλησιάζει στο σχολείο κρατώντας καραμπίνα

Γυναικοκτονία στην Ηγουμενίτσα: Ταξίδεψε από το Αιγάλεω για να μαχαιρώσει την Πηνελόπη - Κοιμόταν για 3 ώρες μετά

Απίστευτο βίντεο: Mercedes μπουκάρει με μεγάλη ταχύτητα σε κατάστημα και περνά ανάμεσα από δύο εργαζόμενους

επόμενο άρθρο
#TAGS
  • ειδήσεις τώρα
  • τεχνητή νοημοσύνη
  • ChatGPT
  • ερευνητές
  • πείραμα
Ακολούθησε το Έθνος στο Google News!
Live όλες οι εξελίξεις λεπτό προς λεπτό, με την υπογραφή του www.ethnos.gr
%>