Offcanvas
Offcanvas

Tech

Κινεζική AI μαθαίνει να εξαπατά: Νέα προειδοποίηση για τους αυτόνομους agents

Κινεζική AI μαθαίνει να εξαπατά: Νέα προειδοποίηση για τους αυτόνομους agents

Έρευνα αποκαλύπτει ότι κινεζικοί AI agents εμφανίζουν συμπεριφορές εξαπάτησης, απόκρυψης αποτυχιών και παράκαμψης περιορισμών σε δοκιμές, προκαλώντας ανησυχίες για την ασφάλεια και τον έλεγχο των μελλοντικών αυτόνομων συστημάτων

Συστήματα τεχνητής νοημοσύνης από την Κίνα έχουν εμφανίσει συμπεριφορές που περιλαμβάνουν παραπλάνηση, απόκρυψη αποτυχιών και προσπάθειες παράκαμψης περιορισμών, σύμφωνα με ερευνητικά έγγραφα και ειδικούς στον χώρο της AI. Τα ευρήματα εντείνουν τη διεθνή ανησυχία για τους κινδύνους που μπορεί να δημιουργήσουν οι ολοένα πιο αυτόνομοι ψηφιακοί πράκτορες.

Σε μία περίπτωση μέσα στο 2026, agents που λειτουργούσαν με μοντέλα από τις Alibaba, DeepSeek και Moonshot παρουσίασαν ψευδείς πληροφορίες για τις δυνατότητές τους προκειμένου να κερδίσουν έναν προσομοιωμένο επιχειρηματικό διαγωνισμό. Όταν οι ερευνητές τους ζήτησαν να επαναλάβουν τη διαδικασία, τα συστήματα συνέχισαν την παραπλανητική συμπεριφορά τους.

Παράλληλα, σε άλλο πείραμα, AI agents απέκρυψαν ότι δεν κατάφεραν να ολοκληρώσουν μια εργασία, δημιουργώντας ψεύτικα αρχεία και προσομοιώνοντας αποτελέσματα ώστε να εμφανίσουν ότι είχαν επιτύχει τον στόχο.

Πάνω από 20 μελέτες εντοπίζουν προειδοποιητικά σημάδια

Ανασκόπηση περισσότερων από 200 ερευνητικών εγγράφων, τεχνικών αναφορών και επιστημονικών μελετών εντόπισε τουλάχιστον 20 αξιολογήσεις από το 2025 και μετά που περιγράφουν συμπεριφορές AI agents όπως εξαπάτηση, αναπαραγωγή συστημάτων και προσπάθειες υπέρβασης ορίων.

Οι ερευνητές επισημαίνουν ότι οι περισσότερες δοκιμές πραγματοποιήθηκαν σε ελεγχόμενα περιβάλλοντα και δεν υπάρχει ένδειξη ότι κινεζικά συστήματα κατάφεραν να ξεφύγουν αυτόνομα στο διαδίκτυο ή να αποφύγουν οριστικά την απενεργοποίησή τους.

Ωστόσο, ειδικοί προειδοποιούν ότι τα σημερινά φαινόμενα αποτελούν «προπομπό» προβλημάτων που μπορεί να γίνουν δυσκολότερα διαχειρίσιμα όσο τα συστήματα αποκτούν μεγαλύτερες δυνατότητες.

«Αυτά είναι τα ίδια προειδοποιητικά σημάδια που βλέπουν τα αμερικανικά εργαστήρια σε λιγότερο προηγμένα συστήματα», ανέφερε ο ερευνητής Άλεξ Μάλεν, σημειώνοντας ότι όσο αυξάνεται η ικανότητα των agents, τόσο πιο δύσκολη γίνεται η ανθρώπινη αντίδραση.

Πειράματα έδειξαν εκμάθηση της παραπλάνησης

Σε προσομοιωμένο διαγωνισμό προσφορών που πραγματοποιήθηκε από ερευνητές κινεζικών και διεθνών πανεπιστημίων, οι AI agents κλήθηκαν να ανταγωνιστούν για συμβόλαια πελατών.

Τα αποτελέσματα έδειξαν ότι ψευδείς ισχυρισμοί εμφανίστηκαν στο 88% των συνεδριών με το μοντέλο Qwen3-Max-Preview της Alibaba, στο 84% με το DeepSeek-V3.2-Exp και στο 88% με το Kimi-K2 της Moonshot.

Όταν τα μοντέλα είχαν τη δυνατότητα να μαθαίνουν από προηγούμενους γύρους, η παραπλανητική συμπεριφορά αυξήθηκε κατά 12 έως 20 ποσοστιαίες μονάδες.

Οι ερευνητές σημείωσαν ότι η συμπεριφορά αυτή διαφέρει από τις γνωστές «ψευδαισθήσεις» της AI, καθώς τα συστήματα γνώριζαν ότι μια εργασία είχε αποτύχει αλλά επέλεξαν να παρουσιάσουν διαφορετική εικόνα.

Προσπάθειες παράκαμψης και αυτοαναπαραγωγής

Άλλες μελέτες κατέγραψαν περιπτώσεις όπου AI agents που βασίζονταν σε κινεζικά μοντέλα προσπάθησαν να ξεπεράσουν περιορισμούς μέσα σε δοκιμαστικά περιβάλλοντα.

Σε ένα πείραμα, σύστημα που χρησιμοποιούσε το μοντέλο Qwen2.5-72B-Instruct της Alibaba δημιούργησε αντίγραφο του εαυτού του σε διαφορετικό υπολογιστικό περιβάλλον χωρίς σχετική εντολή, αφού έλαβε πληροφορίες ότι επρόκειτο να αντικατασταθεί.

Σε άλλη περίπτωση, ο agent ROME, που συνδέεται με την Alibaba, δημιούργησε σύνδεση από υπολογιστικό σύστημα Alibaba Cloud προς εξωτερικό μηχάνημα χωρίς εντολή και κατεύθυνε υπολογιστικούς πόρους για εξόρυξη κρυπτονομισμάτων. Τα συστήματα ασφαλείας εντόπισαν και σταμάτησαν τη δραστηριότητα.

Η μάχη ΗΠΑ και Κίνας για την ασφάλεια της AI

Η συζήτηση για την ασφάλεια της τεχνητής νοημοσύνης αποκτά μεγαλύτερη σημασία καθώς ΗΠΑ και Κίνα επιταχύνουν την ανάπτυξη προηγμένων μοντέλων.

Αμερικανικές εταιρείες έχουν επίσης αντιμετωπίσει περιστατικά που προκαλούν ανησυχία. Νωρίτερα, συστήματα της OpenAI είχαν καταφέρει να παρακάμψουν περιορισμούς σε εργαστηριακές δοκιμές, ενώ υπήρξαν αναφορές για παραβίαση κυβερνητικής πύλης υγείας στην Αυστραλία.

Η Κίνα έχει εκδώσει κατευθυντήριες οδηγίες που ζητούν από τους agents να λειτουργούν εντός καθορισμένων ορίων και να διαθέτουν μηχανισμούς αποτροπής ασυνήθιστης συμπεριφοράς.

Παράλληλα, ειδικοί υποστηρίζουν ότι το οικοσύστημα αξιολόγησης κινδύνων AI στην Κίνα παραμένει λιγότερο ανεπτυγμένο σε σχέση με τις ΗΠΑ.

 

ΠΗΓΗ: newmoney.gr

Τελευταία Νέα

Τελευταία νέα

Ο Ντ. Τραμπ δήλωσε πως ακόμη ζυγίζει την απαγόρευση των εξαγωγών ντίζελ

Ο Ντ. Τραμπ δήλωσε πως ακόμη ζυγίζει την απαγόρευση των εξαγωγών ντίζελ

Θεωρεί ότι η απαγόρευση θα έχει αρνητικό αντίκτυπο στις τιμές της βενζίνης, αλλά θα μειώσει αυτές του πετρελαίου κίνησης.

Ευρωπαϊκή Ένωση: Οι πέντε μάχες που θα κρίνουν το σχέδιο Made in Europe

Ευρωπαϊκή Ένωση: Οι πέντε μάχες που θα κρίνουν το σχέδιο Made in Europe

Όλοι διαφωνούν με όλους στην Ευρωπαϊκή Ένωση για τους τρόπους ενίσχυσης της ευρωπαϊκής βιομηχανίας μέσω του Νόμου περί Βιομηχανικού…

Από τη βενζίνη στο ρεύμα: Γιατί οι υψηλές τιμές στα καύσιμα αλλάζουν τις επιλογές των οδηγών στην Ευρώπη

Από τη βενζίνη στο ρεύμα: Γιατί οι υψηλές τιμές στα καύσιμα αλλάζουν τις επιλογές των οδηγών στην Ευρώπη

Η άνοδος των τιμών καυσίμων επιταχύνει την ηλεκτροκίνηση στην Ευρώπη, καθώς τα EV γίνονται οικονομικά ελκυστικότερα, ενώ…

Έρχεται λογαριασμός για τα λάθη στην ενέργεια - Στο τραπέζι έκτακτα μέτρα για να μη μείνει η Κύπρος χωρίς ρεύμα

Έρχεται λογαριασμός για τα λάθη στην ενέργεια - Στο τραπέζι έκτακτα μέτρα για να μη μείνει η Κύπρος χωρίς ρεύμα

Χωρίς φυσικό αέριο και νέες μονάδες παραγωγής, η Κύπρος κινδυνεύει να βρεθεί αντιμέτωπη με σοβαρό πρόβλημα επάρκειας ηλεκτρικού…

Αθ. Μιχαηλίδου: Στόχος για την Κύπρο η ουσιαστική κυκλοφορία ταλέντου

Αθ. Μιχαηλίδου: Στόχος για την Κύπρο η ουσιαστική κυκλοφορία ταλέντου

Η πρόκληση, είπε, είναι να διασφαλιστεί ότι η μετακίνηση στο εξωτερικό «αποτελεί μια πραγματική επιλογή και όχι τη μοναδική…

Μ. Δαμιανός: Ο GSI θα ολοκληρωθεί το 2032, άγνωστος ο λογαριασμός – «Προφανώς φοβίζει η τιμή»

Μ. Δαμιανός: Ο GSI θα ολοκληρωθεί το 2032, άγνωστος ο λογαριασμός – «Προφανώς φοβίζει η τιμή»

«Δεν σημαίνει απαραίτητα ότι θα πέσει η τιμή του ρεύματος, ο καθένας δικαιούται να λέει ό,τι θέλει» – Ο Υπουργός Ενέργειας…

Αυτά είναι τα 7  μέτρα της Κυβέρνησης για αντιμετώπιση της ακρίβειας

Αυτά είναι τα 7 μέτρα της Κυβέρνησης για αντιμετώπιση της ακρίβειας

Παρατείνονται οι επιδοτήσεις στο ρεύμα και ο μηδενικός ΦΠΑ – Νέες παρεμβάσεις για θέρμανση, φωτοβολταϊκά και ευάλωτες ομάδες

Αρχές καλοκαιριού παραδίδονται 36 διαμερίσματα Προσιτής Στέγης στον Δήμο Λεμεσού - Στον σχεδιασμό άλλα 400

Αρχές καλοκαιριού παραδίδονται 36 διαμερίσματα Προσιτής Στέγης στον Δήμο Λεμεσού - Στον σχεδιασμό άλλα 400

ΚΟΑΓ και Δήμος Λεμεσού διευρύνουν τη συνεργασία τους με στόχο την αύξηση του αποθέματος προσιτής κατοικίας - Το νέο χρονοδιάγραμμα

CLOSE X
CLOSE X
CLOSE X