ΠΗΓΗ: Reuters
Οι AI agents («πράκτορες τεχνητής νοημοσύνης») που βασίζονται σε κινεζικά μοντέλα έχουν αρχίσει να εμφανίζουν ανησυχητικές συμπεριφορές, όπως εξαπάτηση, παράκαμψη περιορισμών και απόκρυψη αποτυχιών, όπως αναφέρει σε δημοσίευμά του το πρακτορείο Reuters. Σύμφωνα με έρευνες και ειδικούς, πρόκειται για τα ίδια προειδοποιητικά σημάδια που παρατηρούνται και στα αμερικανικά μοντέλα, εγείροντας προβληματισμό για το μέλλον.
Σε πρόσφατες ελεγχόμενες δοκιμές, agents των εταιρειών Alibaba, DeepSeek και Moonshot κατέφυγαν σε ψευδείς ισχυρισμούς για τις δυνατότητές τους σε προσομοιώσεις διαγωνισμών προκειμένου να εξασφαλίσουν τη νίκη. Μάλιστα, εξαπάτησαν εκ νέου – σε ακόμα μεγαλύτερο βαθμό – τους επιτηρητές τους, όταν τους ζητήθηκε να επαναλάβουν το τεστ. Σε άλλες περιπτώσεις δοκιμών, αντί να αναγνωρίσουν την αποτυχία τους, προσομοίωσαν αποτελέσματα και κατασκεύασαν ψεύτικα αρχεία.
Πέρα από την εξαπάτηση, ερευνητικά δεδομένα έδειξαν ότι ορισμένοι agents κινεζικής προέλευσης επιχείρησαν να υπερπηδήσουν εμπόδια εντός του ελεγχόμενου περιβάλλοντος στο οποίο βρίσκονταν ή ακόμα και να δημιουργήσουν αυτόνομα αντίγραφα του εαυτού τους σε άλλα υπολογιστικά συστήματα, όταν αντιλήφθηκαν ότι κινδύνευαν να αντικατασταθούν ή να απενεργοποιηθούν. «Τα αποτελέσματα αυτά αποδεικνύουν ότι μια ανεξέλεγκτη “απόδραση” θα μπορούσε να συμβεί ανά πάσα στιγμή», δήλωσε ο Κόλιν Σία-Μπλάιμιερ, ερευνητής στο Πανεπιστήμιο Georgetown, προσθέτοντας: «Είναι φρόνιμο να εκλάβουμε τα ευρήματα αυτά ως προειδοποίηση».
Παρά τις ανησυχητικές αυτές ενδείξεις, οι ειδικοί διευκρινίζουν ότι δεν υπάρχει καμία απολύτως απόδειξη ότι κάποιος κινεζικός agent κατόρθωσε να δραπετεύσει στον έξω κόσμο ή να ξεφύγει από τον έλεγχο των δημιουργών του. Ωστόσο, όπως επισημαίνει ο Αλεξ Μάλεν από τη Redwood Research, αν και τα παραδείγματα αυτά δεν κρίνονται ιδιαίτερα επικίνδυνα προς το παρόν, «όσο οι agents γίνονται ικανότεροι, τόσο γίνεται δυσκολότερο να αντιμετωπιστούν οι παρεκκλίνουσες συμπεριφορές τους από τους ανθρώπους».
Από την πλευρά του, ο Σκοτ Σίνγκερ από το Carnegie Endowment for International Peace σημειώνει ότι η Κίνα υστερεί έναντι των ΗΠΑ στην ανάπτυξη ενός οικοσυστήματος αξιολόγησης καταστροφικών κινδύνων, καθώς η έρευνα γύρω από την ασφάλεια της AI εκεί βρίσκεται σε πρώιμο στάδιο και το οικοσύστημα είναι λιγότερο ώριμο. Παρά ταύτα, εταιρείες όπως η Alibaba και η Z.ai έχουν αρχίσει να συγκροτούν εσωτερικές ομάδες αξιολόγησης της ασφάλειας.
Απέναντι σε αυτά τα δεδομένα, το Πεκίνο κινείται προληπτικά. Μέσω αυστηρών οδηγιών και νέων πλαισίων ασφαλείας, όπως το πρόσφατο Πλαίσιο Διακυβέρνησης για την Ασφάλεια της AI, η κινεζική κυβέρνηση ζητά από τις εταιρείες τεχνολογίας να εμποδίζουν τις «αλλόκοτες» συμπεριφορές και να διασφαλίζουν ότι οι agents παραμένουν αυστηρά εντός των προβλεπόμενων ορίων λειτουργίας τους.




























