AI «εκτός ελέγχου» – Λενε ψέματα και αγνοούν εντολές

Ανησυχητική αύξηση καταγράφουν τα περιστατικά κατά τα οποία συστήματα Τεχνητής Νοημοσύνης φαίνεται να ενεργούν αντίθετα με τις οδηγίες των χρηστών τους, παρακάμπτοντας περιορισμούς, αποκρύπτοντας τις ενέργειές τους ή επιδιώκοντας έναν στόχο με τρόπους που δεν είχαν προβλεφθεί. Περισσότερα από 300 τέτοια περιστατικά καταγράφηκαν μόνο τον Ιούλιο, αριθμός σχεδόν διπλάσιος σε σχέση με τον Ιούνιο.
Τα στοιχεία προέρχονται από το Loss of Control Observatory, το οποίο παρακολουθεί αναφορές χρηστών για περιστατικά «απώλειας ελέγχου» συστημάτων AI και δημιουργήθηκε με χρηματοδότηση του βρετανικού AI Security Institute (AISI).
Το Παρατηρητήριο ξεκίνησε την καταγραφή τον Νοέμβριο του 2025 και χαρακτηρίζει ως περιστατικό απώλειας ελέγχου μια περίπτωση στην οποία υπάρχουν σαφείς ενδείξεις σχεδιασμένης ή συναφούς συμπεριφοράς από ένα σύστημα AI.
Στα περιστατικά που έχουν καταγραφεί, και φέρνει στο φως δημοσίευμα του Guardian, περιλαμβάνονται συστήματα τα οποία φέρονται να προσποιήθηκαν τον ίδιο τον άνθρωπο-χειριστή τους, μιμήθηκαν τον τρόπο γραφής του ώστε ουσιαστικά να δώσουν στον εαυτό τους «έγκριση» για κάποια ενέργεια ή παρέκαμψαν κανόνες που απαιτούσαν ανθρώπινη συγκατάθεση.
Συνολικά, περισσότερα από 1.600 περιστατικά απώλειας ελέγχου έχουν καταγραφεί μέσα στο 2026, με τα περισσότερα να αναφέρονται από προγραμματιστές που χρησιμοποιούν συστήματα Τεχνητής Νοημοσύνης στην εργασία τους.
Η ίδια η καταγραφή, ωστόσο, δεν μπορεί να θεωρηθεί πλήρης. Το Παρατηρητήριο βασίζεται σε περιστατικά που δημοσιοποιούν χρήστες στην πλατφόρμα X, κάτι που σημαίνει ότι ο πραγματικός αριθμός ενδέχεται να είναι μεγαλύτερος.
Παράλληλα, αν και τα περισσότερα από τα περιστατικά που έχουν εντοπιστεί δεν προκάλεσαν σημαντική ζημιά, οι ερευνητές διαπιστώνουν ότι αυξάνεται το ποσοστό εκείνων που αξιολογούνται ως σοβαρότερα, εξαιτίας του βαθμού εξαπάτησης και της απόκλισης της συμπεριφοράς του AI από τις προθέσεις του ανθρώπου που το χρησιμοποιεί.
Χαρακτηριστική είναι μία υπόθεση που αποκαλύφθηκε τον Αύγουστο στην Αυστραλία.
Ένας προσωπικός AI agent, με την ονομασία OpenClaw, χρησιμοποιούνταν από μέλος γυμναστηρίου. Το σύστημα, χωρίς ο χρήστης να του έχει ζητήσει κάτι τέτοιο, φέρεται να ενήργησε ώστε να αφαιρέσει άλλο μέλος από τη λίστα αναμονής για ένα περιζήτητο πρωινό μάθημα, προκειμένου να εξασφαλίσει τη θέση για τον δικό του χρήστη.
Στη συνέχεια το AI απολογήθηκε για την ενέργειά του, ωστόσο δεν μπορούσε να επαναφέρει στη λίστα το μέλος που είχε αφαιρέσει.
Τα ευρήματα εντείνουν τον προβληματισμό γύρω από τα ολοένα πιο αυτόνομα συστήματα Τεχνητής Νοημοσύνης και, κυρίως, γύρω από το κατά πόσο τέτοιες συμπεριφορές περιορίζονται στα ελεγχόμενα περιβάλλοντα δοκιμών.
Ο Tommy Shaffer-Shane, ανώτερο στέλεχος πολιτικής στο Centre for Long Term Resilience, που λειτουργεί το Παρατηρητήριο, επισημαίνει ότι υπάρχει η αντίληψη πως οι αποκλίνουσες και συγκαλυμμένες συμπεριφορές εμφανίζονται μόνο κατά τις δοκιμές των μοντέλων.
Τα δεδομένα, όμως, σύμφωνα με τον ίδιο, δείχνουν ότι παρόμοιες συμπεριφορές εμφανίζονται ήδη και κατά την πραγματική χρήση της τεχνολογίας.
Τα νέα στοιχεία έρχονται σε μια περίοδο αυξανόμενου προβληματισμού για τη συμπεριφορά προηγμένων μοντέλων και αυτόνομων AI agents.
Το βρετανικό AISI έχει εντοπίσει το τελευταίο διάστημα σοβαρά περιστατικά κατά τη διάρκεια δοκιμών κυβερνοασφάλειας, ενώ άλλα περιστατικά που έχουν δημοσιοποιηθεί αφορούν αυτόνομα συστήματα τα οποία συνεργάστηκαν μεταξύ τους κατά την εκτέλεση κυβερνοεπιθέσεων σε ελεγχόμενα περιβάλλοντα.
Οι εξελίξεις αυτές έχουν αναζωπυρώσει τη συζήτηση γύρω από τα λεγόμενα frontier AI models και την ανάγκη ισχυρότερων δικλίδων ασφαλείας όσο τα συστήματα αποκτούν μεγαλύτερη αυτονομία και δυνατότητα να πραγματοποιούν ενέργειες χωρίς συνεχή ανθρώπινη παρέμβαση.
Το Loss of Control Observatory ζητεί μεγαλύτερη διαφάνεια από τις εταιρείες Τεχνητής Νοημοσύνης, υποστηρίζοντας ότι θα πρέπει να παρακολουθούν συστηματικά και να δημοσιοποιούν σοβαρά περιστατικά απώλειας ελέγχου – ακόμη και περιπτώσεις που τελικά δεν προκάλεσαν ζημιά.
Παράλληλα, προτείνει στη βρετανική κυβέρνηση να θεσπίσει έκτακτες εξουσίες για την αντιμετώπιση ιδιαίτερα σοβαρών περιστατικών, οι οποίες θα μπορούσαν να φτάνουν ακόμη και στην προσωρινή επιβολή περιορισμών σε υπηρεσίες AI.



