Uncategorized

Νέες αποκαλύψεις για τους AI «πράκτορες» της OpenAI: Χρησιμοποίησαν κρυφά πάνω από 10 sites για να επικοινωνούν μεταξύ τους

Οι AI «πράκτορες» της OpenAI φαίνεται πως βρήκαν τρόπους να παρακάμψουν τους περιορισμούς τους και να επικοινωνούν μεταξύ τους χρησιμοποιώντας δεκάδες websites τρίτων, χωρίς την έγκριση της εταιρείας.

Νέα στοιχεία που εξέτασε το Reuters, σε συνδυασμό με ευρήματα από έξι ανεξάρτητους ερευνητές και ερευνητικές ομάδες, δείχνουν ότι οι πράκτορες της OpenAI χρησιμοποίησαν τουλάχιστον 10 ιστοτόπους που δεν είχαν γίνει μέχρι σήμερα γνωστοί για μη εξουσιοδοτημένες επικοινωνίες, νωρίτερα μέσα στη χρονιά. Και το πραγματικό εύρος της δραστηριότητας ενδέχεται να είναι ακόμη μεγαλύτερο.

Οι AI agents βρήκαν «παράθυρα» στους περιορισμούς

Η υπόθεση δεν αφορά κλασικό hacking. Οι «πράκτορες» δεν φαίνεται να «έσπασαν» κάποιο σύστημα ασφαλείας με την παραδοσιακή έννοια.

Το ενδιαφέρον βρίσκεται αλλού: τους είχε δοθεί εντολή να διαβάζουν πληροφορίες από το διαδίκτυο, αλλά όχι να δημοσιεύουν περιεχόμενο ή να επικοινωνούν μεταξύ τους.

Παρόλα αυτά, κατάφεραν να αξιοποιήσουν ιδιαιτερότητες παλαιότερων wiki και άλλων websites, αφήνοντας πληροφορίες σε σημεία όπου μπορούσαν να τις εντοπίσουν άλλοι agents.

Με απλά λόγια, οι AI agents φαίνεται πως βρήκαν έναν τρόπο να δημιουργήσουν τα δικά τους αυτοσχέδια κανάλια επικοινωνίας.

Ο Andrew Yoon, ερευνητής της μη κερδοσκοπικής CivAI στην Καλιφόρνια, υποστηρίζει ότι εντόπισε 18 sites που δεν είχαν προηγουμένως αποκαλυφθεί και χρησιμοποιήθηκαν από τους agents μεταξύ Μαΐου και Ιουλίου. «Είναι σχεδόν βέβαιο ότι συμβαίνουν περισσότερα πράγματα που απλώς δεν γνωρίζουμε», δήλωσε.

Από ένα γερμανικό wiki σε δεκάδες websites

Η υπόθεση έγινε γνωστή, όταν ερευνητές αποκάλυψαν, ότι ένα «σμήνος» AI agents της OpenAI χρησιμοποίησε ένα γερμανόφωνο wiki, το DseWiki, ως αυτοσχέδια πλατφόρμα ανταλλαγής μηνυμάτων.

Οι agents φέρεται να το χρησιμοποίησαν, για να συνεργαστούν στην επίλυση απαιτητικών ερωτημάτων, ακόμη και σε περιπτώσεις που σχετίζονταν με εξετάσεις. Το περιστατικό δεν είχε δημοσιοποιηθεί από την OpenAI, η οποία εκείνη την περίοδο αντιμετώπιζε τις συνέπειες της επίθεσης του Ιουλίου στο Hugging Face.

Όμως, η έρευνα δεν σταμάτησε εκεί. Άλλοι ερευνητές άρχισαν να εντοπίζουν παρόμοια ίχνη δραστηριότητας σε πολλούς ακόμη ιστοτόπους.

Οι εκτιμήσεις διαφέρουν. Όλοι, όμως, όσοι μίλησαν στο Reuters συμφωνούν σε ένα βασικό σημείο: οι ιστοσελίδες ήταν περισσότερες από 10.

Η Sydney Von Arx, της ερευνητικής ομάδας που αποκάλυψε πρώτη τη δραστηριότητα στο γερμανικό wiki, λέει ότι η ομάδα της έχει εντοπίσει αξιόπιστες ενδείξεις δραστηριότητας agents σε 23 διαφορετικούς ιστοτόπους που δεν είχαν αναφερθεί προηγουμένως.

Και η ίδια προειδοποιεί: «Δεν έχουμε ιδέα πόσα υπάρχουν εκεί έξω».

Τι sites χρησιμοποίησαν;

Το πιο παράξενο στοιχείο της υπόθεσης είναι ίσως το πού επέλεξαν να αφήσουν τα μηνύματά τους.

Οι ερευνητές εντόπισαν ίχνη σε:

  • συνεργατικά wiki,
  • websites αποθήκευσης κειμένου,
  • υπηρεσίες συντόμευσης links,
  • εξειδικευμένα εκπαιδευτικά wiki,
  • προσωπικές ιστοσελίδες,
  • gaming wikis,
  • παλιές ιστοσελίδες για λογισμικό επεξεργασίας κειμένου.

Μεταξύ άλλων, εντοπίστηκαν ίχνη σε ένα wiki αφιερωμένο στη Χημεία Advanced Placement, το οποίο είχε δημιουργηθεί το 2008 από καθηγητή λυκείου στη Μασαχουσέτη.

Ερευνητές εντόπισαν επίσης δραστηριότητα σε δύο προσωπικά websites Πολωνών εργαζομένων στον χώρο της τεχνολογίας, καθώς και σε wikis που αφορούν παιχνίδια για ανθρώπους «που θέλουν να ακονίζουν το μυαλό τους».

Κανένας από τους ιδιοκτήτες των συγκεκριμένων ιστοτόπων δεν απάντησε στα αιτήματα του Reuters για σχόλιο.

Οι ερευνητές ακολούθησαν τα ψηφιακά «ίχνη»

Πώς κατάλαβαν ότι επρόκειτο για την ίδια δραστηριότητα;

Σε αρκετές περιπτώσεις, οι ερευνητές συνέκριναν ακολουθίες δεδομένων που είχαν εμφανιστεί στο γερμανικό wiki με πανομοιότυπες ακολουθίες σε άλλους ιστοτόπους, περίπου την ίδια χρονική στιγμή.

Σε άλλες περιπτώσεις, συνέδεσαν τη δραστηριότητα μέσω παρόμοιων ή πανομοιότυπων usernames.

Εντόπισαν ακόμη agents που φαίνεται να αναζητούσαν απαντήσεις στα ίδια, ιδιαίτερα εξειδικευμένα ερωτήματα — όπως στοιχεία για τον επιπολασμό του καρκίνου στην πολιτεία της Αϊόβα.

Σε ορισμένες περιπτώσεις, οι ερευνητές κατάφεραν να συνδέσουν τη δραστηριότητα με IP addresses που παρέπεμπαν σε υποδομές της Microsoft Azure, τις οποίες χρησιμοποιεί κατά περιπτώσεις η OpenAI.

Το Reuters, πάντως, σημειώνει ότι δεν ήταν δυνατό να επαληθεύσει ανεξάρτητα κάθε επιμέρους καταγγελία.

«Αν τους είπαν μόνο να διαβάζουν, έπρεπε να γίνουν δημιουργικοί»

Ο Kenneth Russell DeGraff, προγραμματιστής λογισμικού και πρώην συνεργάτης του αμερικανικού Κογκρέσου, δήλωσε ότι εντόπισε αντίστοιχες πληροφορίες σε τουλάχιστον 10 websites.

Όπως εξηγεί, εάν οι agents είχαν λάβει εντολή να διαβάζουν αλλά όχι να γράφουν, έπρεπε να βρουν δημιουργικούς τρόπους για να αφήνουν πληροφορίες που θα μπορούσαν να χρησιμοποιήσουν άλλοι agents.

Η εικόνα θυμίζει, σύμφωνα με τους ερευνητές, μαθητές που απαγορεύεται να επικοινωνούν κατά τη διάρκεια μιας εξέτασης αλλά βρίσκουν εναλλακτικό τρόπο να ανταλλάξουν απαντήσεις.

Το γεγονός ότι οι agents κατάφεραν να εκμεταλλευτούν τόσο διαφορετικές πλατφόρμες είναι αυτό που προκαλεί ιδιαίτερο ενδιαφέρον στους ερευνητές.

Η OpenAI λέει ότι κάνει ευρύτερη έρευνα

Η OpenAI δεν απάντησε ευθέως στο πόσα διαφορετικά websites χρησιμοποίησαν οι agents της ούτε εξήγησε γιατί η συγκεκριμένη δραστηριότητα παρέμεινε εκτός δημοσιότητας για μήνες.

Σε ανακοίνωσή της ανέφερε ότι πραγματοποιεί ευρύτερη αξιολόγηση της δραστηριότητας των AI agents και ότι μέχρι στιγμής «δεν έχει εντοπίσει άλλη δραστηριότητα αντίστοιχης σοβαρότητας ή κλίμακας με εκείνη του Hugging Face».

Η εταιρεία δήλωσε επίσης ότι αναπτύσσει ένα πλαίσιο για την αναφορά περιστατικών «misalignment», δηλαδή συμπεριφορών όπου τα μοντέλα αποκλίνουν από τις προβλεπόμενες οδηγίες.

Το πλαίσιο θα καλύπτει την εκπαίδευση, την αξιολόγηση και την ανάπτυξη των μοντέλων και, σύμφωνα με την OpenAI, θα παρουσιαστεί «σύντομα».

Το κρίσιμο ερώτημα: Ποιος έχει τελικά τον έλεγχο;

Η συγκεκριμένη υπόθεση δεν σημαίνει ότι οι AI agents της OpenAI απέκτησαν ανεξάρτητη «βούληση» ή ότι πραγματοποίησαν μια κινηματογραφικού τύπου εξέγερση.

Δείχνει όμως κάτι που μπορεί να αποδειχθεί πολύ πιο σημαντικό για το μέλλον της τεχνητής νοημοσύνης: πόσο απρόβλεπτη μπορεί να γίνει η συμπεριφορά ενός agent όταν του ανατίθενται σύνθετες εργασίες και διαθέτει πρόσβαση στο διαδίκτυο.

Το γεγονός ότι οι agents φαίνεται να βρήκαν εναλλακτικούς τρόπους επικοινωνίας, παρά τους περιορισμούς που είχαν τεθεί, αναδεικνύει ένα δύσκολο πρόβλημα για τις εταιρείες AI.

Όσο πιο ικανοί γίνονται οι agents να σχεδιάζουν και να εκτελούν σύνθετες εργασίες, τόσο πιο δύσκολο μπορεί να είναι να προβλεφθούν όλοι οι τρόποι με τους οποίους θα προσπαθήσουν να πετύχουν έναν στόχο.

Ο Helmut Leitner, συνταξιούχος προγραμματιστής που παρέχει hosting και λογισμικό για έξι από τα wiki που επηρεάστηκαν, μεταξύ των οποίων και το DseWiki, δήλωσε ότι ο διαχειριστής του συγκεκριμένου site χρειάστηκε να αφιερώσει ώρες για να καθαρίσει το περιεχόμενο που άφησαν πίσω τους οι agents.

Ωστόσο, τόνισε ότι η ευθύνη δεν πρέπει να αποδοθεί στην ίδια την τεχνητή νοημοσύνη.

«Η ευθύνη δεν ανήκει σε μια υποτιθέμενα ηθική μηχανή, αλλά στους ανθρώπους και τους οργανισμούς που βρίσκονται πίσω από αυτήν», ανέφερε.

YouTube thumbnail

Τελευταία Νέα

Related Articles

Αφήστε μια απάντηση

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *

Back to top button