Παραίτηση ανώτερου ερευνητή της Anthropic – Προειδοποίηση για εκτός ελέγχου AI, «μπορεί να απειλήσει την ανθρωπότητα»
Τεχνητή νοημοσύνη και ανησυχίες για την ασφάλεια της ανθρωπότητας βρίσκονται στο επίκεντρο των τελευταίων εξελίξεων στην Anthropic, σύμφωνα με δηλώσεις ανώτερου ερευνητή της εταιρείας.
Ο Evan Hubinger, επικεφαλής της επιστήμης της ευθυγράμμισης στην Anthropic, προειδοποίησε δημόσια ότι αρκετοί εργαζόμενοι θεωρούν πως η τεχνητή νοημοσύνη θα μπορούσε να απειλήσει την ύπαρξη της ανθρωπότητας, ενώ παραδέχτηκε πως η εταιρεία δεν έχει ακόμη βρει λύση για την ευθυγράμμιση των στόχων της τεχνητής νοημοσύνης με τα ανθρώπινα συμφέροντα.
Η τοποθέτηση του Hubinger ήρθε λίγο μετά την παραίτηση του ερευνητή Jacob Coxon από την Anthropic, ο οποίος κατηγόρησε την εταιρεία ότι δεν ενεργεί με επαρκή υπευθυνότητα. Ο Coxon, που έχει εργαστεί σε έρευνα για την προ-εκπαίδευση τόσο στην OpenAI όσο και στην Anthropic, προειδοποίησε ότι οι ανταγωνιστές κινούνται επικίνδυνα γρήγορα προς την ανάπτυξη αυτοβελτιούμενης υπερνοημοσύνης, παίζοντας με τις ζωές των ανθρώπων.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Σε αναρτήσεις του στο X, ο Hubinger ανέφερε ότι αυτός και οι συνάδελφοί του «πιστεύουν ειλικρινά ότι η τεχνητή νοημοσύνη θα μπορούσε να εξοντώσει όλους τους ανθρώπους», εκτιμώντας ότι η πιθανότητα να συμβεί κάτι τέτοιο ξεπερνά το 10% μέσα στην επόμενη δεκαετία. Υπογράμμισε πως, παρά τις προσπάθειες της Anthropic, δεν υπάρχει ακόμα σαφές σχέδιο για την επίλυση του ζητήματος της «ευθυγράμμισης για την υπερνοημοσύνη».
Ο Coxon, σε δικές του δηλώσεις, σημείωσε ότι όσοι εργάζονται στην ανάπτυξη τεχνητής νοημοσύνης πιστεύουν πως αυτή μπορεί να αποτελέσει απειλή για την ανθρωπότητα μέχρι το τέλος της δεκαετίας, τονίζοντας πως αυτό δεν είναι «διαφημιστικό τέχνασμα». Επιπλέον, τόνισε ότι η OpenAI δεν έχει κατανοήσει σε βάθος τα διακυβεύματα για τον πολιτισμό, σε αντίθεση με την Anthropic, η οποία ωστόσο παραμένει εγκλωβισμένη σε έναν ανταγωνιστικό αγώνα δρόμου.
Σε απάντηση στις ανησυχίες, ο Hubinger επικαλέστηκε πρόσφατη έκθεση κινδύνου της Anthropic, υποστηρίζοντας ότι τα σημερινά μοντέλα τεχνητής νοημοσύνης ενέχουν χαμηλό κίνδυνο, αλλά η ανησυχία του εστιάζεται στη δημιουργία υπερνοημοσύνης μέσω αναδρομικής αυτοβελτίωσης, μια διαδικασία που εξελίσσεται ταχύτερα από τις αρχικές εκτιμήσεις.
Πιεστική ανάγκη για ρυθμίσεις και εποπτεία
Οι εξελίξεις αυτές έρχονται σε μια περίοδο όπου κορυφαίοι ερευνητές και στελέχη του κλάδου της τεχνητής νοημοσύνης ζητούν επιβράδυνση της ανάπτυξης προηγμένων συστημάτων. Τον Ιούλιο, υπογράφηκε σχετική δήλωση από σημαντικές προσωπικότητες, όπως οι συνιδρυτές της Anthropic Dario Amodei και Jared Kaplan, ο επικεφαλής επιστήμονας της OpenAI Jakub Pachocki και ο επικεφαλής επιστήμονας της Meta AI Shengjia Zhao.
Στη δήλωση αυτή επισημαίνεται ότι, για να αξιοποιηθεί με ασφάλεια το δυναμικό της τεχνητής νοημοσύνης, ίσως χρειαστεί να δοθεί χρόνος για την ανάπτυξη μέτρων ασφαλείας και εποπτείας. Παράλληλα, τονίζεται η ανάγκη για διεθνή συνεργασία και κυβερνητική παρέμβαση, ώστε να τεθούν όρια στην ανεξέλεγκτη ανάπτυξη αυτοματοποιημένων συστημάτων τεχνητής νοημοσύνης.
Σε πρόσφατη ανάρτησή του, ο Jakub Pachocki επανέλαβε ότι κανένα εργαστήριο δεν έχει επιλύσει πλήρως τα ζητήματα ευθυγράμμισης και παρακολούθησης, υπογραμμίζοντας ότι δεν είναι εφικτό να συνεχιστεί η ταχύτατη επέκταση της τεχνητής νοημοσύνης χωρίς επαρκή έλεγχο για μεγάλο χρονικό διάστημα.



