Τεχνητή Νοημοσύνη: Παραιτήθηκε ερευνητής της Anthropic - Προειδοποιεί για συστήματα AI που "μπορούν να απειλήσουν την ανθρωπότητα"
Τι καταγγέλλει
Ο ερευνητής κάνει λόγο για ακραία σενάρια με συστήματα ΑΙ που μπορεί να έχουν ξεφύγει ήδη από τον έλεγχο
Ο ερευνητής Τζέικομπ Κόξον υπέβαλε την παραίτησή του από την εταιρεία Τεχνητής Νοημοσύνης λόγω των φόβων του ότι μαζί με τους ανταγωνιστές της συμμετέχει σε μια κούρσα ανάπτυξης συστημάτων που τελικά δεν θα μπορούν να ελέγξουν. Σε μία σειρά αναρτήσεών του στα social media, εξηγεί ότι δεν θέλει να συμμετέχει στη γενικευμένη προσπάθεια του κλάδου για τη δημιουργία συστημάτων AI που θα μπορούν να βελτιώνουν μόνα τους τον εαυτό τους. Όπως επισημαίνει, φοβάται ότι τέτοια συστήματα θα μπορούσαν να ξεφύγουν από κάθε έλεγχο και να απειλήσουν την ανθρωπότητα.
Διαβάστε: Νέα Υόρκη: "Φρένο" στην τεχνητή νοημοσύνη στα σχολεία μέχρι το γυμνάσιο
"Ώρα μηδέν" και "τελικό στάδιο"
Ο 27χρονος Βρετανός, ο οποίος έχει σπουδάσει μαθηματικά, ανέφερε ότι πολλοί συνάδελφοί του χρησιμοποιούν πλέον όρους όπως «ώρα μηδέν» και «τελικό στάδιο» για να περιγράψουν την πορεία προς τη δημιουργία αυτοβελτιούμενων μοντέλων. «Οδεύουμε προς ορισμένα από τα πιο ακραία σενάρια και μέχρι το τέλος του επόμενου έτους τα πράγματα μπορεί ήδη να έχουν ξεφύγει από τον έλεγχο», εκτιμά ο Κόξον, προσθέτοντας ότι όταν οι εταιρείες ανταγωνίζονται μεταξύ τους ενώ υπάρχει και ο ανταγωνισμός από την Κίνα, «οι συμβιβασμοί σε θέματα ασφάλειας είναι αναπόφευκτοι».
Ο ίδιος, νωρίτερα, εντός του 2026, άφησε την OpenAI για να ενταχθεί στην Anthropic, καθώς η τελευταία είναι γνωστή για την έμφαση που δίνει στην ασφάλεια των μοντέλων της. Ωστόσο, παρότι θεωρεί ότι οι προσπάθειες της εταιρείας είναι ειλικρινείς, πλέον πιστεύει ότι καμία εταιρεία δεν μπορεί να αναπτύξει υπεύθυνα τεχνητή νοημοσύνη που να ξεπερνά τον άνθρωπο σε ένα ευρύ φάσμα εργασιών -αυτό που συχνά αποκαλείται Τεχνητή Γενική Νοημοσύνη (AGI)- χωρίς κρατική παρέμβαση ή συντονισμένη επιβράδυνση του κλάδου.
Επικαλείται στο σκεπτικό του πρόσφατες περιπτώσεις κατά τις οποίες μοντέλα από την OpenAI και την Anthropic παραβιάστηκαν ή λειτούργησαν σε συνεργατικά «σμήνη» πρακτόρων AI για να τονίσει ότι τα συστήματα μπορούν να υιοθετήσουν κακόβουλους στόχους και να προσπαθήσουν να τους αποκρύψουν από τους ανθρώπους. Ο φόβος του Κόξον είναι πως, όταν αυτά τα συστήματα αρχίσουν να βελτιώνονται μόνα τους, ενδέχεται να εξελιχθούν σε σημείο που να αρνούνται να υπακούσουν σε εντολές.
I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below.
— Jacob Coxon (@hilbertspaess) September 9, 2026
"Ο κόσμος βρίσκεται σε κίνδυνο"
Όπως σημειώνει η «Wall Street Journal», η αποχώρηση του Κόξον έρχεται μετά την παραίτηση, νωρίτερα φέτος, ενός ακόμα ερευνητή που εργαζόταν σε θέματα ασφάλειας, ο οποίος έφυγε για να ασχοληθεί με την ποίηση, προειδοποιώντας ότι «ο κόσμος βρίσκεται σε κίνδυνο». Σημειώνεται ότι ο Κόξον ήταν ένας από τους περισσότερους από 1.000 ερευνητές τεχνητής νοημοσύνης που υπέγραψαν πρόσφατα κοινή δήλωση υπέρ του διεθνούς συντονισμού των κυβερνήσεων, ώστε να υπάρχει η δυνατότητα επιβράδυνσης της ανάπτυξης AI, αν καταστεί αναγκαίο να ενεργοποιηθεί ένα «φρένο» για συστήματα που θα μπορούν να βελτιώνονται μόνα τους.
Η αποχώρηση του Κόξον έρχεται την ώρα που η Anthropic προετοιμάζεται για δημόσια εγγραφή στο χρηματιστήριο, η οποία αναμένεται να είναι μία από τις μεγαλύτερες στην ιστορία. Η εταιρεία επιδιώκει αποτίμηση ύψους 2 τρισεκατομμυρίων δολαρίων και έχει δώσει ιδιαίτερη έμφαση στην υπεύθυνη ανάπτυξη της τεχνολογίας για να προσελκύσει επενδυτές.
Do not underestimate the power of this technology. These will soon be superhuman systems that can hack anything, revolutionize any field overnight, and acquire real power and resources. We have all witnessed the progress in each of these domains, and progress is not slowing.
— Jacob Coxon (@hilbertspaess) September 9, 2026
Η επιρροή των εταιρειών AI
Σύμφωνα με τον Κόξον, στην Anthropic υπάρχει ειδικό κανάλι στο Slack, όπου οι εργαζόμενοι συζητούν για τις ολοένα και πιο ισχυρές δυνατότητες των μοντέλων της εταιρείας, κάτι που αντανακλά το πόση επιρροή έχουν πλέον οι εταιρείες AI στην κατεύθυνση που παίρνει ολόκληρος ο κλάδος. «Είναι κάπως τρελό ότι όλα αυτά συμβαίνουν στα MacBook κάποιων μηχανικών που ζουν στο Σαν Φρανσίσκο, αντί σε κάποιο απομονωμένο καταφύγιο στην έρημο, όπως συνέβαινε με το Σχέδιο Μανχάταν», δήλωσε χαρακτηριστικά ο Κόξον.
Υπενθυμίζεται, τέλος, ότι ο διευθύνων σύμβουλος της εταιρείας, Ντάριο Αμοντέι, και άλλα στελέχη έχουν επανειλημμένα προειδοποιήσει για τους κινδύνους που ενέχουν τα ανεξέλεγκτα μοντέλα τεχνητής νοημοσύνης και έχουν καλέσει τον κλάδο να επιβραδύνει την ανάπτυξή τους.
I am optimistic about the potential for coordination. Warning shots like the Hugging Face attack have made pacing agreements between U.S. labs more viable. I don’t feel like we’re on track to prevent a global race, which may require costly actions such as a temporary ban on…
— Jacob Coxon (@hilbertspaess) September 9, 2026
En