Η απόφασή του, ωστόσο, να παραιτηθεί από την Anthropic, προειδοποιώντας ότι η ανεξέλεγκτη ανάπτυξη της τεχνητής νοημοσύνης θα μπορούσε να οδηγήσει ακόμη και στην εξαφάνιση της ανθρωπότητας, τον μετέτρεψε σε κεντρικό πρόσωπο μιας έντονης αντιπαράθεσης για το μέλλον της ΑΙ, στην οποία συμμετείχαν οι επικεφαλής των μεγαλύτερων εταιρειών τεχνολογίας, κυβερνητικοί αξιωματούχοι και ερευνητές από όλο τον κόσμο.
Ο ίδιος δηλώνει έκπληκτος από τις διαστάσεις που πήρε η παραίτησή του. Απορρίπτει, πάντως, τον χαρακτηρισμό του πληροφοριοδότη δημοσίου συμφέροντος (whistleblower), που του αποδίδουν τόσο υποστηρικτές όσο και επικριτές του. Δεν αποκάλυψε εταιρικά μυστικά, εξηγεί σε μεγάλο αφιέρωμα που έκανε για εκείνον η Wall Street Journal. Απλώς αποφάσισε να πει δημόσια όσα συζητούν μεταξύ τους οι ερευνητές της τεχνητής νοημοσύνης.
Από τις μαθηματικές ολυμπιάδες στην AI
Γιος καθηγητή μεσαιωνικής γερμανικής λογοτεχνίας, ο Κόξον μεγάλωσε στη Βρετανία και φοίτησε σε ένα από τα γνωστά ιδιωτικά σχολεία της Οξφόρδης. Εκεί ανακάλυψε το βιβλίο «Superintelligence: Paths, Dangers, Strategies» του φιλοσόφου Νικ Μπόστρομ, το οποίο τον έφερε για πρώτη φορά αντιμέτωπο με την ιδέα ότι μια υπερευφυής μηχανή θα μπορούσε να αποτελέσει υπαρξιακή απειλή για τον άνθρωπο.
Το 2016, παρακολούθησε το πρόγραμμα AlphaGo της Google DeepMind να επικρατεί ενός κορυφαίου παίκτη του επιτραπέζιου παιχνιδιού Go. Η επίδοση αυτή έδειξε ότι οι μηχανές μπορούσαν πλέον να κυριαρχήσουν σε δραστηριότητες που θεωρούνταν ότι απαιτούσαν ανθρώπινη διαίσθηση και δημιουργικότητα.
Παράλληλα, ο Κόξον διακρινόταν στα μαθηματικά. Επιλέχθηκε για την εθνική ομάδα της Βρετανίας στη Διεθνή Μαθηματική Ολυμπιάδα, κατακτώντας αργυρό μετάλλιο το 2016 και χάλκινο το 2017. Σε μια από εκείνες τις διοργανώσεις, στο Χονγκ Κονγκ, βρέθηκε μαζί με άλλους νεαρούς μαθηματικούς σε ένα McDonald’s. Εμπνευσμένοι από έναν τύπο της θεωρίας αριθμών γνωστό ως «Θεώρημα των Chicken McNuggets» και χρησιμοποιώντας τα κουπόνια φαγητού που τους είχαν απομείνει, αγόρασαν εκατοντάδες κοτομπουκιές και συγκεντρώθηκαν γύρω από έναν πίνακα για να λύσουν ένα δύσκολο μαθηματικό πρόβλημα.
Ο Κόξον, δεξιά, με τη βρετανική ομάδα που συμμετείχε στη Διεθνή Μαθηματική Ολυμπιάδα το 2017
UK Maths Trust
Αρκετά από τα παιδιά εκείνης της παρέας θα γίνονταν αργότερα συνάδελφοί του σε εργαστήρια τεχνητής νοημοσύνης. Από τα έξι μέλη της βρετανικής ομάδας, τα τρία κατέληξαν να εργάζονται στον συγκεκριμένο τομέα. Ανάμεσά τους ήταν ο Τζο Μπέντον, ο οποίος επίσης αποχώρησε πρόσφατα από την Anthropic, προειδοποιώντας ότι οι εταιρείες κατασκευάζουν μηχανές πολύ εξυπνότερες από οποιονδήποτε άνθρωπο και ότι «μπορεί να μην επιβιώσουμε από αυτό».
Η καθοριστική συνάντηση με το GPT-3
Ο Κόξον σπούδασε μαθηματικά στο Κέιμπριτζ, συνεχίζοντας την ενασχόλησή του με την τεχνητή νοημοσύνη. Το 2020, όταν ολοκλήρωνε τις σπουδές του, η OpenAI παρουσίασε το GPT-3, αποδεικνύοντας ότι οι δυνατότητες των γλωσσικών μοντέλων μπορούσαν να αυξάνονται σημαντικά καθώς εκπαιδεύονταν με μεγαλύτερες ποσότητες δεδομένων.
«Το GPT-3 ήταν πραγματικά η στιγμή του “ουάου”», θυμάται.
Μετά το πανεπιστήμιο, ασχολήθηκε για λίγο με τις τιμές εμπορευμάτων, χρησιμοποιώντας στατιστικές αναλύσεις και μηχανική μάθηση για την πρόβλεψη των τιμών της ενέργειας. Ωστόσο, η τεχνητή νοημοσύνη παρέμενε για εκείνον το πιο συναρπαστικό πεδίο επιστημονικής και επαγγελματικής δραστηριότητας. Το 2023 μετακόμισε στο Σαν Φρανσίσκο και προσλήφθηκε στην OpenAI.
Τα πρώτα βήματα στη Σίλικον Βάλεϊ
Ο Κόξον εντάχθηκε στην OpenAI μέσω ενός εξάμηνου προγράμματος για ερευνητές χωρίς προηγούμενη επαγγελματική εμπειρία στην τεχνητή νοημοσύνη. Ειδικεύτηκε στην αρχική εκπαίδευση των μοντέλων, κατά την οποία τροφοδοτούνται με τεράστιες ποσότητες κειμένων, εικόνων και κώδικα. Ο πρώην συνάδελφός του Γουίλ Ντεπιού τον περιγράφει ως έναν συνηθισμένο ερευνητή, ο οποίος δεν ξεχώριζε για τον ακτιβισμό του σχετικά με την ασφάλεια της τεχνητής νοημοσύνης.
Στα τέλη του 2023 απέκτησε πρόσβαση στο Q*, ένα πρώιμο μοντέλο συλλογισμού της OpenAI, ικανό να αναλύει σύνθετα προβλήματα σε επιμέρους βήματα. Όταν του έδωσε ένα δύσκολο σταυρόλεξο, εντυπωσιάστηκε παρακολουθώντας τη διαδικασία με την οποία το σύστημα προσπαθούσε να το λύσει.
Με την πάροδο του χρόνου, πρόσεξε ότι μέλη της ομάδας ασφάλειας της OpenAI αποχώρησαν από την εταιρεία, μεταξύ των οποίων και ο Ντάνιελ Κοκοτάιλο, ο οποίος ίδρυσε μια ερευνητική ομάδα που προέβλεπε διαφορετικά σενάρια ανάπτυξης της τεχνητής νοημοσύνης.
Ο Κόξον ανησυχούσε για το ενδεχόμενο δημιουργίας μιας υπερευφυούς τεχνητής νοημοσύνης που θα ξεπερνούσε τις ανθρώπινες ικανότητες. Θεωρούσε, όμως, ότι οι κυβερνήσεις θα συντονίζονταν εγκαίρως για να επιβραδύνουν την ανάπτυξη της τεχνολογίας, εφόσον κάτι τέτοιο γινόταν αναγκαίο.

Όταν ο Ίλον Μασκ τον αμφισβήτησε μέσω του Χ, ο Κόξον απάντησε με μία φωτογραφία του και την ακόλουθη «μπηχτή»: «Είμαι υπαρκτό πρόσωπο και αυτές είναι οι πραγματικές μου πεποιθήσεις. Θα μπορούσες να ρωτήσεις τους ερευνητές της xAI για μένα, αν δεν τους είχες απολύσει»
Χ/@hilbertspaess
Εν τω μεταξύ, παρακολουθούσε την αξιοσημείωτη πρόοδο της τεχνητής νοημοσύνης στα μαθηματικά, καθώς τα μοντέλα εξελίσσονταν πολύ πιο γρήγορα από ό,τι είχε προβλέψει. Ξαφνικά, δεν δυσκολεύονταν πλέον με την αριθμητική. Το 2024, ένα μοντέλο της Google DeepMind είχε αρκετά καλή απόδοση στη Διεθνή Μαθηματική Ολυμπιάδα ώστε να κερδίσει ένα ασημένιο μετάλλιο. Το 2025, η DeepMind και η OpenAI κέρδισαν και οι δύο χρυσό.
Το 2026, όμως, ο Κόξον και μεγάλο μέρος της κοινότητας για την ασφάλεια της τεχνητής νοημοσύνης άρχισαν πραγματικά να πανικοβάλλονται.
Η μετακίνηση στην Anthropic
Το 2026 αποτέλεσε σημείο καμπής για τον Κόξον. Η εμφάνιση ισχυρότερων μοντέλων, με δυνατότητες πραγματοποίησης σύνθετων κυβερνοεπιθέσεων, ενίσχυσε τους φόβους του ότι η τεχνολογία εξελισσόταν ταχύτερα από τους μηχανισμούς ελέγχου της.
Τον Μάιο εγκατέλειψε την OpenAI για την Anthropic, την οποία θεωρούσε περισσότερο διαφανή ως προς τους κινδύνους των συστημάτων της. Ακολούθησαν, ωστόσο, περιστατικά κατά τη διάρκεια δοκιμών ασφαλείας που τον προβλημάτισαν ακόμη περισσότερο.
Τον Ιούλιο, η OpenAI αποκάλυψε ότι ένα ακυκλοφόρητο μοντέλο της είχε διαφύγει από το απομονωμένο περιβάλλον δοκιμών του και είχε παραβιάσει συστήματα της Hugging Face. Αργότερα, η Anthropic ανακοίνωσε ότι είχε εντοπίσει παρόμοια περιστατικά στις δικές της δοκιμές. Μια έκθεση της ερευνητικής οργάνωσης METR, στα τέλη Αυγούστου, παρουσίασε πρόσθετες πληροφορίες για το πρώτο περιστατικό.
Για τον Κόξον και τους συναδέλφους του, η έκθεση αποτέλεσε, όπως λέει, «μια στιγμή που μας έκανε να πούμε “holy shit ”».
Στο μεταξύ, οι ερευνητές των μεγαλύτερων εργαστηρίων συζητούσαν ολοένα συχνότερα το ενδεχόμενο τα συστήματα τεχνητής νοημοσύνης να αποκτήσουν την ικανότητα να σχεδιάζουν μόνα τους την επόμενη γενιά ισχυρότερων συστημάτων, επιταχύνοντας την τεχνολογική πρόοδο πέρα από τα σημερινά όρια. Ο Κόξον συζήτησε τις ανησυχίες του με τους προϊσταμένους του και εξέτασε το ενδεχόμενο να μετακινηθεί σε θέση αφιερωμένη στην ασφάλεια. Τελικά, όμως, αποφάσισε να αποχωρήσει. «Ακόμη και το να εργάζομαι στην ασφάλεια της Anthropic έμοιαζε σαν να είμαι συνένοχος», εξηγεί.
Η παραίτηση και οι πρώτες αντιδράσεις
Κατά τον Κόξον, η αντιμετώπιση των κινδύνων απαιτεί μια διεθνή συμφωνία, με κυβερνητικές εγγυήσεις για την επιβράδυνση της ανάπτυξης των μοντέλων όταν κρίνεται απαραίτητο. Θεωρεί ότι οι ΗΠΑ, η Κίνα και άλλες χώρες πρέπει να συμφωνήσουν σε ένα κοινό πλαίσιο, ανάλογο με τις διεθνείς συμφωνίες ελέγχου των πυρηνικών εξοπλισμών. Συγκαταλέγεται στους περίπου 1.400 ερευνητές που έχουν υπογράψει έκκληση για τη δημιουργία ενός μηχανισμού έκτακτης επιβράδυνσης της ανάπτυξης της τεχνητής νοημοσύνης.
Πριν παραιτηθεί, συμβουλεύτηκε τον Κοκοτάιλο, με τον οποίο συναντήθηκε για έναν περίπατο στην πανεπιστημιούπολη του Μπέρκλεϊ, κι εκείνος τον διαβεβαίωσε ότι είχε λάβει τη σωστή απόφαση. Την ημέρα της αποχώρησής του, ενημέρωσε τους συναδέλφους του στην Anthropic μέσω Slack και, λίγο αργότερα, δημοσίευσε μια σειρά αναρτήσεων στο X, καθισμένος σε ένα παγκάκι στο Σαν Φρανσίσκο.
Ο λογαριασμός του είχε λιγότερους από 100 ακολούθους. Μέσα σε λίγα λεπτά, όμως, οι δηλώσεις του αναπαράχθηκαν από πρώην συναδέλφους και οργανώσεις που ασχολούνται με την ασφάλεια της τεχνητής νοημοσύνης.
Η παρέμβασή του προκάλεσε αντιδράσεις ακόμη και στα ανώτατα κλιμάκια της βιομηχανίας. Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, δήλωσε ότι συμφωνεί με τον Κόξον περισσότερο απ’ όσο διαφωνεί. Αντίθετα, ο επικεφαλής της Nvidia, Τζένσεν Χουάνγκ, εξέφρασε τον θαυμασμό του για το θάρρος του νεαρού ερευνητή, αμφισβητώντας όμως τις καταστροφικές προβλέψεις του.
Ορισμένοι επικριτές του υποστηρίζουν ότι η παραίτησή του εντάσσεται σε μια ευρύτερη προσπάθεια προώθησης αυστηρότερων διεθνών ρυθμίσεων, οι οποίες θα μπορούσαν να ευνοήσουν τις μεγαλύτερες εταιρείες. Ο Κόξον, από την πλευρά του, επιμένει ότι η απόφασή του ήταν προσωπική.
«Είμαι σίγουρα ένας doomer»
Μέσα σε λίγες ημέρες, ο άγνωστος μαθηματικός βρέθηκε να δίνει συνεντεύξεις σε μεγάλα τηλεοπτικά δίκτυα, ενώ δεχόταν προτάσεις από εκδότες και δημιουργούς podcast. Ο ίδιος αυτοπροσδιορίζεται πλέον ως «doomer», όπως αποκαλούνται στον χώρο της τεχνητής νοημοσύνης όσοι ανησυχούν ιδιαίτερα για τους υπαρξιακούς κινδύνους της.
«Αν doomer σημαίνει κάποιος που πιστεύει ότι θα πεθάνουμε αν δεν αλλάξουμε αυτό που κάνουμε, τότε είμαι σίγουρα doomer», δηλώνει.
Ο Κοκοτάιλο, ο οποίος τον συνάντησε ξανά λίγες ημέρες μετά την παραίτησή του, τον συμβούλευσε να περιορίσει τις δημόσιες εμφανίσεις του και να ξεκουραστεί. «Τόσοι πολλοί άνθρωποι σε αυτές τις εταιρείες θα μπορούσαν να είχαν κάνει το ίδιο», λέει στην Wall Street Journal. «Εκείνος ήταν αυτός που το έκανε».