Η Google DeepMind AI safety ομάδα χάνει δύο ερευνητές που αποχωρούν με εξαιρετικά βαριές προειδοποιήσεις για το μέλλον της τεχνητής νοημοσύνης, υποστηρίζοντας ότι η εξέλιξη των συστημάτων μπορεί να ξεπερνά την ικανότητα της βιομηχανίας να τα ελέγξει με ασφάλεια.
Οι Bilal Chughtai και Josh Engels εργάζονταν πάνω σε AI safety και alignment στη Google DeepMind και αποφάσισαν να φύγουν για οργανισμούς που επικεντρώνονται αποκλειστικά στην ασφάλεια της τεχνητής νοημοσύνης.
Ο Engels εντάσσεται στη METR, έναν ανεξάρτητο οργανισμό που ασχολείται με την αξιολόγηση προηγμένων AI systems, ενώ ο Chughtai πήγε στη BlueDot Impact, nonprofit που επικεντρώνεται στην εκπαίδευση και την έρευνα γύρω από AI safety. Οι δηλώσεις τους όμως είναι πολύ πιο εντυπωσιακές από τις ίδιες τις μετακινήσεις.
«Τρομακτική πιθανότητα τεράστιας ζημιάς»

Ο Josh Engels δήλωσε ότι πλέον θεωρεί πως υπάρχει «τρομακτική πιθανότητα» τα AI systems να προκαλέσουν τεράστια ζημιά μέσα στα επόμενα πέντε χρόνια. Το βασικό του άγχος αφορά το recursive self-improvement.
Πρόκειται για το σενάριο στο οποίο ένα AI system αποκτά την ικανότητα να βελτιώνει ένα άλλο AI system, το οποίο με τη σειρά του μπορεί να δημιουργήσει ακόμη πιο προηγμένες εκδόσεις.
Θεωρητικά, ένας τέτοιος κύκλος θα μπορούσε να οδηγήσει σε πολύ ταχύτερη αύξηση των δυνατοτήτων από αυτή που μπορούν να παρακολουθήσουν ανθρώπινοι ερευνητές. Για τον Engels, το πρόβλημα δεν είναι μόνο ότι τα μοντέλα γίνονται πιο ισχυρά.
Είναι ότι η κατανόηση του πώς παραμένουν aligned με ανθρώπινες προθέσεις δεν εξελίσσεται απαραίτητα με τον ίδιο ρυθμό.
Από τη DeepMind στη METR
Η επιλογή του Engels να φύγει από ένα από τα πιο ισχυρά AI labs του κόσμου για έναν ανεξάρτητο οργανισμό αξιολόγησης είναι ενδεικτική της ανησυχίας του.
Η METR ασχολείται με testing και evaluations προηγμένων AI models, επιχειρώντας να μετρήσει πόσο γρήγορα αυξάνονται οι δυνατότητες των συστημάτων και ποιοι νέοι κίνδυνοι εμφανίζονται.
Η μετάβαση αυτή δείχνει ότι ο Engels θεωρεί σημαντικότερο να εργάζεται πάνω στην ανεξάρτητη αξιολόγηση της τεχνολογίας παρά μέσα σε μια εταιρεία που ταυτόχρονα αναπτύσσει frontier models. Η θέση του δεν είναι ότι κάθε σημερινό AI system αποτελεί άμεση καταστροφική απειλή.
Η ανησυχία είναι η κατεύθυνση: αν οι δυνατότητες συνεχίσουν να αυξάνονται ταχύτερα από τα safety mechanisms, το περιθώριο αντίδρασης μπορεί να μειωθεί πολύ γρήγορα.
«Η AI έχει τη δυνατότητα να μας σκοτώσει όλους»
Ακόμη πιο απόλυτη ήταν η δημόσια τοποθέτηση του Bilal Chughtai. Ο πρώην ερευνητής της Google DeepMind δήλωσε ότι πιστεύει ειλικρινά πως η AI έχει τη δυνατότητα να οδηγήσει ακόμη και σε ανθρώπινη εξαφάνιση και ότι ο χρόνος για την αποφυγή ενός τέτοιου σεναρίου μπορεί να είναι κοντά.
Ο Chughtai εργάστηκε περίπου ενάμιση χρόνο στη DeepMind και είχε άμεση επαφή με την ανάπτυξη και αξιολόγηση advanced AI systems. Το επιχείρημά του βασίζεται κυρίως στην ταχύτητα.
Όπως υποστηρίζει, μέσα σε λίγα χρόνια τα AI systems πέρασαν από περιορισμένα εργαλεία σε agents που μπορούν να εκτελούν σύνθετες εργασίες, να γράφουν κώδικα, να αυτοματοποιούν διαδικασίες και να λειτουργούν με πολύ μεγαλύτερη αυτονομία.
Για τον ίδιο, το χάσμα ανάμεσα στις capabilities και στο alignment διευρύνεται αντί να κλείνει.
Το πρόβλημα της κούρσας

Και οι δύο αποχωρήσεις συνδέονται με μια ευρύτερη συζήτηση που έχει ανοίξει ξανά στη Silicon Valley.
Το βασικό ερώτημα είναι αν οι εταιρείες μπορούν πραγματικά να επιβραδύνουν την ανάπτυξη όταν βρίσκονται σε ακραίο ανταγωνισμό μεταξύ τους.
Google DeepMind, OpenAI, Anthropic, Meta και xAI επενδύουν δισεκατομμύρια σε compute, data centers, research και νέα μοντέλα.
Αν μία εταιρεία αποφασίσει να κινηθεί πιο αργά για λόγους safety, υπάρχει πάντα ο φόβος ότι κάποιος ανταγωνιστής θα συνεχίσει. Αυτό δημιουργεί ένα κλασικό race problem.
Ακόμη και ερευνητές ή executives που αναγνωρίζουν τον κίνδυνο μπορεί να έχουν ισχυρό κίνητρο να συνεχίσουν με υψηλό ρυθμό, επειδή δεν γνωρίζουν τι θα κάνουν οι υπόλοιποι.
Ένα ευρύτερο κύμα αποχωρήσεων

Οι Engels και Chughtai δεν είναι οι μόνοι.
Τις τελευταίες εβδομάδες και ερευνητές από την Anthropic έχουν αποχωρήσει εκφράζοντας παρόμοιους φόβους γύρω από superintelligence, control και alignment.
Παράλληλα, η ίδια η ηγεσία της βιομηχανίας έχει αρχίσει να μιλά πιο ανοιχτά για την ανάγκη να περιοριστεί ο ρυθμός ανάπτυξης των frontier models.
Ο Dario Amodei της Anthropic έχει ζητήσει περισσότερο χρόνο για safety research, ενώ Sam Altman και Elon Musk έχουν επίσης στηρίξει δημόσια την ιδέα ότι η βιομηχανία πρέπει να βρει τρόπο να επιβραδύνει χωρίς να σταματήσει πλήρως την πρόοδο.
Ακόμη και οι μεγάλες ανταγωνίστριες εταιρείες έχουν αρχίσει να συζητούν κοινές πρωτοβουλίες γύρω από AI safety.
Γιατί οι αποχωρήσεις έχουν σημασία
Οι προειδοποιήσεις για υπαρξιακό κίνδυνο από AI δεν αποτελούν επιστημονική βεβαιότητα.
Δεν υπάρχει σήμερα συναίνεση ότι τα υπάρχοντα ή μελλοντικά AI systems θα προκαλέσουν αναπόφευκτα καταστροφικό αποτέλεσμα.
Αυτό όμως δεν κάνει τις συγκεκριμένες αποχωρήσεις αδιάφορες.
Όταν οι άνθρωποι που εργάζονται ακριβώς πάνω στην ασφάλεια και το alignment των frontier models εγκαταλείπουν κορυφαία labs επειδή θεωρούν ότι η πρόοδος κινείται πολύ γρήγορα, το ζήτημα παύει να είναι απλώς μια θεωρητική συζήτηση.
Το πραγματικό ερώτημα δεν είναι αν οι πιο ακραίες προβλέψεις θα επαληθευτούν.
Είναι αν η βιομηχανία διαθέτει σήμερα αρκετούς ανεξάρτητους μηχανισμούς ώστε να ξέρει πότε ένα σύστημα έχει γίνει πιο ισχυρό από όσο μπορεί να ελέγξει με ασφάλεια.
Και οι αποχωρήσεις από τη Google DeepMind δείχνουν ότι τουλάχιστον κάποιοι από τους ανθρώπους που βρίσκονταν πιο κοντά σε αυτή τη δουλειά θεωρούν πως η απάντηση είναι ακόμη όχι.

