Ο CEO της Anthropic ζητά να πατήσει φρένο η ανάπτυξη της AI και προκαλεί ανησυχία

Ο CEO της Anthropic – εταιρεία κατασκευής του Claude – Dario Amodei υποστηρίζει ότι η βιομηχανία της τεχνητής νοημοσύνης έχει φτάσει σε ένα σημείο όπου η ταχύτητα ανάπτυξης των ισχυρότερων AI models πρέπει να περιοριστεί, ώστε οι μηχανισμοί ασφάλειας, οι ανεξάρτητοι έλεγχοι και οι κυβερνήσεις να προλάβουν τις εξελίξεις.

Ο Dario Amodei δεν προτείνει να σταματήσει συνολικά η πρόοδος της τεχνητής νοημοσύνης. Η παρέμβασή του αφορά κυρίως το frontier AI – τα πιο προηγμένα μοντέλα που βρίσκονται στα όρια των σημερινών δυνατοτήτων – και περιγράφει μια στρατηγική τριών σταδίων για αυτό που αποκαλεί «pace the frontier». Με απλά λόγια, ζητά πιο ελεγχόμενο ρυθμό ανάπτυξης, ώστε η ισχύς των νέων συστημάτων να μην αυξάνεται ταχύτερα από την ικανότητα της κοινωνίας να τα ελέγχει.

Τι ζητά

Η πρώτη κίνηση αφορά την ίδια την Anthropic.

Η εταιρεία σχεδιάζει να προσφέρει σε ανεξάρτητους οργανισμούς αξιολόγησης, όπως η METR, πολύ ευρύτερη πρόσβαση στα AI systems της. Στόχος είναι τρίτοι evaluators να μπορούν να ελέγχουν κατά πόσο η Anthropic τηρεί τις δεσμεύσεις και τις διαδικασίες ασφαλείας που έχει ανακοινώσει.

Η κίνηση έχει ιδιαίτερη σημασία, επειδή οι περισσότερες αξιολογήσεις των frontier models πραγματοποιούνται σήμερα με αρκετά περιορισμένη πρόσβαση. Ένας εξωτερικός οργανισμός μπορεί να δοκιμάσει ένα model, αλλά δεν έχει απαραίτητα πλήρη εικόνα για τις εσωτερικές διαδικασίες, τα safeguards ή τα προβλήματα που έχουν εντοπιστεί κατά την ανάπτυξή του.

Ο Dario Amodei θέλει αυτή η σχέση να γίνει βαθύτερη και περισσότερο μόνιμη.

Τρία βήματα

Το δεύτερο στάδιο του σχεδίου είναι πολύ πιο δύσκολο, καθώς απαιτεί συνεργασία ανάμεσα στις μεγαλύτερες AI εταιρείες.

Ο Dario Amodei υποστηρίζει ότι ο κλάδος θα πρέπει να συμφωνήσει σε κοινά safety standards και σε μηχανισμούς που θα περιορίζουν έναν ανεξέλεγκτο αγώνα για όλο και ισχυρότερα μοντέλα. Σε αυτή τη διαδικασία θα μπορούσαν να εμπλακούν και κυβερνητικές αρχές, χωρίς όμως η βιομηχανία να περιμένει απαραίτητα την ολοκλήρωση νέων νομοθετικών πλαισίων.

Dario Amodei: Ο CEO της Anthropic ζητά να πατήσει φρένο η ανάπτυξη της AI

Το επιχείρημα είναι ότι η νομοθεσία κινείται πολύ πιο αργά από την AI.

Η δημιουργία ενός νέου regulatory framework μπορεί να χρειαστεί χρόνια, ενώ μια νέα γενιά models μπορεί να εμφανιστεί μέσα σε λίγους μήνες. Για τον CEO της Anthropic, οι εταιρείες που δραστηριοποιούνται σε δημοκρατικές χώρες θα πρέπει επομένως να δημιουργήσουν ενδιάμεσα κοινές και επαληθεύσιμες πρακτικές ασφαλείας.

Το δύσκολο διεθνές σκέλος

Το τρίτο στάδιο είναι και το πιο φιλόδοξο: μια διεθνής συμφωνία γύρω από τον ρυθμό ανάπτυξης της frontier AI.

Ο Dario Amodei αναγνωρίζει ότι μια πραγματική επιβράδυνση δεν μπορεί να λειτουργήσει μακροπρόθεσμα αν εφαρμοστεί μόνο από αμερικανικές ή ευρωπαϊκές εταιρείες. Αν ένας παίκτης περιορίσει την ανάπτυξή του ενώ ένας γεωπολιτικός αντίπαλος συνεχίσει χωρίς περιορισμούς, δημιουργείται ισχυρό κίνητρο ώστε όλοι να επιστρέψουν στον αγώνα ταχύτητας.

Anthropic: Watermark σε κάθε κείμενο που παράγει το Claude

Γι’ αυτό το σχέδιο περιλαμβάνει τελικά και χώρες όπως η Κίνα και η Ρωσία.

Εδώ όμως εμφανίζεται μια φαινομενική αντίφαση. Ο Amodei ζητά διεθνή συνεργασία, αλλά ταυτόχρονα θεωρεί σημαντικό οι ΗΠΑ και οι υπόλοιπες δημοκρατικές χώρες να διατηρήσουν τεχνολογικό πλεονέκτημα.

Στο πλαίσιο αυτό υποστηρίζει περιορισμούς στην πρόσβαση προηγμένων AI chips, αλλά και μέτρα εναντίον πρακτικών όπως το model distillation, μέσω των οποίων μια εταιρεία μπορεί να χρησιμοποιήσει τις απαντήσεις ενός ισχυρότερου AI system για να εκπαιδεύσει γρηγορότερα ένα δικό της model.

Γιατί τώρα

Η παρέμβαση δεν γίνεται σε ουδέτερη χρονική στιγμή.

Οι δυνατότητες των AI agents διευρύνονται γρήγορα και τα συστήματα αποκτούν μεγαλύτερη αυτονομία στην εκτέλεση σύνθετων εργασιών. Αυτό σημαίνει ότι τα πιθανά προβλήματα δεν περιορίζονται πλέον σε λάθος απαντήσεις ενός chatbot.

Όσο τα models αποκτούν πρόσβαση σε υπολογιστές, software tools, δίκτυα και πραγματικές διαδικασίες, τόσο αυξάνεται και το κόστος ενός λάθους ή μιας κακόβουλης χρήσης.

Η Anthropic βρίσκεται μάλιστα στην ιδιαίτερη θέση να αναπτύσσει από τα ισχυρότερα AI models της αγοράς και ταυτόχρονα να προειδοποιεί ότι η ίδια η αγορά πρέπει να κινηθεί πιο αργά.

Τι σημαίνει

Η πρόταση του Dario Amodei δεν ισοδυναμεί με ένα γενικό moratorium στην τεχνητή νοημοσύνη.

Πρόκειται περισσότερο για προσπάθεια να δημιουργηθούν «φρένα» σε συγκεκριμένα σημεία της frontier development διαδικασίας, ιδιαίτερα όταν νέα μοντέλα αποκτούν δυνατότητες που μπορεί να δημιουργήσουν σημαντικούς κινδύνους. Το μεγάλο πρόβλημα είναι τα κίνητρα.

Οι AI εταιρείες ανταγωνίζονται για χρήστες, επενδύσεις, ταλέντο και τεχνολογική πρωτοκαθεδρία. Καμία δεν θέλει να επιβραδύνει μόνη της αν πιστεύει ότι οι ανταγωνιστές της θα συνεχίσουν να προχωρούν.

Αυτός είναι και ο λόγος που η συζήτηση για AI safety μεταφέρεται πλέον από τα safeguards κάθε μεμονωμένου model σε ένα πολύ μεγαλύτερο ερώτημα: αν μπορεί να υπάρξει συντονισμός σε μια βιομηχανία όπου όλοι έχουν οικονομικό και γεωπολιτικό κίνητρο να φτάσουν πρώτοι στην επόμενη μεγάλη ανακάλυψη.

Ο CEO της Anthropic υποστηρίζει ότι αυτός ο συντονισμός πρέπει να αρχίσει τώρα – πριν η τεχνολογία γίνει τόσο ισχυρή ώστε η συζήτηση για το πότε έπρεπε να μπει φρένο να έρ