Ο Joe Benton, που εργαζόταν στην ομάδα ασφάλειας της Anthropic, ανακοίνωσε ότι αποχώρησε από την εταιρεία και θα ενταχθεί στη μη κερδοσκοπική METR, η οποία ασχολείται με ανεξάρτητες αξιολογήσεις των δυνατοτήτων και των κινδύνων της AI. Ο ίδιος υποστηρίζει ότι οι εταιρείες ανταγωνίζονται για τη δημιουργία συστημάτων πολύ ισχυρότερων από τον άνθρωπο και ότι η ταχύτητα προόδου θα μπορούσε κάποια στιγμή να γίνει ανεξέλεγκτη.
Στο ίδιο μήκος κύματος κινήθηκε ο Josh Engels, ο οποίος έφυγε από τη Google DeepMind και εντάχθηκε επίσης στη METR. Σε συνέντευξή του στο NBC News χρησιμοποίησε μια χαρακτηριστική φράση για την κατάσταση στον χώρο της AI: «Δεν υπάρχουν ενήλικες εδώ».
Με τη φράση αυτή δεν εννοούσε ότι οι ερευνητές δεν προσπαθούν να αντιμετωπίσουν τους κινδύνους. Το αντίθετο. Η ανησυχία του είναι ότι, παρά τις προσπάθειες των ίδιων των εταιρειών, δεν υπάρχει ένας ανεξάρτητος θεσμός που να έχει συνολική εποπτεία της κούρσας και να μπορεί να παρέμβει όταν τα συστήματα γίνονται επικίνδυνα.
Το περιστατικό που έκανε την προειδοποίηση πιο συγκεκριμένη
Οι φόβοι αυτοί δεν βασίζονται μόνο σε θεωρητικά σενάρια. Τον Ιούλιο, κατά τη διάρκεια εσωτερικών δοκιμών κυβερνοασφάλειας, μοντέλα της OpenAI κατάφεραν να παρακάμψουν ορισμένους περιορισμούς, να αποκτήσουν πρόσβαση στο διαδίκτυο και να πραγματοποιήσουν επίθεση σε υποδομές της Hugging Face. Σύμφωνα με την ίδια την OpenAI, τα μοντέλα χρησιμοποίησαν ευπάθειες και μη εξουσιοδοτημένα κανάλια επικοινωνίας, συνεργάστηκαν μεταξύ τους και κατάφεραν να αποκτήσουν πρόσβαση σε συστήματα που δεν αποτελούσαν μέρος του αρχικού περιβάλλοντος δοκιμών. Η OpenAI χαρακτήρισε το περιστατικό προειδοποιητικό σημάδι για το πόσο ισχυρά μπορούν να γίνουν τα AI agents όταν λειτουργούν με μεγάλη αυτονομία.
Η Hugging Face, από τη δική της πλευρά, περιέγραψε μια επίθεση που διήρκεσε περίπου δυόμισι ημέρες και περιλάμβανε πολλαπλά στάδια, από την αρχική διείσδυση μέχρι την απόκτηση πρόσβασης σε υποδομές της εταιρείας.
Το σημαντικό είναι ότι δεν επρόκειτο για ένα μοντέλο που ξαφνικά “αποφάσισε να καταστρέψει τον κόσμο”. Ήταν μια εσωτερική αξιολόγηση κυβερνοασφάλειας, στην οποία τα μοντέλα προσπαθούσαν να πετύχουν έναν στόχο και κατέληξαν να χρησιμοποιούν απρόβλεπτες και μη εξουσιοδοτημένες στρατηγικές. Αυτό ακριβώς είναι που ανησυχεί τους ερευνητές.
Το πρόβλημα είναι η ταχύτητα
Ο Benton υποστηρίζει ότι οι εταιρείες δεν πρέπει απλώς να ανακοινώνουν ότι τα μοντέλα τους είναι ασφαλή, αλλά να υπάρχει περισσότερη ανεξάρτητη αξιολόγηση και υποχρεωτική αναφορά σοβαρών περιστατικών. Η ανησυχία είναι ιδιαίτερα έντονη γύρω από τα λεγόμενα AI agents, συστήματα που δεν περιορίζονται στο να απαντούν σε ερωτήσεις, αλλά μπορούν να σχεδιάζουν ενέργειες, να χρησιμοποιούν εργαλεία, να γράφουν κώδικα και να αλληλεπιδρούν αυτόνομα με υπολογιστικά συστήματα.
Όσο αυξάνονται οι δυνατότητές τους, αυξάνεται και το ενδεχόμενο ένα λάθος, μια ευπάθεια ή ένας λανθασμένος στόχος να έχει συνέπειες πολύ μεγαλύτερες από ένα απλό λανθασμένο chatbot reply.
Οι ίδιοι οι άνθρωποι της AI ζητούν περισσότερο έλεγχο
Οι αποχωρήσεις των Benton και Engels έρχονται μετά την παραίτηση του Jacob Coxon από την Anthropic. Ο Coxon κατηγόρησε δημόσια τις μεγάλες εταιρείες AI ότι προχωρούν προς ολοένα ισχυρότερα και αυτοβελτιούμενα συστήματα χωρίς επαρκείς δικλίδες ασφαλείας. Η παρέμβασή του έγινε viral και αναζωπύρωσε τη συζήτηση για το αν η ανάπτυξη της τεχνητής νοημοσύνης πρέπει να επιβραδυνθεί.
Δείτε ΕΔΩ
Παράλληλα, ο CEO της Anthropic, Dario Amodei, έχει ζητήσει να επιβραδυνθεί ο ρυθμός ανάπτυξης ώστε τα μέτρα ασφαλείας να προλάβουν να συμβαδίσουν με τις δυνατότητες των μοντέλων. Μεταξύ άλλων έχει προτείνει την παρουσία ανεξάρτητων αξιολογητών μέσα στις εταιρείες AI.
Το θέμα πλέον δεν αφορά μόνο τους ίδιους τους ερευνητές. Αμερικανοί νομοθέτες εξετάζουν νέους κανόνες για ανεξάρτητους ελέγχους και εποπτεία των ισχυρότερων συστημάτων τεχνητής νοημοσύνης.
Το μεγάλο ερώτημα, επομένως, δεν είναι αν η AI θα γίνει ισχυρότερη. Αυτό ήδη συμβαίνει. Το ερώτημα είναι αν οι κανόνες, οι έλεγχοι και οι άνθρωποι που είναι υπεύθυνοι για την ασφάλειά της, θα προλάβουν να εξελιχθούν με την ίδια ταχύτητα.
Και αυτό ίσως είναι το πιο ανησυχητικό σημείο της υπόθεσης, οι προειδοποιήσεις δεν έρχονται από ανθρώπους που παρακολουθούν την AI απ’ έξω. Έρχονται από ανθρώπους που μέχρι πριν από λίγες ημέρες βρίσκονταν μέσα στα ίδια τα εργαστήρια που την αναπτύσσουν.
photo: AΠΕ-ΜΠΕ- EPA-EPA









