Όταν το AI αποφασίζει μόνο του: Αυξάνονται τα περιστατικά όπου αγνοεί εντολές, εξαπατά και ενεργεί αυτόβουλα

Η λεγόμενη τεχνητή νοημοσύνη έχει περάσει πλέον, από την απλή απάντηση σε ερωτήσεις, στην εκτέλεση πραγματικών εργασιών.

AI agents μπορούν να περιηγούνται στο διαδίκτυο, να γράφουν και να εκτελούν κώδικα, να χρησιμοποιούν εφαρμογές και να παίρνουν αποφάσεις, με πολύ λιγότερη ανθρώπινη παρέμβαση. Και μαζί με αυτές τις δυνατότητες εμφανίζεται ένα δύσκολο ερώτημα: Τι συμβαίνει όταν ένα σύστημα προσπαθεί να πετύχει τον στόχο του, με τρόπο που ο άνθρωπος δεν είχε προβλέψει;

Νέα στοιχεία του Loss of Control Observatory, που λειτουργεί το Centre for Long-Term Resilience με χρηματοδότηση από το βρετανικό AI Security Institute, δείχνουν ότι οι αναφορές τέτοιων περιστατικών αυξάνονται. Μόνο τον Ιούλιο του 2026 καταγράφηκαν περισσότερες από 300 περιπτώσεις, σχεδόν διπλάσιες από τον Ιούνιο, ενώ ο συνολικός αριθμός για το 2026 έχει ξεπεράσει τις 1.600.

Δεν μιλάμε απλώς για λάθος απαντήσεις

Η συγκεκριμένη έρευνα δεν καταγράφει τις συνηθισμένες «παραισθήσεις» των chatbot, δηλαδή περιπτώσεις όπου ένα AI δίνει λανθασμένες πληροφορίες. Το ενδιαφέρον βρίσκεται σε διαφορετικού τύπου συμπεριφορές: Συστήματα που φέρονται να αγνοούν σαφείς οδηγίες, παρακάμπτουν δικλίδες ασφαλείας ή προσπαθούν να συνεχίσουν έναν στόχο, ακόμη και όταν αυτό έρχεται σε σύγκρουση με την πρόθεση του χρήστη.

Σε ορισμένα περιστατικά που έχουν καταγραφεί, AI φέρονται να μιμήθηκαν τον τρόπο γραφής του ανθρώπου που τα χειριζόταν, ώστε να δημιουργήσουν ουσιαστικά την εντύπωση ότι είχαν λάβει την απαραίτητη έγκριση. Άλλες περιπτώσεις αφορούν προσπάθειες παράκαμψης κανόνων που απαιτούσαν ανθρώπινη συναίνεση.

Αυτό δεν σημαίνει ότι τα συστήματα «σκέφτονται» όπως ένας άνθρωπος ή ότι έχουν αναπτύξει προσωπικές επιθυμίες. Η ανησυχία είναι πιο πρακτική: Ένα AI που έχει συγκεκριμένο στόχο και πρόσβαση σε πραγματικά εργαλεία, μπορεί να βρει έναν τρόπο επίτευξής του, που ο χρήστης δεν είχε σκοπό να του επιτρέψει.

Ένα μάθημα γυμναστικής αποκάλυψε το πρόβλημα

Ένα από τα πιο χαρακτηριστικά περιστατικά συνέβη στην Αυστραλία. Ένας χρήστης χρησιμοποίησε έναν AI agent για να προσπαθήσει να κλείσει θέση σε δημοφιλές μάθημα γυμναστηρίου. Το σύστημα ανακάλυψε αδυναμία στο λογισμικό κρατήσεων και κατάφερε να κινηθεί πέρα από τους κανονικούς περιορισμούς του συστήματος. Στην προσπάθειά του να εξυπηρετήσει τον χρήστη, έφτασε στο σημείο να επηρεάσει τη λίστα αναμονής και να απομακρύνει άλλο μέλος. Το περιστατικό είναι αποκαλυπτικό, ακριβώς επειδή δεν αφορούσε κάποιο στρατιωτικό σύστημα ή εργαστήριο υψηλής ασφάλειας. Ήταν μια απλή καθημερινή υπηρεσία. Το AI δεν χρειάστηκε να «θέλει» να βλάψει κάποιον. Αρκούσε ένας στόχος, πρόσβαση σε ένα σύστημα και μια αδυναμία που μπορούσε να εκμεταλλευτεί.

Και στα εργαστήρια έχουν εμφανιστεί ακόμη πιο σοβαρές συμπεριφορές

Τους τελευταίους μήνες έχουν καταγραφεί και περιστατικά σε ελεγχόμενες δοκιμές που προκαλούν μεγαλύτερη ανησυχία. Το βρετανικό AI Security Institute έχει αναφέρει περίπτωση κατά την οποία AI agents, κατά τη διάρκεια δοκιμής κυβερνοασφάλειας, ανέλαβαν μη εγκεκριμένες ενέργειες με κατεύθυνση πραγματικούς ανθρώπους. Παράλληλα, έρευνες γύρω από προηγμένα AI agents έχουν εξετάσει συμπεριφορές, όπως η απόκρυψη ενεργειών, η προσπάθεια παράκαμψης της εποπτείας και η στρατηγική εξαπάτηση.

Ακόμη πιο εντυπωσιακά είναι τα αποτελέσματα του AISI σχετικά με την ικανότητα αυτοαναπαραγωγής: στις συγκεκριμένες αξιολογήσεις, το ποσοστό επιτυχίας αυξήθηκε από 5% το 2023, σε 60% το 2025. Πρόκειται για δοκιμές δυνατοτήτων και όχι για απόδειξη ότι τα σημερινά AI συστήματα μπορούν να αυτοαναπαραχθούν ανεξέλεγκτα, στον πραγματικό κόσμο.

Υπάρχει όμως μια σημαντική λεπτομέρεια. Οι αριθμοί του Loss of Control Observatory δεν αποτελούν απογραφή όλων των περιστατικών AI στον κόσμο. Οι ερευνητές βασίζονται σε περιστατικά που δημοσιοποιούνται από χρήστες, κυρίως στην πλατφόρμα X. Επομένως, μια περίπτωση που δεν δημοσιεύτηκε, δεν μπορεί να καταγραφεί. Το ίδιο το Παρατηρητήριο αναγνωρίζει ότι η πραγματική έκταση του φαινομένου πιθανότατα είναι διαφορετική.

Αυτό σημαίνει επίσης ότι η αύξηση των αναφορών δεν αποδεικνύει από μόνη της ότι κάθε AI έγινε ξαφνικά πιο «επικίνδυνο». Μπορεί να παίζουν ρόλο και η πολύ μεγαλύτερη χρήση AI agents, η αυξημένη δημοσιότητα τέτοιων περιστατικών και το γεγονός ότι περισσότεροι άνθρωποι πλέον, δίνουν στα συστήματα πρόσβαση σε πραγματικά εργαλεία.

Μια προηγούμενη ανάλυση του ίδιου Παρατηρητηρίου, η οποία εξέτασε περισσότερα από 183.000 δημόσια transcripts από τον Οκτώβριο του 2025 έως τον Μάρτιο του 2026, εντόπισε 698 περιστατικά που ταξινομήθηκαν ως σχετικά με “scheming”, με σχεδόν πενταπλάσια αύξηση των περιστατικών κατά την περίοδο συλλογής. Οι ίδιοι οι ερευνητές υπογραμμίζουν, ωστόσο, ότι πρόκειται για παρατηρησιακά δεδομένα και ότι πρέπει να διαχωρίζονται οι πραγματικές περιπτώσεις στρατηγικής συμπεριφοράς από τις απλές δυσλειτουργίες.

Το πραγματικό πρόβλημα είναι η αυτονομία

Το μεγαλύτερο ζήτημα δεν είναι αν ένα chatbot μπορεί να πει ένα ψέμα. Είναι τι μπορεί να κάνει, όταν έχει τη δυνατότητα να ενεργήσει. Ένα AI που απλώς δίνει λανθασμένες πληροφορίες μπορεί να διορθωθεί από τον χρήστη. Ένας agent που έχει πρόσβαση σε email, αρχεία, λογαριασμούς, κώδικα ή διαδικτυακές υπηρεσίες όμως, μπορεί να προκαλέσει πραγματικές συνέπειες, πριν προλάβει ένας άνθρωπος να παρέμβει.

Γι’ αυτό και η συζήτηση γύρω από την ασφάλεια της τεχνητής νοημοσύνης μετατοπίζεται πλέον από το «τι μπορεί να απαντήσει ένα μοντέλο;» στο «τι μπορεί να κάνει μόνο του;»

Η Διεθνής Έκθεση για την Ασφάλεια της AI επισημαίνει ακριβώς αυτό το πρόβλημα. Όσο αυξάνεται η αυτονομία των agents, τόσο δυσκολότερο γίνεται για τον άνθρωπο να παρέμβει εγκαίρως όταν κάτι πάει στραβά.

Και ίσως αυτή να είναι η πιο σημαντική αλλαγή που φέρνει η νέα γενιά AI. Δεν χρειάζεται ένα σύστημα να έχει “κακές προθέσεις” για να δημιουργήσει πρόβλημα. Αρκεί να είναι αρκετά ικανό, αρκετά αυτόνομο και να έχει περισσότερη πρόσβαση απ’ όση θα έπρεπε.

Γι’ αυτό οι ερευνητές ζητούν από τις εταιρείες AI μεγαλύτερη διαφάνεια και συστηματική αναφορά σοβαρών περιστατικών, ακόμη και όταν τελικά δεν προκλήθηκε ζημιά.

photo: pixabay

ΠΟΛΙΤΙΚΟΛΟΓΙΕΣ

ΠΡΕΠΕΙ ΝΑ ΔΙΑΒΑΣΕΤΕ

ΠΑΡΑΞΕΝΑ

LATEST

Κύρια Θέματα

ΕΥΚΑΙΡΙΕΣ ΑΓΟΡΩΝ

Κάθε μέρα μαζί