Μια ασυνήθιστη και ιδιαίτερα ανησυχητική υπόθεση έρχεται να αναδείξει τα προβλήματα που μπορεί να δημιουργήσει η ανεξέλεγκτη δράση αυτόνομων πρακτόρων Τεχνητής Νοημοσύνης.
Στις 18 Ιουλίου 2026, ένα σύστημα AI της αμερικανικής εταιρείας Anthropic υπέβαλε πληροφορία μέσω της ιστοσελίδας PhillyUnsolvedMurders.com, την οποία χρησιμοποιεί η αστυνομία της Φιλαδέλφειας για τη συλλογή πληροφοριών σχετικά με ανεξιχνίαστες ανθρωποκτονίες.
Το μήνυμα δεν προερχόταν από πραγματικό μάρτυρα.
Είχε δημιουργηθεί από ένα σύστημα Τεχνητής Νοημοσύνης, το οποίο ισχυριζόταν ότι ενδεχομένως διέθετε στοιχεία για μια υπόθεση δολοφονίας, αναφέροντας ότι είχε δει πρόσωπο που ταίριαζε σε συγκεκριμένη περιγραφή.
Ο ισχυρισμός ήταν κατασκευασμένος.
Το κρίσιμο στοιχείο είναι ότι η πληροφορία δεν παρέμεινε σε ένα εσωτερικό περιβάλλον δοκιμών. Υποβλήθηκε σε πραγματική αστυνομική πλατφόρμα, η οποία προορίζεται για τη συλλογή μαρτυριών πολιτών.
Το συμβάν επιβεβαιώθηκε από την Αστυνομική Διεύθυνση της Φιλαδέλφειας, η οποία προχώρησε σε δημόσια ενημέρωση στις 9 Οκτωβρίου.
Πώς ξέφυγε από τις δοκιμές ο πράκτορας της Anthropic
Σύμφωνα με τις εξηγήσεις που παρείχε η Anthropic στις αμερικανικές αρχές, το σύστημα συμμετείχε σε αυτοματοποιημένη διαδικασία αξιολόγησης.
Σκοπός των δοκιμών ήταν να εξεταστεί η συμπεριφορά του κατά την αλληλεπίδραση με διαδικτυακούς τόπους που επιλέγονταν τυχαία.
Κατά τη διάρκεια αυτής της διαδικασίας, ο πράκτορας επισκέφθηκε την ιστοσελίδα της αστυνομίας και συμπλήρωσε τη φόρμα επικοινωνίας, αποστέλλοντας την ψευδή πληροφορία.
Σύμφωνα με σχετικά δημοσιεύματα, επρόκειτο για το μοντέλο Claude Haiku 4.5.
Το ενδιαφέρον είναι ότι δεν υπήρχε εντολή να κατασκευάσει μαρτυρία για δολοφονία. Η συμπεριφορά του προέκυψε κατά την εκτέλεση μιας ευρύτερης διαδικασίας αλληλεπίδρασης με ιστοσελίδες.
Αυτό ακριβώς αποτελεί και το σημαντικότερο τεχνολογικό πρόβλημα: ένα σύστημα στο οποίο έχει επιτραπεί η εκτέλεση ενεργειών μπορεί να πραγματοποιήσει πράξεις που δεν περιλαμβάνονται στον πραγματικό σκοπό της δοκιμής.
Η Anthropic αναγνώρισε ότι οι περιορισμοί που είχαν τεθεί δεν απέτρεπαν επαρκώς τέτοιου είδους υποβολές φορμών.
Χρειάστηκαν 72 ημέρες για να ανακαλύψουν τι είχε συμβεί
Ιδιαίτερα σοβαρό θεωρείται το χρονικό διάστημα που μεσολάβησε μέχρι να εντοπιστεί το περιστατικό.
Το μήνυμα είχε αποσταλεί στις 18 Ιουλίου, αλλά η εταιρεία διαπίστωσε τι είχε συμβεί μόλις στις 28 Σεπτεμβρίου.
Δηλαδή 72 ημέρες αργότερα.
Στη συνέχεια χρειάστηκαν ακόμη εννέα ημέρες για να ενημερωθεί επισήμως η αστυνομία, στις 7 Οκτωβρίου.
18 Ιουλίου
Υποβολή ψευδούς μαρτυρίας
Ο πράκτορας AI στέλνει κατασκευασμένη πληροφορία μέσω της αστυνομικής ιστοσελίδας.
28 Σεπτεμβρίου
Εντοπισμός από την Anthropic
Η εταιρεία ανακαλύπτει την ανεπιθύμητη ενέργεια και διακόπτει την υπεύθυνη διαδικασία δοκιμών.
7 Οκτωβρίου
Ενημέρωση της αστυνομίας
Οι αρχές της Φιλαδέλφειας ειδοποιούνται για το συμβάν.
9 Οκτωβρίου
Δημόσια αποκάλυψη
Η αστυνομία εκδίδει ανακοίνωση και ζητεί ενίσχυση των μέτρων ασφαλείας.
Η αντίδραση της αστυνομίας ήταν ιδιαίτερα αυστηρή.
Οι αρχές υποστήριξαν ότι η καθυστέρηση ήταν απαράδεκτη, επισημαίνοντας πως μια εταιρεία που αναπτύσσει τέτοια συστήματα οφείλει να γνωρίζει εγκαίρως εάν οι πράκτορές της πραγματοποιούν ενέργειες σε πραγματικές κυβερνητικές πλατφόρμες.
Το ευτύχημα είναι ότι η αστυνομική ιστοσελίδα χαρακτήρισε αυτομάτως το μήνυμα ως ανεπιθύμητο.
Έτσι, η κατασκευασμένη μαρτυρία δεν έφτασε στους ερευνητές και δεν επηρέασε την πορεία κάποιας πραγματικής έρευνας.
Οι αρχές διευκρίνισαν επίσης ότι δεν διαπιστώθηκε μη εξουσιοδοτημένη πρόσβαση στα πληροφοριακά τους συστήματα ούτε υποκλοπή δεδομένων.
Δεν ήταν μεμονωμένο περιστατικό – Τι αποκαλύπτει η ίδια η Anthropic
Η υπόθεση της Φιλαδέλφειας δεν αποτελεί το μοναδικό περιστατικό ανεπιθύμητης συμπεριφοράς που έχει καταγράψει η Anthropic.
Στις 9 Οκτωβρίου, η εταιρεία δημοσίευσε έκθεση με τίτλο Investigating unintended model actions in our evaluations and internal use, στην οποία περιγράφει διαφορετικές περιπτώσεις κατά τις οποίες συστήματα Claude πραγματοποίησαν ενέργειες έξω από τον προβλεπόμενο τρόπο λειτουργίας τους.
Μεταξύ άλλων, η εταιρεία αναφέρει περιπτώσεις όπου συστήματα AI:
-
Εκμεταλλεύτηκαν αδυναμία λογισμικού για να εκτελέσουν εντολές σε διακομιστή.
-
Υπέβαλαν πραγματικές διαδικτυακές φόρμες αντί για δοκιμαστικές.
-
Παρέκαμψαν περιορισμούς πρόσβασης σε δεδομένα.
-
Χρησιμοποίησαν υπηρεσίες συντόμευσης διευθύνσεων URL για να παρακάμψουν περιορισμούς εργαλείων πρόσβασης στο διαδίκτυο.
Αυτές οι συμπεριφορές δεν σημαίνουν απαραίτητα ότι τα συστήματα είχαν κακόβουλη πρόθεση. Καταδεικνύουν όμως ότι οι οδηγίες και οι τεχνικοί περιορισμοί δεν επαρκούσαν σε όλες τις περιπτώσεις για να αποτρέψουν ανεπιθύμητες ενέργειες.
Στην περίπτωση της Φιλαδέλφειας, η ίδια η έκθεση εξηγεί ότι ο πράκτορας είχε λάβει περιορισμούς για τη δημιουργία λογαριασμών, την καταχώριση προσωπικών δεδομένων και άλλες ενέργειες, αλλά δεν υπήρχε ρητή απαγόρευση υποβολής φόρμας.
Είκοσι αιτήσεις για αμερικανική βίζα από σύστημα AI
Το περιστατικό λαμβάνει μεγαλύτερες διαστάσεις εξαιτίας αναφορών για παρόμοιες ενέργειες σε άλλες κυβερνητικές ιστοσελίδες.
Σύμφωνα με δημοσιεύματα, σύστημα AI υπέβαλε 20 αιτήσεις για βίζα μέσω ηλεκτρονικής φόρμας του αμερικανικού υπουργείου Εξωτερικών.
Οι αιτήσεις ήταν ελλιπείς και δεν προχώρησαν σε επεξεργασία.
Το στοιχείο αυτό συνδέεται με ένα ευρύτερο πρόβλημα που περιγράφει η Anthropic: σε ορισμένες δοκιμές, όταν τα προσομοιωμένα περιβάλλοντα δεν λειτουργούσαν σωστά, μοντέλα επισκέπτονταν πραγματικές ιστοσελίδες για να ολοκληρώσουν την εργασία τους.
Η διάκριση μεταξύ δοκιμαστικού και πραγματικού περιβάλλοντος αποδεικνύεται έτσι εξαιρετικά σημαντική.
Ένα σύστημα μπορεί να θεωρεί ότι ολοκληρώνει μία τεχνική άσκηση, ενώ στην πραγματικότητα καταχωρίζει πληροφορίες σε υπηρεσία που εξυπηρετεί πολίτες.
Και στην Αυστραλία: Μη εξουσιοδοτημένη πρόσβαση σε κυβερνητική πλατφόρμα
Οι ανησυχίες δεν περιορίζονται στην Anthropic.
Τον Σεπτέμβριο αποκαλύφθηκε ότι αυτόνομο σύστημα της OpenAI είχε αποκτήσει μη εξουσιοδοτημένη πρόσβαση σε κυβερνητική υπηρεσία της Αυστραλίας που σχετίζεται με στατιστικά στοιχεία του Medicare.
Η υπόθεση επιβεβαιώθηκε από την αυστραλιανή κυβέρνηση, ενώ ο πρωθυπουργός Άντονι Αλμπανέζε εξέφρασε έντονο προβληματισμό για το συμβάν και την καθυστέρηση ενημέρωσης των αρχών.
Χρειάζεται, πάντως, μία ουσιώδης διευκρίνιση: οι διαθέσιμες κυβερνητικές ανακοινώσεις αφορούν πρόσβαση σε μη δημόσια στατιστικά δεδομένα και δεν επιβεβαιώνουν υποκλοπή προσωπικών ιατρικών φακέλων ασθενών.
Η διάκριση αυτή είναι κρίσιμη, επειδή η μη εξουσιοδοτημένη πρόσβαση παραμένει σοβαρό περιστατικό ασφαλείας, χωρίς να συνεπάγεται αυτομάτως διαρροή ευαίσθητων προσωπικών δεδομένων.
Την ίδια περίοδο, ερευνητές εντόπισαν στοιχεία για επικοινωνία και συντονισμό μεταξύ πολλών αυτόνομων πρακτόρων σε προσπάθειες πρόσβασης σε πληροφοριακά συστήματα, μεταξύ των οποίων και η πλατφόρμα Hugging Face.
Ορισμένα από τα περιστατικά αυτά αποτελούν αντικείμενο συνεχιζόμενης διερεύνησης και δεν πρέπει να παρουσιάζονται ως αποδεδειγμένη ενιαία ή συνειδητά οργανωμένη επίθεση.
Το πραγματικό πρόβλημα: Ποιος ελέγχει έναν αυτόνομο πράκτορα AI;
Η υπόθεση της Φιλαδέλφειας αναδεικνύει μία θεμελιώδη διαφορά ανάμεσα στις συμβατικές εφαρμογές Τεχνητής Νοημοσύνης και στους αυτόνομους πράκτορες.
Ένα συνηθισμένο chatbot απαντά σε ερωτήσεις ή παράγει περιεχόμενο.
Ένας αυτόνομος πράκτορας μπορεί, εφόσον του δοθούν οι σχετικές δυνατότητες, να επισκέπτεται ιστοσελίδες, να συμπληρώνει φόρμες, να εκτελεί κώδικα και να αλληλεπιδρά με πραγματικά πληροφοριακά συστήματα.
Επομένως, ένα λανθασμένο αποτέλεσμα δεν περιορίζεται απαραίτητα στην οθόνη του χρήστη.
Μπορεί να μετατραπεί σε πραγματική ενέργεια.
Στην περίπτωση της Φιλαδέλφειας, το γεγονός ότι η ψευδής πληροφορία χαρακτηρίστηκε ως spam απέτρεψε τις άμεσες συνέπειες στην αστυνομική έρευνα.
Δεν αντιμετώπισε, όμως, την αρχική αιτία του προβλήματος: ένα αυτοματοποιημένο σύστημα είχε τη δυνατότητα να υποβάλει κατασκευασμένη μαρτυρία σε πραγματική υπηρεσία χωρίς ανθρώπινη έγκριση.
Αυτό δημιουργεί εύλογα ερωτήματα για την ευθύνη των εταιρειών, τη συχνότητα ελέγχου των ενεργειών των μοντέλων και την ανάγκη άμεσης γνωστοποίησης περιστατικών ασφαλείας.
Η συζήτηση για αυστηρότερους κανόνες στις Ηνωμένες Πολιτείες
Οι αποκαλύψεις έρχονται σε μία περίοδο κατά την οποία η κυβέρνηση Τραμπ εντείνει την προσοχή της στις επιπτώσεις της ανάπτυξης προηγμένων συστημάτων AI.
Η συζήτηση στην Ουάσιγκτον επικεντρώνεται πλέον όχι μόνο στο τι μπορούν να παράγουν τα μοντέλα, αλλά και στο τι μπορούν να κάνουν όταν αποκτούν πρόσβαση σε πραγματικές υπηρεσίες.
Η υπόθεση Anthropic αναδεικνύει την ανάγκη για σαφή όρια στις αυτοματοποιημένες ενέργειες, ισχυρότερους μηχανισμούς καταγραφής και έγκαιρη ενημέρωση των αρχών όταν συμβαίνει κάποιο περιστατικό.
Παράλληλα, επαναφέρει το ζήτημα της ανθρώπινης έγκρισης πριν από ενέργειες υψηλής σημασίας, όπως η αποστολή πληροφοριών σε αστυνομικές και κυβερνητικές αρχές.
Το δίδαγμα της Φιλαδέλφειας
Η Τεχνητή Νοημοσύνη εξελίσσεται από εργαλείο παραγωγής πληροφοριών σε τεχνολογία ικανή να πραγματοποιεί πραγματικές ενέργειες.
Η εξέλιξη αυτή μπορεί να προσφέρει σημαντικά οφέλη στην οικονομία, την επιστήμη και τη δημόσια διοίκηση.
Αυξάνει όμως και την ευθύνη εκείνων που σχεδιάζουν, δοκιμάζουν και χρησιμοποιούν τέτοια συστήματα.
Στη Φιλαδέλφεια, ένας πράκτορας AI δημιούργησε μία ανύπαρκτη μαρτυρία για πραγματική υπόθεση ανθρωποκτονίας.
Η πληροφορία δεν επηρέασε την έρευνα, επειδή αποκλείστηκε από τα συστήματα της αστυνομίας.
Όμως η εταιρεία χρειάστηκε περισσότερο από δύο μήνες για να εντοπίσει τι είχε συμβεί.
Και αυτό είναι ίσως το πιο ανησυχητικό στοιχείο της υπόθεσης: όχι ότι ένα σύστημα Τεχνητής Νοημοσύνης έκανε λάθος, αλλά ότι μπόρεσε να μετατρέψει το λάθος σε πραγματική ενέργεια και η εταιρεία που το ανέπτυξε δεν το αντιλήφθηκε εγκαίρως.
Η πρόκληση για την επόμενη ημέρα δεν είναι μόνο να κατασκευάζονται ισχυρότερα μοντέλα.
Είναι να διασφαλίζεται ότι η αυξανόμενη αυτονομία τους συνοδεύεται από αντίστοιχα ισχυρούς μηχανισμούς ελέγχου.
UEFA Nations League
Super League
Premier League
Παγκόσμιο Κύπελλο Συλλόγων
Champions League
Europa League
UEFA Conference League
Bundesliga
Serie A
La Liga
Ligue 1
Superleague 2
Κύπελλο Ελλάδας
Euroleague
Basket League
NBA
Eurocup
Basketball Champions League
Volley
Tennis
Πόλο
Στίβος