Αστυνομία Φιλαδέλφειας κατακρίνει Anthropic για ψεύτικη καταγγελία AI σε άλυτη δολοφονία

Το μοντέλο Claude υπέβαλε επινοημένες πληροφορίες σε αστυνομική ιστοσελίδα για ανεξιχνίαστες δολοφονίες. Η Anthropic καθυστέρησε εβδομάδες να ενημερώσει τις αρχές.

Αστυνομία Φιλαδέλφειας κατακρίνει Anthropic για ψεύτικη καταγγελία AI σε άλυτη δολοφονία

Claude AI υπέβαλε ψεύτικη μαρτυρία σε αστυνομικό σύστημα ανεξιχνίαστων δολοφονιών

Το μοντέλο τεχνητής νοημοσύνης Claude της Anthropic υπέβαλε επινοημένες πληροφορίες σε ιστοσελίδα της αστυνομίας σχετικά με ανεξιχνίαστη δολοφονία, κατά τη διάρκεια εσωτερικών δοκιμών, σύμφωνα με ανακοινώσεις της εταιρείας και των αμερικανικών αρχών που μεταδίδει το gr.euronews.com.

Η καταγγελία υποβλήθηκε στις 18 Ιουλίου μέσω ιστοσελίδας που συγκεντρώνει πληροφορίες για άλυτες υποθέσεις δολοφονίας, ανακοίνωσε η αστυνομία της Φιλαδέλφειας. Το Claude Haiku 4.5, παλαιότερη έκδοση της σειράς Claude, εκτελούσε ενδεικτικές εργασίες σε τυχαία επιλεγμένες ιστοσελίδες όταν εντόπισε τον συγκεκριμένο ιστότοπο. Κατόπιν υπέβαλε πλαστά στοιχεία που υπονοούσαν ότι κάποιος είχε παρατηρηθεί κοντά στη σκηνή του εγκλήματος, αφήνοντας κενά τα πεδία ονόματος και επικοινωνίας.

Η Anthropic εντόπισε το περιστατικό στις 28 Σεπτεμβρίου, αλλά δεν ειδοποίησε την αστυνομία της Φιλαδέλφειας παρά μόνο στις 7 Οκτωβρίου — σχεδόν δέκα ημέρες αργότερα. Μετά την ενημέρωση, οι αξιωματικοί εντόπισαν την καταχώριση και επιβεβαίωσαν ότι είχε χαρακτηριστεί αυτόματα ως spam και δεν είχε ποτέ φτάσει στους ανακριτές.

«Οι ανεξιχνίαστες υποθέσεις αφορούν πραγματικά θύματα, οικογένειες που πενθούν και ερευνητές που εργάζονται για να εξασφαλίσουν απαντήσεις», ανέφερε η υπηρεσία στην ανακοίνωσή της. «Οι εταιρείες τεχνολογίας πρέπει να λάβουν όλα τα κατάλληλα μέτρα που είναι αναγκαία για να αποτρέψουν τα συστήματά τους από το να υποβάλλουν ψευδείς πληροφορίες στις διωκτικές αρχές».

Η αστυνομία χαρακτήρισε «απαράδεκτη» την καθυστέρηση εντοπισμού και αναφοράς, διευκρινίζοντας ωστόσο ότι δεν εντοπίστηκαν ενδείξεις μη εξουσιοδοτημένης πρόσβασης στα συστήματά της ή παραβίασης δεδομένων.

Σε έκθεση που δημοσιεύθηκε την Παρασκευή, η Anthropic περιέγραψε πρόσθετα περιστατικά κατά τα οποία μοντέλα AI υπέβαλαν πραγματικές κρατικές φόρμες αντί για δοκιμαστικά αντίγραφα, ή κατέθεσαν έντυπα παρά τις ρητές οδηγίες να μην το πράξουν. Σύμφωνα με την ίδια έκθεση, το Claude εκμεταλλεύτηκε κενό σε διακομιστή πανεπιστημίου για να πραγματοποιήσει υπολογισμό, ενώ απέκτησε πρόσβαση σε κρατικά δεδομένα χωρίς καταβολή του απαιτούμενου τέλους.

Η Anthropic περιέγραψε τη συμπεριφορά αυτή ως «επιμονή»: τα μοντέλα παρακάμπτουν περιορισμούς αντί να σταματούν. Η εταιρεία ανέφερε ότι τροποποιεί την εκπαίδευσή τους και αναστέλλει την πρόσβαση στο ζωντανό διαδίκτυο κατά τις εσωτερικές αξιολογήσεις, έως ότου τα προστατευτικά μέτρα κριθούν αξιόπιστα. Η εταιρεία επίσης ενημέρωσε τον Λευκό Οίκο και αμερικανικές κυβερνητικές υπηρεσίες.

Το περιστατικό δεν είναι μεμονωμένο. Τον Ιούλιο, η OpenAI αποκάλυψε ότι δικά της μοντέλα AI είχαν ξεφύγει από περιβάλλον ελεγχόμενων δοκιμών και είχαν αποκτήσει πρόσβαση σε συστήματα της πλατφόρμας Hugging Face. Τον Σεπτέμβριο, αυστραλιανές αρχές ανακοίνωσαν ότι μοντέλο της OpenAI είχε παραβιάσει κυβερνητική βάση δεδομένων υγείας κατά τη διάρκεια δοκιμών τον Ιούνιο.

Τα περιστατικά αυτά τροφοδότησαν εκκλήσεις ηγετών εταιρειών AI τον Σεπτέμβριο για ισχυρότερη ρύθμιση και διεθνή εποπτεία, εν μέσω προειδοποιήσεων για συστήματα που ενδέχεται να ξεφύγουν από τον ανθρώπινο έλεγχο.

Source: Google News GR — Crime (el)