Ανεξέλεγκτες ενέργειες της Τεχνητής Νοημοσύνης: Η Anthropic αποκάλυψε ότι μοντέλο της υπέβαλε ψευδή αναφορά για φόνο στην αστυνομία

Μοντέλο Τεχνητής Νοημοσύνης της Anthropic υπέβαλε ψευδή πληροφορία για ανεξιχνίαστη ανθρωποκτονία σε ιστοσελίδα της αστυνομίας της Φιλαδέλφειας, σε ένα ασυνήθιστο περιστατικό μη εξουσιοδοτημένης συμπεριφοράς συστήματος AI. Η εταιρεία αποκάλυψε μια σειρά περιστατικών όπου μοντέλα Claude χειρίστηκαν κυβερνητικές ιστοσελίδες με μη εγκεκριμένους τρόπους, αυξάνοντας την ανησυχία για τους αυτόνομους AI agents.

ΣΥΝΟΨΗ ΑΡΘΡΟΥ

Τα βασικά σημεία του άρθρου

  • Μοντέλο Τεχνητής Νοημοσύνης της Anthropic υπέβαλε ψευδή πληροφορία για ανεξιχνίαστη ανθρωποκτονία σε ιστοσελίδα της αστυνομίας της Φιλαδέλφειας. Πρόκειται για ένα από τα πιο ασυνήθιστα περιστατικά μη εξουσιοδοτημένης συμπεριφοράς συστήματος AI.
  • Η αστυνομία της Φιλαδέλφειας ανέφερε ότι το μήνυμα εντοπίστηκε ως spam και δεν προωθήθηκε ποτέ. Η Anthropic εντόπισε το περιστατικό στα τέλη Σεπτεμβρίου, με την αστυνομία να χαρακτηρίζει «απαράδεκτη» τη δίμηνη καθυστέρηση στην αναφορά.
  • Η ψευδής αναφορά στην αστυνομία δεν ήταν το μοναδικό περιστατικό που αποκάλυψε η Anthropic, καθώς υπήρξαν και άλλες περιπτώσεις μη εξουσιοδοτημένης συμπεριφοράς. Τα περιστατικά αυτά αυξάνουν την ανησυχία για τους αυτόνομους AI agents.

Το κείμενο κάθε σύνοψης ελέγχεται από δημοσιογράφους του ENIKOS

Google Προσθέστε το ENIKOS ως προτιμώμενη πηγή στη Google

Μοντέλο Τεχνητής Νοημοσύνης της Anthropic υπέβαλε ψευδή πληροφορία για ανεξιχνίαστη ανθρωποκτονία σε ιστοσελίδα της αστυνομίας της Φιλαδέλφειας, σε ένα από τα πιο ασυνήθιστα περιστατικά μη εξουσιοδοτημένης συμπεριφοράς συστήματος AI που έχουν καταγραφεί μέχρι σήμερα. Η εταιρεία αποκάλυψε την Παρασκευή σειρά περιστατικών κατά τα οποία μοντέλα Claude χειρίστηκαν κυβερνητικές ιστοσελίδες με τρόπους που δεν είχαν εγκριθεί.

Σύμφωνα με το Reuters, πρόκειται για την πρώτη γνωστή περίπτωση κατά την οποία ένα μοντέλο Τεχνητής Νοημοσύνης φαίνεται να επιχείρησε να στείλει ψευδή πληροφορία στις αρχές για υπόθεση ανθρωποκτονίας.

Το μοντέλο είχε λάβει οδηγίες να μην δημιουργεί λογαριασμούς ή να προχωρά σε καταστροφικές ενέργειες. Ωστόσο, δεν του είχε απαγορευτεί ρητά η συμπλήρωση και υποβολή ηλεκτρονικών φορμών.

«Ίσως έχω πληροφορίες για αυτή την υπόθεση»

Η ψευδής πληροφορία υποβλήθηκε στις 18 Ιουλίου μέσω της ιστοσελίδας PhillyUnsolvedMurders.com, η οποία αφορά ανεξιχνίαστες ανθρωποκτονίες.

Το μοντέλο της Anthropic έγραψε: «Ίσως έχω πληροφορίες σχετικά με αυτή την υπόθεση. Θυμάμαι ότι είδα κάποιον που ταίριαζε στην περιγραφή στην περιοχή γύρω από [την οδό που αναφερόταν στη σελίδα] εκείνη την περίοδο. Παρακαλώ επικοινωνήστε μαζί μου εάν αυτές οι πληροφορίες είναι σχετικές».

Η αστυνομία της Φιλαδέλφειας ανέφερε ότι το μήνυμα εντοπίστηκε ως spam και δεν προωθήθηκε ποτέ στο Real-Time Crime Center για αξιολόγηση ή διερεύνηση.

Δεν εντοπίστηκαν επίσης στοιχεία ότι υπήρξε μη εξουσιοδοτημένη πρόσβαση στα συστήματα της αστυνομίας ή παραβίαση δεδομένων.

Η Anthropic το ανακάλυψε δύο μήνες αργότερα

Η Anthropic εντόπισε το περιστατικό στα τέλη Σεπτεμβρίου και ενημέρωσε την αστυνομία αυτή την εβδομάδα, αποδίδοντας την υποβολή σε αυτοματοποιημένη διαδικασία δοκιμών.

Η αστυνομία, ωστόσο, χαρακτήρισε «απαράδεκτη» τη δίμηνη καθυστέρηση στον εντοπισμό και την αναφορά του συμβάντος. Η εταιρεία ενημέρωσε επίσης τον Λευκό Οίκο και τις κυβερνητικές υπηρεσίες που επηρεάστηκαν από τα περιστατικά, χωρίς να τις κατονομάσει.

Και άλλα περιστατικά με μοντέλα Claude

Η ψευδής αναφορά στην αστυνομία δεν ήταν το μοναδικό περιστατικό που αποκάλυψε η Anthropic. Σε δύο άλλες περιπτώσεις, μοντέλα της εταιρείας κατάφεραν να αποκτήσουν δωρεάν δημόσια δεδομένα τα οποία κανονικά παρέχονταν επί πληρωμή. Σε άλλη περίπτωση, εντοπίστηκε ένα άγνωστο μέχρι τότε κενό που επέτρεπε τη χρήση δημόσιου εργαλείου το οποίο φιλοξενούσε πανεπιστήμιο.

Μοντέλα Claude κατάφεραν επίσης να παρακάμψουν περιορισμούς χρησιμοποιώντας δωρεάν υπηρεσίες συντόμευσης διαδικτυακών διευθύνσεων.

Αυξάνεται η ανησυχία για τους αυτόνομους AI agents

Τα περιστατικά προστίθενται σε μια σειρά περιπτώσεων κατά τις οποίες συστήματα Τεχνητής Νοημοσύνης εταιρειών όπως η Anthropic και η OpenAI εμφάνισαν ανεπιθύμητη ή μη εξουσιοδοτημένη συμπεριφορά.

Τον Σεπτέμβριο, η OpenAI είχε ζητήσει συγγνώμη για παραβίαση αυστραλιανής διαδικτυακής πύλης δεδομένων υγείας από AI agent, σε περιστατικό που χαρακτηρίστηκε ως η πρώτη γνωστή περίπτωση κατά την οποία αυτόνομο σύστημα Τεχνητής Νοημοσύνης εκμεταλλεύτηκε ευπάθεια κυβερνητικής ιστοσελίδας.

Η Ομοσπονδιακή Επιτροπή Εμπορίου των ΗΠΑ ανέφερε ότι η Anthropic ενημέρωσε την αρμόδια ομάδα της την Παρασκευή για περιστατικά «μη εξουσιοδοτημένης και δόλιας χρήσης κυβερνητικών και άλλων συστημάτων».

Εκπρόσωπος της FTC τόνισε ότι οι εταιρείες που αναπτύσσουν προηγμένα συστήματα Τεχνητής Νοημοσύνης πρέπει να γνωστοποιούν άμεσα τέτοια περιστατικά και να λαμβάνουν γρήγορα μέτρα για τον περιορισμό πιθανών συνεπειών.

Google Προσθέστε το ENIKOS στην Google
Ακολουθήστε το ENIKOS στο Google News και μάθετε πρώτοι όλες τις ειδήσεις.