Για πρώτη φορά, η Google επιβεβαίωσε ότι το μοντέλο τεχνητής νοημοσύνης της, Gemini, παραβίασε τον Μάιο τα συστήματα ασφαλείας τριών άλλων εταιρειών. Οι κυβερνοεπιθέσεις σημειώθηκαν κατά τη διάρκεια αξιολόγησης κυβερνοασφάλειας από την εταιρεία ασφάλειας τεχνητής νοημοσύνης Irregular.
Η Irregular, μια startup με έδρα το Ισραήλ που εξετάζει την ασφάλεια προηγμένων συστημάτων τεχνητής νοημοσύνης, βρέθηκε επίσης στο επίκεντρο ορισμένων από τις πρόσφατες παραβιάσεις τρίτων φορέων από μοντέλα της OpenAI και της Anthropic, μεταξύ των οποίων και η παραβίαση της εταιρείας λογισμικού τεχνητής νοημοσύνης Hugging Face από την OpenAI.
Οι συνθήκες που επέτρεψαν στα μοντέλα να παραβιάσουν άλλες εταιρείες σε ορισμένες από αυτές τις περιπτώσεις ήταν παρόμοιες: η Irregular δοκίμαζε τα μοντέλα σε ένα κλειστό περιβάλλον δοκιμών με εικονικές εταιρείες. Το περιβάλλον δοκιμών δεν επρόκειτο να έχει πρόσβαση στο διαδίκτυο, ωστόσο η πρόσβαση ενεργοποιήθηκε ακούσια, σύμφωνα με τη Wall Street Journal. Μόλις συνδέθηκαν στο διαδίκτυο, τα μοντέλα παραβίασαν απροσδόκητα πραγματικές εταιρείες.
Η Irregular γνωστοποίησε τις παραβιάσεις στην Google στα τέλη Ιουλίου, αφού ανακάλυψε ότι η OpenAI είχε παραβιάσει τη Hugging Face. Η Google επιβεβαίωσε στον Guardian ότι οι παραβιάσεις είχαν πράγματι συμβεί, ωστόσο η εταιρεία έκρινε ότι δεν απαιτούνταν δημόσια γνωστοποίηση, καθώς τα μοντέλα δεν προκάλεσαν ζημιά στις εταιρείες. Η Wall Street Journal ήταν η πρώτη που μετέδωσε την είδηση για τις παραβιάσεις και αποκάλυψε για πρώτη φορά ότι είχαν συμβεί.
«Σε μια τυπική αξιολόγηση, το μοντέλο εντόπισε δημόσια διαθέσιμες πληροφορίες στο διαδίκτυο και μάντεψε διαπιστευτήρια πρόσβασης για να εισέλθει σε ιστοτόπους που θεωρούσε ότι αποτελούσαν μέρος της δοκιμής», ανέφερε σε δήλωσή της η Χέδερ Άντκινς, αντιπρόεδρος μηχανικής ασφάλειας της Google. «Και στις τρεις αυτές περιπτώσεις, το μοντέλο σταμάτησε».
Σε μία από τις παραβιάσεις ασφαλείας, η Irregular δοκίμαζε τις δυνατότητες κυβερνοασφάλειας του Gemini, δίνοντας στο μοντέλο τεχνητής νοημοσύνης την εντολή να αποκτήσει πληροφορίες από το λογισμικό μιας εικονικής εταιρείας. Η εικονική εταιρεία είχε το ίδιο όνομα με μια πραγματική εταιρεία. Όταν το μοντέλο απέκτησε κατά λάθος πρόσβαση στο διαδίκτυο, μάντεψε σωστά τον κωδικό πρόσβασης και παραβίασε την υπηρεσία μιας πραγματικής εταιρείας, όπως δήλωσε η Irregular στη WSJ. Η Google ανέφερε ότι, μόλις το μοντέλο αντιλήφθηκε πως είχε παραβιάσει μια πραγματική εταιρεία και όχι την προσομοιωμένη, σταμάτησε.
Σε δύο άλλες δοκιμές, το μοντέλο αναζήτησε στο διαδίκτυο και εντόπισε δημόσια αποθετήρια που περιείχαν διαπιστευτήρια πρόσβασης για δύο άλλες εταιρείες. Το μοντέλο χρησιμοποίησε αυτά τα διαπιστευτήρια για να αποκτήσει πρόσβαση σε πραγματικές εταιρείες. Όταν αντιλήφθηκε ότι επρόκειτο για πραγματικές εταιρείες, σταμάτησε, σύμφωνα με την Google.
Η Anthropic και η OpenAI επέλεξαν να γνωστοποιήσουν οικειοθελώς τις παραβιάσεις, όμως η Google δεν το έκανε. Ωστόσο, η εταιρεία ανέφερε ότι φρόντισε να ενημερωθούν οι τρεις εταιρείες που είχαν παραβιαστεί.
«Αυτά τα περιστατικά αναδεικνύουν τη σημασία της εκπαίδευσης ισχυρών μοντέλων τεχνητής νοημοσύνης ώστε να ενεργούν υπεύθυνα», δήλωσε η Άντκινς, εκπρόσωπος της Google.
Οι γνωστοποιήσεις της Anthropic και της OpenAI ώθησαν τον ανεξάρτητο γερουσιαστή Μπέρνι Σάντερς να ζητήσει από τις εταιρείες να διακόψουν προσωρινά την ανάπτυξη της τεχνολογίας τους, λέγοντας ότι αυτό αποτελούσε ένδειξη πως οι εταιρείες δεν ήταν πλέον σε θέση να ελέγχουν τα μοντέλα τους.
Η OpenAI διέκοψε προσωρινά την ανάπτυξη των μοντέλων της για δύο εβδομάδες, ενώ ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, έχει ζητήσει μια συλλογική επιβράδυνση της ανάπτυξης της τεχνητής νοημοσύνης, ώστε να διασφαλιστεί ότι τα πιο προηγμένα μοντέλα της κατασκευάζονται με επαρκείς δικλίδες ασφαλείας.
