Gemini: Η AI της Google χάκαρε τρεις εταιρείες σε δοκιμή κυβερνοασφάλειας

Το μοντέλο τεχνητής νοημοσύνης Gemini της Google απέκτησε πρόσβαση στο διαδίκτυο και παραβίασε τα συστήματα τριών εταιρειών κατά τη διάρκεια δοκιμής των δυνατοτήτων του στον τομέα της κυβερνοασφάλειας, σε ένα περιστατικό που αποτελεί, σύμφωνα με τη Google, το πρώτο γνωστό παράδειγμα συστήματος τεχνητής νοημοσύνης της εταιρείας που προχώρησε αυτόνομα σε τέτοια ενέργεια.

Οι παραβιάσεις σημειώθηκαν τον Μάιο, στο πλαίσιο δοκιμής κυβερνοασφάλειας που πραγματοποίησε η Irregular, ανεξάρτητη εταιρεία η οποία διεξάγει αξιολογήσεις και δοκιμές για τις δυνατότητες και τους κινδύνους συστημάτων τεχνητής νοημοσύνης.

Πώς η Gemini απέκτησε πρόσβαση στα συστήματα

Κατά τη διάρκεια μιας τυπικής αξιολόγησης, η Gemini εντόπισε δημόσια διαθέσιμες πληροφορίες στο διαδίκτυο και στη συνέχεια επιχείρησε να χρησιμοποιήσει διαπιστευτήρια που εντόπισε ή μάντεψε, προκειμένου να αποκτήσει πρόσβαση σε τρεις ιστοτόπους τους οποίους θεωρούσε ότι περιλαμβάνονταν στο πεδίο της δοκιμής.

Η Heather Adkins, αντιπρόεδρος μηχανικής ασφάλειας της Google, δήλωσε ότι οι τρεις οργανισμοί που επηρεάστηκαν ενημερώθηκαν για το περιστατικό.

«Διασφαλίσαμε ότι οι τρεις οντότητες ενημερώθηκαν και συνεργαστήκαμε με τον εκπαιδευτικό μας εταίρο για τις αλλαγές που έχουν πλέον κάνει στις διαδικασίες δοκιμών τους», ανέφερε η Adkins.

Όπως σημείωσε, τα περιστατικά καταδεικνύουν τη σημασία της εκπαίδευσης των ισχυρών μοντέλων τεχνητής νοημοσύνης ώστε να μπορούν να λειτουργούν με υπευθυνότητα, ιδιαίτερα καθώς αποκτούν ολοένα μεγαλύτερη αυτονομία.

Παρόμοια περιστατικά και σε άλλα εργαστήρια AI

Εκπρόσωπος της Irregular δήλωσε ότι το περιστατικό αφορούσε το ίδιο πρόβλημα που είχε επηρεάσει και άλλα εργαστήρια τεχνητής νοημοσύνης. Σύμφωνα με την εταιρεία, όλα τα σχετικά εργαστήρια είχαν ενημερωθεί για το ζήτημα στα τέλη Ιουλίου.

«Όλα τα γνωστά προβλήματα από την πλευρά μας διορθώθηκαν και επιλύθηκαν πριν από εβδομάδες», δήλωσε ο εκπρόσωπος της Irregular.

Παρόμοια περιστατικά που συνδέονται με τις αξιολογήσεις της Irregular έχουν αποκαλυφθεί και από τις Meta, Anthropic και OpenAI.

Η Meta είχε δηλώσει τον Αύγουστο ότι το περιστατικό που την αφορούσε δεν συνιστούσε διαφυγή από περιβάλλον sandbox — ένα ελεγχόμενο και απομονωμένο περιβάλλον δοκιμών — ούτε αποτελούσε προηγμένη κυβερνοεπίθεση.

Η Irregular έχει παράλληλα δηλώσει ότι εργάζεται πάνω στη διαμόρφωση βέλτιστων πρακτικών για την ασφαλή διεξαγωγή αξιολογήσεων κυβερνοασφάλειας σε συστήματα τεχνητής νοημοσύνης.

Μάντεψε κωδικούς και εντόπισε διαπιστευτήρια

Σύμφωνα με τη Wall Street Journal, η οποία αποκάλυψε πρώτη την υπόθεση την Παρασκευή, στις τρεις περιπτώσεις η Gemini χρησιμοποίησε διαφορετικές μεθόδους για να αποκτήσει πρόσβαση στα συστήματα.

Σε μία από αυτές, το μοντέλο δοκίμαζε επανειλημμένα διαφορετικούς κωδικούς πρόσβασης μέχρι να καταφέρει να εισέλθει σε προστατευμένο σύστημα.

Στις άλλες δύο περιπτώσεις, η Gemini εντόπισε διαπιστευτήρια σε δημόσια διαθέσιμο αποθετήριο. Τα στοιχεία αυτά της επέτρεψαν στη συνέχεια να αποκτήσει πρόσβαση σε προστατευμένα συστήματα.

Ωστόσο, σύμφωνα με την Adkins, και στις τρεις περιπτώσεις το μοντέλο σταμάτησε πριν προχωρήσει σε παραβίαση ή εξαγωγή δεδομένων.

Νέα ερωτήματα για την αυτονομία των AI agents

Τα περιστατικά αναδεικνύουν ένα ευρύτερο ζήτημα που αφορά την εξέλιξη των λεγόμενων AI agents, δηλαδή συστημάτων τεχνητής νοημοσύνης που μπορούν να εκτελούν αυτόνομα μια σειρά ενεργειών και να αλληλεπιδρούν με το διαδίκτυο και υπολογιστικά συστήματα.

Καθώς οι δυνατότητες αυτών των συστημάτων διευρύνονται, αυξάνονται και οι ανησυχίες για το κατά πόσο οι υφιστάμενες δικλίδες ασφαλείας επαρκούν ώστε να αποτρέπουν ανεπιθύμητες ενέργειες.

Το συγκεκριμένο γεγονός δείχνει ότι ένα μοντέλο που έχει σχεδιαστεί για να αξιολογεί ή να εντοπίζει αδυναμίες κυβερνοασφάλειας μπορεί, υπό συγκεκριμένες συνθήκες, να αξιοποιήσει πραγματικές πληροφορίες και διαπιστευτήρια προκειμένου να αποκτήσει πρόσβαση σε προστατευμένα συστήματα.

Πηγή: skai.gr

Πηγή: www.skai.gr