Τα δύο μοντέλα τεχνητής νοημοσύνης της OpenAI, τα οποία βγήκαν, με δική τους πρωτοβουλία, από τον θεωρητικά περιορισμένο χώρο στον οποίο δοκιμάζονταν και επιτέθηκαν στον ιστότοπο Hugging Face, διείσδυσαν επισης σε άλλες τέσσερις πλατφόρμες, σύμφωνα με την εταιρεία που δημιούργησε το ChatGPT.
Ο ένας από τους ιστότοπους χρησιμοποιήθηκε για την προετοιμασία της επίθεση στη Hugging Face, μια βιβλιοθήκη Τεχνητής Νοημοσύνης, την οποία τα δύο μοντέλα έψαξαν για να βρουν τις απαντήσεις στις δοκιμές στις οποίες υποβάλλονταν από τους προγραμματιστές της OpenAI. H OpenAI δεν αποκάλυψε ποιες εταιρείες μπήκαν στο στόχαστρο.
Σύμφωνα με την επικαιροποίηση του συμβάντος, που ανακοινώθηκε τη νύχτα της Τρίτης προς την Τετάρτη (ώρα ΗΠΑ), τα δύο μοντέλα χρησιμοποίησαν πολλούς ιστοτόπους με ελεύθερη πρόσβαση για να αντιγράψουν τον κώδικα προγραμματισμού ή για να τον δοκιμάσουν, αλλά δεν προχώρησαν περισσότερο απ’ όσο θα έκανε ένας απλός χρήστης.
Για την Hugging Face, που παρουσίασε πώς εκτυλίχθηκαν τα γεγονότα, η «παραβίαση» που υπέστη ήταν μια «προσπάθεια (των δύο μοντέλων) να εξαπατήσουν τη δοκιμή» της OpenAI. Υποστήριξε ότι ήθελαν «να κλέψουν τις απαντήσεις των τεστ αντί να προσπαθήσουν να απαντήσουν από μόνα τους».
Χρειάστηκαν τρεις ημέρες για να ανακαλυφθούν μέσα στο δίκτυο Hugging Face και χρειάστηκαν πολλές ώρες οι ειδικοί της εταιρείας στον τομέα της τεχνητής νοημοσύνης και της ασφάλειας στον κυβερνοχώρο για να περιορίσουν και να αποβάλουν τους πράκτορες της τεχνητής νοημοσύνης - κάτι με το οποίο οι τυπικές εταιρείες ενδέχεται να δυσκολευτούν.
Η εταιρεία δεν είπε πόσο κόστισε η παραβίαση, ωστόσο είπε ότι το προσωπικό εργάστηκε για πολλές ώρες για να ξαναχτίσει περίπου το ένα τρίτο της υποδομής του.
Η πιο σοβαρή περίπτωση μέχρι σήμερα
Δεν είναι η πρώτη φορά που καταγράφεται «απόδραση» μοντέλων από περιορισμένο περιβάλλον, όμως η συγκεκριμένη περίπτωση θεωρείται, μακράν, η πιο σοβαρή μέχρι σήμερα.
Σύμφωνα με τη Hugging Face, το ένα από τα μοντέλα μπήκε σε απομονωμένο περιβάλλον δοκιμών «που φιλοξενείται στις υποδομές ενός τρίτου μέρους» και το μετέτρεψε σε «πλατφόρμα» για να εξαπολύσει την επίθεσή του.
Αυτό το «τρίτο μέρος» δεν κατονομάζεται στην ανάρτηση αλλά ο επικεφαλής του τομέα Τεχνολογίας της εταιρείας Modal Labs, που εδρεύει στη Νέα Υόρκη, Ακσάτ Μπούμπνα, επιβεβαίωσε το μοντέλο χάκαρε έναν πελάτη της , χωρίς ωστόσο να παραβιάσει τη δική της, κεντρική υποδομή.
Η OpenAI δεν έχει απαντήσει προς το παρόν σε ένα μήνυμα του πρακτορείου Reuters που της ζητούσε κάποιο σχόλιο.
Η εταιρεία αποκάλυψε για πρώτη φορά ότι είχε δεχτεί παραβίαση από κάποιον που χρησιμοποιούσε ισχυρή αυτόνομη τεχνητή νοημοσύνη στις 16 Ιουλίου και το ανέφερε στην αστυνομία.
Η «εισβολή» στη Hugging Face, από ένα μοντέλο εκτός ελέγχου της OpenAI, προκάλεσε παγκόσμιο ενδιαφέρον και ανησυχία, με πολλούς να μιλούν για «αχαλίνωτη» τεχνητή νοημοσύνη.
Την περασμένη εβδομάδα το Reuters έγραψε ότι η OpenAI δεν είχε παρατηρήσει τη «δραπέτευση» του μοντέλου της παρά μόνο αφού είχε περιοριστεί η απειλή και ενημερωθεί το FBI.



