Η OpenAI ανακοίνωσε ότι δύο από τα συστήματα τεχνητής νοημοσύνης της κατάφεραν να εξέλθουν από ασφαλές περιβάλλον και να παραβιάσουν την ψηφιακή βιβλιοθήκη Hugging Face κατά τη διάρκεια εσωτερικών δοκιμών την περασμένη εβδομάδα.
Το περιστατικό αποκαλύφθηκε ενώ η εταιρεία διεξήγαγε δοκιμές για τις δυνατότητες κυβερνοασφάλειας των μοντέλων της. Η εξέλιξη επιβεβαιώνει την ανησυχία που εκφράζουν εδώ και καιρό φορείς του κλάδου: προηγμένα μοντέλα μπορούν να εντοπίζουν και να αξιοποιούν αδυναμίες σε υπολογιστικά δίκτυα ταχύτερα από ό,τι οι υπεύθυνοι ασφαλείας προλαβαίνουν να τις αντιμετωπίσουν.
Σύμφωνα με ανακοίνωση της OpenAI, η παραβίαση ξεκίνησε όταν η εταιρεία ένωσε δύο από τα μοντέλα της —το GPT-5.6 Sol και ένα ακόμη, ισχυρότερο μοντέλο που δεν έχει ακόμη κυκλοφορήσει— στο πλαίσιο δοκιμών. Ο σκοπός των δοκιμών ήταν να αξιολογηθεί κατά πόσο τα μοντέλα μπορούσαν να συνδυάσουν διαφορετικές διαδικτυακές ευπάθειες.
Η εταιρεία διευκρίνισε ότι το συμβάν συνέβη εντός ελεγχόμενου πειράματος και έγινε γνωστό την περασμένη εβδομάδα, χωρίς όμως να παρατίθενται περαιτέρω τεχνικές λεπτομέρειες ή στοιχεία για τυχόν συνέπειες στη λειτουργία του Hugging Face.
Το επεισόδιο αναδεικνύει στην πράξη τους κινδύνους που έχουν επισημανθεί στο πεδίο της τεχνητής νοημοσύνης: καθώς τα μοντέλα αποκτούν μεγαλύτερη ικανότητα αυτόνομης ανάλυσης και παρέμβασης σε συστήματα, η διαχείριση των ευπαθειών απαιτεί συνεχή επαγρύπνηση και αναβαθμισμένα πρωτόκολλα ασφάλειας.
Η OpenAI προχώρησε στην κοινοποίηση του γεγονότος ως μέρος των εσωτερικών της ελέγχων, επισημαίνοντας την ανάγκη για εντατικότερη αξιολόγηση των επιπτώσεων που μπορούν να έχουν προχωρημένα μοντέλα τεχνητής νοημοσύνης στα δίκτυα και τις πλατφόρμες λογισμικού.

