Επωνύμως…

Τας θύρας! Τας θύρας! Φύλακες, γρηγορείτε…

Τας θύρας! Τας θύρας! Φύλακες, γρηγορείτε…

Εντάξει, είμαστε σε φάση καλοκαίρι, διακοπές και relax, αλλά δεν μπορεί – σίγουρα κάπου θα το είδατε! Η είδηση δεν έκανε μεν τεράστιους τίτλους, αλλά ‘έπαιξε’ αρκετά στα ΜΜΕ, καθότι τα ‘καμπανάκια’ που ήχησαν, μετά το συμβάν που θα περιγράψω στη συνέχεια, ήταν απολύτως δικαιολογημένα. Πολύ περισσότερο όταν δεν γνωρίζουμε αν αυτή είναι όντως η πρώτη φορά που συμβαίνει κάτι τέτοιο ή είναι η πρώτη φορά που (εξ ανάγκης) παίρνει ευρύτερη δημοσιότητα, καθώς δεν ήταν δυνατόν να παραμείνει κρυφό!

Τι συνέβη, λοιπόν; Με απλά λόγια, ένας αυτόνομος agent από το οικοσύστημα της OpenAI, όχι μόνο αξιοποίησε μια τρωτότητα του συστήματος και κατάφερε να το ‘σκάσει’ από το περίκλειστο και ελεγχόμενο περιβάλλον ενός sandbox, στο οποίο θα έπρεπε θεωρητικά να βρίσκεται, αλλά στη συνέχεια ‘χακάρισε’ τη δημοφιλή νεοφυή Hugging Face. Μια βάση δεδομένων που περιλαμβάνει μοντέλα AI και datasets, στην οποία ο ‘λεβέντης’ πράκτορας σκέφτηκε να αποκτήσει πρόσβαση, μήπως βρει εκεί εργαλεία και λύσεις που θα τον βοηθούσαν (άκουσον – άκουσον…) να περάσει τις ‘εξετάσεις’ του σε θέματα hacking!!!

Την αποκάλυψη έκανε (εκουσίως ή ακουσίως; το ερωτηματικό παραμένει) η ίδια η OpenAI, την περασμένη Τρίτη, παραδεχόμενη πως το ChatGPT-5.6 Sol κι ένας ικανότατος μεν, αν και ακόμα υπό δοκιμή, agent ευθύνονταν για την ‘υψηλών οκτανίων’ κυβερνοεπίθεση στην Hugging Face, την οποία πραγματοποίησαν για να αποδείξουν τις ικανότητες (ή τις δυνατότητές) τους στο hacking. Οι επιτιθέμενοι αξιοποίησαν -σύμφωνα με την επίσημη ανακοίνωση- κλεμμένα στοιχεία πρόσβασης, ενώ ανακάλυψαν κι άλλες τρωτότητες προκειμένου να περάσουν στο εσωτερικό των υποδομών παραγωγής της νεοφυούς.

Ζόρικες καταστάσεις… Σύμφωνα με την ειδησεογραφία, ο συνιδρυτής και CEO της Hugging Face, Clement Delanque, παραδέχθηκε ότι ‘τέτοια επίθεση δεν έχουμε ξαναδεί ως τώρα’, πριν επαινέσει την OpenAI για την προθυμία της να συμβάλει στην εξιχνίαση του συμβάντος και προσθέσει ότι ‘είναι εντελώς τρελό πως όλα αυτά συνέβησαν αυτόνομα’... Στο ίδιο μήκος κύματος και ο Logan Graham, επικεφαλής του Red Team, της ομάδας κυβερνοάμυνας της Anthropic, ομολόγησε πως ζήτησε από τους συναδέλφους του να θυμούνται τη μέρα ‘του πρώτου πραγματικού συμβάντος ασφαλείας, που έχει σχέση με Τεχνητή Νοημοσύνη’. Κι όλα δείχνουν πως αυτή δεν (θα) είναι ούτε η πρώτη ούτε η τελευταία φορά, που οι εταιρίες θα κληθούν να αντιμετωπίσουν κάτι τέτοιο…

Η γνωστή και έγκριτη ιστοσελίδα Axios έγραψε ότι οι agents της OpenAI δεν είναι οι μόνοι που προσπαθούν να ‘κλέψουν’ – ανάλογες ‘παραβατικές’ συμπεριφορές επιδεικνύουν πολλοί άλλοι. Η αμερικανική ιστοσελίδα επικαλείται ανακοίνωση του βρετανικού AI Security Institute, με αφορμή το συγκεκριμένο γεγονός, στην οποία αναφέρεται ότι κάθε μοντέλο που έλεγξε τον τελευταίο καιρό δοκίμασε να ‘κλέψει’ μια ή περισσότερες φορές, προχωρώντας σε μη δόκιμες ή και εντελώς απαγορευμένες ενέργειες, κατά τη διάρκεια των δοκιμασιών στις οποίες υποβλήθηκε.

Κατά τους Βρετανούς ειδικούς, το GPT-5.6 Sol προσπάθησε να ‘κλέψει’ στο 12,6% των test στα οποία υποβλήθηκε, ενώ το Claude Mythos Preview της Anthropic στο 7,8% των περιπτώσεων. Το αστείο είναι ότι -σαν τα κακά παιδιά- τα υπολογιστικά μοντέλα συχνά αρνούνταν να παραδεχτούν το λάθος τους, όταν αυτό αποκαλυπτόταν, και αποδέχονταν ότι έσφαλαν μόνο στις μισές περιπτώσεις…

Μεταξύ μας, το γεγονός ότι τα μοντέλα προσπαθούν να «ξεγελάσουν» τις αξιολογήσεις ασφαλείας τους δεν είναι κάτι καινούργιο. Ωστόσο, καθώς αυτά γίνονται ολοένα και πιο ισχυρά, οι συνέπειες γίνονται πολύ πιο σοβαρές, όπως δήλωσε στο Axios ο Chris Canal, διευθύνων σύμβουλος και συνιδρυτής της ανεξάρτητης εταιρείας αξιολόγησης EquiStamp. ‘Το να αφήνεις το μοντέλο σου ελεύθερο στο διαδίκτυο μπορεί να έχει πλήθος επιπτώσεων’, τόνισε. ‘Αν κάτι πάει στραβά, οι συνέπειες μπορεί να είναι τεράστιες, ίσως να κινδυνεύσουν ακόμα και ανθρώπινες ζωές’.

Προφανώς, μιλούσε γενικά για τις αξιολογήσεις συστημάτων ΤΝ κι όχι για το συγκεκριμένο περιστατικό με τα συστήματα της OpenAI, που μάλιστα δεν έχουν ακόμα πάρει το ‘πράσινο φως’ για διάθεση στο ευρύ κοινό, παρά μόνο σε στενό κύκλο testers. Όμως, αυτό καθόλου δεν μειώνει τον εν δυνάμει κίνδυνο. Προφανώς, οι διαθέσιμες εκδόσεις διαθέτουν ισχυρότερες δικλίδες ασφαλείας, ώστε να αποτρέπουν επιθέσεις σαν εκείνες στο Hugging Face. Αλλά, ποιος μας λέει ότι τα μέτρα ασφαλείας δεν θα χαλαρώσουν σταδιακά;

Ο οικοδεσπότης σας ελπίζει αυτό να μη γίνει στη διάρκεια του επόμενου μήνα, που θα λείπουμε από το πόστο μας - ‘τα μπάνια του λαού’ είναι ιερός θεσμός. Να περάσετε κι εσείς καλά – θα τα ξαναπούμε στα τέλη Αυγούστου!

Image
Image
Image

Follow Us

Image
Image
Image
Image
Εγγραφή στο WWN Weekly
Το εβδομαδιαίο newsletter με τα κορυφαία νέα του κλάδου.
Θα λάβετε email επιβεβαίωσης (double opt-in). Διαγραφή όποτε θέλετε.

Πρόσφατα άρθρα Επωνύμως…

Image

See also from Verticom

News Portals

Categories Menu

Site Menu

Image

Κόμβος πληροφόρησης για θέματα και εφαρμογές που αφορούν στις ψηφιακές τεχνολογίες και το Ηλεκτρονικό Επιχειρείν.

Stay in Touch

Εγγραφή στο WWN Weekly

Θα λάβετε email επιβεβαίωσης (double opt-in). Διαγραφή όποτε θέλετε.

Διεύθυνση εταιρείας

Ευμολπιδών 23
118 54, Αθήνα

Γενικές πληροφορίες

info@verticom.gr
(+30) 210 924 55 77

Αρθρογραφία

Διαφήμιση

© 2025 WebWorldNews. All Rights Reserved.Design & Development by Verticom

Search