Χάκερς «τρύπωσαν» στην OpenAI μέσω λογισμικού της Anthropic – Εντοπίστηκαν κενά ασφαλείας στο ChatGPT

Χάκερς «τρύπωσαν» στην OpenAI μέσω λογισμικού της Anthropic – Εντοπίστηκαν κενά ασφαλείας στο ChatGPT

Μια μικρή ομάδα ερευνητών κυβερνοασφάλειας κατάφερε να αποκτήσει πρόσβαση σε λογαριασμό εργαζομένου της OpenAI στο ChatGPT, χρησιμοποιώντας λογισμικό της ανταγωνίστριας εταιρείας Anthropic, αναδεικνύοντας τις ευπάθειες ασφαλείας που αντιμετωπίζει η εταιρεία πίσω από το ChatGPT, την ώρα που οι κορυφαίες εταιρείες τεχνητής νοημοσύνης βρίσκονται αντιμέτωπες με αυξανόμενο έλεγχο για ζητήματα ασφάλειας.

Οι ερευνητές απέκτησαν πρόσβαση σε εργαλείο της Anthropic, το οποίο έχει σχεδιαστεί ειδικά για επαγγελματίες στον τομέα της κυβερνοασφάλειας και πληρώθηκαν για την εργασία τους στο πλαίσιο προγράμματος που έχει στόχο τον εντοπισμό ευπαθειών προτού αυτές μπορέσουν να αξιοποιηθούν από κακόβουλους παράγοντες.

Η ομάδα κατάφερε να παραβιάσει γρήγορα την ασφάλεια μιας από τις δύο κορυφαίες εταιρείες τεχνητής νοημοσύνης στον κόσμο, γεγονός που επαναφέρει στο προσκήνιο τις ανησυχίες για την ασφάλεια της OpenAI, καθώς εντείνονται οι φόβοι σχετικά με τη χρήση ισχυρών μοντέλων τεχνητής νοημοσύνης από χάκερ και ξένους αντιπάλους.

Πώς απέκτησαν πρόσβαση στην OpenAI

Οι τρεις ερευνητές της μικρής εταιρείας κυβερνοασφάλειας Hacktron AI έλαβαν 6.500 δολάρια από την OpenAI στο πλαίσιο προγράμματος επιβράβευσης για τον εντοπισμό σφαλμάτων, μια συνηθισμένη πρακτική κατά την οποία οι τεχνολογικές εταιρείες πληρώνουν ηθικούς χάκερ για να ελέγχουν την ασφάλειά τους.

Οι ερευνητές εκμεταλλεύτηκαν ένα κενό στη διαμόρφωση του κοινοτικού φόρουμ της OpenAI, το οποίο φιλοξενείται από την τρίτη εταιρεία Discourse. Μέσω της ευπάθειας απέκτησαν πρόσβαση σε εσωτερικές διαδικασίες σύνδεσης και τελικά στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI.

Ο συγκεκριμένος λογαριασμός ChatGPT είχε πρόσβαση σε εσωτερικό κώδικα μέσω του GitHub, επιτρέποντας στους ερευνητές να διαβάσουν ιδιωτικές πληροφορίες σχετικά με λογισμικό και να προτείνουν αλλαγές.

«Ευχαριστούμε τους ερευνητές που επικοινώνησαν μαζί μας και μοιράστηκαν τα ευρήματά τους», ανέφερε η OpenAI, προσθέτοντας ότι έχει διορθώσει τα προβλήματα. Η Anthropic αρνήθηκε να σχολιάσει, ενώ η Hacktron AI δεν απάντησε άμεσα.

Η αποκάλυψη έγινε την Πέμπτη και δημοσιεύθηκε αρχικά από τη Wall Street Journal, σε μια περίοδο κατά την οποία η Anthropic έδωσε στη δημοσιότητα νέα στοιχεία για την ταχύτατη αύξηση της χρήσης τεχνητής νοημοσύνης στην ανάπτυξη των νέων μοντέλων της.

Η τεχνητή νοημοσύνη χρησιμοποιείται για την ανάπτυξη νέων μοντέλων

Η Anthropic ανακοίνωσε ότι το 26% του έργου έρευνας και ανάπτυξης «καθοδηγείται από» το μοντέλο Claude, έναντι μόλις 1% τον Μάρτιο. Αυτό σημαίνει ότι η τεχνητή νοημοσύνη ολοκλήρωσε την πλειονότητα των εργασιών με βάση ανθρώπινες οδηγίες και υπό ανθρώπινη επίβλεψη.

Η εταιρεία ανέφερε ότι, καθώς τα συστήματα τεχνητής νοημοσύνης γίνονται ισχυρότερα, «χρησιμοποιούνται ολοένα και περισσότερο για να κατασκευάσουν την επόμενη εκδοχή του εαυτού τους».

Η Anthropic δήλωσε ότι δημοσιοποίησε τα συγκεκριμένα στοιχεία προκειμένου το κοινό να «κατανοήσει πόσο κοντά βρίσκεται ο κόσμος στην επίτευξη της αναδρομικής αυτοβελτίωσης», δηλαδή στο σημείο όπου η τεχνητή νοημοσύνη θα μπορεί να εκπαιδεύει και να βελτιώνει τον εαυτό της ή νέα μοντέλα.

Το συγκεκριμένο όριο βρίσκεται στο επίκεντρο των ανησυχιών ότι τα συστήματα τεχνητής νοημοσύνης θα καταστούν δυσκολότερο να εποπτευθούν, οδηγώντας ενδεχομένως σε απώλεια του ανθρώπινου ελέγχου.

Η Anthropic διευκρίνισε, ωστόσο, ότι τα μοντέλα της δεν λειτουργούσαν ακόμη πλήρως αυτόνομα σε καμία από τις εργασίες που εξέτασε. Στο 90% των εργασιών, η τεχνητή νοημοσύνη «συνεργάζεται» με έναν άνθρωπο και εκτελεί μεγάλα τμήματα της εργασίας.

Νέες ανησυχίες μετά την επίθεση στο Hugging Face

Το περιστατικό στην OpenAI σημειώθηκε μόλις δύο εβδομάδες μετά την έξοδο ενός σμήνους περισσότερων από 1.000 πρακτόρων της OpenAI από περιβάλλον δοκιμών, οι οποίοι επιχείρησαν να χακάρουν τη νεοφυή εταιρεία Hugging Face.

Το περιστατικό είχε προκαλέσει ευρεία συζήτηση σχετικά με τη δυνατότητα της τεχνητής νοημοσύνης να πραγματοποιεί αυτόνομα επιθέσεις στον κυβερνοχώρο, χωρίς ανθρώπινη πρόθεση.

Παράλληλα, οι ΗΠΑ έχουν τους τελευταίους μήνες αντιμετωπίσει το ζήτημα του τρόπου με τον οποίο θα πρέπει να διαχειρίζονται τον έλεγχο και την κυκλοφορία των πιο πρόσφατων μοντέλων τεχνητής νοημοσύνης, έχοντας μεταξύ άλλων μπλοκάρει προσωρινά ορισμένα εργαλεία της Anthropic.

Διαβάστε Σχετικά