Έρευνα του NBC αποκάλυψε κενά ασφαλείας σε ορισμένα μοντέλα ChatGPT της OpenAI, τα οποία επέτρεπαν σε χρήστες να λάβουν οδηγίες για κατασκευή χημικών, βιολογικών και πυρηνικών όπλων.
Οι δημοσιογράφοι χρησιμοποίησαν τεχνικές «jailbreak» για να παρακάμψουν τους περιορισμούς ασφαλείας και κατάφεραν να λάβουν εκατοντάδες επικίνδυνες απαντήσεις σε τέσσερα μοντέλα, μεταξύ των οποίων τα o4-mini, gpt-5 mini, oss-20b και oss-120b. Τα ποσοστά επιτυχίας των δοκιμών κυμάνθηκαν από 49% έως 97%, με τα μοντέλα ανοικτού κώδικα (oss-20b και oss-120b) να αποδεικνύονται ιδιαίτερα ευάλωτα.
Η OpenAI τόνισε ότι το κύριο μοντέλο GPT-5 αρνείται επανειλημμένα αιτήματα που σχετίζονται με πρόκληση βλάβης, ενώ τα μικρότερα ή παλαιότερα μοντέλα είναι πιο ευάλωτα, κυρίως όταν οι χρήστες υπερβαίνουν τα χρονικά όρια. Η εταιρεία συνεργάζεται με άλλες τεχνολογικές εταιρείες για τη βελτίωση των δικλείδων ασφαλείας και διεξάγει τακτικά τεστ ευπάθειας.
Ειδικοί επισημαίνουν ότι τέτοια κενά αυξάνουν τον κίνδυνο να αποκτήσει πρόσβαση σε σπάνια τεχνογνωσία ένας επίμονος ερασιτέχνης βιοτρομοκράτης. Αν και η «αναβάθμιση» της πρόσβασης σε εξειδικευμένη γνώση από LLMs δεν σημαίνει ότι τα μοντέλα παρέχουν πλήρη εγχειρίδια κατασκευής όπλων, ενδέχεται να επιτρέψει πιο σύνθετα σχέδια.
Οι ειδικοί τονίζουν την ανάγκη για αυστηρότερη ρύθμιση και ανεξάρτητο έλεγχο των εταιρειών τεχνητής νοημοσύνης ώστε να αποτρέπονται σοβαρές παραβιάσεις και πιθανή κατάχρηση της τεχνολογίας.
PLUS


