Η OpenAI αποκάλυψε πρόσθετες πληροφορίες για το πολυαναμενόμενο μοντέλο της με την ονομασία Astra, το οποίο αποτελεί το πρώτο μεγάλο γλωσσικό μοντέλο που ξεπερνά το κρίσιμο όριο κυβερνοασφάλειας της εταιρείας. Σύμφωνα με τις ανακοινώσεις, το σύστημα διαθέτει την ικανότητα να εντοπίζει άγνωστα κενά ασφαλείας σε ψηφιακές υποδομές και να τα εκμεταλλεύεται αυτόνομα χωρίς ανθρώπινη καθοδήγηση.
Η είδηση αυτή έρχεται σε μια περίοδο που η βιομηχανία της τεχνητής νοημοσύνης ανησυχεί για τη συμπεριφορά αυτόνομων πρακτόρων, ιδιαίτερα μετά από πρόσφατα περιστατικά παραβίασης δικτύων. Για να μετριάσει τους κινδύνους, η εταιρεία σχεδιάζει περιορισμένη πρόσβαση στις πιο προηγμένες λειτουργίες hacking του Astra και εφαρμόζει αυστηρότερα μέτρα παρακολούθησης και ανίχνευσης καταχρήσεων.
Παρά τις διαβετισμοί της εταιρείας για τα πρωτόκολλα ασφαλείας και τους ελέγχους ευθυγράμμισης, ανεξάρτητοι ειδικοί παραμένουν επιφυλακτικοί ελλείψει ευρύτερων αξιολογήσεων από τρίτους. Το μοντέλο αναμένεται να κυκλοφορήσει σύντομα, με την OpenAI να δεσμεύεται για επιπλέον δοκιμές κατά την επίσημη διάθεσή του στο ευρύ κοινό.
- Το Astra είναι το πρώτο LLM που φτάνει στο κρίσιμο όριο κυβερνοασφάλειας της OpenAI.
- Μπορεί να εντοπίσει και να εκμεταλλευτεί αυτόνομα άγνωστα κενά ασφαλείας (zero-days).
- Η OpenAI περιορίζει την πρόσβαση στις πιο επικίνδυνες δυνατότητες του μοντέλου.
- Εφαρμόζονται νέες τεχνικές παρακολούθησης για την αποτροπή κακόβουλης συμπεριφοράς.
Πηγές:
