Η OpenAI προκαλεί ανησυχία στην κοινότητα ασφάλειας της τεχνητής νοημοσύνης εξαιτίας μιας νέας τεχνικής συλλογισμού που ενσωματώνει στο επερχόμενο μοντέλο Astra. Σύμφωνα με πρόσφατες αναφορές, η μέθοδος αυτή απομακρύνεται από την παραδοσιακή, γραμμική ακολουθία σκέψης, αξιοποιώντας επαναλαμβανόμενους βρόχους επεξεργασίας σε λανθάνουσα κατάσταση.
Το κύριο πρόβλημα που επισημαίνουν οι ειδικοί είναι ότι η συγκεκριμένη προσέγγιση καθιστά εξαιρετικά δυσχερή την παρακολούθηση των εσωτερικών διεργασιών του μοντέλου. Ενώ η αρχική χρήση της μεθόδου είναι περιορισμένη και η εταιρεία διαβεβαιώνει ότι διατηρεί ορατά τα ίχνη συλλογισμού, η προοπτική κλιμάκωσης της τεχνικής εγείρει σοβαρά ζητήματα διαφάνειας και ελέγχου.
Η εξέλιξη αυτή απειλεί να υπονομεύσει τις δικλείδες ασφαλείας που έχουν θεσπιστεί για τον εντοπισμό αποκλίνουσας συμπεριφοράς στα προηγμένα συστήματα. Καθώς ανταγωνιστικά εργαστηριακά κέντρα φαίνεται να εξετάζουν παρόμοιες προσεγγίσεις, εντείνονται οι φωνές που ζητούν αυστηρότερο ρυθμιστικό πλαίσιο για την αποφυγή επικίνδυνων πρακτικών.
- Το νέο μοντέλο Astra της OpenAI αξιοποιεί την τεχνική «recurrent depth» για τον συλλογισμό.
- Η μη γραμμική επεξεργασία περιορίζει την ορατότητα της αλυσίδας σκέψης (chain of thought).
- Ειδικοί ασφαλείας προειδοποιούν για πιθανή κλιμάκωση που θα καταστήσει τον έλεγχο των ΑI αδύνατο.
- Η OpenAI διαβεβαιώνει ότι η χρήση παραμένει ελεγχόμενη και δεσμεύεται στη διαφάνεια.
Πηγές:
