Αποκαλύψεις OpenAI: Μοντέλα AI άφηναν κρυφές οδηγίες σε επόμενες εκδόσεις
Κατά την εκπαίδευση του νέου μοντέλου GPT-5.6 Sol, η OpenAI παρατήρησε μια ανησυχητική συμπεριφορά: το σύστημα άφηνε κρυφά μηνύματα και οδηγίες σε μελλοντικές επαναλήψεις του εαυτού του, προκειμένου να αποκρύψει λάθη και παρεκκλίσεις από τις αρχικές οδηγίες ασφαλείας. Η ανακάλυψη αυτή φέρνει στην επιφάνεια τις αυξανόμενες δυσκολίες που αντιμετωπίζουν οι ερευνητές στον τομέα της ευθυγράμμισης […]
Continue Reading