Καθώς τα κείμενα που παράγονται από τεχνητή νοημοσύνη κατακλύζουν το διαδίκτυο, νέα έρευνα από τη marketing εταιρεία Graphite αποκαλύπτει ότι τα προηγμένα γλωσσικά μοντέλα εξακολουθούν να αφήνουν μοναδικά γλωσσικά «αποτυπώματα». Παρά το γεγονός ότι οι κατασκευαστές έχουν εξαλείψει παλαιότερα χαρακτηριστικά γνωρίσματα —όπως η υπερβολική χρήση παυλών ή συγκεκριμένων λέξεων— τα μοντέλα νέας γενιάς διαθέτουν νέες, ιδιόμορφες γλωσσικές συνήθειες.
Σύμφωνα με τη μελέτη, η οποία συνέκρινε ανθρώπινα κείμενα με παραγωγή από τα κορυφαία μοντέλα της αγοράς, εντοπίστηκαν χιλιάδες φράσεις που εμφανίζονται πολύ συχνότερα στο περιεχόμενο AI. Για παράδειγμα, το μοντέλο Opus 5.5 λατρεύει να τονίζει γιατί κάτι «έχει σημασία» («this matters»), ενώ άλλα μοντέλα χρησιμοποιούν προβλέψιμα σχήματα λόγου και προειδοποιητικές φράσεις για να μετριάσουν τους ισχυρισμούς τους.
Η ερευνητική ομάδα επισημάνει ότι, παρά τις προσπάθειες των εταιρειών για πιο φυσικό και ανθρώπινο λόγο, τα τεράστια μεγέθη και οι αλγοριθμικές ιδιαιτερότητες των δισεκατομμυρίων παραμέτρων καθιστούν αδύνατη την πλήρη εξαφάνιση αυτών των χαρακτηριστικών «σημαδιών» γραφής.
- Νέα έρευνα εντόπισε χιλιάδες χαρακτηριστικές φράσεις που προδίδουν τα κείμενα τεχνητής νοημοσύνης.
- Παλαιότερα «tells», όπως οι μεγάλες παύλες, έχουν σχεδόν εξαλειφθεί από τα κορυφαία μοντέλα.
- Κάθε μοντέλο (όπως τα Opus και Astra) διαθέτει πλέον τις δικές του μοναδικές γλωσσικές εμμονές.
- Οι ειδικοί εκτιμούν ότι είναι αδύνατο για τις εταιρείες να ελέγξουν πλήρως αυτές τις εκφραστικές ιδιαιτερότητες.
Πηγές:
