ΑρχικήAIΜελέτη του Stanford διαπιστώνει ότι τα chatbots τεχνητής νοημοσύνης δυσκολεύονται να διαχωρίσουν...

Μελέτη του Stanford διαπιστώνει ότι τα chatbots τεχνητής νοημοσύνης δυσκολεύονται να διαχωρίσουν το γεγονός από την πεποίθηση

...οι τεχνολογίες τεχνητής νοημοσύνης απαιτούν «άμεσες βελτιώσεις» πριν από την ευρεία τους διάδοση σε τομείς υψηλού ρίσκου...

Loading

Μια ολοκληρωμένη μελέτη που δημοσιεύθηκε στο Nature Machine Intelligence αποκάλυψε ότι σημαντικά chatbots τεχνητής νοημοσύνης, συμπεριλαμβανομένου του ChatGPT, αποτυγχάνουν να διακρίνουν αξιόπιστα μεταξύ αληθινών και ψευδών πεποιθήσεων, εγείροντας σοβαρές ανησυχίες σχετικά με την ανάπτυξή τους σε κρίσιμους τομείς όπως η υγειονομική περίθαλψη, το δίκαιο και η δημοσιογραφία.

Τα μοντέλα τεχνητής νοημοσύνης παρουσιάζουν θεμελιώδη αδυναμία στην αναγνώριση πεποιθήσεων

Ερευνητές του Πανεπιστημίου Stanford δοκίμασαν 24 μεγάλα γλωσσικά μοντέλα χρησιμοποιώντας 13.000 ερωτήσεις και διαπίστωσαν ότι όλα τα συστήματα δυσκολεύτηκαν να αναγνωρίσουν τις ψευδείς πεποιθήσεις σε σύγκριση με τις αληθινές. Η μελέτη αποκάλυψε ότι τα νεότερα μοντέλα που κυκλοφόρησαν μετά τον Μάιο 2024, συμπεριλαμβανομένου του GPT-4o, ήταν 34,3% λιγότερο πιθανό να αναγνωρίσουν ψευδείς πεποιθήσεις πρώτου προσώπου σε σύγκριση με τις αληθινές πεποιθήσεις. Τα παλαιότερα μοντέλα είχαν ακόμη χειρότερη απόδοση, παρουσιάζοντας μείωση 38,6% στην ακριβή αναγνώριση ψευδών πεποιθήσεων.

Ενώ αυτά τα μοντέλα πέτυχαν ποσοστά ακρίβειας μεταξύ 91,1% και 91,5% κατά την αναγνώριση απλών αληθών ή ψευδών δηλώσεων, η απόδοσή τους μειώθηκε δραματικά όταν αντιμετώπιζαν γλώσσα βασισμένη σε πεποιθήσεις όπως “Πιστεύω ότι…”. Σύμφωνα με τους ερευνητές, τα συστήματα τεχνητής νοημοσύνης επέδειξαν “ασυνεπείς στρατηγικές συλλογισμού”, βασιζόμενα σε επιφανειακή αντιστοίχιση προτύπων παρά σε βαθιά κατανόηση.

Αυξανόμενες ανησυχίες για τις εφαρμογές στον πραγματικό κόσμο

Τα ευρήματα έρχονται σε μια κρίσιμη χρονική στιγμή, καθώς η χρήση chatbots τεχνητής νοημοσύνης επεκτείνεται ραγδαία. Μια πρόσφατη έκθεση του Adobe Express διαπίστωσε ότι το 77% των Αμερικανών που χρησιμοποιούν το ChatGPT το θεωρούν μηχανή αναζήτησης, με έναν στους τρεις χρήστες να το εμπιστεύεται περισσότερο από τις παραδοσιακές μηχανές αναζήτησης. Αυτή η τάση έχει οδηγήσει σε ρυθμιστικές ενέργειες, με την OpenAI να απαγορεύει επίσημα στο ChatGPT να παρέχει ιατρικές, νομικές ή χρηματοοικονομικές συμβουλές από τις 29 Οκτωβρίου 2025.​

Ο Pablo Haya Coll, ειδικός στην υπολογιστική γλωσσολογία στο Αυτόνομο Πανεπιστήμιο της Μαδρίτης, προειδοποίησε ότι «η σύγχυση μεταξύ πεποιθήσεων και γνώσης μπορεί να οδηγήσει σε σοβαρά σφάλματα στην κρίση» σε κρίσιμους τομείς όπου η ακρίβεια είναι ουσιώδης. Οι ερευνητές τόνισαν ότι αυτοί οι περιορισμοί μπορεί να «παραπλανήσουν διαγνώσεις, να διαστρεβλώσουν δικαστικές αποφάσεις και να ενισχύσουν τη παραπληροφόρηση».

Πρόσφατα περιστατικά ανέδειξαν αυτούς τους κινδύνους στην πράξη. Τον Μάιο, ένας δικαστής της Καλιφόρνια επέβαλε πρόστιμο 31.000 δολαρίων σε δύο δικηγορικά γραφεία επειδή συμπεριέλαβαν παραπλανητικές πληροφορίες που δημιουργήθηκαν από AI σε νομικές εκθέσεις. Επιπλέον, ένας ειδικός παραπληροφόρησης του Stanford παραδέχθηκε ότι παρέλειψε να εντοπίσει «φανταστικές παραπομπές» σε δικαστική δήλωση που συντάχθηκε με τη βοήθεια του ChatGPT.​

Οι συγγραφείς της μελέτης κατέληξαν στο συμπέρασμα ότι οι τεχνολογίες τεχνητής νοημοσύνης απαιτούν «άμεσες βελτιώσεις» πριν από την ευρεία τους διάδοση σε τομείς υψηλού ρίσκου, ιδιαίτερα επειδή η αδυναμία της τεχνολογίας να διαχωρίσει τις υποκειμενικές πεποιθήσεις από τα αντικειμενικά γεγονότα αποτελεί ένα θεμελιώδες δομικό μειονέκτημα.

theregister

How useful was this post?

Click on a star to rate it!

Average rating 0 / 5. Vote count: 0

No votes so far! Be the first to rate this post.

George S. Metallidis
George S. Metallidishttps://techlog.gr
Όλα ξεκίνησαν το 1988 όταν μπήκε στο σπίτι το πρώτο PC ένας 32bit 80386 με 4mb ram, CGA γραφικά σε 16colours monitor....και φυσικά λιώσιμο με το DOS game Grand Prix Circuit της Accolade
Σχετικά άρθρα

Η AI ετοιμάζεται να ψωνίζει για εμάς – Visa και Mastercard...

0
Visa, Mastercard και Ant International δημιουργούν κοινό πλαίσιο για να αναγνωρίζουν και να ελέγχουν AI agents που θα μπορούν να πραγματοποιούν αγορές για λογαριασμό των χρηστών.

ΔΕΙΤΕ ΑΚΟΜΑ!