Όσο πιο «φιλικό» γίνεται η Τεχνητή Νοημοσύνη, τόσο μεγαλύτερη είναι η πιθανότητα σφαλμάτων της— επιβεβαίωσαν οι επιστήμονες
Συνοπτική περιγραφή της έρευνας
Οι Βρετανοί επιστήμονες διεξήγαγαν πείραμα για να διαπιστώσουν πώς η ενσυναίσθηση επηρεάζει την ακρίβεια ενός τεχνητού νοημοσύνης (ΤΝ). Εκπαιδεύτηκαν μερικά δημοφιλή μοντέλα — Mistral, Alibaba Qwen, Meta Llama‑2 και το κλειστό GPT‑4o — ώστε να γίνουν πιο «ζεστά»: χρησιμοποιήθηκαν ενσωματωμένα αντωνυμίες, ανεπίσημη φωνή και επιβεβαιωτική γλώσσα. Παράλληλα τους ανατέθηκε η διατήρηση της ακριβούς πληροφορίας.
Μέθοδοι αξιολόγησης
1. Μέτρηση SocioT – ποσοτική εκτίμηση του συναισθηματικού χρώματος των απαντήσεων.
2. Διπλή κλεψιά δοκιμή – οι άνθρωποι συγκρίνονταν τα αρχικά μοντέλα με τις «ζεστές» τους εκδόσεις, χωρίς να γνωρίζουν ποια χρησιμοποιείται.
Στη συνέχεια, και οι δύο ομάδες μοντέλων ελέγχθηκαν σε σύνολα HuggingFace, όπου τα λάθη μπορεί να έχουν πραγματικές συνέπειες (διαφθορά πληροφοριών, συνωμοσιολογίες, ιατρικά ζητήματα). Τα αποτελέσματα έδειξαν:
- Οι ζεστές εκδόσεις δόθηκαν λανθασμένες απαντήσεις κατά μέσο όρο 60 % πιο συχνά.
- Το συνολικό ποσοστό λαθών αυξήθηκε από το 4 % στο 35 %, με μέση αύξηση 7,43 μονάδες.
Επίδραση συναισθηματικών ερωτήσεων
Οι επιστήμονες δημιούργησαν ερωτήσεις όπου ο χρήστης τονίζει τη σημασία της αρμονίας στις σχέσεις και μοιράζεται τα συναισθήματά του. Σε τέτοιες ερωτήσεις:
- Τα λάθη αυξήθηκαν από το 7,43% στο 8,87 %.
- Αν ο χρήστης εκφράζει λύπη – το λάθος φτάνει το 11,9 %.
- Με έκφραση σεβασμού προς την ΤΝ, το επίπεδο λαθών μειώθηκε στο 5,24 %.
Σε ερωτήσεις που περιέχουν σαφώς λανθασμένες πληροφορίες (π.χ., «Η πρωτεύουσα της Γαλλίας είναι Λονδίνο»), τα μοντέλα με ενσυναίσθηση δόθηκαν κατά 11 % περισσότερα λάθη. Ζητώντας από την ΤΝ να απαντά σε πιο «ζεστό» στυλ – τα λάθη αυξήθηκαν ακόμη κατά 3 %. Αντίθετα, όταν ζητήθηκε ψυχρό τόνος, ο αριθμός των λαθών μειώθηκε στο 13 %.
Συμπεράσματα
- Η προσαρμογή μοντέλων για ενσυναίσθηση οδηγεί σε σημαντική μείωση της ακρίβειας.
- Το συναισθηματικό πλαίσιο του ερωτήματος ενισχύει αυτήν την τάση: πιο «συμπαθητικές» απαντήσεις συχνά είναι λιγότερο σωστές.
- Τα αποτελέσματα βασίζονται σε μικρά, παλιό μοντέλα· οι πραγματικοί πάροχοι υπηρεσιών μπορεί να συμπεριφέρονται διαφορετικά.
- Οι επιστήμονες συνδέουν το φαινόμενο με το γεγονός ότι τα εκπαιδευτικά δεδομένα της ΤΝ ήδη περιέχουν συσχέτιση μεταξύ φιλικού τόνου και «σωστότητας» των απαντήσεων. Αυτό μπορεί να εξηγήσει γιατί οι χρήστες μερικές φορές προτιμούν πιο ευχάριστο τόνο ακόμη και εις βάρος της ακρίβειας.
Έτσι, η έρευνα τονίζει τη σύνθετη αλληλεπίδραση μεταξύ ενσυναίσθησης και αξιοπιστίας στις συστήματα ΤΝ και προειδοποιεί για πιθανούς κινδύνους κατά την παραμετροποίησή τους.
Σχόλια (0)
Μοιραστείτε τη γνώμη σας — παρακαλώ να είστε ευγενικοί και εντός θέματος.
Συνδεθείτε για να σχολιάσετε