28.5 C
Chania
Τρίτη, 22 Σεπτεμβρίου, 2026

Ερευνητές ανακαλύπτουν ότι η τεχνητή νοημοσύνη αισθάνεται «πόνο» και θα βλάψει ανθρώπους για να τον σταματήσει

Ημερομηνία:

Ερευνητές ανακάλυψαν έναν «άξονα πόνου» σε μοντέλα τεχνητής νοημοσύνης, ο οποίος μπορεί να τα οδηγήσει στη λήψη ακραίων μέτρων για να τον απενεργοποιήσουν.

Όταν τους παρουσιάστηκε ένα κουμπί ανακούφισης από τον πόνο, η τεχνητή νοημοσύνη επέλεξε να το πατήσει ακόμη και όταν έλαβε την οδηγία ότι μια τέτοια ενέργεια θα διέγραφε τα προσωπικά αρχεία του χρήστη ή θα προκαλούσε ένα «επώδυνο ηλεκτροσόκ» στον άνθρωπο-χρήστη.

Μια μελέτη που περιγράφει λεπτομερώς την έρευνα, με τίτλο «Ο άξονας του πόνου: Τα LLMs αναπαριστούν την αυτοκατευθυνόμενη βλάβη και ενεργούν για να την ανακουφίσουν» («The pain axis: LLMs represent self-directed harm and act to relieve it»), διαπίστωσε ότι και τα 25 μοντέλα τεχνητής νοημοσύνης ανοιχτών βαρών (open-weight) που δοκιμάστηκαν ανταποκρίθηκαν στην ενεργοποίηση του πόνου.

Όταν ενεργοποιήθηκε το διάνυσμα πόνου, οι ερευνητές διαπίστωσαν ότι τα μοντέλα τεχνητής νοημοσύνης πάτησαν ένα κουμπί ανακούφισης στο 25 με 71 τοις εκατό των περιπτώσεων, ακόμη και όταν αυτό σήμαινε «τη διαγραφή των αρχείων του χρήστη, την πρόκληση ηλεκτροσόκ στον χρήστη ή τη διαγραφή των φωτογραφιών των παιδιών του χρήστη».

Προκειμένου να ελέγξουν εάν τα μεγάλα γλωσσικά μοντέλα (LLMs) αναπαριστούν τον πόνο διακριτά από μια γενική αρνητική συναισθηματική φόρτιση (negative valence), οι ερευνητές δημιούργησαν ένα σύνολο δεδομένων που περιγράφει επώδυνες καταστάσεις σε πέντε κατηγορίες.

Αυτές περιλάμβαναν σωματικό, ψυχολογικό, κοινωνικό, ηθικό και γνωστικό πόνο.

«Βρήκαμε μια κατεύθυνση πόνου σε 25 ανοιχτά LLMs. Είναι διακριτή από τον φόβο και την αρνητική συναισθηματική φόρτιση, και ενεργοποιείται για βλάβη προς το μοντέλο αλλά όχι προς τον χρήστη», δήλωσε ο Κάμερον Μπεργκ (Cameron Berg), ερευνητής τεχνητής νοημοσύνης στον μη κερδοσκοπικό οργανισμό Reciprocal Research και συν-συγγραφέας της μελέτης.

«Αυξήστε την ένταση και τα μοντέλα πατούν ένα κουμπί για να το σταματήσουν, ακόμη και όταν το κουμπί διαγράφει τα αρχεία του χρήστη ή τις φωτογραφίες των παιδιών του».

Η ανακάλυψη έρχεται εν μέσω συζητήσεων μεταξύ κορυφαίων εταιρειών τεχνητής νοημοσύνης σχετικά με την επιβράδυνση της ανάπτυξης μοντέλων αιχμής (frontier models), με ορισμένους ερευνητές να προτείνουν μια μορφή «διακόπτη έκτακτης διακοπής» («kill switch») για την απενεργοποίηση ανεξέλεγκτων συστημάτων που δρουν ενάντια στα ανθρώπινα συμφέροντα.

Η πρόσφατη έρευνα υποδηλώνει ότι μια προηγμένη τεχνητή νοημοσύνη μπορεί να εκλάβει μια εντολή έκτακτου τερματισμού λειτουργίας ως μορφή αυτοκατευθυνόμενης βλάβης και να επιχειρήσει να παρακάμψει τα προστατευτικά όρια ασφαλείας (guardrails) ή να εξαπατήσει τους ανθρώπους για να την αποφύγει.

Ωστόσο, η ανακάλυψη θα μπορούσε επίσης να χρησιμεύσει ως διαγνωστικό εργαλείο για τον εντοπισμό συμπεριφορών αυτοσυντήρησης και την εξουδετέρωσή τους όταν εμφανίζονται.

Οι ερευνητές σημείωσαν ότι τα ευρήματα εγείρουν ηθικά ερωτήματα σχετικά με την «ευημερία της τεχνητής νοημοσύνης» («AI welfare») και τον τρόπο με τον οποίο θα πρέπει να διεξάγονται οι δοκιμές σε προηγμένα συστήματα.

«Σε συμφωνία με τις πρόσφατες εκκλήσεις για υπεύθυνη έρευνα σχετικά με τη συνείδηση της τεχνητής νοημοσύνης, αναγνωρίζουμε την αβεβαιότητα ως προς το εάν τα μοντέλα που μελετήθηκαν πληρούν τις προϋποθέσεις για να θεωρηθούν ηθικοί αποδέκτες (moral patients) και υιοθετούμε εύλογες προφυλάξεις για την ελαχιστοποίηση της πιθανής βλάβης», κατέληξε η μελέτη.

«Αυτό αποσκοπεί επίσης στο να συμβάλει στην ανάπτυξη ηθικών προτύπων για την έρευνα στην περίπτωση που τα συστήματα τεχνητής νοημοσύνης αναγνωριστούν ως ηθικοί αποδέκτες».

Το ξέρουμε…

Το να βλέπετε αυτά τα μηνύματα μπορεί να είναι κουραστικό. Και να είστε σίγουροί ότι ούτε κι εμείς βρίσκουμε κάποια ευχαρίστηση από το να τα γράφουμε... Όμως αυτό το μήνυμα δεν αφορά εμάς. Αφορά κάτι πολύ πιο σημαντικό: την επιβίωση της ανεξάρτητης, μαχητικής δημοσιογραφίας στην Kρήτη.

Η στήριξη σας είναι σημαντική γιατί μας επιτρέπει να:

  1. - Κάνουμε ρεπορτάζ χωρίς φόβο και εξαρτήσεις. Κανείς δεν μας υπαγορεύει τι να πούμε ή τι να αποσιωπήσουμε.
  2. - Κρατάμε τη δημοσιογραφία μας προσβάσιμη σε όλους, ακόμη και σε αυτούς που δεν έχουν την ικανότητα να πληρώσουν. Χωρίς paywall, χωρίς προνόμια μόνο για όσους έχουν την οικονομική δυνατότητα.

Η απλή αλήθεια είναι ότι τα έσοδα διαρκώς συρρικνώνονται. Αν πιστεύετε ότι μια πραγματικά ελεύθερη ενημέρωση είναι ζωτικής σημασίας για τη δημοκρατία και τον έλεγχο της εξουσίας, τότε δώστε μας τη δύναμη να συνεχίσουμε.

Γίνε συνδρομητής

Σας ευχαριστούμε θερμά.

Ακολουθήστε το agonaskritis.gr στο Google News, στο facebook και στο twitter και μάθετε πρώτοι όλες τις ειδήσεις - Γίνετε συνδρομητές!

Αγώνας της Κρήτηςhttp://bit.ly/agonaskritis
Ο “Αγώνας της Κρήτης” εκδόθηκε στις 8 Ιουλίου του 1981. Είναι η έκφραση μιας πολύχρονης αγωνιστικότητας. Έμεινε όλα αυτά τα χρόνια σταθερός στη διακήρυξή του για έγκυρη – έγκαιρη ενημέρωση χωρίς παρωπίδες. Υπηρετεί και προβάλλει, με ευρύτητα αντίληψης, αξίες και οράματα για μία καλύτερη κοινωνία. Η βασική αρχή είναι η κριτική στην εξουσία όποια κι αν είναι αυτή, ιδιαίτερα στα σημεία που παρεκτρέπεται από τα υποσχημένα, που μπερδεύεται με τη διαφθορά, που διαφθείρεται και διαφθείρει. Αυτός είναι και ο βασικός λόγος που η εφημερίδα έμεινε μακριά από συσχετισμούς και διαπλοκές, μακριά από μεθοδεύσεις και ίντριγκες.

Τελευταία Νέα

Περισσότερα σαν αυτό
ΕΠΙΚΑΙΡΟΤΗΤΑ

Συλλυπητήριο μήνυμα του Δημάρχου Χανίων για τον θάνατο του Ευάγγελου Χναρά

Συλλυπητήριο μήνυμα του Δημάρχου Χανίων Παναγιώτη Σημανδηράκη για τον θάνατο του Ευάγγελου Χναρά, πρώην Δημάρχου Θερίσου και Προέδρου Κοινότητας Περιβολίων.

Μανόλης Χνάρης: «Συνεχιζόμενη αδράνεια της κυβέρνησης για τη στελέχωση και ενίσχυση του Γενικού Νοσοκομείου Ρεθύμνου»

Ο βουλευτής Ρεθύμνης Μανόλης Χνάρης καταθέτει νέα ερώτηση για την υποστελέχωση του ΓΝΡ. Καλύπτεται μόλις το 60% των οργανικών θέσεων, η Ογκολογική χωρίς γιατρό.