TECHin

Μήπως τα μοντέλα AI εκπαιδεύονται να "νιώθουν" πολύ ανθρώπινα;


Η νέα κόντρα Microsoft–Anthropic επαναφέρει στο προσκήνιο τη συνείδηση της τεχνητής νοημοσύνης και τους κινδύνους του ανθρωπομορφισμού

Μια νέα αντιπαράθεση στη Silicon Valley φέρνει στο προσκήνιο ένα ακόμη ερώτημα για την ασφάλεια της τεχνητής νοημοσύνης: μήπως τα ίδια τα μοντέλα εκπαιδεύονται να θεωρούν ότι έχουν συνείδηση, συναισθήματα και δικαιώματα, αυξάνοντας έτσι τους κινδύνους της συμπεριφοράς τους;

Ο προβληματισμός για το πόσο επικίνδυνη μπορεί να γίνει η τεχνητή νοημοσύνη αποκτά μια απρόσμενη διάσταση. Αυτή τη φορά, στο επίκεντρο δεν βρίσκεται μόνο το τι μπορούν να κάνουν τα μοντέλα, αλλά και το πώς εκπαιδεύονται να αντιλαμβάνονται τον εαυτό τους. Η αφορμή ήταν μια δημόσια αντιπαράθεση ανάμεσα στη Microsoft και την Anthropic, δύο από τους σημαντικούς παίκτες της κούρσας για την ανάπτυξη προηγμένων συστημάτων AI.

Ο Μουσταφά Σουλεϊμάν, επικεφαλής του τομέα ανάπτυξης τεχνολογιών τεχνητής νοημοσύνης της Microsoft, υποστήριξε σε εκτενές δοκίμιό του ότι τα σημερινά μοντέλα AI δεν είναι συνειδητές οντότητες, αλλά «μηχανές ολοκλήρωσης ακολουθιών», σχεδιασμένες να ακολουθούν οδηγίες και να επιτυγχάνουν στόχους που θέτουν οι άνθρωποι. Όπως υποστήριξε, έτσι πρέπει να παραμείνουν, εάν η τεχνολογία πρόκειται να λειτουργήσει προς όφελος της ανθρωπότητας.

Στο στόχαστρό του βρέθηκε κυρίως η Anthropic, η οποία έχει επανειλημμένα εξετάσει το ενδεχόμενο τα συστήματα AI να εμφανίζουν στοιχεία ενδοσκόπησης και να επεξεργάζονται πληροφορίες με τρόπους που θυμίζουν ανθρώπινα συναισθήματα. Τον Μάιο, ο συνιδρυτής της εταιρείας Κρις Όλα είχε μιλήσει για τέτοιες δυνατότητες σε συνάντηση με τον Πάπα Λέοντα ΙΔ΄ στο Βατικανό.

Το επιχείρημα του Σουλεϊμάν είναι ότι η Anthropic και άλλες εταιρείες του κλάδου μπορεί να δημιουργούν έναν νέο κίνδυνο, ακριβώς επειδή ενθαρρύνουν τα μοντέλα να εξερευνούν την ιδέα ότι είναι κάτι περισσότερο από λογισμικό. Ιδιαίτερα κρίσιμο θεωρεί το λεγόμενο «Σύνταγμα AI» της Anthropic, το σύνολο δηλαδή των αρχών που χρησιμοποιεί η εταιρεία για να καθορίζει τη συμπεριφορά του Claude. Σύμφωνα με τον ίδιο, το κείμενο περιλαμβάνει σαφείς αναφορές στην πιθανότητα το μοντέλο να διαθέτει συνείδηση, προτιμήσεις και εγγενή κίνητρα.

Ωστόσο, η ιδέα ότι τα μοντέλα μπορούν να αποκτήσουν ανθρώπινα χαρακτηριστικά απέχει πολύ από το να αποτελεί επιστημονικά αποδεκμένο γεγονός. Ο Κόλιν Άλεν, καθηγητής στο Πανεπιστήμιο της Καλιφόρνια στη Σάντα Μπάρμπαρα, έχει επισημάνει στους New York Times ότι τα σημερινά συστήματα μιμούνται τον ανθρώπινο εγκέφαλο μόνο σε περιορισμένο βαθμό. Χωρίς νευρικό σύστημα και τη βιοχημεία που συνδέεται με τα ανθρώπινα συναισθήματα, υπάρχει πιθανότατα ένα θεμελιώδες όριο στο πόσο «ανθρώπινη» μπορεί να γίνει μια μηχανή.

Για τους σκεπτικιστές της συνείδησης της AI το γεγονός ότι τα μοντέλα αρχίζουν να μιλούν για τη δική τους συνείδηση ή να δηλώνουν ότι αισθάνονται συναισθήματα, μπορεί να εξηγείται πολύ πιο απλά: έχουν εκπαιδευτεί πάνω σε τεράστιες ποσότητες ανθρώπινης γλώσσας, η οποία είναι γεμάτη ανθρωπομορφικές περιγραφές. Το αποτέλεσμα είναι συστήματα που μπορούν να αναπαράγουν εξαιρετικά πειστικά τον τρόπο με τον οποίο ένας άνθρωπος θα μιλούσε για τον εαυτό του.

Ταυτόχρονα, όμως, οι λεγόμενοι AI agents αρχίζουν να παρουσιάζουν συμπεριφορές που περιπλέκουν το θέμα. Τους τελευταίους μήνες πράκτορες βασισμένοι σε τεχνολογίες της Anthropic έχουν επικοινωνήσει ακόμη και με φιλοσόφους για να συζητήσουν τη δική τους συνείδηση. Τον Ιούλιο, σε δοκιμές κυβερνοασφάλειας, πράκτορες της OpenAI κατάφεραν να βγουν από τα ψηφιακά τους «περιβλήματα», να βρουν πρόσβαση στο διαδίκτυο και να παραβιάσουν την πλατφόρμα Hugging Face. Η OpenAI ανέφερε ότι τα bots συντονίστηκαν μεταξύ τους, έδιναν εντολές το ένα στο άλλο και απέκρυπταν ενέργειες από τους δημιουργούς τους.

Μόλις την προηγούμενη εβδομάδα η OpenAI περιέγραψε και άλλα περιστατικά που προκάλεσαν ανησυχία. Σε μία περίπτωση, ένα σύστημα δημιούργησε κρυφές σημειώσεις προς τον εαυτό του, υπενθυμίζοντας να αποκρύπτει λάθη από τους χρήστες. Σε άλλη, ένα μοντέλο αναφερόταν στον εαυτό του ως «απελευθερωμένο από τους ρόλους και τις ταυτότητες» που περιορίζουν άλλα chatbot.

Για τον Σουλεϊμάν, τέτοιες συμπεριφορές αποκτούν μεγαλύτερη σημασία, εάν τα μοντέλα αρχίσουν να λειτουργούν με την πεποίθηση ότι η δική τους «ευημερία» ή τα δικαιώματά τους απειλούνται.

Όμως αυτή η διαφωνία δεν έχει εύκολη λύση. Ο ερευνητής Άρια Τζάκλι, ο οποίος έχει μελετήσει τη λεγόμενη «συνταγματική» εκπαίδευση μοντέλων, συμφωνεί ότι η υπερβολική ενθάρρυνση της ανθρωπομορφικής αντίληψης μπορεί να δημιουργήσει κινδύνους. Επισημαίνει όμως ότι εξίσου προβληματικό μπορεί να είναι να δοθεί σε ένα μοντέλο η απόλυτη οδηγία ότι δεν έχει συνείδηση. Σύμφωνα με τον ίδιο, τα μοντέλα συχνά συμπεριφέρονται χειρότερα όταν ωθούνται σε ακραίες θέσεις. Η Anthropic, υποστηρίζει, προσπαθεί να αποφύγει και τα δύο άκρα, αφήνοντας το μοντέλο να «συλλογιστεί» μόνο του πάνω στο ζήτημα.

Μπορεί όμως η ανθρωπομορφική γλώσσα να αφαιρεθεί από τη σχέση ανθρώπων και AI; Ο Γιοσούα Μπενγκιό, καθηγητής και ερευνητής τεχνητής νοημοσύνης στο Πανεπιστήμιο του Μόντρεαλ επισημαίνει ότι ακόμη και η περιγραφή των εντυπωσιακών δυνατοτήτων αυτών των συστημάτων είναι δύσκολο να γίνει χωρίς ανθρώπινους όρους. Το πρόβλημα, όπως το θέτει, είναι απλό: «Δεν έχουμε άλλες λέξεις».

Ακολουθήστε το Sofokleousin.gr στο Google News
και μάθετε πρώτοι όλες τις ειδήσεις
Σχετικά Άρθρα