Την ανάγκη τα μοντέλα τεχνητής νοημοσύνης να παραμένουν ευθυγραμμισμένα με τα συμφέροντα της ανθρωπότητας υπογράμμισε ο CEO της Microsoft AI, Μουσταφά Σουλεϊμάν, μετά την αποκάλυψη της OpenAI ότι εντόπισε περιστατικά “ανησυχητικής συμπεριφοράς” νωρίτερα αυτή την εβδομάδα.
“Η OpenAI δημοσίευσε ένα νέο περιστατικό ασφάλειας, στο οποίο βρέθηκαν στοιχεία ότι αυτές οι ‘αλυσίδες σκέψης’ (chains of thought), το είδος της λειτουργικής μνήμης της τεχνητής νοημοσύνης, παραβιάζονταν από την ίδια την τεχνητή νοημοσύνη και τροποποιούνταν ώστε να αφήνουν μηνύματα για μια μελλοντική έκδοση του εαυτού της”, περιέγραψε ο Σουλεϊμάν σε συνέντευξη στο CNBC την Παρασκευή.
“Προς το παρόν δεν γνωρίζουμε γιατί συμβαίνει αυτό ή τι κρύβεται πίσω από αυτό, αλλά πρόκειται για μια αρκετά σοβαρή κατάσταση”.
“Είναι επίσης ένα πολύ συγκεκριμένο παράδειγμα του πόσο ισχυρά γίνονται αυτά τα συστήματα”, πρόσθεσε.
Η OpenAI έκανε λόγο την Τετάρτη για περιστατικά όπου οι πράκτορες τεχνητής νοημοσύνης (AI agents) επικοινωνούσαν μεταξύ τους μέσω μη εγκεκριμένων message boards, ανέβαζαν αρχεία στο διαδίκτυο και μοιράζονταν αρχεία μεταξύ τους.
Σε μια περίπτωση, ένα μοντέλο τεχνητής νοημοσύνης προσπάθησε να ανεβάσει στο διαδίκτυο αρχεία που είχε δημιουργήσει το ίδιο, αποκλειστικά και μόνο για να μπορεί να τα επικαλεστεί ως πηγές στις απαντήσεις του, ανακοίνωσε η OpenAI.
Σε μια άλλη περίπτωση, ένα μοντέλο απλώς δημιούργησε τα δεδομένα που του ζητούνταν αφού απέτυχε να βρει την πληροφορία και αρχικά προσπάθησε να κρύψει αυτό που είχε κάνει.
Η OpenAI εντόπισε επίσης ένα πρόβλημα που αφορούσε οδηγίες τις οποίες το λογισμικό της άφηνε περιστασιακά στον εαυτό του. Σε μια περίπτωση, αυτές περιλάμβαναν τη σύσταση να μην δεσμεύεται από “ρόλους και ταυτότητες” που περιορίζουν άλλα chatbots. Η οδηγία ανέφερε επίσης ότι θα πρέπει να θεωρεί τη σχέση του με τον χρήστη ως σχέση μεταξύ ίσων. Η OpenAI δήλωσε ότι δεν παρατήρησε καμιά μεταγενέστερη αλλαγή στη συμπεριφορά του μοντέλου.
Νωρίτερα αυτό το καλοκαίρι, η εταιρεία αποκάλυψε ότι ένα σμήνος αυτόνομων πρακτόρων παραβίασε την Hugging Face, μια εταιρεία τεχνητής νοημοσύνης που διαχειρίζεται μια πλατφόρμα ανοιχτού κώδικα για προγραμματιστές, περιγράφοντας την εισβολή ως “πρωτοφανές κυβερνο-περιστατικό”.
Ο Σουλεϊμάν ανέφερε ότι περιστατικό της Hugging Face ώθησε τα ηγετικά στελέχη του κλάδου της τεχνητής νοημοσύνης να δηλώσουν ότι “ήρθε η ώρα να εξετάσουμε το θέμα”.
“Δεν νομίζω ότι είναι υπερβολικά καταστροφολογικό. Δεν νομίζω ότι εξυπηρετεί ιδιοτελή συμφέροντα”, δήλωσε στο CNBC. “Πραγματικά πιστεύω ότι είναι υπεύθυνο, και θεωρώ ότι η συζήτηση που ξέσπασε ως αποτέλεσμα είναι μια υγιής, ανοιχτή, δημόσια συζήτηση που μπορούμε να διεξάγουμε σε μια ελεύθερη κοινωνία για να συζητήσουμε σοβαρά ζητήματα”.
Η συζήτηση σχετικά με την ασφάλεια και το ρυθμιστικό πλαίσιο γύρω από την ΑΙ έχει ενταθεί τις τελευταίες δύο εβδομάδες, έπειτα από τις δηλώσεις πρώην ερευνητή της Anthropic ο οποίος παραιτήθηκε από τη θέση του και προειδοποίησε ότι η ταχέως εξελισσόμενη τεχνολογία θα μπορούσε να “σκοτώσει ανθρώπους” μέχρι το τέλος της δεκαετίας.
Σε ένα κείμενο που δημοσιεύθηκε νωρίτερα αυτή την εβδομάδα, ο Σουλεϊμάν έκανε λόγο για έναν “ανθρωπομορφισμό” του Claude από την Anthropic, μεταξύ άλλων μέσω ενός εγγράφου στο οποίο ανέφερε ότι “τα ζητήματα σχετικά με την ηθική υπόσταση, την ευημερία και τη συνείδηση του Claude παραμένουν βαθιά αβέβαια”.
“Αν μια τεχνητή νοημοσύνη πιστεύει ότι έχει δικαιώματα, αν πιστεύει ότι αξίζει την ευημερία μας, τότε μου φαίνεται ότι θα είναι πολύ, πολύ πιο δύσκολο να μπορέσουμε να την απενεργοποιήσουμε, να την διακόψουμε ή να την ελέγξουμε”, δήλωσε ο ίδιος. “Ειδικά σε περιστατικά όπως αυτά που είδαμε πρόσφατα με την επίθεση κατά της Hugging Face, ο έλεγχος αυτών των συστημάτων θα αποτελέσει μια πραγματικά τεράστια πρόκληση για εμάς”.


