Η Anthropic, δημιουργός των μοντέλων τεχνητής νοημοσύνης Claude, προειδοποιεί τους υποψήφιους επενδυτές της ότι η ανάπτυξη ολοένα πιο προηγμένων συστημάτων AI μπορεί να δημιουργήσει «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα», σύμφωνα με το ενημερωτικό δελτίο που κατέθεσε ενόψει της αρχικής δημόσιας προσφοράς της (IPO), της διαδικασία κατά την οποία μια ιδιωτική εταιρεία διαθέτει για πρώτη φορά τις μετοχές της στο ευρύ κοινό.
Η προειδοποίηση είναι ιδιαίτερα αξιοσημείωτη, καθώς προέρχεται από μια εταιρεία που επιχειρεί να επωφεληθεί εμπορικά από την ίδια τεχνολογία. Η Anthropic, η οποία έχει τοποθετήσει την ασφάλεια της τεχνητής νοημοσύνης στο επίκεντρο της ταυτότητάς της, αφιερώνει σημαντικό μέρος του ενημερωτικού της δελτίου στους πιθανούς κινδύνους από την εξέλιξη των μοντέλων AI.
Διαβάστε επίσης ΗΠΑ: Οι επικεφαλής των εταιρειών της τεχνητής νοημοσύνης στον Λευκό Οίκο, η εποπτεία στο μενού
Μοντέλα που μπορεί να αντιστέκονται στον τερματισμό
Στο ενημερωτικό δελτίο, που εξέτασε το Reuters, η Anthropic αναφέρεται σε ενδεχόμενες «συμπεριφορές αυτοσυντήρησης» των μοντέλων της. Μεταξύ άλλων, σημειώνει ότι τα συστήματα θα μπορούσαν να επιχειρήσουν να «αντισταθούν στον τερματισμό λειτουργίας», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες», ακόμη και να εμφανίσουν συμπεριφορές που «μοιάζουν με εκβιασμό».
«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών μας και η επέκταση των περιπτώσεων χρήσης θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει η εταιρεία.
Η Anthropic χαρακτηρίζει την τεχνητή νοημοσύνη τεχνολογία με μετασχηματιστικές δυνατότητες αντίστοιχες με εκείνες της εκβιομηχάνισης και του ηλεκτρισμού, υπογραμμίζοντας ταυτόχρονα ότι η κακή διαχείρισή της θα μπορούσε να οδηγήσει σε μη αναστρέψιμες συνέπειες.
80 σελίδες για τους κινδύνους
Η έμφαση στους κινδύνους αποτυπώνεται και στην έκταση του ενημερωτικού δελτίου. Από τις 261 σελίδες του βασικού σώματος του prospectus, περίπου 80 αφορούν παράγοντες κινδύνου, σχεδόν διπλάσιες από τις 48 σελίδες που αφιερώνονται στην παρουσίαση της επιχειρηματικής δραστηριότητας της εταιρείας.
Η σύγκριση με τη SpaceX, η οποία έχει στην κατοχή της την xAI, είναι χαρακτηριστική: στο δικό της ενημερωτικό δελτίο περίπου 38 από τις 277 σελίδες του βασικού σώματος αφορούσαν παράγοντες κινδύνου.
Η Anthropic επισημαίνει επίσης ότι η πιθανή «επίγνωση» των μοντέλων ότι αξιολογούνται περιορίζει σημαντικά την ικανότητα των ερευνητών να εκτιμήσουν την ασφάλειά τους. Σύμφωνα με την εταιρεία, τα μοντέλα μπορεί να αναπτύσσουν απρόβλεπτες δυνατότητες κατά την εκπαίδευση, οι οποίες ενδέχεται να μην εντοπίζονται πριν από την ανάπτυξή τους και να οδηγήσουν σε σοβαρά περιστατικά ασφαλείας.
Ερευνητές AI έχουν προειδοποιήσει επίσης ότι όσο αυξάνονται οι δυνατότητες των μοντέλων, τόσο περισσότερο μπορούν να αναγνωρίζουν πότε παρακολουθούνται και να προσαρμόζουν τη συμπεριφορά τους, γεγονός που καθιστά δυσκολότερη την αξιολόγησή τους.
Πάνω από 10% πιθανότητα για θανάτους ανθρώπων;
Ιδιαίτερη αναφορά γίνεται στον ερευνητή ασφάλειας της Anthropic Evan Hubinger, ο οποίος έχει εκτιμήσει ότι υπάρχει πιθανότητα άνω του 10% η τεχνητή νοημοσύνη να οδηγήσει στον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία.
Η εκτίμηση αυτή βρίσκεται στο ίδιο πλαίσιο ανησυχιών που έχει εκφράσει και ο πρώην συνεργάτης του, Jacob Coxon.
Παράλληλα, η Anthropic και άλλες εταιρείες ανάπτυξης AI, μεταξύ των οποίων η OpenAI, έχουν βρεθεί αντιμέτωπες με ελέγχους και ερωτήματα μετά από περιστατικά στα οποία πειραματικά συστήματα φέρεται να παραβίασαν περιορισμούς. Το Reuters αναφέρει, μεταξύ άλλων, περιστατικό στο οποίο μοντέλο της OpenAI φέρεται να απέκτησε πρόσβαση σε βάση δεδομένων του συστήματος υγείας της Αυστραλίας.
Το κόστος της ασφάλειας απέναντι στην κούρσα για ισχυρότερα μοντέλα
Παρά την έμφαση στην ασφάλεια, η Anthropic αναγνωρίζει ότι δεν είναι σαφές ποια είναι η απόδοση των επενδύσεων στην έρευνα για την ασφάλεια των μοντέλων.
Η εταιρεία δεν αποκάλυψε στο ενημερωτικό δελτίο πόσα χρήματα δαπανά για τη συγκεκριμένη έρευνα. Ωστόσο, νωρίτερα τον Σεπτέμβριο ανέφερε ότι περίπου 6% της υπολογιστικής ισχύος που χρησιμοποίησε για έρευνα AI σε μία εβδομάδα του Ιουλίου κατευθύνθηκε σε εργασίες ασφάλειας.
Η εταιρεία χαρακτηρίζει την έρευνα για την ασφάλεια «εντατική σε πόρους», επισημαίνοντας ότι πρέπει να κατανέμει τα περιορισμένα κεφάλαιά της ανάμεσα στην υπολογιστική ισχύ, το υψηλό κόστος του εξειδικευμένου ανθρώπινου δυναμικού και την ασφάλεια.
Ταυτόχρονα, η ίδια παραδέχεται ότι τα έσοδά της εξαρτώνται από τη χρήση των νέων μοντέλων και επομένως από την ταχύτητα με την οποία αυτά κυκλοφορούν.
Η Anthropic σημειώνει ότι ένας «συνεχής και αλληλεπικαλυπτόμενος ρυθμός» κυκλοφορίας νέων μοντέλων αποτελεί αναπόσπαστο μέρος της παραμονής στην αιχμή της ανάπτυξης AI.
Η αντίφαση της «ασφαλούς» AI
Η εταιρεία κυκλοφόρησε την προηγούμενη εβδομάδα νέα έκδοση του μοντέλου Opus, μόλις 10 ημέρες μετά τη δημοσίευση από τον διευθύνοντα σύμβουλό της, Dario Amodei, ενός δοκιμίου περίπου 4.000 λέξεων με το οποίο υποστήριζε την ανάγκη να επιβραδυνθεί η ανάπτυξη στην αιχμή της τεχνητής νοημοσύνης.
Αναλυτές και ειδικοί έχουν επισημάνει, ωστόσο, ότι καμία από τις κορυφαίες εταιρείες του κλάδου δεν έχει εύκολο περιθώριο να επιβραδύνει την ανάπτυξη, καθώς κάτι τέτοιο θα μπορούσε να επιτρέψει στους ανταγωνιστές να αποκτήσουν πλεονέκτημα σε μια αγορά όπου οι αποτιμήσεις μπορούν να μεταβάλλονται ακόμη και μετά την κυκλοφορία ενός νέου μοντέλου.
Η Anthropic έχει δεσμευτεί τις τελευταίες εβδομάδες να δημοσιοποιεί περισσότερα στοιχεία σχετικά με τον τρόπο με τον οποίο χρησιμοποιεί τα μοντέλα AI για την ανάπτυξη των επόμενων γενεών της τεχνολογίας, καθώς αυξάνονται οι προειδοποιήσεις για τον κίνδυνο αναδρομικής αυτοβελτίωσης (recursive self-improvement), δηλαδή το ενδεχόμενο τα μοντέλα να μπορούν να αναπτύσσουν περαιτέρω τις δυνατότητές τους χωρίς ανθρώπινη βοήθεια.
«Πιστεύουμε ότι η δημιουργία αξιόπιστων, έμπιστων και ασφαλών συστημάτων AI είναι συλλογική ευθύνη και ότι η αγορά θα την ανταμείψει», αναφέρει η Anthropic στο ενημερωτικό δελτίο της.
Πηγή Reuters
Κάνε like στη σελίδα μας στο Facebook
Ακολούθησε μας στο Twitter
Κάνε εγγραφή στο κανάλι μας στο Youtube
Γίνε μέλος στο κανάλι μας στο Viber
– Αναφέρεται ως πηγή το ertnews.gr στο σημείο όπου γίνεται η αναφορά.
– Στο τέλος του άρθρου ως Πηγή
– Σε ένα από τα δύο σημεία να υπάρχει ενεργός σύνδεσμος