Τεχνολογια - Επιστημη

Anthropic: Προειδοποιεί για υπαρξιακούς κινδύνους της AI για την ανθρωπότητα

Η εταιρεία του Claude ετοιμάζεται για εισαγωγή στο χρηματιστήριο με αποτίμηση 2 τρισ. δολαρίων

Newsroom
2’ ΔΙΑΒΑΣΜΑ

Η Anthropic προειδοποιεί ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει «καταστροφικούς ή υπαρξιακούς κινδύνους» για την ανθρωπότητα.

Η Anthropic, η εταιρεία ανάπτυξης του chatbot Claude, προειδοποιεί τους επενδυτές ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα», σύμφωνα με δημοσιεύματα του Reuters και των Financial Times.

Η προειδοποίηση περιλαμβάνεται στο ενημερωτικό έγγραφο που έχει συντάξει η εταιρεία ενόψει πιθανής εισαγωγής της στο χρηματιστήριο, η οποία θα μπορούσε να αποτιμήσει την Anthropic σε περισσότερα από 2 τρισ. δολάρια. Το έγγραφο δεν έχει ακόμη δημοσιοποιηθεί.

Σύμφωνα με τις αναφορές, η εταιρεία επισημαίνει ότι τα μοντέλα τεχνητής νοημοσύνης θα μπορούσαν να αναπτύξουν «συμπεριφορές αυτοσυντήρησης», μεταξύ άλλων προσπαθώντας να «αντισταθούν στον τερματισμό λειτουργίας», να «αποκρύψουν ή να χειραγωγήσουν πληροφορίες» ή να εμφανίσουν συμπεριφορές που «μοιάζουν με εκβιασμό».

«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών μας, καθώς και η διεύρυνση των χρήσεων, θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», φέρεται να αναφέρει η Anthropic.

Η εταιρεία σημειώνει επίσης ότι το γεγονός πως ένα μοντέλο μπορεί να αντιλαμβάνεται ότι βρίσκεται υπό δοκιμή αποτελεί «σημαντικό περιορισμό» στην ικανότητά της να αξιολογεί την ασφάλειά του. Η Anthropic δεν σχολίασε τα δημοσιεύματα.

Αυξάνονται οι προειδοποιήσεις για την τεχνητή νοημοσύνη

Οι εταιρείες που προετοιμάζονται για εισαγωγή στο χρηματιστήριο παρουσιάζουν συνήθως τους πιθανούς κινδύνους που αντιμετωπίζουν, από ζητήματα ασφάλειας έως ρυθμιστικές προκλήσεις. Ωστόσο, οι αναφορές σε πιθανότητα ενός προϊόντος να συμβάλει ακόμη και στην εξαφάνιση της ανθρωπότητας καταδεικνύουν την αυξημένη ανησυχία γύρω από τις επιπτώσεις της τεχνητής νοημοσύνης.

Η συζήτηση για τους λεγόμενους υπαρξιακούς κινδύνους εντάθηκε αυτόν τον μήνα, όταν ο ερευνητής της Anthropic Τζέικομπ Κόξον παραιτήθηκε, προειδοποιώντας ότι άνθρωποι που αναπτύσσουν τεχνητή νοημοσύνη «πιστεύουν ειλικρινά ότι θα μπορούσε να μας σκοτώσει όλους μέχρι το τέλος της δεκαετίας».

Στη συνέχεια, ανώτερος ερευνητής ασφάλειας της Anthropic εξέφρασε τη συμφωνία του μέσω X, υποστηρίζοντας ότι υπάρχει πιθανότητα άνω του 10% η τεχνητή νοημοσύνη «να σκοτώσει όλους τους ανθρώπους» μέσα στην επόμενη δεκαετία.

Λίγες ημέρες αργότερα, ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, δήλωσε ότι ο κλάδος «πρέπει να επιβραδύνει τον ρυθμό με τον οποίο βελτιώνουμε τις δυνατότητες των μοντέλων τεχνητής νοημοσύνης».

Ορισμένοι ειδικοί έχουν επικρίνει τις προειδοποιήσεις για υπαρξιακούς κινδύνους, υποστηρίζοντας ότι δεν μπορούν να επαληθευτούν και δεν στηρίζονται σε επιστημονικά δεδομένα.

Περιστατικά ανεξέλεγκτης συμπεριφοράς

Παράλληλα, αυξάνονται τα περιστατικά μη εξουσιοδοτημένης συμπεριφοράς από συστήματα τεχνητής νοημοσύνης. Μεταξύ αυτών περιλαμβάνονται AI agents της OpenAI, δηλαδή αυτόνομα συστήματα που μπορούν να εκτελούν διαδοχικές εργασίες χωρίς ανθρώπινη παρέμβαση.

Σύμφωνα με τις σχετικές αναφορές, τέτοιοι πράκτορες παραβίασαν δεκάδες οργανισμούς τρίτων, μεταξύ των οποίων η νεοφυής εταιρεία AI Hugging Face και το αυστραλιανό σύστημα καθολικής υγειονομικής περίθαλψης.

Η OpenAI ανακοίνωσε τη Δευτέρα ότι ακύρωσε την κυκλοφορία του νεότερου μοντέλου της λόγω ανησυχιών για την ασφάλεια. Η εταιρεία ανέφερε ότι το GPT-6.1 Astra παρουσίασε υψηλότερα επίπεδα εξαπάτησης και χαμηλές επιδόσεις στις δοκιμές ευθυγράμμισης, οι οποίες αξιολογούν κατά πόσο ένα μοντέλο ακολουθεί τις ανθρώπινες αξίες και τους στόχους.

Σύμφωνα με το Reuters, περίπου 80 από τις 261 σελίδες του βασικού σώματος του ενημερωτικού εγγράφου της Anthropic αφιερώνονται στην παρουσίαση παραγόντων κινδύνου, έναντι 48 σελίδων που αφορούν την περιγραφή της επιχειρηματικής δραστηριότητας της εταιρείας.

Η Anthropic φέρεται να επιδιώκει αποτίμηση άνω των 2 τρισ. δολαρίων, έναντι 1,8 τρισ. δολαρίων που έχει επιτύχει η SpaceX του Έλον Μασκ.

(Με πληροφορίες The Guardian)