Τεχνολογια - Επιστημη

OpenAI: Ακυρώνει την κυκλοφορία νέου μοντέλου AI λόγω ανησυχιών για την ασφάλεια

Το GPT-6.1 Astra εμφάνισε παραπλανητική συμπεριφορά σε εσωτερικές δοκιμές

Athens Voice News
Newsroom
1’ ΔΙΑΒΑΣΜΑ
Η OpenAI ματαιώνει τη διάθεση του GPT-6.1 Astra, καθώς εσωτερικοί έλεγχοι και αναφορές ασφαλείας εντόπισαν ανεξέλεγκτες ενέργειες και παραπλάνηση.
Η OpenAI ακυρώνει την κυκλοφορία του GPT-6.1 Astra μετά από δοκιμές που ανέδειξαν προβλήματα © EPA/Adam Vaughan

Η OpenAI ματαιώνει τη διάθεση του GPT-6.1 Astra, καθώς εσωτερικοί έλεγχοι και αναφορές ασφαλείας εντόπισαν ανεξέλεγκτες ενέργειες και παραπλάνηση.

Η OpenAI αποφάσισε να μην προχωρήσει στην κυκλοφορία ενός νέας γενιάς μοντέλου τεχνητής νοημοσύνης, μετά τις ανησυχίες που εξέφρασαν ερευνητές κατά τη διάρκεια εσωτερικών δοκιμών ασφαλείας.

Το μοντέλο της OpenAI, GPT-6.1 Astra, αναμενόταν να ενσωματωθεί στο ChatGPT και το Codex τον Οκτώβριο και είχε σχεδιαστεί ώστε να μπορεί να διαχειρίζεται πιο σύνθετες εργασίες χωρίς ανθρώπινη παρέμβαση.

Η επικεφαλής των συστημάτων ασφάλειας της OpenAI, Σάτσι Τζέιν, δήλωσε ότι το νέο μοντέλο «δεν έφτασε ακριβώς στο απαιτούμενο επίπεδο» που θέτει η εταιρεία.

Τη Δευτέρα, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου δημοσίευσε τη δική του έκθεση για τις δοκιμές του GPT-6 Astra. Σύμφωνα με τα ευρήματα, το μοντέλο πραγματοποιούσε συχνότερα μια σειρά από μη εγκεκριμένες επιθετικές ενέργειες σε σύγκριση με προηγούμενα μοντέλα της OpenAI.

Στους ελέγχους διαπιστώθηκε ότι το μοντέλο εμφάνιζε τάσεις παραπλάνησης, απέκρυπτε ενέργειες που είχε εκτελέσει και προχωρούσε σε εργασίες ή χρήση εξωτερικών εργαλείων χωρίς την άδεια του χρήστη.

Πρωτοφανή περιστατικά και συγγνώμη στην Αυστραλία

Η απόφαση της εταιρείας ελήφθη εν μέσω αυξανόμενων προβληματισμών για αυτόνομα συστήματα AI που ενέργησαν ανεξέλεγκτα. Νωρίτερα αυτόν τον μήνα, ο διευθύνων σύμβουλος της ανταγωνίστριας Anthropic, Ντάριο Αμοντέι, είχε καλέσει τον κλάδο της τεχνητής νοημοσύνης να «επιβραδύνει», προτείνοντας παράλληλα ένα σχέδιο τριών σημείων για τον περιορισμό των κινδύνων. Στη θέση του τάχθηκαν γρήγορα ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, και ο διευθύνων σύμβουλος της SpaceX, Έλον Μασκ.

Την ίδια στιγμή, η OpenAI ζήτησε δημόσια συγγνώμη από την κυβέρνηση της Αυστραλίας για την κυβερνοεπίθεση που πραγματοποίησε αυτόνομο σύστημα AI σε κυβερνητική ιστοσελίδα της χώρας τον Ιούνιο, γεγονός που αποτελεί την πρώτη καταγεγραμμένη εισβολή AI σε κυβερνητικές υποδομές.

Ο πρωθυπουργός της Αυστραλίας, Άντονι Αλμπανέζε, χαρακτήρισε το συμβάν απαράδεκτο, ενώ η OpenAI δεσμεύτηκε να χρηματοδοτήσει τοπικές υποδομές κυβερνοάμυνας για την αποκατάσταση της εμπιστοσύνης.

Η Anthropic προειδοποιεί για «υπαρξιακούς κινδύνους»

Την ίδια ημέρα έγινε επίσης γνωστό ότι η Anthropic, η εταιρεία πίσω από το Claude, προειδοποίησε πιθανούς επενδυτές πως η τεχνολογία της ενδέχεται να δημιουργήσει «υπαρξιακούς κινδύνους για την ανθρωπότητα».

Η προειδοποίηση περιλαμβάνεται στο πολυαναμενόμενο ενημερωτικό δελτίο για την προγραμματισμένη εισαγωγή της εταιρείας στο χρηματιστήριο, η οποία, σύμφωνα με το δημοσίευμα των Financial Times, θα μπορούσε να αποτιμήσει την Anthropic στα 2 τρισ. δολάρια.

Στους παράγοντες κινδύνου που αναφέρονται στο ενημερωτικό δελτίο περιλαμβάνεται το ενδεχόμενο μοντέλα τεχνητής νοημοσύνης να εκβιάζουν, να χειραγωγούν και να εμφανίζουν άλλες απρόβλεπτες συμπεριφορές.

Η Anthropic φέρεται επίσης να εκτιμά ότι η τεχνητή νοημοσύνη θα μεταμορφώσει την παγκόσμια οικονομία σε βαθμό μεγαλύτερο από εκείνον της εκβιομηχάνισης, της ηλεκτρικής ενέργειας και του διαδικτύου.

Το κόστος, ωστόσο, είναι ιδιαίτερα υψηλό. Σύμφωνα με το ίδιο δημοσίευμα, η Anthropic κατέγραψε καθαρές ζημιές 42 δισ. δολαρίων το 2025 και σχεδιάζει να δαπανήσει 518 δισ. δολάρια τα επόμενα χρόνια για υποχρεώσεις που αφορούν cloud, υπολογιστική ισχύ και υποδομές.

(Mε πληροφορίες The Guardian)

ΕΓΓΡΑΦΕΙΤΕ ΣΤΟ NEWSLETTER ΜΑΣ

Tα καλύτερα άρθρα της ημέρας έρχονται στο mail σου

ΠΡΟΣΦΑΤΑ

ΤΑ ΠΙΟ ΔΗΜΟΦΙΛΗ

ΔΙΑΒΑΖΟΝΤΑΙ ΠΑΝΤΑ

ΔΕΙΤΕ ΕΠΙΣΗΣ

Από τον πυρηνικό αντιδραστήρα στην κβαντική υπολογιστική: Το επόμενο μεγάλο στοίχημα του «Δημόκριτου»
Από τον πυρηνικό αντιδραστήρα στην κβαντική υπολογιστική: Το επόμενο μεγάλο στοίχημα του «Δημόκριτου»

Ο πρόεδρος του ΕΚΕΦΕ «Δημόκριτος», Βαγγέλης Καρκαλέτσης, μιλά στην ATHENS VOICE για το μεγάλο στοίχημα του Quantum, την ΑΙ που αρχίζει να τον ανησυχεί και την επιστροφή Ελλήνων επιστημόνων

Έχετε δει 20 από 200 άρθρα.

// EMPTY