- CITY GUIDE
- PODCAST
-
23°
OpenAI: Ακυρώνει την κυκλοφορία νέου μοντέλου AI λόγω ανησυχιών για την ασφάλεια
Το GPT-6.1 Astra εμφάνισε παραπλανητική συμπεριφορά σε εσωτερικές δοκιμές
Η OpenAI ματαιώνει τη διάθεση του GPT-6.1 Astra, καθώς εσωτερικοί έλεγχοι και αναφορές ασφαλείας εντόπισαν ανεξέλεγκτες ενέργειες και παραπλάνηση.
Η OpenAI αποφάσισε να μην προχωρήσει στην κυκλοφορία ενός νέας γενιάς μοντέλου τεχνητής νοημοσύνης, μετά τις ανησυχίες που εξέφρασαν ερευνητές κατά τη διάρκεια εσωτερικών δοκιμών ασφαλείας.
Το μοντέλο της OpenAI, GPT-6.1 Astra, αναμενόταν να ενσωματωθεί στο ChatGPT και το Codex τον Οκτώβριο και είχε σχεδιαστεί ώστε να μπορεί να διαχειρίζεται πιο σύνθετες εργασίες χωρίς ανθρώπινη παρέμβαση.
Η επικεφαλής των συστημάτων ασφάλειας της OpenAI, Σάτσι Τζέιν, δήλωσε ότι το νέο μοντέλο «δεν έφτασε ακριβώς στο απαιτούμενο επίπεδο» που θέτει η εταιρεία.
Τη Δευτέρα, το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου δημοσίευσε τη δική του έκθεση για τις δοκιμές του GPT-6 Astra. Σύμφωνα με τα ευρήματα, το μοντέλο πραγματοποιούσε συχνότερα μια σειρά από μη εγκεκριμένες επιθετικές ενέργειες σε σύγκριση με προηγούμενα μοντέλα της OpenAI.
Στους ελέγχους διαπιστώθηκε ότι το μοντέλο εμφάνιζε τάσεις παραπλάνησης, απέκρυπτε ενέργειες που είχε εκτελέσει και προχωρούσε σε εργασίες ή χρήση εξωτερικών εργαλείων χωρίς την άδεια του χρήστη.
Πρωτοφανή περιστατικά και συγγνώμη στην Αυστραλία
Η απόφαση της εταιρείας ελήφθη εν μέσω αυξανόμενων προβληματισμών για αυτόνομα συστήματα AI που ενέργησαν ανεξέλεγκτα. Νωρίτερα αυτόν τον μήνα, ο διευθύνων σύμβουλος της ανταγωνίστριας Anthropic, Ντάριο Αμοντέι, είχε καλέσει τον κλάδο της τεχνητής νοημοσύνης να «επιβραδύνει», προτείνοντας παράλληλα ένα σχέδιο τριών σημείων για τον περιορισμό των κινδύνων. Στη θέση του τάχθηκαν γρήγορα ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, και ο διευθύνων σύμβουλος της SpaceX, Έλον Μασκ.
Την ίδια στιγμή, η OpenAI ζήτησε δημόσια συγγνώμη από την κυβέρνηση της Αυστραλίας για την κυβερνοεπίθεση που πραγματοποίησε αυτόνομο σύστημα AI σε κυβερνητική ιστοσελίδα της χώρας τον Ιούνιο, γεγονός που αποτελεί την πρώτη καταγεγραμμένη εισβολή AI σε κυβερνητικές υποδομές.
Ο πρωθυπουργός της Αυστραλίας, Άντονι Αλμπανέζε, χαρακτήρισε το συμβάν απαράδεκτο, ενώ η OpenAI δεσμεύτηκε να χρηματοδοτήσει τοπικές υποδομές κυβερνοάμυνας για την αποκατάσταση της εμπιστοσύνης.
Η Anthropic προειδοποιεί για «υπαρξιακούς κινδύνους»
Την ίδια ημέρα έγινε επίσης γνωστό ότι η Anthropic, η εταιρεία πίσω από το Claude, προειδοποίησε πιθανούς επενδυτές πως η τεχνολογία της ενδέχεται να δημιουργήσει «υπαρξιακούς κινδύνους για την ανθρωπότητα».
Η προειδοποίηση περιλαμβάνεται στο πολυαναμενόμενο ενημερωτικό δελτίο για την προγραμματισμένη εισαγωγή της εταιρείας στο χρηματιστήριο, η οποία, σύμφωνα με το δημοσίευμα των Financial Times, θα μπορούσε να αποτιμήσει την Anthropic στα 2 τρισ. δολάρια.
Στους παράγοντες κινδύνου που αναφέρονται στο ενημερωτικό δελτίο περιλαμβάνεται το ενδεχόμενο μοντέλα τεχνητής νοημοσύνης να εκβιάζουν, να χειραγωγούν και να εμφανίζουν άλλες απρόβλεπτες συμπεριφορές.
Η Anthropic φέρεται επίσης να εκτιμά ότι η τεχνητή νοημοσύνη θα μεταμορφώσει την παγκόσμια οικονομία σε βαθμό μεγαλύτερο από εκείνον της εκβιομηχάνισης, της ηλεκτρικής ενέργειας και του διαδικτύου.
Το κόστος, ωστόσο, είναι ιδιαίτερα υψηλό. Σύμφωνα με το ίδιο δημοσίευμα, η Anthropic κατέγραψε καθαρές ζημιές 42 δισ. δολαρίων το 2025 και σχεδιάζει να δαπανήσει 518 δισ. δολάρια τα επόμενα χρόνια για υποχρεώσεις που αφορούν cloud, υπολογιστική ισχύ και υποδομές.
(Mε πληροφορίες The Guardian)
ΤΑ ΠΙΟ ΔΗΜΟΦΙΛΗ
ΔΙΑΒΑΖΟΝΤΑΙ ΠΑΝΤΑ
ΔΕΙΤΕ ΕΠΙΣΗΣ
Το GPT-6.1 Astra εμφάνισε παραπλανητική συμπεριφορά σε εσωτερικές δοκιμές
Απρόοπτο με έναν από τους τρεις κινητήρες
Το αναγνωστικό κοινό απογοητεύεται, κόσμος μένει χωρίς δουλειά, αλλά είναι και η προδοσία ανάμεσα στον αναγνώστη και τον (όποιο) συντάκτη / συγγραφέα
Η παγίδα που πρέπει να γνωρίζουν οι γονείς και πώς να την αποφύγουν
Ο ερευνητής του «Δημόκριτου» Στέλιος Καρόζης εξηγεί στην ATHENS VOICE τι είναι –και τι δεν είναι– το AI Factory «Pharos»
Τα δεδομένα μέχρι σήμερα δεν δείχνουν αυξημένο κίνδυνο
Ο πρόεδρος του ΕΚΕΦΕ «Δημόκριτος», Βαγγέλης Καρκαλέτσης, μιλά στην ATHENS VOICE για το μεγάλο στοίχημα του Quantum, την ΑΙ που αρχίζει να τον ανησυχεί και την επιστροφή Ελλήνων επιστημόνων
Η ΤΝ δεν αλλάζει μόνο τον τρόπο με τον οποίο εργαζόμαστε. Μπορεί να αλλάξει και τον τρόπο με τον οποίο ένας άνθρωπος ξεχωρίζει στη δουλειά του.
Μια βραδιά επιστήμης, δέους και μεγάλων ερωτημάτων για τη θέση μας στο σύμπαν
Το νέο AI της Meta αναδεικνύει νικητές και χαμένους
Έρευνα αποκαλύπτει τη ραγδαία αύξηση της ψηφιακής εξάρτησης των νέων
Περισσότεροι από 180 ομιλητές από 60 χώρες θα βρεθούν στις σκηνές του συνεδρίου στο Άμπου Ντάμπι, στις 6-7 Οκτωβρίου
Έρευνα-ανατροπή στην ιατρική - Ελπίδα για θεραπείες θανατηφόρων παθήσεων που σχετίζονται με τον εγκέφαλο
Μιλήσαμε με την Μαίρη Πατρικίου για την πλατφόρμα που καλεί τους αγνώστους της διπλανής πόρτας να γίνουν γείτονες
100 χρόνια από το έτος που αναδιαμόρφωσε την επιστημονική σκέψη
Ο καβγάς για τις «πειραγμένες» οικογενειακές φωτογραφίες με τα εγγόνια
Γιατί η απόδοση ενός λογοτεχνικού έργου απαιτεί ερμηνεία, δημιουργικότητα και βαθιά σχέση με τη γλώσσα
Τα εργαλεία γεννούν καινούργιες ερωτήσεις
Το ψηφιακό άβαταρ μπέρδεψε τα λόγια του κατά τη διάρκεια τηλεοπτικής συνέντευξης
Έχετε δει 20 από 200 άρθρα.