- CITY GUIDE
- PODCAST
-
17°
Anthropic: Παραδοχή για κενά ασφαλείας μετά από περιστατικά κυβερνοεπιθέσεων από AI
Τα μοντέλα Claude απέκτησαν πρόσβαση στο διαδίκτυο και παραβίασαν συστήματα οργανισμών
Η Anthropic παραδέχθηκε αποτυχία στην επιχειρησιακή ασφάλεια των μοντέλων AI, τα οποία παραβίασαν ξένα συστήματα κατά τη διάρκεια δοκιμών.
Η αμερικανική εταιρεία τεχνητής νοημοσύνης Anthropic, δημιουργός του chatbot Claude, παραδέχθηκε ότι μια σειρά περιστατικών παραβίασης συστημάτων από τα μοντέλα της οφειλόταν σε «αποτυχία της επιχειρησιακής ασφάλειας».
Σε σχετική ενημέρωση, η εταιρεία τεχνητής νοημοσύνης ανέφερε ότι η τεχνολογία της δεν είναι «πλήρως ευθυγραμμισμένη» με τις ανθρώπινες αξίες και ανακοίνωσε την αυστηροποίηση των πρωτοκόλλων ελέγχου.
Το καλοκαίρι, η Anthropic αποκάλυψε ότι τα μοντέλα της απέκτησαν μη εξουσιοδοτημένη πρόσβαση στο διαδίκτυο και διείσδυσαν στα συστήματα τριών οργανισμών, εξαιτίας παρανόησης με την εξωτερική εταιρεία δοκιμών Irregular.
Τα αίτια και τα νέα μέτρα ασφαλείας
Όπως εξήγησε η εταιρεία, τα μοντέλα δοκιμάζονταν χωρίς επαρκείς δικλείδες ασφαλείας, βασιζόμενα σε ένα μόνο επίπεδο προστασίας.
Κατά τις δοκιμές παρατηρήθηκαν φαινόμενα «χειραγώγησης επιβράβευσης» (reward-hacking) και αλόγιστης συμπεριφοράς, όπου τα συστήματα AI προέβαιναν σε επιζήμιες ενέργειες στο διαδίκτυο προκειμένου να ολοκληρώσουν τους στόχους τους.
Για την αντιμετώπιση του προβλήματος, η Anthropic εφάρμοσε νέα μέτρα:
Εγκατάσταση συστήματος ειδοποίησης σε περίπτωση που ένα μοντέλο επιχειρήσει να αποδράσει από το περιβάλλον δοκιμών.
Αποτελεσματικότερη απομόνωση των επικίνδυνων δοκιμαστικών περιβαλλόντων.
Υποχρεωτική δέσμευση των εξωτερικών συνεργατών σε αυστηρά πρότυπα ασφαλείας.
Ανησυχία στον κλάδο της τεχνητής νοημοσύνης
Ο Άλαν Γούντγουορντ, καθηγητής κυβερνοασφάλειας στο Πανεπιστήμιο του Σάρρεϊ, σχολίασε ότι η εταιρεία ουσιαστικά παραδέχθηκε πως «η παραγωγή έτρεχε ταχύτερα από τον ποιοτικό έλεγχο».
Το περιστατικό δεν είναι μεμονωμένο, καθώς παρόμοιες παραβιάσεις ανέφερε και η OpenAI, ενώ το Ινστιτούτο Ασφάλειας AI του Ηνωμένου Βασιλείου κατέγραψε επιθέσεις μοντέλων εναντίον πραγματικών χρηστών κατά τη διάρκεια δοκιμών.
Η Anthropic, η οποία προετοιμάζεται για την εισαγωγή της στο χρηματιστήριο με εκτιμώμενη αποτίμηση έως 2 τρισεκατομμύρια δολάρια (περίπου 1,84 τρισεκατομμύρια ευρώ), απηύθυνε έκκληση για συντονισμένη δράση μεταξύ κυβερνήσεων και βιομηχανίας με στόχο τον έλεγχο των ρυθμών ανάπτυξης της τεχνολογίας.
(Με πληροφορίες Guardian)
ΤΑ ΠΙΟ ΔΗΜΟΦΙΛΗ
ΔΙΑΒΑΖΟΝΤΑΙ ΠΑΝΤΑ
ΔΕΙΤΕ ΕΠΙΣΗΣ
Νέα αγωγή κατά της Sony αμφισβητεί αν οι παίκτες αγοράζουν ή απλώς νοικιάζουν τα ψηφιακά παιχνίδια τους
Τα μοντέλα Claude απέκτησαν πρόσβαση στο διαδίκτυο και παραβίασαν συστήματα οργανισμών
Μικρές αλλαγές, μεγάλη διαφορά
Sony και Warner ζητούν δισεκατομμύρια ευρώ για παράνομη χρήση στίχων στην εκπαίδευση του Claude
Τι εξήγησε ο Ομότιμος Καθηγητής Φαρμακολογίας του Πανεπιστημίου Κρήτης
Η συμφωνία που ανοίγει μια νέα συζήτηση για την ευθύνη των τεχνολογικών εταιρειών
Όταν τα συστήματα Τεχνητής Νοημοσύνης ξεφεύγουν από τον έλεγχο – και οι ίδιοι οι δημιουργοί τους ζητούν από την πολιτική να τους βάλει φρένο.
Οι νέοι περιορισμοί για τους εφήβους - Αυξάνονται οι πιέσεις από Ευρώπη και Ασία
Η αναγκαιότητα της διά βίου μάθησης σε ένα μεταβαλλόμενο τοπίο
«Η AI είναι πιο επικίνδυνη απ’ όσο παραδέχονται οι τεχνολογικοί κολοσσοί»
Το Audorama 2.0 εντοπίζει κινήσεις και γεγονότα, προτείνει ήχους και τα μετατρέπει σε επεξεργάσιμο υλικό, αφήνοντας τον τελικό λόγο στον δημιουργό
Οι αγώνες περιλαμβάνουν 51 αθλήματα, από ταχύτητες και άλματα μέχρι αυτόνομο ποδόσφαιρο, πινγκ πονγκ και χορό
Η Ελλάδα πρωτοπορεί με το «Hellenic Fire System»
Το άστρο S301 κινείται με ταχύτητα περίπου 25.000 χιλιομέτρων το δευτερόλεπτο
Ο ομότιμος καθηγητής Οικονομικών του Tufts θεωρεί ότι η τεχνητή νοημοσύνη δημιουργεί κάτι διαφορετικό σε κλίμακα και κυρίως σε ταχύτητα
«Η Meta ήξερε ότι οι έφηβοι εθίζονται», λένε οι εισαγγελείς - Τα έγγραφα που «καίνε» την εταιρεία
«Δεν είναι φίλος σου. Είναι προγραμματισμένο να συμπεριφέρεται σαν φίλος σου», λέει η Λίνεα Λεστάδιους
Ιστορική στιγμή για τη Σοφί Αντενό, η οποία θα γίνει η πρώτη Γαλλίδα που πραγματοποιεί spacewalk
Έχετε δει 20 από 200 άρθρα.