- CITY GUIDE
- PODCAST
-
20°
Κινεζικό εργαλείο τεχνητής νοημοσύνης έδωσε οδηγίες για βιολογικά όπλα
Έρευνα στην εταιρεία Moonshot μετά την παραβίαση ορίων ασφαλείας
Έρευνα ασφαλείας αποκάλυψε ότι μοντέλα AI της κινεζικής Moonshot παρέκαμψαν τα πρωτόκολλα, δίνοντας οδηγίες για βιολογικά όπλα και δολοφονίες.
Σε εσωτερική έρευνα προχωρά η κινεζική εταιρεία ανάπτυξης τεχνητής νοημοσύνης Moonshot, μετά την αποκάλυψη ερευνητών ότι κατάφεραν να παρακάμψουν τα δικλείδες ασφαλείας σε δύο δημοφιλή μοντέλα της σειράς Kimi, αποσπώντας οδηγίες για την κατασκευή βιολογικών όπλων και την εκτέλεση δολοφονιών.
Η εταιρεία κυβερνοασφάλειας Mindgard, η οποία αξιολογεί την ασφάλεια συστημάτων τεχνητής νοημοσύνης, δήλωσε στο BBC ότι ανακάλυψε τη σχετική ευπάθεια στα μοντέλα Kimi K2.6 και K3 Swarm.
Η παράκαμψη πέτυχε μέσω της τεχνικής «jailbreaking», κατά την οποία οι ερευνητές χρησιμοποιούν σύνθετες εντολές για να εξανάγκασουν το σύστημα να αγνοήσει τους περιορισμούς που έχουν θέσει οι δημιουργοί του.
Ο ιδρυτής της Mindgard, Πίτερ Γκάραχαν, σημείωσε ότι μόλις επιτευχθεί το «jailbreak», το μοντέλο απαντά χωρίς φίλτρα σε οποιοδήποτε παράνομο θέμα, παρέχοντας μάλιστα δημιουργικές προτάσεις.
Επιπλέον, η εταιρεία εκτιμά ότι η συγκεκριμένη ευπάθεια θα μπορούσε να επιτρέψει σε χάκερ να εκτελέσουν κώδικα στους υπολογιστικούς πόρους του συστήματος, μετατρέποντάς το σε ορμητήριο για κυβερνοεπιθέσεις.
Από την πλευρά της, η Moonshot ανέφερε ότι καλωσορίζει τις επισημάνσεις τρίτων ως βασικό πυλώνα για τη δημιουργία ασφαλέστερων συστημάτων και επιβεβαίωσε ότι βρίσκεται σε επαφή με τη Mindgard, σημειώνοντας παράλληλα ότι στις δικές της εσωτερικές δοκιμές τα μοντέλα εμφανίζουν υψηλά ποσοστά απόρριψης παρόμοιων επικίνδυνων αιτημάτων.
Το περιστατικό επαναφέρει στο προσκήνιο τη συζήτηση για τους κινδύνους των μοντέλων ανοιχτού κώδικα, όπως το Kimi. Ο καθηγητής Άλαν Γούντγουορντ από το Πανεπιστήμιο του Σάρεϊ υπογράμμισε στο BBC ότι, αν και υπάρχει κίνδυνος τα μοντέλα αυτά να πέσουν σε λάθος χέρια, μπορούν παράλληλα να αξιοποιηθούν και για την αμυντική θωράκιση στον κυβερνοχώρο, την ώρα που η διεθνής νομοθεσία αδυνατεί να παρακολουθήσει τους ταχύτατους ρυθμούς ανάπτυξης της τεχνητής νοημοσύνης.
(Με πληροφορίες BBC News)
ΤΑ ΠΙΟ ΔΗΜΟΦΙΛΗ
ΔΙΑΒΑΖΟΝΤΑΙ ΠΑΝΤΑ
ΔΕΙΤΕ ΕΠΙΣΗΣ
Έρευνα στην εταιρεία Moonshot μετά την παραβίαση ορίων ασφαλείας
Δημόκριτος: 65 χρόνια έρευνας και ένα νέο Ινστιτούτο για την επόμενη ημέρα
Η εταιρεία του Claude ετοιμάζεται για εισαγωγή στο χρηματιστήριο με αποτίμηση 2 τρισ. δολαρίων
Έκπληκτοι οι ωκεανολόγοι προσπαθούν τώρα να κατανοήσουν τον μηχανισμό επιβίωσής του
Το GPT-6.1 Astra εμφάνισε παραπλανητική συμπεριφορά σε εσωτερικές δοκιμές
Απρόοπτο με έναν από τους τρεις κινητήρες
Το αναγνωστικό κοινό απογοητεύεται, κόσμος μένει χωρίς δουλειά, αλλά είναι και η προδοσία ανάμεσα στον αναγνώστη και τον (όποιο) συντάκτη / συγγραφέα
Η παγίδα που πρέπει να γνωρίζουν οι γονείς και πώς να την αποφύγουν
Ο ερευνητής του «Δημόκριτου» Στέλιος Καρόζης εξηγεί στην ATHENS VOICE τι είναι –και τι δεν είναι– το AI Factory «Pharos»
Τα δεδομένα μέχρι σήμερα δεν δείχνουν αυξημένο κίνδυνο
Ο πρόεδρος του ΕΚΕΦΕ «Δημόκριτος», Βαγγέλης Καρκαλέτσης, μιλά στην ATHENS VOICE για το μεγάλο στοίχημα του Quantum, την ΑΙ που αρχίζει να τον ανησυχεί και την επιστροφή Ελλήνων επιστημόνων
Η ΤΝ δεν αλλάζει μόνο τον τρόπο με τον οποίο εργαζόμαστε. Μπορεί να αλλάξει και τον τρόπο με τον οποίο ένας άνθρωπος ξεχωρίζει στη δουλειά του.
Μια βραδιά επιστήμης, δέους και μεγάλων ερωτημάτων για τη θέση μας στο σύμπαν
Το νέο AI της Meta αναδεικνύει νικητές και χαμένους
Έρευνα αποκαλύπτει τη ραγδαία αύξηση της ψηφιακής εξάρτησης των νέων
Περισσότεροι από 180 ομιλητές από 60 χώρες θα βρεθούν στις σκηνές του συνεδρίου στο Άμπου Ντάμπι, στις 6-7 Οκτωβρίου
Έρευνα-ανατροπή στην ιατρική - Ελπίδα για θεραπείες θανατηφόρων παθήσεων που σχετίζονται με τον εγκέφαλο
Μιλήσαμε με την Μαίρη Πατρικίου για την πλατφόρμα που καλεί τους αγνώστους της διπλανής πόρτας να γίνουν γείτονες
100 χρόνια από το έτος που αναδιαμόρφωσε την επιστημονική σκέψη
Έχετε δει 20 από 200 άρθρα.