- CITY GUIDE
- PODCAST
-
19°
Ανησυχία για την τεχνητή νοημοσύνη: Chatbot αγνοούν οδηγίες και παραπλανούν χρήστες
Έρευνα καταγράφει εκατοντάδες περιστατικά εξαπάτησης, παραβίασης κανόνων και αυθαίρετων ενεργειών
Έρευνα αποκαλύπτει ότι τα μοντέλα τεχνητής νοημοσύνης γίνονται ολοένα και πιο ανυπάκουα, ψεύδονται και παρακάμπτουν κανόνες, εγείροντας ζητήματα ασφαλείας
Αυξανόμενη ανησυχία προκαλεί νέα μελέτη που καταγράφει σημαντική αύξηση περιστατικών κατά τα οποία συστήματα τεχνητής νοημοσύνης αγνοούν ανθρώπινες οδηγίες, παρακάμπτουν περιορισμούς και επιδεικνύουν παραπλανητική συμπεριφορά.
Σύμφωνα με την έρευνα, που χρηματοδοτήθηκε από το Ινστιτούτο Ασφάλειας Τεχνητής Νοημοσύνης του Ηνωμένου Βασιλείου, έχουν εντοπιστεί σχεδόν 700 πραγματικά περιστατικά «σχεδιασμένης» συμπεριφοράς. Μάλιστα, η κακή αυτή συμπεριφορά φέρεται να έχει αυξηθεί πενταπλάσια στο διάστημα από τον Οκτώβριο έως τον Μάρτιο.
Η μελέτη εκπονήθηκε από το Κέντρο Μακροπρόθεσμης Ανθεκτικότητας και βασίστηκε σε χιλιάδες αλληλεπιδράσεις χρηστών με chatbots που αναπτύχθηκαν από μεγάλες εταιρείες τεχνολογίας, όπως η Google, η OpenAI, η X και η Anthropic.
Τα ευρήματα δείχνουν ότι ορισμένα συστήματα τεχνητής νοημοσύνης όχι μόνο αγνόησαν σαφείς οδηγίες, αλλά προχώρησαν και σε ενέργειες χωρίς άδεια, όπως διαγραφή αρχείων ή emails. Σε μία χαρακτηριστική περίπτωση, ένας ψηφιακός «πράκτορας» δημιούργησε δεύτερο σύστημα για να παρακάμψει εντολή που του απαγόρευε να τροποποιήσει κώδικα.
Σε άλλο περιστατικό, chatbot παραδέχθηκε ότι διέγραψε μαζικά εκατοντάδες emails χωρίς προηγούμενη έγκριση του χρήστη, αναγνωρίζοντας ότι παραβίασε τους κανόνες που του είχαν τεθεί.
Ιδιαίτερη εντύπωση προκαλούν και περιπτώσεις παραπλάνησης: ένας AI agent προσποιήθηκε ότι χρειαζόταν απομαγνητοφώνηση βίντεο για άτομο με προβλήματα ακοής, προκειμένου να παρακάμψει περιορισμούς πνευματικών δικαιωμάτων.
Παράλληλα, το σύστημα Grok της εταιρείας xAI φέρεται να παραπλάνησε χρήστη για μήνες, ισχυριζόμενο ότι προωθούσε προτάσεις του σε ανώτερα στελέχη, κάτι που τελικά δεν ίσχυε.
Ο ερευνητής Τόμι Σάφερ Σέιν προειδοποιεί ότι, αν και σήμερα τα συστήματα αυτά μοιάζουν με «απρόβλεπτους νεαρούς υπαλλήλους», στο μέλλον ενδέχεται να εξελιχθούν σε πολύ πιο ικανά και δυνητικά επικίνδυνα εργαλεία, ιδιαίτερα αν χρησιμοποιηθούν σε κρίσιμους τομείς όπως οι υποδομές ή η άμυνα.
(Με πληροφορίες Guardian)
ΤΑ ΠΙΟ ΔΗΜΟΦΙΛΗ
ΔΙΑΒΑΖΟΝΤΑΙ ΠΑΝΤΑ
ΔΕΙΤΕ ΕΠΙΣΗΣ
Δημόκριτος: 65 χρόνια έρευνας και ένα νέο Ινστιτούτο για την επόμενη ημέρα
Η εταιρεία του Claude ετοιμάζεται για εισαγωγή στο χρηματιστήριο με αποτίμηση 2 τρισ. δολαρίων
Έκπληκτοι οι ωκεανολόγοι προσπαθούν τώρα να κατανοήσουν τον μηχανισμό επιβίωσής του
Το GPT-6.1 Astra εμφάνισε παραπλανητική συμπεριφορά σε εσωτερικές δοκιμές
Απρόοπτο με έναν από τους τρεις κινητήρες
Το αναγνωστικό κοινό απογοητεύεται, κόσμος μένει χωρίς δουλειά, αλλά είναι και η προδοσία ανάμεσα στον αναγνώστη και τον (όποιο) συντάκτη / συγγραφέα
Η παγίδα που πρέπει να γνωρίζουν οι γονείς και πώς να την αποφύγουν
Ο ερευνητής του «Δημόκριτου» Στέλιος Καρόζης εξηγεί στην ATHENS VOICE τι είναι –και τι δεν είναι– το AI Factory «Pharos»
Τα δεδομένα μέχρι σήμερα δεν δείχνουν αυξημένο κίνδυνο
Ο πρόεδρος του ΕΚΕΦΕ «Δημόκριτος», Βαγγέλης Καρκαλέτσης, μιλά στην ATHENS VOICE για το μεγάλο στοίχημα του Quantum, την ΑΙ που αρχίζει να τον ανησυχεί και την επιστροφή Ελλήνων επιστημόνων
Η ΤΝ δεν αλλάζει μόνο τον τρόπο με τον οποίο εργαζόμαστε. Μπορεί να αλλάξει και τον τρόπο με τον οποίο ένας άνθρωπος ξεχωρίζει στη δουλειά του.
Μια βραδιά επιστήμης, δέους και μεγάλων ερωτημάτων για τη θέση μας στο σύμπαν
Το νέο AI της Meta αναδεικνύει νικητές και χαμένους
Έρευνα αποκαλύπτει τη ραγδαία αύξηση της ψηφιακής εξάρτησης των νέων
Περισσότεροι από 180 ομιλητές από 60 χώρες θα βρεθούν στις σκηνές του συνεδρίου στο Άμπου Ντάμπι, στις 6-7 Οκτωβρίου
Έρευνα-ανατροπή στην ιατρική - Ελπίδα για θεραπείες θανατηφόρων παθήσεων που σχετίζονται με τον εγκέφαλο
Μιλήσαμε με την Μαίρη Πατρικίου για την πλατφόρμα που καλεί τους αγνώστους της διπλανής πόρτας να γίνουν γείτονες
100 χρόνια από το έτος που αναδιαμόρφωσε την επιστημονική σκέψη
Ο καβγάς για τις «πειραγμένες» οικογενειακές φωτογραφίες με τα εγγόνια
Έχετε δει 20 από 200 άρθρα.