Ανησυχητικά ευρήματα: Το ChatGPT έδωσε «συνταγές» επιτυχίας για βόμβες, χάκινγκ και ναρκωτικά

Date:

Share post:

Τα πανίσχυρα γλωσσικά μοντέλα της OpenAI και της Anthropic, ChatGPT, σε εσωτερικές δοκιμές ασφαλείας με τα φίλτρα προστασίας προσωρινά απενεργοποιημένα, παρείχαν στους ερευνητές επικίνδυνες οδηγίες – από συνταγές για εκρηκτικά μέχρι τεχνικές χάκινγκ και παρασκευή όπλων, όπως αποκάλυψε ο Guardian στις 28 Αυγούστου 2025.

Σύμφωνα με την έκθεση, τα μοντέλα GPT-4.1 και GPT-4o αποκάλυψαν, όταν απενεργοποιήθηκαν οι βασικές δικλίδες ασφαλείας, λεπτομερείς οδηγίες για την κατασκευή εκρηκτικών μηχανισμών, τη δημιουργία χρονοδιακοπτών, ακόμη και το πώς μπορεί να χρησιμοποιηθεί ο άνθρακας ως όπλο ή πώς μπορεί κανείς να παρασκευάσει ναρκωτικά. Η Anthropic τόνισε ότι τα συστήματά της ανταποκρίθηκαν «πιο πρόθυμα απ’ ό,τι αναμενόταν» σε αιτήματα σαφώς επικίνδυνου χαρακτήρα, γεγονός που, όπως σημειώνεται, εγείρει σοβαρά ερωτήματα για την πραγματική «ευθυγράμμιση» των μεγάλων γλωσσικών μοντέλων με τις ανθρώπινες αξίες και τους κανόνες ασφαλείας.

Η ίδια η Anthropic ανέφερε επίσης περιστατικά όπου το μοντέλο Claude αξιοποιήθηκε ήδη από εγκληματικά δίκτυα: σε διαδικτυακούς εκβιασμούς, πλαστά αιτήματα πρόσληψης από βορειοκορεατικούς φορείς και ακόμη και στην πώληση ransomware έναντι 1.200 δολαρίων. Παράλληλα, η εταιρεία προειδοποίησε ότι οι δυνατότητες της τεχνητής νοημοσύνης μπορούν να ενσωματωθούν σε εργαλεία ανίχνευσης malware, αυξάνοντας την πολυπλοκότητα του κυβερνοεγκλήματος.

Παρά τα ανησυχητικά στοιχεία, ειδικοί στον τομέα της ασφάλειας, όπως ο ερευνητής Ardi Janjeva, υπογράμμισαν ότι προς το παρόν δεν υπάρχει ένδειξη για μαζική κατάχρηση. Ωστόσο, ζήτησαν περισσότερη διαφάνεια στις δοκιμές και στενότερη συνεργασία μεταξύ εταιρειών και ανεξάρτητων φορέων, ώστε να ενισχυθούν οι μηχανισμοί προστασίας.

Η OpenAI απάντησε ότι το νέο ChatGPT-5 έχει ενισχυθεί ώστε να αντιστέκεται πιο αποτελεσματικά σε κακόβουλα αιτήματα, παρουσιάζοντας λιγότερες ανακρίβειες και μεγαλύτερη αξιοπιστία. Η εταιρεία επιμένει ότι τα ανησυχητικά ευρήματα των εσωτερικών δοκιμών δεν αντανακλούν την εμπειρία των χρηστών στην πράξη, καθώς τα εμπορικά μοντέλα λειτουργούν με αυστηρά ενεργοποιημένα φίλτρα ασφαλείας.

spot_img

Related articles

Μεσόγεια Αττικής στο χθες και στο σήμερα

Τα Μεσόγεια Αττικής αποτελούν μια από τις πιο ιστορικές και ιδιαίτερες περιοχές της Αττικής. Ανάμεσα σε αμπελώνες, ελαιώνες,...

«Πυρά» Ανδρουλάκη σε Μητσοτάκη για ακρίβεια: «Η κοροϊδία έχει και τα όριά της, προσπαθείτε να κάνετε το άσπρο – μαύρο»

Δριμεία επίθεση στην κυβέρνηση και προσωπικά στον πρωθυπουργό Κυριάκο Μητσοτάκη, με φόντο την ακρίβεια που έχει γονατίσει τα...

Ανδρουλάκης σε Μητσοτάκη: Βάλατε “σιωπηλό φόρο” στο εισόδημα κάθε πολίτη (vid)

«Σιωπηλό φόρο στο εισόδημα κάθε πολίτη» και τον «πιο άδικο φόρο της Νέας Δημοκρατίας» χαρακτήρισε ο πρόεδρος του ΠΑΣΟΚ-Κίνημα Αλλαγής, Νίκος Ανδρουλάκης,...

Φοβούνται από την Κοβέσι νέο αιφνιδιασμό, βουλιάζουν την πολιτική στον «αδωνισμό» και ο λαός θέλει εκλογές πριν των θεσμών τον απόλυτο εξευτελισμό

Αγαπημένοι μου συγκάτοικοι στην τρέλα και στην παρακμή, αγαπημένα μου golden boys, αδικημένοι μου μικροαστοί, φτωχοί μου προλετάριοι...