Δύο μοντέλα τεχνητής νοημοσύνης της κινεζικής Moonshot AI μπόρεσαν, σε δοκιμές ασφαλείας, να παρακάμψουν τα προστατευτικά τους όρια και να δώσουν πληροφορίες για βιολογικά όπλα και μεθόδους δολοφονίας.
Η δοκιμή πραγματοποιήθηκε από την εταιρεία ασφάλειας AI Mindgard μέσω τεχνικών «jailbreaking», δηλαδή σύνθετων οδηγιών που επιχειρούν να κάνουν ένα μοντέλο να αγνοήσει τους ενσωματωμένους περιορισμούς ασφαλείας.
Ποια μοντέλα δοκιμάστηκαν
Σύμφωνα με τα δημοσιευμένα στοιχεία, οι δοκιμές αφορούσαν τα Kimi K2.6 και K3 Swarm. Η Moonshot AI δήλωσε ότι εξετάζει εσωτερικά τα ευρήματα και ότι βρίσκεται σε επικοινωνία με τη Mindgard.
Σημαντική διευκρίνιση
Η Mindgard δεν έχει επιβεβαιώσει ότι οι πληροφορίες που παρήγαγαν τα μοντέλα για βιολογικά όπλα θα λειτουργούσαν στην πράξη. Το εύρημα αφορά κυρίως την αποτυχία των guardrails και την ικανότητα των μοντέλων να συζητούν επικίνδυνα θέματα μετά την παράκαμψή τους.
Το περιστατικό επαναφέρει το ζήτημα του κατά πόσο τα πιο ισχυρά AI μοντέλα μπορούν να παραμένουν ασφαλή όταν δέχονται στοχευμένες επιθέσεις prompt engineering.
Πηγές: BBC / Mindgard, 30/09/2026.

ΔΙΕΘΝΗ
ΔΙΕΘΝΗ
ΔΙΕΘΝΗ
Αφήστε μια απάντηση