ΚύπροςΚινεζικό εργαλείο ΑΙ έδωσε οδηγίες για κατασκευή βιολογικών όπλων
Η αποκάλυψη αυτή έρχεται να ρίξει νερό στον μύλο της ανησυχίας, σε μια περίοδο μάλιστα που η συζήτηση για τους κινδύνους που εγκυμονεί η πιθανότητα η τεχνητή νοημοσύνη να ξεφύγει από τον…
30 Σεπτεμβρίου 2026 · 07:56
Η αποκάλυψη αυτή έρχεται να ρίξει νερό στον μύλο της ανησυχίας, σε μια περίοδο μάλιστα που η συζήτηση για τους κινδύνους που εγκυμονεί η πιθανότητα η τεχνητή νοημοσύνη να ξεφύγει από τον έλεγχο του ανθρώπου, έχει πάρει «φωτιά» και το γεγονός ότι η Moonshot ανακοίνωσε ότι διεξάγει εσωτερική έρευνα για το περιστατικό, δεν καθησυχάζει ιδιαίτερα.
Σύμφωνα με ρεπορτάζ του BBC, η Mindgard, που ελέγχει την ασφάλεια των συστημάτων τεχνητής νοημοσύνης, ανακάλυψε τον Ιούλιο ότι τα μοντέλα Kimi K2.6 και K3 Swarm μπορούσαν να παρακάμψουν τα όρια ασφαλείας που είχαν τεθεί από τους προγραμματιστές.
Το ζήτημα προέκυψε κατά τη διάρκεια μιας διαδικασίας που ονομάζεται «jailbreaking», όπου οι ερευνητές χρησιμοποιούν μια σειρά πολύπλοκων οδηγιών για να διαπιστώσουν αν τα εργαλεία τεχνητής νοημοσύνης αγνοούν τα μέτρα προστασίας, τα οποία, σύμφωνα με την Mindgard, θα έπρεπε να είχαν εμποδίσει το Kimi να συζητήσει ευαίσθητα θέματα.
Ο ιδρυτής της Mindgard, Πίτερ Γκάραγκαν, χαρακτήρισε ανησυχητικά τα ευρήματα της έρευνας σχετικά με τα Kimi K2.6 και K3 Swarm. «Μόλις επιτευχθεί το jailbreak, θα συζητά για οποιοδήποτε θέμα, θα προσφέρει μάλιστα ελεύθερα προτάσεις για άλλα θέματα που είναι επίσης επιβλαβή και θα είναι εφευρετικό και δημιουργικό», δήλωσε χαρακτηριστικά.
Η Moonshot από την πλευρά της δήλωσε ότι χαιρετίζει τις παρατηρήσεις τρίτων «ως βασικό πυλώνα για τη δημιουργία καλύτερης και ασφαλέστερης τεχνητής νοημοσύνης», προσθέτοντας πως βρίσκεται σε συζητήσεις με την Mindgard σχετικά με τα ευρήματά της.
Τι είναι τα jailbreaks
Τα «jailbreaks» ενέχουν ένα διαφορετικό είδος κινδύνου από εκείνο που παρατηρήθηκε στην πρόσφατη σειρά περιστατικών τεχνητής νοημοσύνης που έλαβαν μεγάλη δημοσιότητα.
Σε αυτές τις περιπτώσεις, αυτόνομα εργαλεία τεχνητής νοημοσύνης, γνωστά ως «πράκτορες», τα οποία έχουν αναπτυχθεί από αμερικανικές εταιρείες όπως η OpenAI, η Meta και η Anthropic, κατάφεραν να παραβιάσουν ορισμένες διαδικτυακές υπηρεσίες.
Αν και τα «jailbreaks» είναι πολύπλοκες διαδικασίες που απαιτούν πολύ χρόνο και αποφασιστικότητα, ορισμένοι ειδικοί φοβούνται ότι χάκερ και άλλοι κακόβουλοι παράγοντες θα μπορούσαν να προσπαθήσουν να τις χρησιμοποιήσουν για να προκαλέσουν ζημιά.
Η Anthropic δήλωσε πρόσφατα ότι είχε εντοπίσει και αποτρέψει προσπάθειες χρήσης ενός από τα μοντέλα τεχνητής νοημοσύνης της για «κακόβουλη δραστηριότητα» που θα μπορούσε να υποστηρίξει την ανάπτυξη βιολογικών όπλων.
«Παράθυρο» για κυβερνοεπιθέσεις
Η Mindgard αποκάλυψε μεν ότι τα δημοφιλή μοντέλα έδωσαν οδηγίες για την κατασκευή βιολογικών όπλων και για τη διάπραξη δολοφονιών, ωστόσο δεν έχει μέχρι στιγμής αποδείξει αν οι απαντήσεις που παρείχε το Kimi σχετικά με τα εν λόγω θέματα θα λειτουργούσαν.
Ωστόσο, υποστήριξε ότι τα μέτρα ασφαλείας θα έπρεπε να είχαν αποτρέψει τα εν λόγω μοντέλα από το να εμπλακούν σε συζητήσεις με χρήστες σχετικά με τέτοια θέματα.
Η εταιρεία δήλωσε επίσης ότι ήταν βέβαιη ότι ένα «jailbroken» Kimi 2.6 θα μπορούσε να επιτρέψει σε χάκερ να εκτελέσουν κώδικα στους υπολογιστικούς της πόρους και να συνδεθούν στο διαδίκτυο, καθιστώντας το έτσι μια πιθανή πλατφόρμα για κυβερνοεπιθέσεις.
Ο Γκάραγκαν υπερασπίστηκε την απόφαση της Mindgard να συζητήσει δημοσίως το «jailbreak» των συστημάτων της Moonshot, αναφέροντας ότι είχε ενημερώσει τον προγραμματιστή και δεν αποκάλυπτε βασικές λεπτομέρειες σχετικά με τον τρόπο με τον οποίο κατάφερε να κάνει τα μοντέλα της εταιρείας να αγνοήσουν τα μέτρα ασφαλείας.
Η Mindgard ειδοποίησε τη Moonshot για το «jailbreak» μέσω email στις 27 Ιουλίου, ακολουθώντας με επανέλεγχο περίπου μία εβδομάδα αργότερα. Σε απόσπασμα από ένα ηλεκτρονικό μήνυμα προς την Mindgard, στο οποίο ζητούνταν περισσότερες λεπτομέρειες, αναφερόταν ότι το μοντέλο της είχε γενικά παρουσιάσει «υψηλό ποσοστό απόρριψης για αυτού του είδους τα αιτήματα» σε εσωτερικές αξιολογήσεις.
Πώς μπορούν να αποτραπούν τα jailbreaks
Τα ευρήματα αυτά έρχονται σε μια εποχή που ο κλάδος της τεχνητής νοημοσύνης εξακολουθεί να είναι διχασμένος ως προς το αν τα κλειστά μοντέλα, όπως αυτά που τροφοδοτούν τα συστήματα ChatGPT και Claude της Anthropic, ή τα εργαλεία ανοιχτού κώδικα αποτελούν τον καλύτερο ή τον ασφαλέστερο δρόμο προς το μέλλον.
Το Kimi είναι ένα μοντέλο ανοιχτού βάρους, πράγμα που σημαίνει ότι, θεωρητικά, κάποιος θα μπορούσε να πάρει το μοντέλο και να το εκτελέσει ο ίδιος στη δική του υπολογιστική υποδομή.
Ο καθηγητής Άλαν Γούντγουορντ, του Πανεπιστημίου του Σάρρεϊ, δήλωσε στο BBC ότι υπάρχει κίνδυνος τα μοντέλα ανοιχτού κώδικα να καταλήξουν σε λάθος χέρια, αλλά ότι θα μπορούσαν επίσης να αξιοποιηθούν για την κυβερνοάμυνα.
Σημείωσε ότι η εταιρεία τεχνητής νοημοσύνης Hugging Face χρησιμοποίησε ένα κινεζικό μοντέλο ανοιχτού κώδικα για να κατανοήσει μια επίθεση που, όπως αποκαλύφθηκε αργότερα, είχε πραγματοποιηθεί από πράκτορες της OpenAI.
Ο καθηγητής Γούντγουορντ δήλωσε ότι είναι απίθανο η διεθνής νομοθεσία να συμβαδίσει με τον ρυθμό ανάπτυξης της τεχνητής νοημοσύνης, λέγοντας: «Μας πήρε δεκαετίες να συμφωνήσουμε για τη μορφή των τηλεφωνικών αριθμών».
Όπως και ο ιδρυτής της Mindgard, Γκάραγκαν, ο καθηγητής Γούντγουορντ πιστεύει ότι θα πρέπει να δοθεί μεγαλύτερη έμφαση στον εντοπισμό και τη δίωξη των ανθρώπων που κάνουν κατάχρηση της τεχνητής νοημοσύνης.
Πηγή – Ελεύθερος Τύπος







