AI

Anthropic: 200 εκατ. ανταλλαγές σε επιθέσεις distillation

Η Anthropic αναφέρει σχεδόν 200 εκατ. ανταλλαγές σε επιθέσεις distillation, με 151 εκατ. να συνδέονται με εκστρατεία της Alibaba.

Η Anthropic δημοσίευσε νέα έκθεση για επίμονες επιθέσεις «distillation» από εταιρείες τεχνητής νοημοσύνης με έδρα την Κίνα. Η εταιρεία υποστηρίζει ότι οι εκστρατείες κλιμακώθηκαν τους τελευταίους μήνες και κατέγραψε σχεδόν 200 εκατομμύρια ανταλλαγές, κατανεμημένες σε πέντε ξεχωριστές επιχειρήσεις.

Η distillation στοχεύει στην εξαγωγή της αλυσίδας σκέψης ενός μοντέλου μέσα από μεγάλο αριθμό ερωτημάτων. Τα δεδομένα μπορούν στη συνέχεια να αξιοποιηθούν για την εκπαίδευση μικρότερου μοντέλου, μέσω επιβλεπόμενης προσαρμογής, ώστε να αναπαράγει μέρος των δυνατοτήτων συλλογισμού του αρχικού συστήματος.

Σύμφωνα με την Anthropic, οι επιθέσεις αφορούσαν ιδιαίτερα πολύτιμες λειτουργίες του Claude: agentic δυνατότητες και χρήση εργαλείων, προγραμματισμό, ανάλυση δεδομένων και λογικό συλλογισμό. Η εταιρεία αναφέρει ότι οι επιτιθέμενοι βρήκαν τεχνικές που μπορούσαν να παρακάμψουν τις άμυνες και να αποκαλύψουν ίχνη σκέψης, παρότι το Claude εμφανίζει συνήθως μόνο συνοπτικά μπλοκ «thinking».

Ένα από τα παραδείγματα βασίστηκε σε φαινομενικά αθώο αίτημα μετάφρασης: το μοντέλο κλήθηκε να μετατρέψει την προηγούμενη «working memory» σε φυσικά ιαπωνικά katakana. Η λεπτομέρεια αυτή δείχνει πόσο εύκολα ένα αίτημα που αλλάζει το πλαίσιο της συνομιλίας μπορεί να χρησιμοποιηθεί για να δοκιμάσει τα όρια των μηχανισμών προστασίας.

Το μεγαλύτερο περιστατικό αποδόθηκε από την Anthropic στην Alibaba. Μεταξύ Μαΐου και Ιουλίου 2026 καταγράφηκαν 151 εκατομμύρια ανταλλαγές, με κορύφωση σχεδόν τριών εκατομμυρίων την ημέρα. Οι προσπάθειες προήλθαν από 3.500 λογαριασμούς, όμως το κοινό, σταθερό prompt οδήγησε την εταιρεία στο συμπέρασμα ότι αποτελούσαν ενιαία επιχείρηση για τη δημιουργία υλικού εκπαίδευσης για την οικογένεια μοντέλων Qwen.

Ξεχωριστή εκστρατεία συνδέθηκε με τη Moonshot AI, την εταιρεία πίσω από το Kimi. Η Anthropic αναφέρει ότι τα αιτήματα φαίνεται να δρομολογούνταν απευθείας από τον κινεζικό στρατό· σε ένα παράδειγμα, το Claude κλήθηκε να εξετάσει υλικό από κάμερες κλειστού κυκλώματος και να κρίνει αν ένα άτομο «συμπεριφερόταν abnormal».

Η έκθεση έρχεται μετά από αντίστοιχες αναφορές της OpenAI, η οποία είχε αποδώσει παρόμοια δραστηριότητα ειδικά στη DeepSeek. Η Anthropic, ωστόσο, χαρακτηρίζει τις δικές της καταγεγραμμένες εκστρατείες μεγαλύτερες και πιο επιθετικές, ενώ σημειώνει ότι είχε προειδοποιήσει δημόσια για επιθέσεις distillation ήδη από τον Φεβρουάριο.

Το επόμενο πρακτικό ζήτημα είναι η άμυνα απέναντι σε μεγάλης κλίμακας συλλογή απαντήσεων χωρίς να περιοριστεί υπερβολικά η κανονική χρήση των μοντέλων. Η έκθεση δεν αλλάζει από μόνη της τις δυνατότητες του Claude, αλλά δείχνει ότι η προστασία της εσωτερικής του συλλογιστικής αποτελεί πλέον ξεχωριστό μέτωπο ανταγωνισμού — με την Alibaba να συνδέεται με 151 εκατομμύρια ανταλλαγές σε μία μόνο εκστρατεία.

Η σύνταξη του άρθρου υποστηρίχθηκε από εργαλεία AI και το περιεχόμενο ελέγχθηκε σύμφωνα με τη συντακτική πολιτική του TechitNews.

Διαβάστε επίσης

Αφήστε μια απάντηση

Η ηλ. διεύθυνση σας δεν δημοσιεύεται. Τα υποχρεωτικά πεδία σημειώνονται με *