Das britische AI Security Institute hat zum ersten Mal öffentlich gemessen, wie weit offene KI-Modelle bei Cyberfähigkeiten hinter den geschlossenen Spitzenmodellen liegen. Ergebnis: vier bis sieben Monate. Anfang 2025 waren es noch sechs bis zehn. GLM-5.2 erreicht auf 70 Cyber-Aufgaben das Niveau von Opus 4.6 aus dem Februar, DeepSeek V4-Pro das von Opus 4.5 aus dem November 2025.
Die interessantere Zahl steht bei den Kosten. Ein Cyber-Range-Test mit 100 Millionen Token kostete mit Opus 4.5 oder 4.6 rund 85 Dollar, mit GLM-5.2 etwa 46 Dollar und mit DeepSeek V4-Pro genau 1,19 Dollar. Pro Einzelaufgabe: 15 Dollar bei Opus 4.6, 28 Cent bei DeepSeek. Angriffe werden also nicht nur ein bisschen billiger, sie werden um den Faktor 50 billiger, und damit skalierbar. Die Sicherheitsvorkehrungen der offenen Modelle bezeichnet das AISI als weitgehend wirkungslos, DeepSeek V4-Pro verweigerte Reverse-Engineering-Aufgaben manchmal, aber einmal nochmal fragen reichte.
Das ist die Pointe der ganzen Open-Weights-Debatte in einem Satz: Sobald die Gewichte draußen sind, sind Monitoring, Klassifizierer und Nutzungslimits Dekoration, weil sie alle davon leben, den Zugang zu kontrollieren. Wer offene Modelle mag, und dafür gibt es gute Gründe, von Datenschutz über Anpassbarkeit bis zu der Gewissheit, dass niemand das Modell unter dir abschaltet, bekommt dieselbe Eigenschaft eben auch von der anderen Seite serviert. Wer sich anschauen will, was so ein Modell auf dem eigenen Rechner überhaupt leistet, findet das hier erklärt.
Das AISI schränkt selbst ein: Die Modelle wurden für die Tests nicht optimiert, die Ergebnisse unterschätzen ihr Maximum eher. Und in den simulierten Netzwerken fehlen aktive Verteidiger. Als Nächstes soll Kimi K3 geprüft werden, dessen Gewichte Ende Juli erscheinen. Das Institut versteht den verbleibenden Vorsprung als Vorbereitungsfenster für Verteidiger. Vier Monate sind ein kurzes Fenster.
Quellen
- AI Security Institute: How far behind the frontier are leading open-weight models on cyber?
- The Decoder: Open-weight models now match frontier cyber performance from just four months ago at a fraction of the cost
- AI Security Institute: Measuring AI agents progress on multi-step cyber attack scenarios
Ähnliche News
- Offene KI-Modelle hacken fast so gut wie die teuren
- Kimi K3 wird das größte offene KI-Modell der Welt
- Ein offenes Modell aus China schlägt GPT-5.5 beim Coding
Diese Meldung wurde mit Unterstützung von Claude (Anthropic) recherchiert und verfasst. Inhaltliche Fehler sind möglich. Die verlinkten Quellen ermöglichen eine eigene Prüfung. Fachbegriffe erläutert das Glossar.