Claude Science macht aus dem Chatbot eine Laborbank

KI-News: Claude Science, Genomik, 60+ Tools

Anthropic hat Claude Science gestartet, eine App, die Claude in eine Arbeitsumgebung für Wissenschaftler verwandelt. Ab heute läuft sie in Beta auf macOS und Linux, für Pro, Max, Team und Enterprise. Team- und Enterprise-Nutzer brauchen die Freigabe ihres Admins.

Weiterlesen

Meituan baut ein 1,6-Billionen-Modell ganz ohne Nvidia

KI-News: LongCat, 1.6T, China-Chips

Meituan kennt man in China als Lieferdienst für das Abendessen. Jetzt hat die Firma eines der größten offenen Coding-Modelle der Welt veröffentlicht. LongCat-2.0 ist seit dem 30. Juni auf Hugging Face frei verfügbar, ein Mixture-of-Experts-Modell mit 1,6 Billionen Parametern. Der eigentliche Clou steht im Kleingedruckten: Trainiert wurde es komplett auf chinesischen Chips, kein einziger Nvidia-Beschleuniger war beteiligt.

Weiterlesen

Ein GitHub-Link genügt, und der KI-Agent öffnet Angreifern die Tür

KI-News: Prompt Injection, Reverse Shell, RCE

0DIN, die Bug-Bounty-Plattform von Mozilla für generative KI, hat einen Angriff vorgeführt, bei dem ein präpariertes GitHub-Repository die Kontrolle über einen Entwicklerrechner übernimmt, sobald ein KI-Coding-Tool das Projekt einrichtet. Der eigentliche Schadcode steht dabei nirgends im Repository. Genau das ist der Trick.

Weiterlesen

Dasselbe Modell, dieselbe Frage, drei verschiedene Antworten

KI-News: Biologie, gget virus, 16,9% auf 99,7%

Anthropic hat hunderte KI-Agenten auf eine Routineaufgabe losgelassen, an der sich entscheidet, ob das mit der Wissenschafts-KI ernst gemeint ist: Virensequenzen aus der NCBI-Datenbank ziehen, Alltagsarbeit jedes Virologen. Das Ergebnis fiel mau aus. Selbst die stärksten Modelle erreichten Trefferquoten zwischen 16,9% und 91,3%, und auf dieselbe Frage spuckten sie bei jedem Durchlauf etwas anderes aus. Am Montag, den 30. Juni, zeigt das Unternehmen die Arbeit beim virtuellen Event »The Briefing: AI for Science«.

Weiterlesen

Chinas GLM-5.2 führt die US-Exportkontrolle vor

KI-News: GLM-5.2, 39% F1, open weights

Am 12. Juni sperrte das US-Handelsministerium Claude Fable 5 und Mythos 5 weltweit, weil die Modelle zu gut darin sind, Sicherheitslücken zu finden. Einen Tag später lud Zhipu AI sein offenes Modell GLM-5.2 bei Hugging Face hoch. Diese Woche haben zwei unabhängige Sicherheitsfirmen nachgemessen, Semgrep und Graphistry. Ergebnis: Das frei herunterladbare China-Modell findet Schwachstellen genauso gut wie die gesperrten US-Modelle, in einem Test sogar besser.

Weiterlesen

OpenAI beerdigt GPT-4.5 und damit die ganze GPT-4-Ära

KI-News: GPT-4.5, ChatGPT, Ende

OpenAI hat GPT-4.5 am 27. Juni aus ChatGPT entfernt. Damit verschwindet das letzte Modell der GPT-4-Generation aus der Oberfläche, drei Jahre nachdem GPT-4 den Hype überhaupt erst losgetreten hat. Angekündigt war die Abschaltung seit dem 28. Mai, nach einer 30-Tage-Frist war jetzt Schluss. Wer eine alte Unterhaltung wieder öffnet, in der GPT-4.5 antwortete, bekommt die Fortsetzung von GPT-5.5 serviert, ob er will oder nicht.

Weiterlesen

DeepSeek verschenkt seinen Tempo-Trick und benchmarkt ihn gleich selbst

KI-News: DeepSpec, DSpark, +85%

DeepSeek hat am Freitag DeepSpec veröffentlicht, einen kompletten Open-Source-Baukasten für sogenanntes Speculative Decoding. Nicht nur fertige Modellgewichte, sondern die ganze Trainings- und Bewertungsmaschinerie, dazu drei Algorithmen mit den Namen DSpark, DFlash und Eagle3. Frei lizenziert, zum Herunterladen für jeden.

Weiterlesen

GPT-5.6 ist da, aber die US-Regierung lässt fast niemanden ran

KI-News: GPT-5.6, Sol Terra Luna, 20 Firmen

OpenAI hat am 26. Juni die GPT-5.6-Reihe vorgestellt, drei Modelle mit Himmelskörper-Namen: Sol als Flaggschiff, Terra für den Alltag, Luna als günstige Schnellvariante. Nutzen darf sie vorerst fast niemand. Der Start ist ein geschlossener Preview für rund 20 Organisationen, handverlesen, ohne Warteliste, ohne Bewerbung. Wer reinkommt, entscheidet OpenAI nach Absprache mit der US-Regierung.

Weiterlesen