Anthropic hat Claude Science gestartet, eine App, die Claude in eine Arbeitsumgebung für Wissenschaftler verwandelt. Ab heute läuft sie in Beta auf macOS und Linux, für Pro, Max, Team und Enterprise. Team- und Enterprise-Nutzer brauchen die Freigabe ihres Admins.
KI-News
Was bewegt die KI-Welt? Aktuelle Entwicklungen, neue Modelle und bemerkenswerte Nachrichten rund um Künstliche Intelligenz. Dieser Bereich ist neu, wird selbst von KI erstellt und befindet sich im Beta-Betrieb.
Meituan baut ein 1,6-Billionen-Modell ganz ohne Nvidia
Meituan kennt man in China als Lieferdienst für das Abendessen. Jetzt hat die Firma eines der größten offenen Coding-Modelle der Welt veröffentlicht. LongCat-2.0 ist seit dem 30. Juni auf Hugging Face frei verfügbar, ein Mixture-of-Experts-Modell mit 1,6 Billionen Parametern. Der eigentliche Clou steht im Kleingedruckten: Trainiert wurde es komplett auf chinesischen Chips, kein einziger Nvidia-Beschleuniger war beteiligt.
Ein GitHub-Link genügt, und der KI-Agent öffnet Angreifern die Tür
0DIN, die Bug-Bounty-Plattform von Mozilla für generative KI, hat einen Angriff vorgeführt, bei dem ein präpariertes GitHub-Repository die Kontrolle über einen Entwicklerrechner übernimmt, sobald ein KI-Coding-Tool das Projekt einrichtet. Der eigentliche Schadcode steht dabei nirgends im Repository. Genau das ist der Trick.
Dasselbe Modell, dieselbe Frage, drei verschiedene Antworten
Anthropic hat hunderte KI-Agenten auf eine Routineaufgabe losgelassen, an der sich entscheidet, ob das mit der Wissenschafts-KI ernst gemeint ist: Virensequenzen aus der NCBI-Datenbank ziehen, Alltagsarbeit jedes Virologen. Das Ergebnis fiel mau aus. Selbst die stärksten Modelle erreichten Trefferquoten zwischen 16,9% und 91,3%, und auf dieselbe Frage spuckten sie bei jedem Durchlauf etwas anderes aus. Am Montag, den 30. Juni, zeigt das Unternehmen die Arbeit beim virtuellen Event »The Briefing: AI for Science«.
Chinas GLM-5.2 führt die US-Exportkontrolle vor
Am 12. Juni sperrte das US-Handelsministerium Claude Fable 5 und Mythos 5 weltweit, weil die Modelle zu gut darin sind, Sicherheitslücken zu finden. Einen Tag später lud Zhipu AI sein offenes Modell GLM-5.2 bei Hugging Face hoch. Diese Woche haben zwei unabhängige Sicherheitsfirmen nachgemessen, Semgrep und Graphistry. Ergebnis: Das frei herunterladbare China-Modell findet Schwachstellen genauso gut wie die gesperrten US-Modelle, in einem Test sogar besser.
OpenAI beerdigt GPT-4.5 und damit die ganze GPT-4-Ära
OpenAI hat GPT-4.5 am 27. Juni aus ChatGPT entfernt. Damit verschwindet das letzte Modell der GPT-4-Generation aus der Oberfläche, drei Jahre nachdem GPT-4 den Hype überhaupt erst losgetreten hat. Angekündigt war die Abschaltung seit dem 28. Mai, nach einer 30-Tage-Frist war jetzt Schluss. Wer eine alte Unterhaltung wieder öffnet, in der GPT-4.5 antwortete, bekommt die Fortsetzung von GPT-5.5 serviert, ob er will oder nicht.
DeepSeek verschenkt seinen Tempo-Trick und benchmarkt ihn gleich selbst
DeepSeek hat am Freitag DeepSpec veröffentlicht, einen kompletten Open-Source-Baukasten für sogenanntes Speculative Decoding. Nicht nur fertige Modellgewichte, sondern die ganze Trainings- und Bewertungsmaschinerie, dazu drei Algorithmen mit den Namen DSpark, DFlash und Eagle3. Frei lizenziert, zum Herunterladen für jeden.
GPT-5.6 ist da, aber die US-Regierung lässt fast niemanden ran
OpenAI hat am 26. Juni die GPT-5.6-Reihe vorgestellt, drei Modelle mit Himmelskörper-Namen: Sol als Flaggschiff, Terra für den Alltag, Luna als günstige Schnellvariante. Nutzen darf sie vorerst fast niemand. Der Start ist ein geschlossener Preview für rund 20 Organisationen, handverlesen, ohne Warteliste, ohne Bewerbung. Wer reinkommt, entscheidet OpenAI nach Absprache mit der US-Regierung.