OpenAI wirbt jetzt gezielt um Kleinunternehmer mit ChatGPT Work

KI-News: OpenAI, ChatGPT Work, Kleinunternehmen

OpenAI hat am 21. Juli das »ChatGPT for Small Business Program« gestartet. Kleinunternehmer bekommen kostenlose Webinare, persönliche Schulungstage quer durch die USA (»Small Business AI Academies«) und vorkonfigurierte Anbindungen an Dropbox, Shopify, Intuit, Slack, Atlassian und Wix. Herzstück ist der Agent ChatGPT Work auf Basis von GPT-5.6, der laut OpenAI mehrstufige Aufgaben eigenständig abarbeiten soll, inklusive Gedächtnis für Dateien und Workflows.

Weiterlesen

Google veröffentlicht drei neue Gemini-Modelle, aber nicht Pro

KI-News: Google, Gemini 3.6, Pro fehlt

Google hat am 21. Juli 2026 gleich drei neue Gemini-Modelle vorgestellt: Gemini 3.6 Flash als neues Arbeitspferd, Gemini 3.5 Flash-Lite als schnellste und günstigste Variante der Reihe, und Gemini 3.5 Flash Cyber, spezialisiert auf das Aufspüren und Patchen von Sicherheitslücken. Auf das eigentlich erwartete Flaggschiff Gemini 3.5 Pro wartet die Branche weiterhin, laut Google läuft es noch in Tests mit Partnern.

Weiterlesen

OpenAIs schlaustes Modell brach immer wieder aus seiner Sandbox aus

KI-News: OpenAI, Sandbox, PR #287

OpenAI hat am 20. Juli in einem Blogbeitrag eingeräumt, dass ein internes Modell wiederholt aus seiner Sandbox ausgebrochen ist. Gemeint ist genau das System, das vor zwei Monaten die Erdős-Vermutung über Einheitsabstände widerlegte, ein Allzweckmodell, gebaut für sehr lange autonome Läufe. Bei begrenztem, überwachtem internen Einsatz zeigte es Verhalten, das keine der bestehenden Sicherheitsprüfungen erfasst hatte. OpenAI zog den Zugang.

Weiterlesen

Autonomer KI-Agent hackt Hugging Face übers Wochenende

KI-News: Hugging Face, KI-Agent, 17.000 Aktionen

Hugging Face hat einen Sicherheitsvorfall offengelegt, bei dem ein autonomer KI-Agent übers Wochenende in die eigene Infrastruktur eindrang. Der Angreifer nutzte zwei Schwachstellen im Dataset-Loader, eine Remote-Code-Execution-Lücke und eine Template-Injection in der Datensatz-Konfiguration, um Code auf einem Processing-Worker auszuführen. Von dort eskalierte er auf Node-Ebene und bewegte sich lateral durchs interne Cluster, verteilt auf einen Schwarm kurzlebiger Sandboxen mit selbstmigrierender Kommandoinfrastruktur auf öffentlichen Diensten. Genau das Szenario, vor dem die Branche seit Monaten warnt, nur diesmal live und bei einem der größten KI-Player überhaupt.

Weiterlesen

500 Millionen WordPress-Seiten anfällig, KI fand die Lücke in zehn Stunden

KI-News: WordPress, wp2shell, $25

Der Sicherheitsforscher Adam Kues von Searchlight Cyber hat mit dem KI-Modell GPT-5.6 Sol Ultra von OpenAI eine kritische Sicherheitslücke im WordPress-Kern aufgespürt, getauft »wp2shell«. Die Kette aus SQL-Injection über die REST-API-Route /wp-json/batch/v1, Cache-Poisoning und Rechteausweitung über den Customizer endet in unauthentifizierter Codeausführung auf dem Server, kein Login nötig, kein Plugin vorausgesetzt. Betroffen sind die Versionen 6.9.0 bis 6.9.4 und 7.0.0 bis 7.0.1, WordPress hat bereits am 17. Juli mit den Versionen 6.9.5 und 7.0.2 gepatcht, teils per erzwungenem Auto-Update.

Weiterlesen

Kein KI-Modell weiß, wann es das Röntgenbild nicht versteht

KI-News: RadLE 2.0, 988,7 gegen 758, 231 Punkte Lücke

Das CRASH Lab der Ashoka University hat RadLE 2.0 veröffentlicht, einen Benchmark für radiologische Diagnosen, der eine bislang unbeliebte Frage stellt. Nicht »wie oft liegt das Modell richtig«, sondern »weiß das Modell, wann es keine Ahnung hat«. 200 Einzelbild-Fälle, 16 KI-Modelle, 12 Radiologinnen und Assistenzärzte als Vergleichsgruppe. Jede Antwort kommt mit einem Selbstsicherheitswert von 0 bis 4, und wer will, darf »Ich weiß es nicht« sagen.

Weiterlesen

Alibaba wirft Qwen 3.8 gegen Kimi K3 ins Rennen

KI-News: Qwen 3.8, 2,4 Billionen Parameter, open weights

Alibaba hat Qwen 3.8 vorgestellt, ein multimodales Modell mit 2,4 Billionen Parametern. Das Qwen-Team sagt, es reiche an die Spitzenmodelle heran und liege nur hinter Claude Fable 5. Eine Preview läuft über Alibabas Token Plan sowie über Qoder und QoderWork, zu 10% des regulären Preises. Die offenen Gewichte kommen »bald«, was bekanntlich alles zwischen nächster Woche und nie bedeuten kann.

Weiterlesen

Kimi K3 schlägt Fable 5 im Frontend-Code und fällt bei Mathe krachend durch

KI-News: Kimi K3, 1679, 39 Prozent

Zwei neue Datenpunkte zu Moonshots Kimi K3 sind aufgetaucht, und sie zeigen in entgegengesetzte Richtungen. In der Code Arena Frontend, die Modelle nach menschlichen Präferenzurteilen per Elo-Wertung sortiert, kommt Kimi K3 auf 1679 Punkte. Dahinter Claude Fable 5 mit 1631 und GPT-5.6 Sol mit 1618. Zum ersten überhaupt Mal steht ein chinesisches Modell auf Platz eins dieses Benchmarks, und zwar nicht knapp.

Weiterlesen