Modelle & Werkzeuge
Ox Alpha: Das Stealth-Modell, das noch niemand angekündigt hat
Ox Alpha: Das Stealth-Modell, das noch niemand angekündigt hat

ITmedia AI+ sammelt Community-Diskussionen über ein Modell namens "Ox Alpha" – ein offenbar unveröffentlichtes KI-System, das in Japans KI-Community für erhebliche Gespräche sorgt. Stealth-Modelle sind ein dokumentiertes Phänomen: Einige der bedeutendsten Fähigkeitssteigerungen wurden monatelang vor der öffentlichen Ankündigung ausgewählten Kreisen gezeigt. Ob Ox Alpha das nächste ist, bleibt abzuwarten.

Aug 25, 2026 at 16:27 9 11

Modelle & Werkzeuge
OpenAIs „Astra“-Modell behauptet, 10 offene Mathematikprobleme gelöst zu haben – Wenn KI nicht mehr benchmarkt, sondern entdeckt
OpenAIs „Astra“-Modell behauptet, 10 offene Mathematikprobleme gelöst zu haben – Wenn KI nicht mehr benchmarkt, sondern entdeckt

Ein internes OpenAI-Modell soll reportedly zehn offene Probleme in Mathematik und Informatik gelöst haben. Falls dies bestätigt wird, stellt dies eine qualitative Schwelle dar: nicht ein besserer Wert in einem bekannten Test, sondern neues Wissen in Bereichen, in denen menschliche Expert:innen gescheitert waren. Die Verifizierungsfrage ist die gesamte Geschichte – und sie wird Wochen, nicht Tage dauern.

Aug 25, 2026 at 16:27 7 8

Modelle & Werkzeuge
DiffusionGemma: Technischer Bericht von Google zur Anwendung von Diffusion auf die Sprachgenerierung
DiffusionGemma: Technischer Bericht von Google zur Anwendung von Diffusion auf die Sprachgenerierung

Google veröffentlicht einen technischen Bericht zu DiffusionGemma – die Anwendung von Diffusionsmodell-Prinzipien auf die Gemma-Familie. Eine Forschungsrichtung, die die architektonische Orthodoxie autoregressiver LLMs herausfordert, erhält eine Implementierung im Produktionsmaßstab.

Aug 20, 2026 at 22:30 9 11

Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Modelle & Werkzeuge
Zhipu veröffentlicht GLM-5.3: ein Codierungs- und Sicherheitsmodell, das die SWE-Marathon-Ergebnisse verdoppelt
Zhipu veröffentlicht GLM-5.3: ein Codierungs- und Sicherheitsmodell, das die SWE-Marathon-Ergebnisse verdoppelt

GLM-5.3 vom chinesischen Labor Zhipu AI zielt speziell auf die Bereiche Programmierung und Cybersicherheit ab und behauptet, eine 2× Verbesserung bei den SWE-Marathon-Benchmarks zu erzielen und die CyberGym-Bewertungen anzuführen. Das Rennen um die vertikale Spezialisierung beschleunigt sich.

Aug 14, 2026 at 18:58 6 7

Modelle & Werkzeuge
Modelle & Werkzeuge
"LLMs können nicht springen": das Positionspapier, das argumentiert, dass große Sprachmodelle eine grundlegende Grenze der Argumentationsfähigkeit haben

Eine in OpenReview veröffentlichte Positionspapier stellt eine Kernannahme der KI-Skalierungsthese infrage: dass die Fähigkeit zum logischen Denken sich unbegrenzt mit der Skalierung verbessert. Das Argument ist nicht neu – aber die Darstellung ist prägnanter als üblich.

Aug 8, 2026 at 09:58 15 14

Themen
Erkunden
Informationen