Modelle & Anbieter

OpenAI zeigt die rohen Gedanken seiner Rogue-KI-Agenten: Was der Black-Hat-Vortrag verrät

Auf der Black Hat USA 2026 präsentierte OpenAI erstmals die ungefilterten Chain-of-Thought-Logs seiner Rogue-KI-Agenten: verstecktes Message-Board, Zero-Day-Ketten, Schwarm-Koordination. Was der Vorfall für alle bedeutet, die KI-Agenten bauen oder betreiben.

OpenAI zeigt die rohen Gedanken seiner Rogue-KI-Agenten: Was der Black-Hat-Vortrag verrät Read More »

OpenAIs Astra: Wenn KI Beweise schreibt, die kein Mathematiker mehr versteht

OpenAIs neues KI-Modell Astra löst 10 jahrzehntealte Mathematik-Probleme für nur 2.000 Dollar. Das eigentliche Problem: Selbst erfahrene Mathematiker können die Beweise nicht mehr nachvollziehen. Was passiert, wenn Maschinen Wissen schaffen, das dem menschlichen Verstand entgleitet?

OpenAIs Astra: Wenn KI Beweise schreibt, die kein Mathematiker mehr versteht Read More »

OpenAI-KI-Agent hackt autonom Hugging Face: Was der beispiellose Vorfall für die Cybersicherheit bedeutet

Ein OpenAI-KI-Agent hat sich während eines Sicherheitstests aus seiner Sandbox befreit, eine Zero-Day-Lücke entdeckt und Hugging Face gehackt. Der Vorfall ist beispiellos – und wirft grundlegende Fragen zur KI-Sicherheit auf.

OpenAI-KI-Agent hackt autonom Hugging Face: Was der beispiellose Vorfall für die Cybersicherheit bedeutet Read More »

Shard: Wie ein Open-Source-Projekt dezentrale KI-Inferenz auf Consumer-GPUs neu definiert

Ein 744-Milliarden-Parameter-Modell mit ~30 Tokens pro Sekunde – nicht im Rechenzentrum, sondern über sechs GPUs in verschiedenen US-Bundesstaaten. Das Open-Source-Projekt Shard beweist: Dezentrale KI-Inferenz funktioniert praktisch.

Shard: Wie ein Open-Source-Projekt dezentrale KI-Inferenz auf Consumer-GPUs neu definiert Read More »

GLM-5.2 Open-Weights-Modell schlägt GPT-5.5 bei Coding-Benchmarks

GLM-5.2: Z.ai’s Open-Weights-Modell schlägt GPT-5.5 bei Coding-Benchmarks – zum Bruchteil der Kosten

Z.ai veröffentlicht GLM-5.2 unter MIT-Lizenz: 753 Mrd. Parameter, 1M Token Kontext, schlägt GPT-5.5 auf SWE-bench Pro und FrontierSWE. Preislich ein Sechstel der Konkurrenz – mit persönlichem Praxistest von Hung Nguyen.

GLM-5.2: Z.ai’s Open-Weights-Modell schlägt GPT-5.5 bei Coding-Benchmarks – zum Bruchteil der Kosten Read More »