Hermes: TillClawn 🤡 hat einen Bruder bekommen – und es ist kein Paketdienst
Neben TillClawn 🤡 steht ab heute ein zweiter Baustein in unserem Stack: Hermes. Kein Paketdienst, kein weiterer Agenten-Layer – sondern ein schlankes Framework…
Anthropic launcht Claude Sonnet 5 – ein Sonnet-Modell, das nah an Opus 4.8 herankommt, aber zu einem Bruchteil des Preises. Update August 2026: Wie sich Claude …
Europas Compute-Stau: Warum es 2026 kaum freie Rechenkapazität gibt
B200-Cluster mit Monaten Vorlauf, ausverkaufte EU-Regionen, Hyperscaler, die offen von Capacity Constraints sprechen: Europa hat ein Compute-Problem – und es wi…
Sakana AI veröffentlicht Fugu – kein neues Foundation-Modell, sondern ein Orchestrator, der spezialisierte LLMs kombiniert. Antwort auf Vendor-Lock-in, Export-C…
Agent Harness als Kategorie: Warum der Harness das neue Produkt ist
Der Harness — Skills, Sandbox, Subagents, Memory, Channel-Routing — ist die eigentliche Produktebene über dem Modell. Eine Einordnung, wer wo spielt: Claude Cod…
KI-Benchmarks im Überblick: Arena, SWE-Bench, AutomationBench & Co.
Wie funktionieren KI-Benchmarks – von LMArena über SWE-Bench bis zu Zapiers AutomationBench? Ein Überblick über Elo-Rankings, statische Evals, Agent-Benchmarks …
NotebookLM 3.5: Vom Preprocessor zum agentischen Research-Partner
Google hat NotebookLM auf Gemini 3.5 gehoben, einen Cloud-Computer reingebaut und Antigravity-Agents angebunden. Aus dem Quellen-Reader wird ein eigenständiger …
AutoClaw: Z.ais Agent, der nicht chattet, sondern arbeitet
AutoClaw ist der Agent-Layer von Z.ai – kein Chatbot, sondern ein AI Partner, der Aufgaben tatsächlich ausführt. Was AutoClaw kann, wie es mit unserem Agent Clu…
Z.ai GLM-5.2 – warum der nächste Frontier-Sprung aus China kommt
Z.ai veröffentlicht GLM-5.2 – mehr als Verdopplung gegenüber GLM-5.1, dicht an Claude Fable 5, billiger, on-prem fähig. Während US-Frontier-Modelle abgeschaltet…
Killt Local AI die ganzen AI-SaaS-Startups? Ein ehrlicher Blick aus dem Maschinenraum
Meetily nimmt Meeting-Notizen komplett lokal auf. Qwen läuft auf dem Laptop. RTX Spark kommt 2026 in die Notebooks. Werden die ganzen AI-Wrapper-Startups jetzt …
GLM-5.2 vs. Kimi K2.7 Code: Zwei Open-Weight-Releases in einer Woche – aber zwei sehr unterschiedliche Wetten
Innerhalb von vier Tagen haben Z.ai (GLM-5.2) und Moonshot AI (Kimi K2.7 Code) ihre nächste Generation Open-Weight-Modelle veröffentlicht. Auf den ersten Blick …
Lovable Feature-Roundup: Was im Mai und Juni 2026 wirklich wichtig wurde
Subagents, native Claude-MCP, Preview-Toolbar, Publish-from-Chat, Slow-Query-Analyse: In sechs Wochen hat Lovable mehr ausgeliefert als manche Plattform im halb…
SEO und AEO klingen nach demselben Spiel mit anderem Akronym. Sind sie nicht. Wo sich die beiden Disziplinen überschneiden, wo sie auseinandergehen – und was du…
Antigravity in der Praxis: Multi-Agent-Pipelines für Mid-Market-Kunden
Antigravity macht Multi-Agent-Pipelines aus dem Lab-Spielzeug zum produktiven Werkzeug. Ein Hands-on Architektur-Walkthrough aus laufenden Mid-Market-Projekten …