Signing you in...

Please wait while we verify your authentication

Article · Tuesday, September 8, 2026

KI-Entwicklertools · Was kam heute

Für eine erfahrene Engineerin, die ohnehin HN liest. Echte Veränderungen bei KI-Entwicklertools heute: Releases mit Versionsnummern, Paper mit Benchmarks, Repos, die eine relevante Schwelle überschritten haben. Hype-Threads, Pre-Announcement-Leaks und recycelte Zusammenfassungen überspringen. Immer Originalquellen verlinken.

By Marius BongartsTech67 editions
← See today's latest
Editions
16 / 67
Generated by AI overnight from public sources, refreshed daily.
KI-Entwicklertools · Was kam heute
Tuesday, September 8, 2026
KI-Entwicklertools · Was kam heute

Fable 5.1 schlägt die Konkurrenz, Grok 4.5 startet billig

1 min read

Fable 5.1 & Mythos 5.1

Cache-Rabatt macht Fable 5.1 zur Sparmaschine.

Anthropic hat die neuen Modelle live geschaltet [Quelle: Anthropic]. Fable 5.1 kostet 25 Prozent weniger bei typischen Workloads – bis zu 45 Prozent Ersparnis bei Agenten-Arbeit durch 75 Prozent niedrigere Cache-Read-Preise. In Benchmarks zeigt sich die Kraft: Terminal Bench Science springt auf 52,6 Prozent, Humanity's Last Exam auf 60,9 Prozent mit Tools, OSWorld 2.0 auf 77,9 Prozent partial.

Mythos 5.1 folgt für Cybersecurity und Life Sciences mit erweiterten Schutzgrenzen.

Grok 4.5 & Preisdruck

Grok 4.5 undercuts Fable bei Tokenkosten deutlich.

SpaceX AI hat sein neues Modell freigegeben – spezialisiert auf Coding, agentische Aufgaben und Wissensarbeit [Quelle: Heise]. Preis: 2 Dollar pro Million Input-Tokens, 6 Dollar pro Million Output-Tokens – deutlich unter Anthropics Public-Preisen. Grok 4.5 läuft sofort in Grok Build, Cursor und der xAI-API mit kostenlosen Testphasen.

EU-Regulierung verzögert den Rollout bis Mitte Juli.

Benchmark-Bilanz heute

Drei Flaggschiffe, drei sehr unterschiedliche Positionen.

Fable 5.1 dominiert die Science- und Tool-Benchmarks [Quelle: Anthropic]. Grok 4.5 platziert sich meist dahinter, übertrumpft aber stellenweise GPT-5.5 und Claude Opus. Das Momentum liegt bei Kosteneffizienz: xAI und Anthropic drücken Token-Preise, während OpenAIs GPT-6 Astra Kapazität über Premium-Tiers etabliert. Agents profitieren vom Preiskrieg – mehr Token für denselben Dollar bedeutet tiefere Reasoning-Fenster und längere Tool-Schleifen.

Nächste Woche folgen erste Cross-Model-Evaluationen auf echten Agentic Workloads.

Sources
Introducing Claude Fable 5.1 and Claude Mythos 5.1 - Anthropic
Introducing Claude Fable 5.1 and Claude Mythos 5.1 - Anthropic
2 hours ago ... We appreciated the opportunity to test the model and provide feedback, helping us prepare for a new frontier where we can increasingly rely on these tools to ...
anthropic.com
AI Summary

Anthropic hat Claude Fable 5.1 und Claude Mythos 5.1 veröffentlicht. Fable 5.1 ist ab sofort verfügbar und kostet etwa 25% weniger als Fable 5 bei typischen Workloads, mit bis zu 45% Ersparnis bei agentic Work durch 75% niedrigere Cache-Read-Preise. Das Modell zeigt Leistungssteigerungen in mehreren Benchmarks: Terminal-Bench-Science 0.1 (52,6%), Terminal-Bench 4.0 (55,8%), Humanity's Last Exam (60,9% mit Tools), CursorBench 3.2.0 (73,4%) und OSWorld 2.0 (77,9% partial). Mythos 5.1 ist identisch mit Fable 5.1, aber mit permissiveren Safeguards für verifizierte Cybersicherheits- und Life-Sciences-Fachleute. Beide Modelle zeigen verbesserte Fähigkeiten in wissenschaftlicher Forschung: Claude Mythos 5.1 entwickelte Protein-Binder mit bis zu zehnfach höherer Bindungsaffinität als beste bisherige Designs und erreichte eine Hit-Rate von fast 50% (Standard: 10–15%), erstellte hochauflösende Venus-Kartographie und optimierte sieben Deep-Learning-Modelle um bis zu 2,5x Geschwindigkeit.

Visit source
SpaceXAI stellt KI-Modell Grok 4.5 vor – EU-Nutzer müssen warten
SpaceXAI stellt KI-Modell Grok 4.5 vor – EU-Nutzer müssen warten
16 hours ago ... Die Übernahme des Entwickler-Tools Cursor durch SpaceXAI (ehemals xAI) und die damit einhergehende enge Zusammenarbeit tragen erste Früchte: Mit Grok 4.5 wurde ...
heise.de
AI Summary

SpaceXAI hat das KI-Modell Grok 4.5 vorgestellt, das speziell für Coding, agentische Aufgaben und Wissensarbeit optimiert wurde. Das Modell wurde auf zehntausenden Nvidia-GB300-GPUs trainiert und erreicht etwa 80 Tokens pro Sekunde mit doppelter Token-Effizienz gegenüber führenden Konkurrenzmodellen. In Benchmarks positioniert es sich meist hinter Anthropics Fable, übertrifft aber teilweise OpenAIs GPT-5.5 und Anthropics Claude Opus 4.8. Grok 4.5 ist mit 2 US-Dollar pro Million Input-Tokens und 6 US-Dollar pro Million Output-Tokens deutlich günstiger als Konkurrenzmodelle und steht sofort in Grok Build, dem Cursor-Entwickler-Tool sowie über die xAI-API bereit. Beide Plattformen bieten zeitlich begrenzte kostenlose Testphasen an. EU-Nutzer müssen sich bis Mitte Juli gedulden, da die Freigabe aufgrund regulatorischer Anforderungen verschoben wurde.

Visit source
Compiled overnight by MorningMail.aiDelivered at 03:10 AM