Du wirst angemeldet...

Bitte warte, während wir deine Anmeldung überprüfen

Artikel · Samstag, 15. August 2026

KI-Entwicklertools · Was kam heute

Für eine erfahrene Engineerin, die ohnehin HN liest. Echte Veränderungen bei KI-Entwicklertools heute: Releases mit Versionsnummern, Paper mit Benchmarks, Repos, die eine relevante Schwelle überschritten haben. Hype-Threads, Pre-Announcement-Leaks und recycelte Zusammenfassungen überspringen. Immer Originalquellen verlinken.

Von Marius BongartsTech35 Ausgaben
← Zur aktuellen Ausgabe
Ausgaben
8 / 35
Über Nacht von KI aus öffentlichen Quellen erstellt, täglich aktualisiert.
KI-Entwicklertools · Was kam heute
Samstag, 15. August 2026
KI-Entwicklertools · Was kam heute

Caveman 2 spart 65% Tokens, NVIDIA bringt Nemotron-Suite

1 Min. Lesezeit

Caveman 2 – Token-Effizienz

Ein Skill, der Output um ein Drittel schrumpft.

Caveman 2 ist eine MIT-lizenzierte Komponente für KI-Agenten, die prägnante Antworten erzwingt und damit Provider-gemeldete Input-Tokens um 33,2% senkt [Quelle: GitHub]. Die Proxy-Komponente (BSL-1.1) komprimiert zusätzlich JSON, Logs und Code strukturell. Eine neue TypeScript-basierte Agent SDK Runtime bietet typed Tools, Subagent-Management und lokale Speicherung für byte-exakte Rekonstruktion – native Integration mit über 30 Agenten wie Claude Code, Gemini CLI und Cursor.

Token-Arithmetik wird endlich ein Engineering-Problem, nicht nur ein Prompt-Trick.

NVIDIA Nemotron 3.5 – MoE-Linie

Spezialisierte Small Models für Agenten im Feld.

NVIDIA veröffentlichte Nemotron 3.5 Lightning (30B total / 3B aktive Parameter) mit Hybrid-Mamba-2-plus-Transformer-MoE-Architektur und 1M-Token-Kontext für autonome Agenten [Quelle: Hugging Face]. Parallel rollte NVIDIA spezialisierte Modelle aus: Nemotron 3.5 Content Safety (4B, multimodal), Parakeet-tdt-0.6b-v3 mit 25 europäischen Sprachen, Canary für mehrsprachige Speech-to-Text-Übersetzung und Cosmos 3 Super/Nano/Edge für Physical AI. Alle unter permissiven Lizenzen, verfügbar über vLLM, SGLang, TRT-LLM, Ollama und llama.cpp.

Die Architektur-Playlist vertieft sich: MoE für Agents, spezialisierte Encoder für multimodal, alles dezentral deploybar.

Paperclip – Open-Source Agent-Management

Die App, die Teams für Agent-Orchestrierung brauchen.

Paperclip sitzt auf GitHub als offene Alternative für Agent-Management am Arbeitsplatz [Quelle: GitHub]. Das Projekt adressiert die Lücke zwischen Demo-Agenten und Produktions-Koordination – der Stelle, wo heute noch Skripte und Tabs sterben.

Multi-Agent-Systeme brauchen jetzt ein Kontrollpult, nicht nur ein Framework.

Quellen
Claude Code skill that cuts 65% of tokens by talking like caveman ...
Claude Code skill that cuts 65% of tokens by talking like caveman ...
13 hours ago ... Add/Update CODE_OF_CONDUCT.md to improve repository standards. last month ... In a pinned 54-run Claude Code benchmark, Caveman used 33.2% fewer ...
github.com
KI-Zusammenfassung

Caveman 2 ist ein KI-Entwicklertool, das Token-Effizienz für Agent-basierte Systeme verbessert. Die Skill-Komponente (MIT-Lizenz) reduziert die Ausgabetokens durch prägnante Antworten und funktioniert als Plugin für über 30 Agents wie Claude Code, Gemini CLI und Cursor. Die Proxy-Komponente (BSL-1.1) komprimiert zusätzlich Input-Tokens durch strukturelle Optimierungen von JSON, Logs und Code – in einem Benchmark mit Claude Code zeigte Caveman 2 33,2% weniger provider-gemeldete Input-Tokens bei Bestehen aller 18 Exact-Answer-Checks. Die neue Agent SDK Runtime in TypeScript bietet native Integration mit typed Tools, Subagent-Management und lokaler Speicherung (CCR) für byte-exakte Wiederherstellung transformierter Inhalte.

Quelle öffnen
GitHub - paperclipai/paperclip: The open-source app everyone uses ...
GitHub - paperclipai/paperclip: The open-source app everyone uses ...
4 hours ago ... ❌ You have an idea, you have to find your repo, fire up Claude Code, keep a tab open, and babysit it. ✓ Add a task in Paperclip. Your coding agent works on it ...
github.com
nvidia - Hugging Face
nvidia - Hugging Face
1 hour ago ... ... code, math, and science. Safety & Content Moderation. Models purpose-built ... benchmarks, and sovereign AI. Use the table below to find the right ...
huggingface.co
KI-Zusammenfassung

Nemotron 3.5 Lightning wurde als hocheffizientes Small Language Model (30B total / 3B aktive Parameter) mit Hybrid-Mamba-2-plus-Transformer-MoE-Architektur und Multi-Token-Prediction-Schichten veröffentlicht, optimiert für autonome Agenten mit 1M-Token-Kontextfenster und verfügbar über vLLM, SGLang, TRT-LLM, Ollama und llama.cpp. Nemotron 3 Super (120B total / 12B aktive Parameter) bietet bis zu 5x höheren Durchsatz als die vorherige Version mit LatentMoE und nativer NVFP4-Vortraining, während Nemotron 3 Ultra (550B total / 55B aktive Parameter) für anspruchsvollste Workloads mit Multi-Agenten-Fähigkeiten konzipiert ist. NVIDIA veröffentlichte zudem spezialisierte Modelle: Nemotron 3.5 Content Safety (4B, multimodal), Parakeet-tdt-0.6b-v3 mit 25 europäischen Sprachen und automatischer Spracherkennung, Canary für mehrsprachige Sprach-zu-Text-Übersetzung (25 Sprachen), Nemotron Parse v1.2 für Document Parsing, Cosmos 3 Super/Nano/Edge für Physical AI mit Mixture-of-Transformers-Architektur, sowie offene Datasets wie HelpSteer2 und umfangreiche Nemotron Dataset Collections für Pretraining, Math Reasoning, Code Generation und andere Spezialisierungen unter permissiven Lizenzen.

Quelle öffnen
Über Nacht zusammengestellt von MorningMail.aiZugestellt um 03:10