Signing you in...

Please wait while we verify your authentication

Article · Saturday, August 15, 2026

KI-Entwicklertools · Was kam heute

Für eine erfahrene Engineerin, die ohnehin HN liest. Echte Veränderungen bei KI-Entwicklertools heute: Releases mit Versionsnummern, Paper mit Benchmarks, Repos, die eine relevante Schwelle überschritten haben. Hype-Threads, Pre-Announcement-Leaks und recycelte Zusammenfassungen überspringen. Immer Originalquellen verlinken.

By Marius BongartsTech35 editions
← See today's latest
Editions
8 / 35
Generated by AI overnight from public sources, refreshed daily.
KI-Entwicklertools · Was kam heute
Saturday, August 15, 2026
KI-Entwicklertools · Was kam heute

Caveman 2 spart 65% Tokens, NVIDIA bringt Nemotron-Suite

1 min read

Caveman 2 – Token-Effizienz

Ein Skill, der Output um ein Drittel schrumpft.

Caveman 2 ist eine MIT-lizenzierte Komponente für KI-Agenten, die prägnante Antworten erzwingt und damit Provider-gemeldete Input-Tokens um 33,2% senkt [Quelle: GitHub]. Die Proxy-Komponente (BSL-1.1) komprimiert zusätzlich JSON, Logs und Code strukturell. Eine neue TypeScript-basierte Agent SDK Runtime bietet typed Tools, Subagent-Management und lokale Speicherung für byte-exakte Rekonstruktion – native Integration mit über 30 Agenten wie Claude Code, Gemini CLI und Cursor.

Token-Arithmetik wird endlich ein Engineering-Problem, nicht nur ein Prompt-Trick.

NVIDIA Nemotron 3.5 – MoE-Linie

Spezialisierte Small Models für Agenten im Feld.

NVIDIA veröffentlichte Nemotron 3.5 Lightning (30B total / 3B aktive Parameter) mit Hybrid-Mamba-2-plus-Transformer-MoE-Architektur und 1M-Token-Kontext für autonome Agenten [Quelle: Hugging Face]. Parallel rollte NVIDIA spezialisierte Modelle aus: Nemotron 3.5 Content Safety (4B, multimodal), Parakeet-tdt-0.6b-v3 mit 25 europäischen Sprachen, Canary für mehrsprachige Speech-to-Text-Übersetzung und Cosmos 3 Super/Nano/Edge für Physical AI. Alle unter permissiven Lizenzen, verfügbar über vLLM, SGLang, TRT-LLM, Ollama und llama.cpp.

Die Architektur-Playlist vertieft sich: MoE für Agents, spezialisierte Encoder für multimodal, alles dezentral deploybar.

Paperclip – Open-Source Agent-Management

Die App, die Teams für Agent-Orchestrierung brauchen.

Paperclip sitzt auf GitHub als offene Alternative für Agent-Management am Arbeitsplatz [Quelle: GitHub]. Das Projekt adressiert die Lücke zwischen Demo-Agenten und Produktions-Koordination – der Stelle, wo heute noch Skripte und Tabs sterben.

Multi-Agent-Systeme brauchen jetzt ein Kontrollpult, nicht nur ein Framework.

Sources
Claude Code skill that cuts 65% of tokens by talking like caveman ...
Claude Code skill that cuts 65% of tokens by talking like caveman ...
13 hours ago ... Add/Update CODE_OF_CONDUCT.md to improve repository standards. last month ... In a pinned 54-run Claude Code benchmark, Caveman used 33.2% fewer ...
github.com
AI Summary

Caveman 2 ist ein KI-Entwicklertool, das Token-Effizienz für Agent-basierte Systeme verbessert. Die Skill-Komponente (MIT-Lizenz) reduziert die Ausgabetokens durch prägnante Antworten und funktioniert als Plugin für über 30 Agents wie Claude Code, Gemini CLI und Cursor. Die Proxy-Komponente (BSL-1.1) komprimiert zusätzlich Input-Tokens durch strukturelle Optimierungen von JSON, Logs und Code – in einem Benchmark mit Claude Code zeigte Caveman 2 33,2% weniger provider-gemeldete Input-Tokens bei Bestehen aller 18 Exact-Answer-Checks. Die neue Agent SDK Runtime in TypeScript bietet native Integration mit typed Tools, Subagent-Management und lokaler Speicherung (CCR) für byte-exakte Wiederherstellung transformierter Inhalte.

Visit source
GitHub - paperclipai/paperclip: The open-source app everyone uses ...
GitHub - paperclipai/paperclip: The open-source app everyone uses ...
4 hours ago ... ❌ You have an idea, you have to find your repo, fire up Claude Code, keep a tab open, and babysit it. ✓ Add a task in Paperclip. Your coding agent works on it ...
github.com
nvidia - Hugging Face
nvidia - Hugging Face
1 hour ago ... ... code, math, and science. Safety & Content Moderation. Models purpose-built ... benchmarks, and sovereign AI. Use the table below to find the right ...
huggingface.co
AI Summary

Nemotron 3.5 Lightning wurde als hocheffizientes Small Language Model (30B total / 3B aktive Parameter) mit Hybrid-Mamba-2-plus-Transformer-MoE-Architektur und Multi-Token-Prediction-Schichten veröffentlicht, optimiert für autonome Agenten mit 1M-Token-Kontextfenster und verfügbar über vLLM, SGLang, TRT-LLM, Ollama und llama.cpp. Nemotron 3 Super (120B total / 12B aktive Parameter) bietet bis zu 5x höheren Durchsatz als die vorherige Version mit LatentMoE und nativer NVFP4-Vortraining, während Nemotron 3 Ultra (550B total / 55B aktive Parameter) für anspruchsvollste Workloads mit Multi-Agenten-Fähigkeiten konzipiert ist. NVIDIA veröffentlichte zudem spezialisierte Modelle: Nemotron 3.5 Content Safety (4B, multimodal), Parakeet-tdt-0.6b-v3 mit 25 europäischen Sprachen und automatischer Spracherkennung, Canary für mehrsprachige Sprach-zu-Text-Übersetzung (25 Sprachen), Nemotron Parse v1.2 für Document Parsing, Cosmos 3 Super/Nano/Edge für Physical AI mit Mixture-of-Transformers-Architektur, sowie offene Datasets wie HelpSteer2 und umfangreiche Nemotron Dataset Collections für Pretraining, Math Reasoning, Code Generation und andere Spezialisierungen unter permissiven Lizenzen.

Visit source
Compiled overnight by MorningMail.aiDelivered at 03:10 AM