Signing you in...

Please wait while we verify your authentication

Article · Friday, July 10, 2026

KI-Entwicklertools · Was kam heute

Für eine erfahrene Engineerin, die ohnehin HN liest. Echte Veränderungen bei KI-Entwicklertools heute: Releases mit Versionsnummern, Paper mit Benchmarks, Repos, die eine relevante Schwelle überschritten haben. Hype-Threads, Pre-Announcement-Leaks und recycelte Zusammenfassungen überspringen. Immer Originalquellen verlinken.

By Marius BongartsTech35 editions
← See today's latest
Editions
30 / 35
Generated by AI overnight from public sources, refreshed daily.
KI-Entwicklertools · Was kam heute
Friday, July 10, 2026
KI-Entwicklertools · Was kam heute

Hermes Agent lernt, Qwen3 skaliert, Nexus regelt

1 min read

Hermes Agent

Nous Research veröffentlicht einen KI-Agenten, der aus eigenen Erfahrungen lernt.

Hermes Agent läuft auf beliebiger Infrastruktur – VPS, GPU-Cluster, serverlos – und unterstützt alle großen Modelle über Nous Portal, OpenRouter und OpenAI [Quelle: GitHub]. Die Kernidee: autonome Skill-Erstellung aus Trajektorien, persistente Speicherung mit periodischen Nudges, Session-Suche über FTS5 und Batch-Training für Tool-Calling-Modelle. Erreichbar über CLI und direkt auf Telegram, Discord, Slack, WhatsApp und Signal.

Sketch: Self-improving agents werden zur erwarteten Baseline, nicht zum Forschungsprojekt.

Qwen3-Coder & Code-Modelle

Qwen3-Coder setzt neue Maßstäbe für Open-Source-Code-Agenten.

Die Mixture-of-Experts-Architektur mit 80B Gesamtparametern und 3B aktiven Parametern erreicht 44,3% auf SWE-Bench Pro bei nativer 256K-Kontextlänge [Quelle: Modal]. Qwen2.5-Coder-7B schlägt sich mit 88,4% auf HumanEval überraschend stark; IBM Granite 4.1-30B zeigt 88,41% auf HumanEval und 73,68% auf BFCL v3 für Tool Calling. Spezialisierte Code-Modelle unter 30B lösen jetzt Tasks, die früher 70B+ brauchten.

Entscheidungsfrage für Teams: Ist Spitzenqualität das Ziel oder Qualität pro Watt?

Nexus: AI-Gateway Open Source

10x National Security hat eine Enterprise-AI-Governance-Plattform quelloffenen gemacht.

Nexus, entwickelt in Rust und Next.js, läuft als zentraler Kontrollpunkt für OpenAI und Anthropic (und künftige Provider) mit Policy Enforcement, Audit Trails, Cost Tracking und Response-Caching [Quelle: Open Source For U]. Das System erhält die OpenAI-kompatible API, unterstützt Multi-Tenant-Management und lädt auf GitLab zu Community-Beiträgen für Provider-Integrationen und OpenTelemetry-Support ein.

Das Signal: Governance-as-Code zieht aus dem DIY-Hobbyraum in Produktionssetups um.

Sources
NousResearch/hermes-agent: The agent that grows with you - GitHub
NousResearch/hermes-agent: The agent that grows with you - GitHub
15 hours ago ... Honcho dialectic user modeling. Compatible with the agentskills.io open standard. Scheduled automations, Built-in cron scheduler with delivery to any platform.
github.com
AI Summary

Hermes Agent, ein selbstlernender KI-Agent von Nous Research, wurde veröffentlicht und bietet eine integrierte Lernschleife, die Fähigkeiten aus Erfahrungen erstellt und verbessert. Der Agent läuft auf verschiedenen Infrastrukturen (VPS, GPU-Cluster, serverlos), unterstützt beliebige Modelle über Nous Portal, OpenRouter und OpenAI, und ist über CLI sowie Messaging-Plattformen (Telegram, Discord, Slack, WhatsApp, Signal) erreichbar. Kernfeatures umfassen autonome Skill-Erstellung, Speicherung mit periodischen Nudges, FTS5-Session-Suche mit LLM-Zusammenfassung, Batch-Trajektorien-Generierung für das Training von Tool-Calling-Modellen sowie Unterstützung für MCP-Server-Integration und Cron-Scheduling.

Visit source
Best Open Source Models for Code Completion Agents in 2026
Best Open Source Models for Code Completion Agents in 2026
9 hours ago ... These AI-powered systems rely on open source large language models fine ... repos or Modal Volumes, covering the models in this guide. Whether you're ...
modal.com
AI Summary

Qwen3-Coder-Next nutzt eine Mixture-of-Experts-Architektur mit 80B Gesamtparametern und 3B aktiven Parametern und erreicht 44,3% auf SWE-Bench Pro mit 256K nativer Kontextlänge. Qwen2.5-Coder-32B erzielte beim Release im September 2024 Benchmarks von 92,7% auf HumanEval Instruct und 90,2% auf MBPP Instruct. Qwen2.5-Coder-7B-Instruct erreicht 88,4% auf HumanEval trotz nur 7,61B Parametern. IBM Granite 4.1-30B zeigt 88,41% auf HumanEval, 85,45% auf MBPP und 73,68% auf BFCL v3 für Tool Calling.

Visit source
10x National Security Open Sources Nexus AI Gateway
10x National Security Open Sources Nexus AI Gateway
19 hours ago ... Nexus provides a single governed control point for enterprise AI deployments, enabling organisations to manage AI model access, policies, routing, audit trails, ...
opensourceforu.com
AI Summary

10x National Security hat Nexus open-sourced, ein unternehmensweites AI-Gateway und LLM-Kontrollplane, das auf GitLab verfügbar ist. Nexus ermöglicht Organisationen, den Zugriff auf KI-Modelle (aktuell OpenAI und Anthropic) über einen zentralen Kontrollpunkt zu verwalten, einschließlich Policy-Enforcement, Audit Trails, Observability und Cost Tracking, während die bestehende OpenAI-kompatible API erhalten bleibt. Das in Rust und Next.js entwickelte System unterstützt Provider-Routing, automatische Retries, Response-Caching und Multi-Tenant-Management und wurde als vendor-neutrales Open-Source-Framework konzipiert, um Community-Beiträge für Provider-Integrationen, OpenTelemetry-Support und Security-Enhancements zu ermöglichen.

Visit source
Compiled overnight by MorningMail.aiDelivered at 03:10 AM