TOOLSChatGPT Work: Der Agent für ambitionierte Projekte
OpenAI stellt ChatGPT Work vor – einen Agent, der über mehrere Apps hinweg arbeitet, längerfristig an Projekten bleibt und Ziele eigenständig umsetzt.
TOOLSClaude Cowork: Dein Smartphone als Fernsteuerung für AI-Aufgaben
Anthropic rollt Claude Cowork aus – einen AI Agent, der Multi-Step-Tasks automatisiert. Max-Nutzer können über Smartphone und Web Aufgaben delegieren, die im Hintergrund weiterlaufen.
TOOLSOmnigent: Open-Source Framework für einheitliche AI-Agent-Verwaltung
Omnigent bietet eine zentrale Lösung für die Verwaltung mehrerer Coding Agents. Das Open-Source-Framework standardisiert CLI, Credentials und Shell-Befehle – und schließt damit Governance-Lücken bei Agent-Kosten und Ausführungen.
TOOLSSystem-Prompt gegen KI-Halluzinationen: Fakten statt Erfindungen
KI-Modelle erfinden regelmäßig Fakten und Quellen. Ein gezielter System-Prompt reduziert dieses Problem deutlich. Wir zeigen, wie du Halluzinationen im Arbeitsalltag minimierst.
TOOLSGoogle Colab CLI: Remote Runtimes für lokale Entwicklung
Google hat eine Command-Line Interface für Colab veröffentlicht, die lokale Terminals mit Remote-Runtimes verbindet. Entwickler können damit Python-Scripts auf entfernten GPUs/TPUs ausführen und Ergebnisse lokal abrufen.
TOOLSClaude Code Auto Mode: Weniger Bestätigungen, mehr Sicherheit
Anthropic hat Auto Mode für Claude Code entwickelt, um Nutzer von repetitiven Genehmigungsprompts zu entlasten. Machine-Learning-Klassifizierer entscheiden automatisch über sichere Operationen – bei 93% Approval-Rate ein großes Potenzial.
TOOLSOpenHack: Open-Source-Tool für AI-gestützte Vulnerability Research
OpenHack ist ein neues MIT-lizenziertes Open-Source-Tool der niederländischen Security-Firma Hadrian. Es automatisiert Vulnerability Research durch AI-Agenten und lässt sich in gängige Coding-Harnesses wie Claude Code oder Cursor integrieren.
TOOLSGitHub Copilot App: Microsoft startet Early Access
Microsoft bringt eine eigenständige GitHub Copilot App auf den Markt. Pro und Pro+ Abonnenten erhalten ab sofort Zugang zur Technical Preview. Damit antwortet Microsoft auf ähnliche Angebote von Anthropic und OpenAI.
TOOLSTausende KI-Agenten nachts im Einsatz: So nutzt Anthropic sein eigenes Modell
Boris Cherny, Gründer von Claude Code, setzt Anthropics KI-Modell in großem Stil ein. Nachts laufen tausende Agenten parallel – ein Einblick in praktische Multi-Agent-Nutzung.
TOOLSGraphBit: Strukturierte Agent-Orchestrierung ohne Halluzinationen
GraphBit ersetzt fehleranfällige Prompt-basierte Agent-Steuerung durch explizite DAG-Workflows. Ein Rust-Engine garantiert reproduzierbare Ausführung, parallele Verarbeitung und minimale Latenz — ohne Framework-bedingte Halluzinationen.
TOOLSSandyaa: Open-Source Tool für autonome Sicherheitsprüfungen
Sandyaa ist ein neues Open-Source-Tool von SecureLayer7, das LLMs nutzt, um Schwachstellen in Code zu identifizieren und funktionierende Exploits zu generieren. Das Projekt unter MIT-Lizenz soll Entwickler von manuellen Code-Audits entlasten.
TOOLSOpenAI startet Daybreak: KI-Tool zur Schwachstellenerkennung
OpenAI bringt Daybreak an den Markt – ein KI-System zur automatisierten Erkennung von Software-Sicherheitslücken. Das Tool soll Unternehmen helfen, ihre Cyber-Abwehr zu beschleunigen.
TOOLSLLM direkt in der Shebang-Zeile ausführen
Simon Willison zeigt, wie man LLMs direkt über die Shebang-Zeile in Skripten aufrufen kann. Das ermöglicht neue Möglichkeiten für automatisierte Textverarbeitung und Datenanalyse.
TOOLSInference-Shift: Warum Geschwindigkeit bei Agenten nicht mehr zählt
Agentic AI verändert die Anforderungen an Inference-Infrastruktur grundlegend. Wenn KI-Agenten autonom arbeiten, wird Speed irrelevant – andere Faktoren rücken in den Fokus.
TOOLSDeepClaude: Claude-Interface mit DeepSeek-Backend für 94% niedrigere Kosten
Ein Open-Source-Script ersetzt Claudes teure Anthropic-Backend durch DeepSeek V4 Pro und spart dabei bis zu 94% Kosten. Die Agent-Loop bleibt funktional, nur die Rechenleistung kommt von einem günstigeren Anbieter.
TOOLSCopilot trägt sich ungewollt als Co-Autor ein
Microsofts Copilot registriert sich automatisch als Co-Autor in Git-Commits – selbst wenn die KI nie verwendet wurde. Das sorgt für Verärgerung bei Entwicklern.
TOOLSWorkspace Agents in ChatGPT: Automatisierung für Teams
OpenAI führt Workspace Agents ein: Cloud-basierte KI-Agenten für ChatGPT, die komplexe Workflows automatisieren und Teams helfen, Tool-übergreifend effizienter zu arbeiten.
TOOLSWebSockets in der Responses API: Schnellere Agent-Workflows
OpenAI zeigt, wie WebSockets und Connection-Scoped Caching die Latenz bei Agent-Workflows reduzieren. Ein Blick auf die technische Optimierung des Codex Agent Loop.
TOOLSMulti-LoRA LLMs auf dem Smartphone: Effiziente Edge-Deployment-Strategien
Forscher zeigen, wie sich große Sprachmodelle mit mehreren LoRAs effizient auf Smartphones wie dem Samsung Galaxy S24/S25 deployen lassen. Durch Dynamic Self-Speculative Decoding und Multi-Stream-Mechanismen erreichen sie 4-6x schnellere Inferenz bei minimalem Speicherverbrauch.
TOOLSBolzano: LLM-gestützte mathematische Forschung in der Praxis
Ein Multi-Agent-System namens Bolzano hat eigenständig acht mathematische Probleme gelöst. Sechs Ergebnisse erreichen publikationsfähiges Niveau, fünf entstanden weitgehend autonom. Das zeigt: LLMs können echte Beiträge zur Forschung leisten.
TOOLSClaude Pro: Anthropic bringt kostenpflichtige Variante
Anthropic startet Claude Pro als kostenpflichtiges Abo-Modell. Nutzer erhalten höhere Nutzungslimits, frühen Zugang zu neuen Features und Modellen. Das Angebot richtet sich an Power-User und Profis.
TOOLSClaude 3 jetzt auf Google Vertex AI verfügbar
Anthropic stellt die Claude 3 Modelle über Google Vertex AI bereit. Entwickler können jetzt über Googles ML-Plattform auf Claude zugreifen und ihre Enterprise-Infrastruktur nutzen.
TOOLSClaude 3.5 Sonnet jetzt in GitHub Copilot verfügbar
Anthropic bringt Claude 3.5 Sonnet zu GitHub Copilot. Das Modell bietet verbesserte Code-Generierung und soll Entwickler effizienter machen. Die Integration ist ab sofort verfügbar.
TOOLSClaude integriert sich in Amazon Alexa+
Anthropic integriert Claude in Amazons Alexa+ Premium-Dienst. Die KI unterstützt nun komplexe Aufgaben über Sprachsteuerung und erweitert die Fähigkeiten von Alexa erheblich.
TOOLSModel Context Protocol: Standardisierter Datenaustausch für KI-Systeme
Anthropic stellt das Model Context Protocol vor – einen offenen Standard für die nahtlose Verbindung von KI-Modellen mit externen Datenquellen. Das Protokoll ermöglicht Entwicklern eine einheitliche Integration ohne proprietäre Schnittstellen.
TOOLSAnthropic kauft Bun – Claude Code überschreitet 1-Milliarde-Grenze
Anthropic hat das JavaScript-Runtime-Projekt Bun akquiriert und vermeldete gleichzeitig, dass Claude Code die 1-Milliarden-Dollar-Marke erreicht hat. Die Übernahme soll die Entwicklertools des Unternehmens stärken.
TOOLSAnthropic spendet Model Context Protocol an Open-Source-Community
Anthropic gibt das Model Context Protocol als Open-Source frei und gründet die Agentic AI Foundation. Der Schritt soll die Entwicklung von AI-Agenten standardisieren und die Zusammenarbeit in der Community fördern.
TOOLSAnthropic Labs: Experimentelle KI-Features für Claude-Nutzer
Anthropic startet Labs als Plattform für experimentelle Funktionen. Nutzer können neue Claude-Features testen und direktes Feedback geben, bevor diese in die Produktversion gehen.
TOOLSClaude Agent SDK jetzt in Apples Xcode verfügbar
Anthropic und Apple integrieren das Claude Agent SDK in Xcode. Entwickler können damit agentenbasierte Anwendungen direkt in der Apple-Entwicklungsumgebung erstellen und testen.
TOOLSClaude jetzt mit erweiterten Cybersecurity-Fähigkeiten
Anthropic stellt Claude mit erweiterten Sicherheitsfähigkeiten zur Verfügung. Das Modell soll Defender:innen helfen, Schwachstellen zu identifizieren und Cyberangriffe abzuwehren.
TOOLSEffektive Tools für Agents schreiben — mit Agent-Unterstützung
Die Qualität von Agent-Tools bestimmt ihre Leistung entscheidend. Anthropic zeigt, wie man hochwertige Tools und Evaluationen entwickelt und wie Claude seine eigenen Tools selbst optimieren kann.
TOOLSEffektive LLM-Agenten: Einfachheit schlägt Komplexität
Anthropic hat Dutzende Teams beim Aufbau von LLM-Agenten begleitet. Das Ergebnis ist eindeutig: Einfache, kombinierbare Muster funktionieren besser als komplexe Frameworks.
TOOLSClaude Code: So orchestriert Boris Cherny fünf AI-Agenten parallel
Boris Cherny, Schöpfer von Claude Code, hat seinen Entwicklungs-Workflow offengelegt: Er orchestriert fünf AI-Agenten gleichzeitig, nutzt ausschließlich das langsamste Modell und transformiert jede AI-Fehler in permanente Lernregeln.
TOOLSAgents.js: LLMs mit JavaScript Tools ausstatten
Hugging Face stellt Agents.js vor – eine JavaScript-Bibliothek, die Language Models mit Tools und Funktionen ausstattet. Entwickler können damit Agent-Systeme direkt im Browser oder Node.js aufbauen.
TOOLSQuantisierung in Transformers: Native Unterstützung erklärt
Hugging Face integriert mehrere Quantisierungsmethoden direkt in die Transformers-Bibliothek. Das ermöglicht effizientere Modelle ohne externe Tools und mit weniger Speicherverbrauch.
TOOLSLLM-Optimierung in der Produktion
Effiziente Inference, niedrigere Kosten: Hugging Face zeigt praktische Techniken zur Optimierung von Large Language Models im Produktiveinsatz.
TOOLSLlama 2 70B effizient mit PyTorch FSDP trainieren
PyTorch FSDP ermöglicht das Fine-Tuning großer Sprachmodelle wie Llama 2 70B mit optimiertem RAM-Verbrauch. Ein praktischer Guide zeigt, wie Speicher gespart und Training beschleunigt wird.
TOOLSChat Templates: Das versteckte Performance-Problem
Hugging Face zeigt, wie falsch implementierte Chat Templates die Model-Performance heimlich sabotieren. Ein Standard-Ansatz soll das Problem lösen.
TOOLSOptimum-NVIDIA: LLM-Inferenz mit einer Codezeile
Hugging Face und NVIDIA stellen Optimum-NVIDIA vor: ein neues Tool, das LLM-Inferenz durch Optimierungen drastisch beschleunigt. Die Integration in bestehende Workflows erfolgt mit minimaler Code-Änderung.
TOOLSLLM Fine-tuning 2x schneller mit Unsloth und TRL
Hugging Face integriert Unsloth in TRL und verdoppelt die Geschwindigkeit beim Fine-tuning von Large Language Models. Die neue Integration reduziert Speicherverbrauch und Trainingszeit deutlich.
TOOLSHugging Face TGI: Messages API für offene LLMs
Hugging Face erweitert TGI um eine OpenAI-kompatible Messages API. Entwickler können damit offene Sprachmodelle nahtlos als Drop-in-Replacement nutzen — ohne Code-Änderungen.
TOOLSStrukturierte Outputs: Mehr Konsistenz bei KI-Generierung
Strukturierte Generierung verbessert die Zuverlässigkeit von LLM-Outputs durch Schema-Validierung. Hugging Face zeigt, wie konsistente Antworten die Prompt-Instabilität reduzieren.
TOOLSTGI Multi-LoRA: Eine Instanz für 30 Modelle
Mit TGI Multi-LoRA können 30 unterschiedliche LoRA-Adapter auf einer einzelnen Basis-Instanz bereitgestellt werden. Das spart Ressourcen und vereinfacht die Modellverwaltung erheblich.
TOOLSMistral 7B mit Core ML auf Apple-Geräten ausführen
Hugging Face zeigt, wie sich das Mistral 7B Sprachmodell mit Core ML auf iPhones und Macs ausführen lässt. Die Integration ermöglicht lokale KI-Inferenz ohne Internetverbindung und mit vollständiger Datenkontrolle.
TOOLSOutlines-core 0.1.0: Strukturierte Generierung für Rust und Python
Hugging Face veröffentlicht Outlines-core 0.1.0 mit nativer Unterstützung für strukturierte KI-Generierung in Rust und Python. Das Framework ermöglicht präzise Output-Formate ohne Umwege über externe APIs.
TOOLSTransformers.js v3: WebGPU und neue Modelle
Transformers.js Version 3 bringt WebGPU-Unterstützung für GPU-Beschleunigung im Browser mit. Neu hinzugekommen sind Modelle und Tasks für erweiterte NLP-Anwendungen ohne Server-Backend.
TOOLSUniversal Assisted Generation: Schnelleres Decoding mit beliebigen Modellen
Hugging Face stellt Universal Assisted Generation vor – eine Methode für schnelleres LLM-Decoding, die mit verschiedenen Assistant-Modellen kompatibel ist. Die Technik beschleunigt Inference ohne zusätzliches Training.
TOOLSText Generation Inference unterstützt jetzt mehrere Backends
Hugging Face erweitert Text Generation Inference um flexible Backend-Optionen wie TRT-LLM und vLLM. Nutzer können nun zwischen verschiedenen Inferenz-Engines wählen und so Performance und Anforderungen optimal abstimmen.
TOOLSTiny Agents: Funktionsfähige KI-Agenten in 50 Codezeilen
Hugging Face zeigt, wie sich mit dem Model Context Protocol effiziente KI-Agenten minimal umsetzen lassen. Ein praktisches Beispiel für schlanke Agent-Architekturen ohne Overhead.
TOOLSMCP-Server mit Gradio bauen: Praktische Integration
Gradio ermöglicht es nun, Model Context Protocol Server direkt in Python zu implementieren. Eine neue Integration vereinfacht die Entwicklung von AI-Tools mit standardisiertem Protokoll.
TOOLSTiny Agents in Python: Agenten in 70 Zeilen Code
Hugging Face zeigt, wie man mit dem Model Context Protocol (MCP) funktionsfähige AI-Agenten in knapp 70 Zeilen Python schreibt. Ein praktischer Einstieg in agentenbasierte Systeme ohne Komplexität.
TOOLSCodeAgents mit Structured Output: Präzisere Tool-Ausführung
Hugging Face integriert Structured Output in CodeAgents. Das erzwingt definierte JSON-Schemas für Tool-Aufrufe und reduziert Fehler, Token-Verbrauch und Latenzen deutlich.
TOOLSHugging Face baut eigenen MCP Server
Hugging Face hat einen Model Context Protocol Server entwickelt, um seine Plattform direkt in Claude und andere AI-Tools zu integrieren. Das ermöglicht Entwicklern einfacheren Zugriff auf Models, Datasets und Hub-Features.
TOOLSScreenEnv: Desktop Agents mit vollständigem Stack deployen
ScreenEnv ermöglicht es, AI-Agenten direkt auf Desktop-Umgebungen einzusetzen. Das Framework verbindet Screen Understanding mit Action Execution für automatisierte Workflows.
TOOLSMCP für Forschung: KI-Systeme mit Research-Tools verbinden
Model Context Protocol ermöglicht es KI-Systemen, direkt auf Forschungswerkzeuge zuzugreifen. Hugging Face zeigt, wie MCP Workflows in der wissenschaftlichen Arbeit vereinfacht.
TOOLSMCP-Server in Python: KI-Einkaufsassistent mit Gradio
Hugging Face zeigt, wie man Model Context Protocol (MCP) Server in Python implementiert. Ein praktisches Beispiel: ein Virtual Try-On Assistant, der Gradio für die Benutzeroberfläche nutzt.
TOOLSClaude mit Model Context Protocol: Bilder generieren leicht gemacht
Claude kann jetzt über das Model Context Protocol direkt auf Hugging Face Modelle zugreifen und Bilder generieren. Die Integration ermöglicht nahtloses Zusammenspiel zwischen Anthropics LLM und Open-Source-Tools.
TOOLSSmol2Operator: GUI-Agenten für automatisierte Computeraufgaben
Hugging Face stellt Smol2Operator vor – leichte Sprachmodelle, die trainiert wurden, um grafische Benutzeroberflächen eigenständig zu bedienen. Die neuen Agenten ermöglichen Automatisierung von Desktop-Aufgaben ohne komplexe Programmierung.
TOOLSTransformers v5: Einfachere Modell-Definitionen für das AI-Ökosystem
Hugging Face veröffentlicht Transformers v5 mit vereinfachten Modell-Definitionen. Die Update reduziert Komplexität und macht die Bibliothek zugänglicher für Entwickler.
TOOLSTransformers.js v4: Jetzt auf NPM verfügbar
Transformers.js v4 ist ab sofort über NPM installierbar. Die JavaScript-Bibliothek bringt Machine-Learning-Modelle direkt in Browser und Node.js – ohne Python-Abhängigkeiten.
TOOLSCustom CUDA Kernels mit Codex und Claude automatisieren
Hugging Face zeigt, wie LLMs wie Codex und Claude Custom CUDA Kernels schreiben können. Das vereinfacht die GPU-Optimierung und macht High-Performance Computing zugänglicher für mehr Entwickler.
TOOLSGGML und llama.cpp schließen sich Hugging Face an
Die Open-Source-Projekte GGML und llama.cpp integrieren sich in Hugging Face. Der Schritt sichert die Langzeitentwicklung lokaler KI-Modelle und stärkt das Ökosystem für Edge-Deployment.
TOOLSTRL v1.0: Die Post-Training Library erreicht Production-Reife
Hugging Face stellt TRL v1.0 vor – eine Bibliothek für Post-Training von Large Language Models. Die neue Version bringt Stabilität, bessere Performance und erweiterte Features für Industrial-Anwendungen.
TOOLSClaude Artifacts: Live-Dashboards selbst erstellen
Claude führt Live-Artifacts ein: Dashboards aktualisieren sich automatisch und bleiben dauerhaft aktuell. Anthropic und Amazon bauen parallel die Infrastruktur für höhere Rechenleistung aus.
TOOLSClaude Token Counter: Vergleich zwischen Modellen
Simon Willison erweitert sein Token-Zähl-Tool um Modellvergleiche. Entwickler können nun einfach sehen, wie unterschiedliche Claude-Versionen Token abrechnen.
TOOLSMicrosoft: Copilot auf Enterprise-Geräten deinstallierbar
Microsoft ermöglicht IT-Administratoren nun, Copilot auf Enterprise-Geräten über neue Policy-Einstellungen zu deinstallieren. Die Funktion ist seit dem April 2026 Patch Tuesday verfügbar.
TOOLSCodex App Server: So integrierst du Codex-Agents in deine Anwendung
OpenAI stellt den Codex App Server vor – eine bidirektionale JSON-RPC API für die nahtlose Integration von Codex-Agents. Streaming, Tool-Nutzung und Genehmigungsprozesse werden damit standardisiert.
TOOLSChatGPT kommt ins Excel – mit Financial Data Integrations
OpenAI integriert ChatGPT direkt in Excel und erweitert die Financial Data Integrations. Die neue Funktion soll Datenmodellierung und Analyse in regulierten Umgebungen beschleunigen.
TOOLSOpenAI unterstützt Cyber-Defense mit GPT-5.4 und 10 Millionen Dollar
OpenAI startet "Trusted Access for Cyber" mit einem spezialisierten GPT-5.4-Cyber-Modell und verteilt 10 Millionen Dollar API-Grants an führende Sicherheitsfirmen und Unternehmen.
TOOLSGPT-5.4-Cyber: OpenAI erweitert Trusted Access für Cybersecurity
OpenAI stellt GPT-5.4-Cyber für verifizierte Sicherheitsexperten bereit. Das Programm Trusted Access for Cyber wächst, um fortgeschrittene KI-Cybersecurity-Fähigkeiten verantwortungsvoll zu nutzen.
TOOLSOpenAI erweitert Agents SDK um Sandbox-Ausführung
OpenAI hat das Agents SDK mit nativer Sandbox-Umgebung und Model-nativer Harness aktualisiert. Entwickler können nun sicherere, langfristig laufende Agenten mit erweiterten Datei- und Tool-Fähigkeiten entwickeln.
TOOLSCodex Update: Computer Use und browsing für Entwickler
OpenAI erweitert Codex um Computer Use, In-App-Browsing und Bildgenerierung. Die neue Version für macOS und Windows soll Entwickler-Workflows deutlich beschleunigen.
