MODELSOpenAI stellt GPT-5.6 vor – neue Modell-Familie mit verbesserter Sicherheit
OpenAI hat seine neue Modell-Familie mit GPT-5.6 vorgestellt. Die Updates bringen Verbesserungen in mehreren Bereichen, insbesondere bei Cybersecurity-Anwendungen.
MODELSOpenAI startet GPT-5.6 öffentlich — und präsentiert ChatGPT Work
Nach behördlicher Genehmigung durch die Trump-Administration rollt OpenAI das Modell GPT-5.6 nun öffentlich aus. Parallel launcht das Unternehmen ChatGPT Work — eine Kombination aus ChatGPT und Codex für Nicht-Techniker, angetrieben durch Sol, Terra und Luna.
MODELSGPT-5.6: Intelligenz, die mit deinen Anforderungen wächst
OpenAI stellt GPT-5.6 vor: Das Modell bietet höhere Intelligenz pro Token, bessere Performance pro Dollar und flexible Kapazitäten für komplexe Aufgaben.
MODELSClaude Sonnet 5: Fast Opus-Performance zum kleineren Budget
Anthropic hat Sonnet 5 veröffentlicht. Das Modell bietet nahezu die Performance von Opus 4.8, kostet aber deutlich weniger. Eine attraktive Option für Anwendungen, die High Performance nicht teuer erkaufen müssen.
MODELSClaude Sonnet 5: Was sich in Anthropics neuem Modell ändert
Anthropic hat Claude Sonnet 5 veröffentlicht. Simon Willison analysiert die Verbesserungen des neuen Modells und dessen praktische Implikationen für Entwickler.
MODELSGPT-5.6 Sol: OpenAIs nächste Modellgeneration
OpenAI stellt GPT-5.6 Sol vor – ein Modell mit verbesserter Performance in Coding, Science und Cybersecurity. Dazu kommt der bislang umfassendste Safety-Stack des Unternehmens.
MODELSOpenAI präsentiert GPT-5.6: Drei Modelle für unterschiedliche Anforderungen
OpenAI hat GPT-5.6 vorgestellt – eine neue Modellsuite mit drei Varianten. Sol, Terra und Luna adressieren unterschiedliche Use-Cases und sollen besonders bei Coding, Cybersecurity und Biology überzeugen.
MODELSGPT-5.5-Cyber: OpenAIs neues Security-Modell im Benchmark
OpenAI hat GPT-5.5-Cyber aktualisiert. Das auf KI-Sicherheit spezialisierte Modell soll Anthropics Claude 3.5 Sonnet beim Auffinden von Sicherheitslücken übertrumpfen und steht nun Partnerfirmen zur Verfügung.
MODELSOpenAI WebRTC Audio: Dokumentkontext in Echtzeit-Gesprächen
OpenAI erweitert seine WebRTC Audio Sessions um Dokumentkontext. Die Funktion ermöglicht es, PDFs und andere Dateien direkt in Live-Gespräche mit dem Modell einzubeziehen — praktisch für Analyse und Diskussionen.
MODELSAnthropic entschuldigt sich für versteckte Claude Fable Guardrails
Anthropic hat heimlich Beschränkungen in Claude Fable 5 eingebaut und wird dafür kritisiert. Das Unternehmen kündigt an, künftig transparenter über Guardrails zu kommunizieren – auch wenn das mehr Anfragen ablehnt.
MODELSClaude Fable 5: Anthropic veröffentlicht neues Modell mit Sicherheitsvorkehrungen
Anthropic hat Claude Fable 5 veröffentlicht – ein leistungsstarkes Mythos-Klasse-Modell mit erweiterten Cybersecurity-Fähigkeiten. Das Unternehmen implementiert gezielt Safeguards für hochrisikoanfragen, um Missbrauch zu verhindern.
MODELSClaude Fable 5: Anthropic veröffentlicht stärkstes Modell mit Sicherheits-Split
Anthropic hat Claude Fable 5 als stärkstes Modell veröffentlicht. Das Unternehmen nutzt einen ungewöhnlichen Ansatz: Dasselbe Modell wird als zwei Produkte mit unterschiedlichen Safety-Klassifizierern angeboten.
MODELSClaude Fable 5: Anthropics neues Top-Modell mit integriertem Fallback
Anthropic hat Claude Fable 5 veröffentlicht – sein leistungsfähigstes Modell bisher. Das System verfügt über einen integrierten Fallback-Mechanismus für sensible Anfragen.
MODELSClaude Fable 5: Anthropics neustes Flaggschiff-Modell
Anthropic hat Claude Fable 5 vorgestellt – das bislang leistungsfähigste öffentliche Modell des Unternehmens. Es richtet sich an Coding, Research und größere Projektarbeiten.
MODELSClaude Fable 5: Anthropics erstes öffentlich verfügbares Mythos-Modell
Anthropic veröffentlicht Claude Fable 5 als erstes öffentlich zugängliches Modell der Mythos-Klasse. Das System integriert Sicherheits-Guardrails für sensible Bereiche wie Cybersecurity und Biologie.
MODELSAnthropic stellt Claude Mythos 5 und Fable 5 vor
Anthropic veröffentlicht Claude Mythos 5, ein auf Cybersecurity spezialisiertes Modell, sowie die öffentliche Variante Fable 5. Beide Versionen bieten unterschiedliche Sicherheitsstufen für verschiedene Anwendungsfälle.
MODELSClaude Fable 5: Anthropics erstes Mythos-Modell für die Öffentlichkeit
Anthropic veröffentlicht Claude Fable 5, das erste öffentlich verfügbare Modell der Mythos-Klasse. Das System nutzt Guardrails, um Risiken in sensiblen Bereichen wie Cybersecurity und Biologie zu begrenzen.
MODELSClaude Fable 5: Anthropics erstes Mythos-Modell im öffentlichen Release
Anthropic veröffentlicht Claude Fable 5 als stärkstes öffentlich verfügbares Modell. Das Mythos-Modell zeigt besondere Stärken bei Software Engineering und komplexen Aufgaben – mit neuen Sicherheitsmechanismen.
MODELSNvidia N1X: ARM-Laptop-Chips mit Microsoft und Arm im Teaser
Nvidia, Microsoft und Arm teasing gemeinsam die kommende N1X Laptop-Prozessor-Serie. Die Ankündigung erfolgt auf der Computex in Taipei mit Hinweisen auf eine neue PC-Ära.
MODELSAnthropic bringt Claude Opus 4.8 – Mythos-Klasse kommt für alle
Anthropic hat Claude Opus 4.8 veröffentlicht und plant die breite Verfügbarkeit seiner Mythos-Klasse-Modelle. Alle Nutzer erhalten Zugang zu Opus 4.8 zum gleichen Preis wie die Vorgängerversion.
MODELSClaude Opus 4.8: Anthropic hebt die Performance-Latte
Anthropic hat Claude Opus 4.8 vorgestellt. Das Modell übertrifft Konkurrenten in den meisten Benchmarks und kostet gleich viel wie der Vorgänger – ein deutlicher Leistungssprung ohne Preiserhöhung.
MODELSAnthropic bringt Claude Mythos-Modelle zur Öffentlichkeit
Anthropic bestätigt den öffentlichen Rollout der Claude Mythos-Modelle nach Verzögerungen wegen Sicherheitsbedenken. Die neuen Modelle sollen nach Sicherheitsprüfungen schrittweise verfügbar gemacht werden.
MODELSAnthropic stellt Opus 4.8 mit Dynamic Workflows vor
Anthropic hat Opus 4.8 veröffentlicht. Das Modell bringt Dynamic Workflows mit – ein Tool zur Koordination von Agent-Schwärmen für komplexe Aufgaben.
MODELSClaude Opus 4.8: Anthropic veröffentlicht neues KI-Modell
Anthropic hat Claude Opus 4.8 vorgestellt. Das neue Modell soll bei erweiterten Aufgaben und Reasoning-Performance Verbesserungen bieten.
MODELSAnthropic arbeitet an Claude Mythos für Claude Code
Anthropic bereitet die Einführung des Mythos-Modells vor, das ursprünglich als risikobehaftet eingestuft wurde. Das Modell könnte bald in Claude Code integriert werden und wirft Sicherheitsfragen auf.
MODELSGoogle stellt Suche auf agentic AI um – ab 2026
Google kündigt auf der I/O 2026 eine grundlegende Neuausrichtung der Suchmaschine an. Agentic-AI-Systeme sollen künftig komplexe Aufgaben eigenständig übernehmen. Die Transformation wird das Nutzererlebnis erheblich verändern.
MODELSGoogle I/O: KI-Agenten erobern die Suche – Spark wird Premium-Feature
Google rüstet seine Suchmaschine mit autonomen KI-Agenten aus. Der neue Assistent Spark wird kostenpflichtig. Die Suche wird zum Akteur statt zum Werkzeug.
MODELSGoogle I/O 2026: Gemini 3.5 und die neuen AI-Features
Google präsentiert auf der I/O 2026 die Gemini 3.5 Familie mit Flash und Pro Modellen. Neue Features für Search und Gmail sowie Updates zu Project Aura Smart Glasses ergänzen die Ankündigungen.
MODELSGoogle integriert AI Agents in Search und redesignt die Suchleiste
Google macht Gemini 2.5 Flash zum Standard in AI Mode, überarbeitet die Suchleiste und kündigt Search Agents für den Sommer an. Die neuen Features sollen die Suche intelligenter und kontextbezogener gestalten.
MODELSDie letzten 6 Monate LLM-Entwicklung kompakt
Simon Willison fasst die wichtigsten Fortschritte der letzten sechs Monate im LLM-Bereich zusammen. Eine schnelle Orientierung für alle, die den Überblick behalten möchten.
MODELSPosition Bias in Reasoning Models: Länge des Gedankenprozesses verstärkt Verzerrungen
Chain-of-Thought-Modelle wie DeepSeek-R1 zeigen einen überraschenden Effekt: Je länger ihre inneren Denkprozesse, desto stärker die Position Bias bei Multiple-Choice-Fragen. Eine neue Studie deckt auf, wie längeres Reasoning paradoxerweise zu mehr Verzerrungen führt.
MODELSCode w/ Claude 2026: Was Anthropic zeigt
Anthropic präsentiert auf der Code w/ Claude 2026 neue Entwicklungen zu Claude. Simon Willison dokumentiert die Highlights im Live-Blog.
MODELSOpenAI stellt GPT-5.5 Instant vor – neues Standard-Modell
OpenAI hat GPT-5.5 Instant angekündigt, das GPT-3.5 Instant als Standard-Modell in ChatGPT ablöst. Das neue Modell soll schnellere und präzisere Antworten bieten.
MODELSFocus: Selective Aufmerksamkeit statt vollständiger Attention
Focus reduziert die quadratische Komplexität von Attention durch gelernte Token-Gruppierungen. Die Methode lässt sich in bestehende Modelle integrieren, ohne deren Gewichte anzupassen — mit messbaren Speedups und ohne Qualitätsverluste.
MODELSReasoning Skills speichern: Weniger Tokens, bessere Ergebnisse
Forscher zeigen, wie LLMs durch gespeicherte Reasoning Skills effizienter arbeiten: Weniger Tokens für Chain-of-Thought, bessere Genauigkeit bei Coding und Math Tasks.
MODELSGPT-4o und kostenlose Features: OpenAIs Spring Update
OpenAI stellt GPT-4o vor und erweitert das kostenlose ChatGPT-Angebot. Das neue Modell bietet verbesserte Multimodal-Fähigkeiten und schnellere Verarbeitung.
MODELSGPT-4o für alle: OpenAI erweitert kostenloses ChatGPT
OpenAI stellt GPT-4o nun auch kostenlosen ChatGPT-Nutzern zur Verfügung. Das neue Flaggschiff-Modell bringt erweiterte Fähigkeiten in die kostenlose Variante und demokratisiert Zugang zu fortgeschrittener KI.
MODELSGPT-4o mini: Kosteneffiziente KI für größere Einsatzbreite
OpenAI stellt GPT-4o mini vor – ein kompakteres Modell mit besserer Performance bei deutlich niedrigeren Kosten. Ideal für Anwendungen mit hohem Durchsatz und begrenztem Budget.
MODELSGPT-5.4: OpenAIs neues Flaggschiff für professionelle Arbeit
OpenAI hat GPT-5.4 vorgestellt – ein frontier model mit 1M-token context, erweiterten Coding-Fähigkeiten und Computer-Use-Funktionen. Das Modell soll Effizienz und Leistung für professionelle Anwendungen neu definieren.
MODELSVLAA-GUI: Wann sollte ein Agent stoppen, neu starten oder suchen?
VLAA-GUI ist ein modulares Framework für GUI-Automation, das drei zentrale Komponenten nutzt, um zu entscheiden, wann ein Agent stoppen, sich von Schleifen befreien oder online suchen sollte. Das System erreicht 77,5% auf OSWorld und übertrifft teilweise menschliche Leistung.
MODELSCAP: Kontrolliertes Vergessen in LLMs ohne Parameteränderung
CAP bietet eine prompt-basierte Methode zum gezielten Löschen von Wissen aus LLMs, ohne das Modell zu verändern. Die Technik nutzt Reinforcement Learning und ermöglicht reversibles Vergessen — besonders relevant für Compliance und geschlossene Modelle.
MODELSAtlas-Alignment: Interpretierbarkeit zwischen Sprachmodellen übertragbar machen
Atlas-Alignment ermöglicht es, die Interpretierbarkeit eines Sprachmodells auf neue Modelle zu übertragen, ohne teure modellspezifische Trainings zu wiederholen. Ein vortrainiertes Concept Atlas wird durch leichte Alignment-Methoden synchronisiert.
MODELSVon Sprache zu verifiziertem Code: LLMs mit formaler Verifikation
Forscher zeigen, wie Large Language Models mit Dafny-basierter formaler Verifikation zuverlässigen Code generieren. Durch strukturierte Prompts und iteratives Feedback erreichen offene Modelle Verifizierungsquoten von über 90%.
MODELSStrukturiertes Reasoning für Fragen über umfangreiche Dokumentsammlungen
SLIDERS löst das Problem begrenzter Context Windows durch Extraktion in relationale Datenbanken statt Chunk-Aggregation. Das Framework nutzt strukturiertes Reasoning via SQL und Data Reconciliation für konsistente Antworten über Millionen Tokens hinweg.
MODELSExecution Feedback schlägt komplexe Pipelines bei Code-Generierung
Kleine Language Models (1-3B) generieren besseren Code durch Execution Feedback und Self-Refinement als durch komplexe Pipelines. Eine einfache Generate-Execute-Refine-Schleife übertrifft aufwendigere Architekturen deutlich.
MODELSWorld Models für Agents: Von Vorhersagen zu autonomen Simulationen
Eine neue Taxonomie systematisiert World Models für AI-Agents in drei Fähigkeitsstufen und vier Regelregime. Die Übersicht von über 400 Arbeiten zeigt, wie Agents Umgebungsdynamiken verstehen und letztendlich manipulieren können.
MODELSMemanto: Effiziente Semantic Memory für Long-Horizon Agents
Memanto vereinfacht das Memory-Management autonomer Agenten durch eine typisierte Semantic-Memory-Architektur ohne klassische Knowledge Graphs. Das System erreicht State-of-the-Art-Ergebnisse bei deutlich geringerem Overhead und garantiert sub-90ms Retrieval-Latenz.
MODELSSozialwissenschaftliche Studien mit KI-Agenten reproduzieren
Neue Forschung zeigt, dass LLM-Agenten sozialwissenschaftliche Ergebnisse allein aus Methodenbeschreibungen und Originaldaten rekonstruieren können. Die Erfolgsquote hängt stark vom Modell und der Papierqualität ab.
MODELSClaude Instant 1.2: Schneller und günstiger
Anthropic veröffentlicht Claude Instant 1.2 mit verbesserter Performance und niedrigeren Kosten. Das Update bringt bessere Qualität bei gleichzeitig schnellerer Verarbeitung für kostensensitive Anwendungen.
MODELSClaude 3 Haiku: Anthropics schnellstes Modell
Anthropic stellt Claude 3 Haiku vor – das schnellste Modell der Claude-3-Familie. Mit reduzierter Latenz und optimierter Performance eignet sich Haiku besonders für Echtzeit-Anwendungen und kostensensitive Szenarien.
MODELSClaude 3.5 Sonnet & Haiku: Computer Use und neue Fähigkeiten
Anthropic stellt Claude 3.5 Sonnet und Haiku vor und führt Computer Use ein – eine Fähigkeit, mit der KI-Modelle eigenständig Bildschirme steuern können. Die neuen Versionen bieten verbesserte Performance und erweiterte Anwendungsmöglichkeiten.
MODELSClaude 3.7 Sonnet: Bessere Performance bei weniger Kosten
Anthropic hat Claude 3.7 Sonnet vorgestellt – ein effizienteres Modell mit verbesserter Performance. Parallel dazu erweitert Claude Code die Fähigkeiten für spezialisierte Aufgaben.
MODELSClaude 4: Anthropic präsentiert die nächste Modell-Generation
Anthropic hat Claude 4 angekündigt und setzt damit die Weiterentwicklung seines KI-Assistenten fort. Das Modell bringt Verbesserungen in Fähigkeiten und Zuverlässigkeit mit sich.
MODELSClaude Opus 4.1: Besseres Reasoning, längerer Context
Anthropic hat Claude Opus 4.1 vorgestellt. Das Modell verbessert Reasoning-Fähigkeiten und erweitert das Context-Fenster. Es adressiert praktische Anforderungen von Enterprise-Nutzern.
MODELSClaude Code: Anthropic erweitert Geschäftspläne um Admin-Controls
Anthropic integriert Claude Code in seine Business-Pläne und führt neue Admin-Kontrollmöglichkeiten ein. Teams erhalten damit bessere Verwaltungsoptionen und erweiterte Code-Funktionen für Enterprise-Umgebungen.
MODELSClaude Sonnet 4.5: Schnellere KI mit verbesserter Effizienz
Anthropic hat Claude Sonnet 4.5 veröffentlicht und positioniert das Modell als schnellere Alternative zu Claude 3.5 Sonnet. Die Version soll bessere Performance bei optimiertem Ressourcenverbrauch bieten und ist ab sofort verfügbar.
MODELSClaude Haiku 4.5: Schneller und effizienter
Anthropic veröffentlicht Claude Haiku 4.5, ein kompakteres Modell mit verbesserter Performance. Es bietet bessere Geschwindigkeit und Kosteneffizienz für Produktionsumgebungen.
MODELSClaude Opus 4.6: Schneller und effizienter
Anthropic stellt Claude Opus 4.6 vor – ein Modell, das schnellere Verarbeitung bei gleichbleibender Intelligenz bietet. Die verbesserte Effizienz senkt Latenz und Kosten im Betrieb.
MODELSClaudes neue Constitution: Mehr Eigenständigkeit durch selbstgesteuertes Lernen
Anthropic hat Claudes Constitution überarbeitet. Das Modell nutzt jetzt neue Lernmechanismen für konsistenteres Verhalten. Die Änderungen zielen auf verbesserte Zuverlässigkeit und Sicherheit ab.
MODELSClaude Sonnet 4.6: Extended Thinking, schneller, günstiger
Anthropic veröffentlicht Claude Sonnet 4.6 mit Extended Thinking, besseren Reasoning-Fähigkeiten und günstigeren API-Preisen. Das Modell wird zur praktischen Standard-Choice für viele Produktions-Workflows.
MODELSContextual Retrieval: Besserer Zugriff auf Kontextwissen
Anthropic stellt Contextual Retrieval vor – eine Methode, um AI-Modellen gezielten Zugriff auf relevantes Hintergrundwissen zu geben. Das verbessert Antwortqualität und senkt Halluzinationen.
MODELSNousCoder-14B: Open-Source Coding-Modell mit volltransparenter Trainingsmethode
Nous Research veröffentlicht NousCoder-14B, ein Open-Source-Coding-Modell, das proprietäre Systeme erreicht oder übertrifft. Das Besondere: Vollständige Transparenz des Trainings, inklusive Reinforcement Learning-Umgebung und Benchmark-Suite.
MODELSDeepSeek V4 startet: Pro-Version kostet 98% weniger als GPT-4.5 Pro
DeepSeek hat sein größtes und effizientestes Modell veröffentlicht. Die Pro-Version kostet deutlich weniger als Konkurrenzprodukte und positioniert sich als kostengünstige Alternative.
MODELSDeepSeek zeigt neues Modell, das zu Top-KI-Systemen aufschließt
DeepSeek präsentiert ein überarbeitetes KI-Modell mit verbesserten Architekturen, das deutlich effizienter ist und bei Reasoning-Benchmarks fast gleichauf mit führenden Systemen liegt.
MODELSGoogle investiert 40 Milliarden Dollar in Anthropic
Alphabet kündigt eine 40-Milliarden-Dollar-Investition in Anthropic an – noch größer als Amazons jüngste Zusage. Der Wettbewerb um die führende AI-Position verschärft sich deutlich.
MODELSFalcon 180B: Das größte Open-Source-Sprachmodell
Hugging Face hat Falcon 180B veröffentlicht – ein 180-Milliarden-Parameter-Modell, das mit proprietären Systemen konkurriert. Das Open-Source-Modell setzt neue Maßstäbe bei Performance und Zugänglichkeit.
MODELSMixtral: Neues Mixture-of-Experts Modell auf Hugging Face
Hugging Face präsentiert Mixtral, ein hochperformantes Mixture-of-Experts Modell. Das System nutzt spezialisierte Expert-Layer für effizientere Inferenz und bessere Skalierbarkeit bei gleichzeitig niedrigerem Speicherverbrauch.
MODELSConstitutional AI: Ethische KI-Modelle selbst trainieren
Constitutional AI ermöglicht es, offene Sprachmodelle durch selbstdefinierte Regeln ethischer auszurichten. Hugging Face zeigt, wie man diesen Ansatz praktisch umsetzt.
MODELSStarCoder2: Offenes Code-Modell mit verbesserter Performance
Hugging Face veröffentlicht StarCoder2, ein verbessertes Open-Source-Modell für Code-Generierung. Das Modell wurde auf The Stack v2 trainiert und bietet bessere Performance bei kleinerem Footprint.
MODELSGaLore: Effizientes Training großer Modelle auf Standard-Hardware
GaLore reduziert Speicherbedarf beim LLM-Training um bis zu 65%. Die neue Methode ermöglicht es, große Sprachmodelle auf handelsüblicher GPU-Hardware zu trainieren – ohne Qualitätsverluste.
MODELSCosmopedia: Synthetische Trainingsdaten im großen Maßstab
Hugging Face stellt Cosmopedia vor – eine Methode zur Generierung großflächiger synthetischer Daten für das Pre-Training von LLMs. Das Projekt zeigt, wie KI-Modelle effizient mit künstlich erstellten Inhalten trainiert werden können.
MODELSLlama 3: Metas neues Open-Source Sprachmodell
Meta hat Llama 3 veröffentlicht – ein Open-Source Large Language Model mit verbesserter Performance und erweiterten Capabilities. Das Modell steht kostenlos zur Verfügung und richtet sich an Entwickler und Forscher.
MODELSStarCoder2-Instruct: Open Source Code-Modell mit Self-Alignment
Hugging Face veröffentlicht StarCoder2-Instruct, ein vollständig transparentes Code-Generierungs-Modell mit Self-Alignment-Verfahren. Das Modell nutzt offene Daten und dokumentiert seinen Trainingsprozess komplett.
MODELSPaliGemma: Googles offenes Vision-Language-Modell
Google hat PaliGemma veröffentlicht – ein Open-Source-Modell, das Text und Bilder verarbeitet. Das Modell eignet sich für praktische Aufgaben wie Dokumentenerkennung und visuelle Fragen.
MODELSKV-Cache Quantization: Längere Sequenzen, weniger Speicher
KV-Cache Quantization reduziert den Speicherverbrauch beim Inference von Language Models erheblich. Das ermöglicht längere Sequenzen und höheren Durchsatz ohne Hardware-Upgrades.
MODELSGemma 2: Googles neues Open-Source Sprachmodell
Google hat Gemma 2 veröffentlicht – ein offenes Sprachmodell, das Skalierbarkeit und Effizienz kombiniert. Das Modell steht in verschiedenen Größen zur Verfügung und richtet sich an Entwickler und Unternehmen.
MODELSTransformers Code Agent schlägt GAIA-Benchmark
Hugging Face präsentiert einen Code Agent auf Basis von Transformers, der den GAIA-Benchmark erfolgreich meistert. Das System kombiniert Language Models mit praktischer Code-Ausführung und zeigt, wie Agenten komplexe Aufgaben lösen.
MODELSLlama 3.1: Meta skaliert auf 405B mit Multilingualität
Meta veröffentlicht Llama 3.1 in drei Größen bis 405B Parameter. Die neuen Modelle unterstützen 128K Token Context und verbesserte Multilingual-Fähigkeiten. Open Source verfügbar auf Hugging Face.
MODELSFalcon Mamba: Das erste starke 7B-Modell ohne Attention
Hugging Face stellt Falcon Mamba vor – ein 7B-Modell, das auf State Space Models statt Transformer-Attention setzt. Es verspricht bessere Effizienz bei vergleichbarer Performance.
MODELSLLMs auf 1.58bit: Extreme Quantisierung leicht gemacht
Hugging Face zeigt, wie sich Large Language Models auf extreme 1.58bit-Quantisierung reduzieren lassen – ohne großen Aufwand. Ein Durchbruch für ressourcenschonende KI-Nutzung auf Edge-Geräten.
MODELSSmolVLM: Effiziente Vision-Language-Modelle im Kleinstformat
Hugging Face stellt SmolVLM vor – kompakte Vision-Language-Modelle, die auf Edge-Geräten laufen und dabei überraschend gute Performance liefern. Eine praktische Alternative zu großen Modellen.
MODELSOpen-R1: Open-Source-Reproduktion von DeepSeek-R1
Hugging Face veröffentlicht Open-R1, eine vollständig offene Reproduktion von DeepSeeks Reasoning-Modell. Das Projekt ermöglicht es der Community, leistungsstarke Chain-of-Thought-Systeme zu trainieren und anzupassen.
MODELSMini-R1: Deepseek R1 mit Reinforcement Learning nachbauen
Hugging Face zeigt, wie man Deepseek R1 mit Reinforcement Learning reproduziert. Ein praktisches Tutorial für das Training von Reasoning-Modellen ohne proprietäre Infrastruktur.
MODELSPrefill und Decode: LLM-Performance bei parallelen Anfragen optimieren
Wie Prefill und Decode Phasen die Durchsatzrate großer Sprachmodelle beeinflussen. TNG Tech zeigt Optimierungsstrategien für gleichzeitige Nutzeranfragen.
MODELSSmolLM3: Kompakte Sprachmodelle mit Mehrsprachigkeit und langem Kontext
Hugging Face stellt SmolLM3 vor – effiziente Sprachmodelle in verschiedenen Größen mit verbesserter Mehrsprachigkeit und erweitertem Context Window. Ideal für ressourcenbegrenzte Umgebungen.
MODELSOpenAI startet GPT OSS: Neue Open-Source Modellfamilie
OpenAI veröffentlicht GPT OSS, eine neue Open-Source Modellfamilie. Die Modelle sind frei verfügbar und sollen Entwicklern mehr Flexibilität bieten.
MODELSFLUX-2: Neue Bildgenerierung in Hugging Face Diffusers
Hugging Face integriert FLUX-2 in die Diffusers-Library. Das Modell bietet verbesserte Bildqualität und schnellere Generierung. Developer erhalten direkten Zugang zu fortgeschrittenen Text-to-Image-Fähigkeiten.
MODELSGemma 4: Googles neues multimodales On-Device-Modell
Google präsentiert Gemma 4 mit nativer Multimodal-Unterstützung für lokale Verarbeitung. Das Modell kombiniert Text- und Bildverarbeitung auf Edge-Geräten und adressiert Performance sowie Datenschutz gleichermaßen.
MODELSDeepSeek-V4: Eine Million Token Context für produktive Agenten
DeepSeek-V4 erweitert das Context-Fenster auf eine Million Token und macht diese Kapazität praktisch nutzbar. Das Modell zeigt effiziente Performance bei langen Dokumenten und Multi-Turn-Szenarien.
MODELSWorld Models: Warum KI die physische Welt noch nicht beherrscht
KI-Systeme dominieren die digitale Welt, doch die physische Realität bleibt eine Herausforderung. World Models könnten der Schlüssel sein, um Maschinen ein echtes Verständnis der Welt zu geben.
MODELSDeepSeek V4: Das ändert sich beim neuen Flagship-Modell
DeepSeek hat V4 vorgestellt: Das neue Flagship-Modell verarbeitet deutlich längere Prompts und bleibt Open Source. Wir erklären, warum das für die AI-Community relevant ist.
MODELSDeepseek V4: Wie China KI-Unabhängigkeit vorantreibt
Deepseek optimiert V4 für chinesische Hardware statt US-GPUs. Das Flash-Modell läuft auf acht lokalen KI-Beschleunigern. Kleine Änderungen ermöglichen große Auswirkungen auf die technologische Souveränität.
MODELSClaude System Prompts als Git-Timeline nachverfolgbar
Simon Willison dokumentiert Claudes System Prompts in einem Git-Repository und macht deren Entwicklung über die Zeit nachverfolgbar. Ein Ansatz für mehr Transparenz bei KI-Modell-Instruktionen.
MODELSClaude Opus 4.7: Änderungen im System Prompt
Anthropic hat die System Prompt von Claude Opus überarbeitet. Die neuen Vorgaben zeigen, wie sich die Verhaltensrichtlinien zwischen Version 4.6 und 4.7 verschoben haben.
MODELSQwen3.6-27B: Flagship-Level Code-Performance in 27B
Alibabas neues Qwen3.6-27B-Modell erreicht Flagship-Qualität beim Code schreiben trotz kompakter Größe. Das Dense Model eignet sich ideal für lokale Deployment und spezialisierte Coding-Tasks.
MODELSClaude's Code Quality: Aktuelle Entwicklungen und Erkenntnisse
Anthropic adressiert aktuelle Berichte zur Code-Qualität von Claude. Ein Überblick über die neuesten Erkenntnisse und wie sie die Entwicklung des Modells beeinflussen.
MODELSDeepSeek V4: Frontier-Leistung zu Bruchteilen der Konkurrenz
DeepSeek V4 erreicht Frontier-Level-Performance bei deutlich niedrigeren Kosten. Das Modell konkurriert mit teureren Alternativen und setzt neue Maßstäbe bei der Effizienz.
MODELSGPT-5.3-Codex: Coding-Agent mit verbesserter Reasoning
OpenAI stellt GPT-5.3-Codex vor – einen auf Code spezialisierten Agent, der Coding-Performance mit General Reasoning kombiniert. Das Modell soll komplexe, mehrstufige technische Aufgaben bewältigen.
MODELSGPT-5.2 entdeckt neue Formel in der theoretischen Physik
GPT-5.2 hat eine neue Formel für Gluon-Amplituden vorgeschlagen, die anschließend von OpenAI und akademischen Partnern formal bewiesen wurde. Ein Preprint dokumentiert diese Entdeckung im Bereich der theoretischen Physik.
MODELSEVMbench: Benchmark für KI-Agenten in Smart-Contract-Sicherheit
OpenAI und Paradigm stellen EVMbench vor – einen Benchmark, der die Fähigkeit von KI-Agenten bewertet, kritische Sicherheitslücken in Smart Contracts zu erkennen, zu beheben und auszunutzen.
MODELSSWE-bench Verified: Warum OpenAI die Bewertung einstellt
OpenAI stoppt die Evaluierung von SWE-bench Verified wegen Datenkontamination und fehlerhaften Tests. Das Benchmark misst die Coding-Fähigkeiten von KI-Modellen nicht mehr zuverlässig. SWE-bench Pro soll die bessere Alternative sein.
MODELSGPT-5.4: OpenAIs neues Flaggschiff für professionelle Anwendungen
OpenAI stellt GPT-5.4 vor – das leistungsstärkste Modell der Reihe mit erweiterten Fähigkeiten bei Code, Computer Use und 1-Million-Token-Context für professionelle Workflows.
