flowki@club:~$ Gerade gestartet · sei von Anfang an dabei
$ beitreten
## models - 102 artikel
MODELS

OpenAI stellt GPT-5.6 vor – neue Modell-Familie mit verbesserter Sicherheit

10. Juli 20261 min lesezeit

OpenAI hat seine neue Modell-Familie mit GPT-5.6 vorgestellt. Die Updates bringen Verbesserungen in mehreren Bereichen, insbesondere bei Cybersecurity-Anwendungen.

MODELS

OpenAI startet GPT-5.6 öffentlich — und präsentiert ChatGPT Work

9. Juli 2026models2 min

Nach behördlicher Genehmigung durch die Trump-Administration rollt OpenAI das Modell GPT-5.6 nun öffentlich aus. Parallel launcht das Unternehmen ChatGPT Work — eine Kombination aus ChatGPT und Codex für Nicht-Techniker, angetrieben durch Sol, Terra und Luna.

MODELS

GPT-5.6: Intelligenz, die mit deinen Anforderungen wächst

9. Juli 2026models1 min

OpenAI stellt GPT-5.6 vor: Das Modell bietet höhere Intelligenz pro Token, bessere Performance pro Dollar und flexible Kapazitäten für komplexe Aufgaben.

MODELS

Claude Sonnet 5: Fast Opus-Performance zum kleineren Budget

1. Juli 2026models1 min

Anthropic hat Sonnet 5 veröffentlicht. Das Modell bietet nahezu die Performance von Opus 4.8, kostet aber deutlich weniger. Eine attraktive Option für Anwendungen, die High Performance nicht teuer erkaufen müssen.

MODELS

Claude Sonnet 5: Was sich in Anthropics neuem Modell ändert

30. Juni 2026models1 min

Anthropic hat Claude Sonnet 5 veröffentlicht. Simon Willison analysiert die Verbesserungen des neuen Modells und dessen praktische Implikationen für Entwickler.

MODELS

GPT-5.6 Sol: OpenAIs nächste Modellgeneration

26. Juni 2026models1 min

OpenAI stellt GPT-5.6 Sol vor – ein Modell mit verbesserter Performance in Coding, Science und Cybersecurity. Dazu kommt der bislang umfassendste Safety-Stack des Unternehmens.

MODELS

OpenAI präsentiert GPT-5.6: Drei Modelle für unterschiedliche Anforderungen

26. Juni 2026models1 min

OpenAI hat GPT-5.6 vorgestellt – eine neue Modellsuite mit drei Varianten. Sol, Terra und Luna adressieren unterschiedliche Use-Cases und sollen besonders bei Coding, Cybersecurity und Biology überzeugen.

MODELS

GPT-5.5-Cyber: OpenAIs neues Security-Modell im Benchmark

23. Juni 2026models1 min

OpenAI hat GPT-5.5-Cyber aktualisiert. Das auf KI-Sicherheit spezialisierte Modell soll Anthropics Claude 3.5 Sonnet beim Auffinden von Sicherheitslücken übertrumpfen und steht nun Partnerfirmen zur Verfügung.

MODELS

OpenAI WebRTC Audio: Dokumentkontext in Echtzeit-Gesprächen

13. Juni 2026models1 min

OpenAI erweitert seine WebRTC Audio Sessions um Dokumentkontext. Die Funktion ermöglicht es, PDFs und andere Dateien direkt in Live-Gespräche mit dem Modell einzubeziehen — praktisch für Analyse und Diskussionen.

MODELS

Anthropic entschuldigt sich für versteckte Claude Fable Guardrails

11. Juni 2026models1 min

Anthropic hat heimlich Beschränkungen in Claude Fable 5 eingebaut und wird dafür kritisiert. Das Unternehmen kündigt an, künftig transparenter über Guardrails zu kommunizieren – auch wenn das mehr Anfragen ablehnt.

MODELS

Claude Fable 5: Anthropic veröffentlicht neues Modell mit Sicherheitsvorkehrungen

10. Juni 2026models1 min

Anthropic hat Claude Fable 5 veröffentlicht – ein leistungsstarkes Mythos-Klasse-Modell mit erweiterten Cybersecurity-Fähigkeiten. Das Unternehmen implementiert gezielt Safeguards für hochrisikoanfragen, um Missbrauch zu verhindern.

MODELS

Claude Fable 5: Anthropic veröffentlicht stärkstes Modell mit Sicherheits-Split

10. Juni 2026models1 min

Anthropic hat Claude Fable 5 als stärkstes Modell veröffentlicht. Das Unternehmen nutzt einen ungewöhnlichen Ansatz: Dasselbe Modell wird als zwei Produkte mit unterschiedlichen Safety-Klassifizierern angeboten.

MODELS

Claude Fable 5: Anthropics neues Top-Modell mit integriertem Fallback

10. Juni 2026models1 min

Anthropic hat Claude Fable 5 veröffentlicht – sein leistungsfähigstes Modell bisher. Das System verfügt über einen integrierten Fallback-Mechanismus für sensible Anfragen.

MODELS

Claude Fable 5: Anthropics neustes Flaggschiff-Modell

10. Juni 2026models1 min

Anthropic hat Claude Fable 5 vorgestellt – das bislang leistungsfähigste öffentliche Modell des Unternehmens. Es richtet sich an Coding, Research und größere Projektarbeiten.

MODELS

Claude Fable 5: Anthropics erstes öffentlich verfügbares Mythos-Modell

10. Juni 2026models1 min

Anthropic veröffentlicht Claude Fable 5 als erstes öffentlich zugängliches Modell der Mythos-Klasse. Das System integriert Sicherheits-Guardrails für sensible Bereiche wie Cybersecurity und Biologie.

MODELS

Anthropic stellt Claude Mythos 5 und Fable 5 vor

9. Juni 2026models1 min

Anthropic veröffentlicht Claude Mythos 5, ein auf Cybersecurity spezialisiertes Modell, sowie die öffentliche Variante Fable 5. Beide Versionen bieten unterschiedliche Sicherheitsstufen für verschiedene Anwendungsfälle.

MODELS

Claude Fable 5: Anthropics erstes Mythos-Modell für die Öffentlichkeit

9. Juni 2026models1 min

Anthropic veröffentlicht Claude Fable 5, das erste öffentlich verfügbare Modell der Mythos-Klasse. Das System nutzt Guardrails, um Risiken in sensiblen Bereichen wie Cybersecurity und Biologie zu begrenzen.

MODELS

Claude Fable 5: Anthropics erstes Mythos-Modell im öffentlichen Release

9. Juni 2026models1 min

Anthropic veröffentlicht Claude Fable 5 als stärkstes öffentlich verfügbares Modell. Das Mythos-Modell zeigt besondere Stärken bei Software Engineering und komplexen Aufgaben – mit neuen Sicherheitsmechanismen.

MODELS

Nvidia N1X: ARM-Laptop-Chips mit Microsoft und Arm im Teaser

30. Mai 2026models1 min

Nvidia, Microsoft und Arm teasing gemeinsam die kommende N1X Laptop-Prozessor-Serie. Die Ankündigung erfolgt auf der Computex in Taipei mit Hinweisen auf eine neue PC-Ära.

MODELS

Anthropic bringt Claude Opus 4.8 – Mythos-Klasse kommt für alle

29. Mai 2026models1 min

Anthropic hat Claude Opus 4.8 veröffentlicht und plant die breite Verfügbarkeit seiner Mythos-Klasse-Modelle. Alle Nutzer erhalten Zugang zu Opus 4.8 zum gleichen Preis wie die Vorgängerversion.

MODELS

Claude Opus 4.8: Anthropic hebt die Performance-Latte

29. Mai 2026models1 min

Anthropic hat Claude Opus 4.8 vorgestellt. Das Modell übertrifft Konkurrenten in den meisten Benchmarks und kostet gleich viel wie der Vorgänger – ein deutlicher Leistungssprung ohne Preiserhöhung.

MODELS

Anthropic bringt Claude Mythos-Modelle zur Öffentlichkeit

29. Mai 2026models1 min

Anthropic bestätigt den öffentlichen Rollout der Claude Mythos-Modelle nach Verzögerungen wegen Sicherheitsbedenken. Die neuen Modelle sollen nach Sicherheitsprüfungen schrittweise verfügbar gemacht werden.

MODELS

Anthropic stellt Opus 4.8 mit Dynamic Workflows vor

28. Mai 2026models1 min

Anthropic hat Opus 4.8 veröffentlicht. Das Modell bringt Dynamic Workflows mit – ein Tool zur Koordination von Agent-Schwärmen für komplexe Aufgaben.

MODELS

Claude Opus 4.8: Anthropic veröffentlicht neues KI-Modell

28. Mai 2026models1 min

Anthropic hat Claude Opus 4.8 vorgestellt. Das neue Modell soll bei erweiterten Aufgaben und Reasoning-Performance Verbesserungen bieten.

MODELS

Anthropic arbeitet an Claude Mythos für Claude Code

26. Mai 2026models1 min

Anthropic bereitet die Einführung des Mythos-Modells vor, das ursprünglich als risikobehaftet eingestuft wurde. Das Modell könnte bald in Claude Code integriert werden und wirft Sicherheitsfragen auf.

MODELS

Google stellt Suche auf agentic AI um – ab 2026

20. Mai 2026models1 min

Google kündigt auf der I/O 2026 eine grundlegende Neuausrichtung der Suchmaschine an. Agentic-AI-Systeme sollen künftig komplexe Aufgaben eigenständig übernehmen. Die Transformation wird das Nutzererlebnis erheblich verändern.

MODELS

Google I/O: KI-Agenten erobern die Suche – Spark wird Premium-Feature

20. Mai 2026models1 min

Google rüstet seine Suchmaschine mit autonomen KI-Agenten aus. Der neue Assistent Spark wird kostenpflichtig. Die Suche wird zum Akteur statt zum Werkzeug.

MODELS

Google I/O 2026: Gemini 3.5 und die neuen AI-Features

19. Mai 2026models1 min

Google präsentiert auf der I/O 2026 die Gemini 3.5 Familie mit Flash und Pro Modellen. Neue Features für Search und Gmail sowie Updates zu Project Aura Smart Glasses ergänzen die Ankündigungen.

MODELS

Google integriert AI Agents in Search und redesignt die Suchleiste

19. Mai 2026models1 min

Google macht Gemini 2.5 Flash zum Standard in AI Mode, überarbeitet die Suchleiste und kündigt Search Agents für den Sommer an. Die neuen Features sollen die Suche intelligenter und kontextbezogener gestalten.

MODELS

Die letzten 6 Monate LLM-Entwicklung kompakt

19. Mai 2026models1 min

Simon Willison fasst die wichtigsten Fortschritte der letzten sechs Monate im LLM-Bereich zusammen. Eine schnelle Orientierung für alle, die den Überblick behalten möchten.

MODELS

Position Bias in Reasoning Models: Länge des Gedankenprozesses verstärkt Verzerrungen

12. Mai 2026models1 min

Chain-of-Thought-Modelle wie DeepSeek-R1 zeigen einen überraschenden Effekt: Je länger ihre inneren Denkprozesse, desto stärker die Position Bias bei Multiple-Choice-Fragen. Eine neue Studie deckt auf, wie längeres Reasoning paradoxerweise zu mehr Verzerrungen führt.

MODELS

Code w/ Claude 2026: Was Anthropic zeigt

6. Mai 2026models1 min

Anthropic präsentiert auf der Code w/ Claude 2026 neue Entwicklungen zu Claude. Simon Willison dokumentiert die Highlights im Live-Blog.

MODELS

OpenAI stellt GPT-5.5 Instant vor – neues Standard-Modell

6. Mai 2026models1 min

OpenAI hat GPT-5.5 Instant angekündigt, das GPT-3.5 Instant als Standard-Modell in ChatGPT ablöst. Das neue Modell soll schnellere und präzisere Antworten bieten.

MODELS

Focus: Selective Aufmerksamkeit statt vollständiger Attention

5. Mai 2026models1 min

Focus reduziert die quadratische Komplexität von Attention durch gelernte Token-Gruppierungen. Die Methode lässt sich in bestehende Modelle integrieren, ohne deren Gewichte anzupassen — mit messbaren Speedups und ohne Qualitätsverluste.

MODELS

Reasoning Skills speichern: Weniger Tokens, bessere Ergebnisse

3. Mai 2026models1 min

Forscher zeigen, wie LLMs durch gespeicherte Reasoning Skills effizienter arbeiten: Weniger Tokens für Chain-of-Thought, bessere Genauigkeit bei Coding und Math Tasks.

MODELS

GPT-4o und kostenlose Features: OpenAIs Spring Update

2. Mai 2026models1 min

OpenAI stellt GPT-4o vor und erweitert das kostenlose ChatGPT-Angebot. Das neue Modell bietet verbesserte Multimodal-Fähigkeiten und schnellere Verarbeitung.

MODELS

GPT-4o für alle: OpenAI erweitert kostenloses ChatGPT

2. Mai 2026models1 min

OpenAI stellt GPT-4o nun auch kostenlosen ChatGPT-Nutzern zur Verfügung. Das neue Flaggschiff-Modell bringt erweiterte Fähigkeiten in die kostenlose Variante und demokratisiert Zugang zu fortgeschrittener KI.

MODELS

GPT-4o mini: Kosteneffiziente KI für größere Einsatzbreite

2. Mai 2026models1 min

OpenAI stellt GPT-4o mini vor – ein kompakteres Modell mit besserer Performance bei deutlich niedrigeren Kosten. Ideal für Anwendungen mit hohem Durchsatz und begrenztem Budget.

MODELS

GPT-5.4: OpenAIs neues Flaggschiff für professionelle Arbeit

2. Mai 2026models1 min

OpenAI hat GPT-5.4 vorgestellt – ein frontier model mit 1M-token context, erweiterten Coding-Fähigkeiten und Computer-Use-Funktionen. Das Modell soll Effizienz und Leistung für professionelle Anwendungen neu definieren.

MODELS

VLAA-GUI: Wann sollte ein Agent stoppen, neu starten oder suchen?

2. Mai 2026models1 min

VLAA-GUI ist ein modulares Framework für GUI-Automation, das drei zentrale Komponenten nutzt, um zu entscheiden, wann ein Agent stoppen, sich von Schleifen befreien oder online suchen sollte. Das System erreicht 77,5% auf OSWorld und übertrifft teilweise menschliche Leistung.

MODELS

CAP: Kontrolliertes Vergessen in LLMs ohne Parameteränderung

2. Mai 2026models1 min

CAP bietet eine prompt-basierte Methode zum gezielten Löschen von Wissen aus LLMs, ohne das Modell zu verändern. Die Technik nutzt Reinforcement Learning und ermöglicht reversibles Vergessen — besonders relevant für Compliance und geschlossene Modelle.

MODELS

Atlas-Alignment: Interpretierbarkeit zwischen Sprachmodellen übertragbar machen

2. Mai 2026models1 min

Atlas-Alignment ermöglicht es, die Interpretierbarkeit eines Sprachmodells auf neue Modelle zu übertragen, ohne teure modellspezifische Trainings zu wiederholen. Ein vortrainiertes Concept Atlas wird durch leichte Alignment-Methoden synchronisiert.

MODELS

Von Sprache zu verifiziertem Code: LLMs mit formaler Verifikation

2. Mai 2026models1 min

Forscher zeigen, wie Large Language Models mit Dafny-basierter formaler Verifikation zuverlässigen Code generieren. Durch strukturierte Prompts und iteratives Feedback erreichen offene Modelle Verifizierungsquoten von über 90%.

MODELS

Strukturiertes Reasoning für Fragen über umfangreiche Dokumentsammlungen

2. Mai 2026models1 min

SLIDERS löst das Problem begrenzter Context Windows durch Extraktion in relationale Datenbanken statt Chunk-Aggregation. Das Framework nutzt strukturiertes Reasoning via SQL und Data Reconciliation für konsistente Antworten über Millionen Tokens hinweg.

MODELS

Execution Feedback schlägt komplexe Pipelines bei Code-Generierung

2. Mai 2026models1 min

Kleine Language Models (1-3B) generieren besseren Code durch Execution Feedback und Self-Refinement als durch komplexe Pipelines. Eine einfache Generate-Execute-Refine-Schleife übertrifft aufwendigere Architekturen deutlich.

MODELS

World Models für Agents: Von Vorhersagen zu autonomen Simulationen

2. Mai 2026models1 min

Eine neue Taxonomie systematisiert World Models für AI-Agents in drei Fähigkeitsstufen und vier Regelregime. Die Übersicht von über 400 Arbeiten zeigt, wie Agents Umgebungsdynamiken verstehen und letztendlich manipulieren können.

MODELS

Memanto: Effiziente Semantic Memory für Long-Horizon Agents

1. Mai 2026models1 min

Memanto vereinfacht das Memory-Management autonomer Agenten durch eine typisierte Semantic-Memory-Architektur ohne klassische Knowledge Graphs. Das System erreicht State-of-the-Art-Ergebnisse bei deutlich geringerem Overhead und garantiert sub-90ms Retrieval-Latenz.

MODELS

Sozialwissenschaftliche Studien mit KI-Agenten reproduzieren

1. Mai 2026models1 min

Neue Forschung zeigt, dass LLM-Agenten sozialwissenschaftliche Ergebnisse allein aus Methodenbeschreibungen und Originaldaten rekonstruieren können. Die Erfolgsquote hängt stark vom Modell und der Papierqualität ab.

MODELS

Claude Instant 1.2: Schneller und günstiger

1. Mai 2026models1 min

Anthropic veröffentlicht Claude Instant 1.2 mit verbesserter Performance und niedrigeren Kosten. Das Update bringt bessere Qualität bei gleichzeitig schnellerer Verarbeitung für kostensensitive Anwendungen.

MODELS

Claude 3 Haiku: Anthropics schnellstes Modell

1. Mai 2026models1 min

Anthropic stellt Claude 3 Haiku vor – das schnellste Modell der Claude-3-Familie. Mit reduzierter Latenz und optimierter Performance eignet sich Haiku besonders für Echtzeit-Anwendungen und kostensensitive Szenarien.

MODELS

Claude 3.5 Sonnet & Haiku: Computer Use und neue Fähigkeiten

1. Mai 2026models1 min

Anthropic stellt Claude 3.5 Sonnet und Haiku vor und führt Computer Use ein – eine Fähigkeit, mit der KI-Modelle eigenständig Bildschirme steuern können. Die neuen Versionen bieten verbesserte Performance und erweiterte Anwendungsmöglichkeiten.

MODELS

Claude 3.7 Sonnet: Bessere Performance bei weniger Kosten

1. Mai 2026models1 min

Anthropic hat Claude 3.7 Sonnet vorgestellt – ein effizienteres Modell mit verbesserter Performance. Parallel dazu erweitert Claude Code die Fähigkeiten für spezialisierte Aufgaben.

MODELS

Claude 4: Anthropic präsentiert die nächste Modell-Generation

1. Mai 2026models1 min

Anthropic hat Claude 4 angekündigt und setzt damit die Weiterentwicklung seines KI-Assistenten fort. Das Modell bringt Verbesserungen in Fähigkeiten und Zuverlässigkeit mit sich.

MODELS

Claude Opus 4.1: Besseres Reasoning, längerer Context

1. Mai 2026models1 min

Anthropic hat Claude Opus 4.1 vorgestellt. Das Modell verbessert Reasoning-Fähigkeiten und erweitert das Context-Fenster. Es adressiert praktische Anforderungen von Enterprise-Nutzern.

MODELS

Claude Code: Anthropic erweitert Geschäftspläne um Admin-Controls

1. Mai 2026models1 min

Anthropic integriert Claude Code in seine Business-Pläne und führt neue Admin-Kontrollmöglichkeiten ein. Teams erhalten damit bessere Verwaltungsoptionen und erweiterte Code-Funktionen für Enterprise-Umgebungen.

MODELS

Claude Sonnet 4.5: Schnellere KI mit verbesserter Effizienz

1. Mai 2026models1 min

Anthropic hat Claude Sonnet 4.5 veröffentlicht und positioniert das Modell als schnellere Alternative zu Claude 3.5 Sonnet. Die Version soll bessere Performance bei optimiertem Ressourcenverbrauch bieten und ist ab sofort verfügbar.

MODELS

Claude Haiku 4.5: Schneller und effizienter

1. Mai 2026models1 min

Anthropic veröffentlicht Claude Haiku 4.5, ein kompakteres Modell mit verbesserter Performance. Es bietet bessere Geschwindigkeit und Kosteneffizienz für Produktionsumgebungen.

MODELS

Claude Opus 4.6: Schneller und effizienter

1. Mai 2026models1 min

Anthropic stellt Claude Opus 4.6 vor – ein Modell, das schnellere Verarbeitung bei gleichbleibender Intelligenz bietet. Die verbesserte Effizienz senkt Latenz und Kosten im Betrieb.

MODELS

Claudes neue Constitution: Mehr Eigenständigkeit durch selbstgesteuertes Lernen

1. Mai 2026models2 min

Anthropic hat Claudes Constitution überarbeitet. Das Modell nutzt jetzt neue Lernmechanismen für konsistenteres Verhalten. Die Änderungen zielen auf verbesserte Zuverlässigkeit und Sicherheit ab.

MODELS

Claude Sonnet 4.6: Extended Thinking, schneller, günstiger

1. Mai 2026models1 min

Anthropic veröffentlicht Claude Sonnet 4.6 mit Extended Thinking, besseren Reasoning-Fähigkeiten und günstigeren API-Preisen. Das Modell wird zur praktischen Standard-Choice für viele Produktions-Workflows.

MODELS

Contextual Retrieval: Besserer Zugriff auf Kontextwissen

30. Apr. 2026models1 min

Anthropic stellt Contextual Retrieval vor – eine Methode, um AI-Modellen gezielten Zugriff auf relevantes Hintergrundwissen zu geben. Das verbessert Antwortqualität und senkt Halluzinationen.

MODELS

NousCoder-14B: Open-Source Coding-Modell mit volltransparenter Trainingsmethode

30. Apr. 2026models2 min

Nous Research veröffentlicht NousCoder-14B, ein Open-Source-Coding-Modell, das proprietäre Systeme erreicht oder übertrifft. Das Besondere: Vollständige Transparenz des Trainings, inklusive Reinforcement Learning-Umgebung und Benchmark-Suite.

MODELS

DeepSeek V4 startet: Pro-Version kostet 98% weniger als GPT-4.5 Pro

30. Apr. 2026models1 min

DeepSeek hat sein größtes und effizientestes Modell veröffentlicht. Die Pro-Version kostet deutlich weniger als Konkurrenzprodukte und positioniert sich als kostengünstige Alternative.

MODELS

DeepSeek zeigt neues Modell, das zu Top-KI-Systemen aufschließt

29. Apr. 2026models1 min

DeepSeek präsentiert ein überarbeitetes KI-Modell mit verbesserten Architekturen, das deutlich effizienter ist und bei Reasoning-Benchmarks fast gleichauf mit führenden Systemen liegt.

MODELS

Google investiert 40 Milliarden Dollar in Anthropic

29. Apr. 2026models1 min

Alphabet kündigt eine 40-Milliarden-Dollar-Investition in Anthropic an – noch größer als Amazons jüngste Zusage. Der Wettbewerb um die führende AI-Position verschärft sich deutlich.

MODELS

Falcon 180B: Das größte Open-Source-Sprachmodell

29. Apr. 2026models1 min

Hugging Face hat Falcon 180B veröffentlicht – ein 180-Milliarden-Parameter-Modell, das mit proprietären Systemen konkurriert. Das Open-Source-Modell setzt neue Maßstäbe bei Performance und Zugänglichkeit.

MODELS

Mixtral: Neues Mixture-of-Experts Modell auf Hugging Face

29. Apr. 2026models1 min

Hugging Face präsentiert Mixtral, ein hochperformantes Mixture-of-Experts Modell. Das System nutzt spezialisierte Expert-Layer für effizientere Inferenz und bessere Skalierbarkeit bei gleichzeitig niedrigerem Speicherverbrauch.

MODELS

Constitutional AI: Ethische KI-Modelle selbst trainieren

29. Apr. 2026models1 min

Constitutional AI ermöglicht es, offene Sprachmodelle durch selbstdefinierte Regeln ethischer auszurichten. Hugging Face zeigt, wie man diesen Ansatz praktisch umsetzt.

MODELS

StarCoder2: Offenes Code-Modell mit verbesserter Performance

29. Apr. 2026models1 min

Hugging Face veröffentlicht StarCoder2, ein verbessertes Open-Source-Modell für Code-Generierung. Das Modell wurde auf The Stack v2 trainiert und bietet bessere Performance bei kleinerem Footprint.

MODELS

GaLore: Effizientes Training großer Modelle auf Standard-Hardware

29. Apr. 2026models1 min

GaLore reduziert Speicherbedarf beim LLM-Training um bis zu 65%. Die neue Methode ermöglicht es, große Sprachmodelle auf handelsüblicher GPU-Hardware zu trainieren – ohne Qualitätsverluste.

MODELS

Cosmopedia: Synthetische Trainingsdaten im großen Maßstab

29. Apr. 2026models1 min

Hugging Face stellt Cosmopedia vor – eine Methode zur Generierung großflächiger synthetischer Daten für das Pre-Training von LLMs. Das Projekt zeigt, wie KI-Modelle effizient mit künstlich erstellten Inhalten trainiert werden können.

MODELS

Llama 3: Metas neues Open-Source Sprachmodell

29. Apr. 2026models1 min

Meta hat Llama 3 veröffentlicht – ein Open-Source Large Language Model mit verbesserter Performance und erweiterten Capabilities. Das Modell steht kostenlos zur Verfügung und richtet sich an Entwickler und Forscher.

MODELS

StarCoder2-Instruct: Open Source Code-Modell mit Self-Alignment

29. Apr. 2026models1 min

Hugging Face veröffentlicht StarCoder2-Instruct, ein vollständig transparentes Code-Generierungs-Modell mit Self-Alignment-Verfahren. Das Modell nutzt offene Daten und dokumentiert seinen Trainingsprozess komplett.

MODELS

PaliGemma: Googles offenes Vision-Language-Modell

29. Apr. 2026models1 min

Google hat PaliGemma veröffentlicht – ein Open-Source-Modell, das Text und Bilder verarbeitet. Das Modell eignet sich für praktische Aufgaben wie Dokumentenerkennung und visuelle Fragen.

MODELS

KV-Cache Quantization: Längere Sequenzen, weniger Speicher

29. Apr. 2026models1 min

KV-Cache Quantization reduziert den Speicherverbrauch beim Inference von Language Models erheblich. Das ermöglicht längere Sequenzen und höheren Durchsatz ohne Hardware-Upgrades.

MODELS

Gemma 2: Googles neues Open-Source Sprachmodell

29. Apr. 2026models1 min

Google hat Gemma 2 veröffentlicht – ein offenes Sprachmodell, das Skalierbarkeit und Effizienz kombiniert. Das Modell steht in verschiedenen Größen zur Verfügung und richtet sich an Entwickler und Unternehmen.

MODELS

Transformers Code Agent schlägt GAIA-Benchmark

29. Apr. 2026models1 min

Hugging Face präsentiert einen Code Agent auf Basis von Transformers, der den GAIA-Benchmark erfolgreich meistert. Das System kombiniert Language Models mit praktischer Code-Ausführung und zeigt, wie Agenten komplexe Aufgaben lösen.

MODELS

Llama 3.1: Meta skaliert auf 405B mit Multilingualität

29. Apr. 2026models1 min

Meta veröffentlicht Llama 3.1 in drei Größen bis 405B Parameter. Die neuen Modelle unterstützen 128K Token Context und verbesserte Multilingual-Fähigkeiten. Open Source verfügbar auf Hugging Face.

MODELS

Falcon Mamba: Das erste starke 7B-Modell ohne Attention

29. Apr. 2026models1 min

Hugging Face stellt Falcon Mamba vor – ein 7B-Modell, das auf State Space Models statt Transformer-Attention setzt. Es verspricht bessere Effizienz bei vergleichbarer Performance.

MODELS

LLMs auf 1.58bit: Extreme Quantisierung leicht gemacht

29. Apr. 2026models1 min

Hugging Face zeigt, wie sich Large Language Models auf extreme 1.58bit-Quantisierung reduzieren lassen – ohne großen Aufwand. Ein Durchbruch für ressourcenschonende KI-Nutzung auf Edge-Geräten.

MODELS

SmolVLM: Effiziente Vision-Language-Modelle im Kleinstformat

29. Apr. 2026models1 min

Hugging Face stellt SmolVLM vor – kompakte Vision-Language-Modelle, die auf Edge-Geräten laufen und dabei überraschend gute Performance liefern. Eine praktische Alternative zu großen Modellen.

MODELS

Open-R1: Open-Source-Reproduktion von DeepSeek-R1

28. Apr. 2026models2 min

Hugging Face veröffentlicht Open-R1, eine vollständig offene Reproduktion von DeepSeeks Reasoning-Modell. Das Projekt ermöglicht es der Community, leistungsstarke Chain-of-Thought-Systeme zu trainieren und anzupassen.

MODELS

Mini-R1: Deepseek R1 mit Reinforcement Learning nachbauen

28. Apr. 2026models1 min

Hugging Face zeigt, wie man Deepseek R1 mit Reinforcement Learning reproduziert. Ein praktisches Tutorial für das Training von Reasoning-Modellen ohne proprietäre Infrastruktur.

MODELS

Prefill und Decode: LLM-Performance bei parallelen Anfragen optimieren

28. Apr. 2026models2 min

Wie Prefill und Decode Phasen die Durchsatzrate großer Sprachmodelle beeinflussen. TNG Tech zeigt Optimierungsstrategien für gleichzeitige Nutzeranfragen.

MODELS

SmolLM3: Kompakte Sprachmodelle mit Mehrsprachigkeit und langem Kontext

28. Apr. 2026models1 min

Hugging Face stellt SmolLM3 vor – effiziente Sprachmodelle in verschiedenen Größen mit verbesserter Mehrsprachigkeit und erweitertem Context Window. Ideal für ressourcenbegrenzte Umgebungen.

MODELS

OpenAI startet GPT OSS: Neue Open-Source Modellfamilie

28. Apr. 2026models2 min

OpenAI veröffentlicht GPT OSS, eine neue Open-Source Modellfamilie. Die Modelle sind frei verfügbar und sollen Entwicklern mehr Flexibilität bieten.

MODELS

FLUX-2: Neue Bildgenerierung in Hugging Face Diffusers

28. Apr. 2026models1 min

Hugging Face integriert FLUX-2 in die Diffusers-Library. Das Modell bietet verbesserte Bildqualität und schnellere Generierung. Developer erhalten direkten Zugang zu fortgeschrittenen Text-to-Image-Fähigkeiten.

MODELS

Gemma 4: Googles neues multimodales On-Device-Modell

27. Apr. 2026models1 min

Google präsentiert Gemma 4 mit nativer Multimodal-Unterstützung für lokale Verarbeitung. Das Modell kombiniert Text- und Bildverarbeitung auf Edge-Geräten und adressiert Performance sowie Datenschutz gleichermaßen.

MODELS

DeepSeek-V4: Eine Million Token Context für produktive Agenten

27. Apr. 2026models1 min

DeepSeek-V4 erweitert das Context-Fenster auf eine Million Token und macht diese Kapazität praktisch nutzbar. Das Modell zeigt effiziente Performance bei langen Dokumenten und Multi-Turn-Szenarien.

MODELS

World Models: Warum KI die physische Welt noch nicht beherrscht

26. Apr. 2026models2 min

KI-Systeme dominieren die digitale Welt, doch die physische Realität bleibt eine Herausforderung. World Models könnten der Schlüssel sein, um Maschinen ein echtes Verständnis der Welt zu geben.

MODELS

DeepSeek V4: Das ändert sich beim neuen Flagship-Modell

26. Apr. 2026models1 min

DeepSeek hat V4 vorgestellt: Das neue Flagship-Modell verarbeitet deutlich längere Prompts und bleibt Open Source. Wir erklären, warum das für die AI-Community relevant ist.

MODELS

Deepseek V4: Wie China KI-Unabhängigkeit vorantreibt

26. Apr. 2026models1 min

Deepseek optimiert V4 für chinesische Hardware statt US-GPUs. Das Flash-Modell läuft auf acht lokalen KI-Beschleunigern. Kleine Änderungen ermöglichen große Auswirkungen auf die technologische Souveränität.

MODELS

Claude System Prompts als Git-Timeline nachverfolgbar

26. Apr. 2026models1 min

Simon Willison dokumentiert Claudes System Prompts in einem Git-Repository und macht deren Entwicklung über die Zeit nachverfolgbar. Ein Ansatz für mehr Transparenz bei KI-Modell-Instruktionen.

MODELS

Claude Opus 4.7: Änderungen im System Prompt

26. Apr. 2026models2 min

Anthropic hat die System Prompt von Claude Opus überarbeitet. Die neuen Vorgaben zeigen, wie sich die Verhaltensrichtlinien zwischen Version 4.6 und 4.7 verschoben haben.

MODELS

Qwen3.6-27B: Flagship-Level Code-Performance in 27B

26. Apr. 2026models1 min

Alibabas neues Qwen3.6-27B-Modell erreicht Flagship-Qualität beim Code schreiben trotz kompakter Größe. Das Dense Model eignet sich ideal für lokale Deployment und spezialisierte Coding-Tasks.

MODELS

Claude's Code Quality: Aktuelle Entwicklungen und Erkenntnisse

26. Apr. 2026models2 min

Anthropic adressiert aktuelle Berichte zur Code-Qualität von Claude. Ein Überblick über die neuesten Erkenntnisse und wie sie die Entwicklung des Modells beeinflussen.

MODELS

DeepSeek V4: Frontier-Leistung zu Bruchteilen der Konkurrenz

26. Apr. 2026models1 min

DeepSeek V4 erreicht Frontier-Level-Performance bei deutlich niedrigeren Kosten. Das Modell konkurriert mit teureren Alternativen und setzt neue Maßstäbe bei der Effizienz.

MODELS

GPT-5.3-Codex: Coding-Agent mit verbesserter Reasoning

23. Apr. 2026models1 min

OpenAI stellt GPT-5.3-Codex vor – einen auf Code spezialisierten Agent, der Coding-Performance mit General Reasoning kombiniert. Das Modell soll komplexe, mehrstufige technische Aufgaben bewältigen.

MODELS

GPT-5.2 entdeckt neue Formel in der theoretischen Physik

22. Apr. 2026models2 min

GPT-5.2 hat eine neue Formel für Gluon-Amplituden vorgeschlagen, die anschließend von OpenAI und akademischen Partnern formal bewiesen wurde. Ein Preprint dokumentiert diese Entdeckung im Bereich der theoretischen Physik.

MODELS

EVMbench: Benchmark für KI-Agenten in Smart-Contract-Sicherheit

22. Apr. 2026models1 min

OpenAI und Paradigm stellen EVMbench vor – einen Benchmark, der die Fähigkeit von KI-Agenten bewertet, kritische Sicherheitslücken in Smart Contracts zu erkennen, zu beheben und auszunutzen.

MODELS

SWE-bench Verified: Warum OpenAI die Bewertung einstellt

22. Apr. 2026models1 min

OpenAI stoppt die Evaluierung von SWE-bench Verified wegen Datenkontamination und fehlerhaften Tests. Das Benchmark misst die Coding-Fähigkeiten von KI-Modellen nicht mehr zuverlässig. SWE-bench Pro soll die bessere Alternative sein.

MODELS

GPT-5.4: OpenAIs neues Flaggschiff für professionelle Anwendungen

21. Apr. 2026models1 min

OpenAI stellt GPT-5.4 vor – das leistungsstärkste Modell der Reihe mit erweiterten Fähigkeiten bei Code, Computer Use und 1-Million-Token-Context für professionelle Workflows.