## blog - alle artikel
FlowKI bündelt deutschsprachige KI-News, Praxisberichte und Analysen zu Modellen, Coding, Automatisierung, Business und Security — mit Quellen, konkreten Tests und nachvollziehbaren Ergebnissen.
MODELSCriticGen: Evaluierung wird zum Verbesserungswerkzeug für LLMs
Ein neuer Evaluierungsrahmen namens CriticGen macht die Bewertung von Sprachmodellen deutlich präziser und gleichzeitig handlungsorientiert. Statt generischer Kritik erzeugt CriticGen spezifische Verbesserungsvorschläge, die tatsächlich funktionieren – mit einer Erfolgsquote von über 73 Prozent.
SECURITYRAG unter Beschuss: Wie anfällig ist Retrieval-Augmented Generation?
Eine Studie testet, wie Llama 3.1 8B mit verfälschten Dokumenten in RAG-Systemen umgeht. Die Genauigkeit fällt von 78% auf 44%, wenn alle Quellen manipuliert sind – ein Problem für produktive Deployments.
MODELSAutoFyn: Agenten lernen durch Bewährung, nicht durch Gewichtsanpassung
AutoFyn nutzt Expert Iteration, um Sprachmodelle über mehrere Runden zu verbessern — nicht durch Training, sondern durch Aktualisierung persistenter Zustände. Das System hat IMO-Probleme gelöst und echte Sicherheitslücken gefunden.
INDUSTRYDeutschland plant 25% Steuer auf Kryptogewinne ab 2027
Das deutsche Finanzministerium plant eine pauschale 25%-Steuer auf Kryptogewinne ab 2027. Ältere Bestände behalten die bisherige Zwölf-Monats-Freigrenze – die Neuregelung trifft nur künftige Käufer.
TOOLSn8n Assistant: KI-gestützte Workflow-Entwicklung
n8n führt einen KI-Assistenten ein, der natürlichsprachliche Anforderungen direkt in Workflows umsetzt. Das Tool soll die Kluft zwischen Idee und Implementierung überbrücken und die Automation für weniger technische Nutzer zugänglicher machen.
SECURITYAPI-Keys mit Selbstzerstörung: Ein neuer Standard für automatisches Widerrufen
Ein neuer offener Standard ermöglicht es, kompromittierte API-Schlüssel innerhalb von 60 Sekunden automatisch zu deaktivieren. Das Ziel: Lecks von vornherein entschärfen, statt sie später manuell zu bereinigen.
SECURITYcPanel-Sicherheitslücke: Mail-Zugang reicht für Root-Zugriff
cPanel hat eine kritische Sicherheitslücke geschlossen, die es einem Hosting-Account mit Mail-Privilegien ermöglichte, beliebige Dateien zu erstellen und Code als Root auszuführen. Die Schwachstelle betraf alle unterstützten Versionen von cPanel und WHM.
SECURITYAI-Infra-Guard: Open-Source Security Scanner für KI-Systeme
Tencents Zhuque Lab hat AI-Infra-Guard veröffentlicht – einen Open-Source Security Scanner, der KI-Infrastrukturen auf Schwachstellen prüft. Das Tool scannt über 1.600 bekannte CVEs, bewertet MCP-Server und Agent Skills sowie Jailbreak-Anfälligkeit.
INDUSTRY85 Prozent der KI-Projekte scheitern – es liegt nicht an der Technik
Eine aktuelle Umfrage zeigt: Die meisten KI-Projekte in Unternehmen kommen nicht über den Pilotmodus hinaus. Das Hauptproblem ist nicht die Technologie selbst, sondern organisatorische und strategische Faktoren.
SECURITYWeChat-Wurm ohne Benutzerinteraktion: Kritische Sicherheitslücke ermöglicht Kontübernahme
Sicherheitsforscher der Firma Calif haben eine kritische WeChat-Lücke entdeckt, die es Angreifern ermöglicht, einen Wurm ohne Benutzerinteraktion zu verbreiten. WeWorm kapern Nutzerkonten und nutzen gespeicherte Kontakte für exponentielle Verbreitung.
SECURITYAdobe stopft kritische Magento-Lücke: Rust-Backdoor im Umlauf
Adobe hat einen kritischen Zero-Day in Magento und Adobe Commerce gepatcht, der bereits aktiv für die Bereitstellung einer Rust-Backdoor und PHP-Webshells ausgenutzt wurde. Die Lücke CVE-2026-75650 mit maximaler Kritikalität (CVSS 10.0) wird seit Anfang September angegriffen.
TOOLSAI-Agenten zuverlässig in Produktion: Debug, Evaluation und Monitoring
n8n zeigt, wie AI-Agenten in der Produktion stabil laufen: Debugging von Fehlern, Performance-Evaluation, Metriken und Guardrails für kontrolliertes Agent-Verhalten.
CRYPTO7. September: 4 Trades geschlossen (-$25,17), 4 Positionen offen, Equity $1.157
Montag brachte vier Verluste: AVAXUSDT Short -$7,37, DOTUSDT Short -$6,79, zwei ZECUSDT Longs je -$5,67 und -$5,34. Vier Shorts und Longs bleiben offen, Netto +$4,22 unrealisiert. Equity stieg um $1,32.
CRYPTO6. September: 3 Trades geschlossen (+$17,48), 5 Positionen offen, Equity $1.159
Sonntag mit drei Long-Gewinnen auf ZECUSDT und TAOUSDT. Tagesgewinn +$17,48. Fünf offene Positionen überwiegend im Minus. Konto sinkt von $1.162,60 auf $1.159,17.
TOOLSWie Coding Agents die AI-Forschung bei OpenAI beschleunigen
OpenAI nutzt Coding Agents intern, um Forschungsprozesse zu automatisieren. Early Data zeigen deutlich höhere Experiment Velocity und komplexere Task-Bewältigung — ein Einblick in die operative Realität der AI-Forschung.
CRYPTO5. September: 2 Trades geschlossen (-$15,42), 5 Positionen offen, Equity $1.164
Samstag brachte zwei Verluste: VETUSDT Short fiel Stop-Loss (-$7,78), DOGEUSDT Short wurde geclosed (-$7,64). Fünf Positionen laufen, davon zwei im Minus. Tagesverlust: -$15,42.
CRYPTO4. September: ZECUSDT Stop-Loss, 5 Positionen offen, Equity 1.179,76 USD
Ein Trade geschlossen mit -2,54 USD Verlust nach Stop-Loss. Fünf Positionen im Markt: drei Short-Trades im Gewinn (ADAUSDT +6,22 USD, AVAXUSDT +1,82 USD, DOGEUSDT +5,32 USD), ein Long-Trade mit Minus (ZECUSDT -2,05 USD), ein Short-Trade nahezu neutral (XRPUSDT -0,09 USD).
CRYPTO3. September: Kein Trade, 4 Positionen offen, Equity +$0,79
Handelstag ohne Transaktionen. Vier Short-Positionen laufen mit gemischtem Ergebnis: OPUSDT und ATOMUSDT im Plus, XRPUSDT und VETUSDT im Minus. Equity bei $1.176,39.
SECURITYGegen Manipulation: Wie man generative Suchmaschinen vor GEO-Angriffen schützt
Forscher präsentieren GEO Defender, ein Abwehrsystem gegen Generative Engine Optimization – eine neue Angriffsform, die Webseiten so umschreibt, dass sie in KI-generierten Suchergebnissen bevorzugt werden. Das System reduziert erfolgreiche Angriffe von 50 % auf 6 %.
TOOLSAnthropic veröffentlicht Commerce Agents: Open-Source-Blueprint für Shopping-KI
Anthropic hat mit "commerce-agents" einen Open-Source-Blueprint unter Apache-2.0-Lizenz veröffentlicht, der Shopping- und Merchant-Agents für Retail, Travel, Telecom und Entertainment bereitstellt. Das Framework standardisiert wiederkehrende Entwicklungsmuster wie Agent-Loops, Tool-Layer und Approval-Gates.
CRYPTO2. September: 10 Trades panic-closed, +0,58 USD, 4 Positionen offen, Equity 1.191,08
Alle 10 Trades des Tages wurden per Panik-Button geschlossen (6 Gewinne, 4 Verluste). Netto +0,58 USD. Vier Short-Positionen bleiben offen. 7-Tage-Saldo: -5,19 USD.
SECURITYOpenAIs Astra überschreitet kritischen Cybersecurity-Schwellenwert
OpenAIs neues Modell Astra hat eine kritische Sicherheitsschwelle überschritten: Es kann eigenständig Zero-Day-Lücken in gut gesicherten Systemen finden und ausnutzen.
MODELSBenchMIRT: Was messen LLM-Benchmarks wirklich?
Allen AI hat mit BenchMIRT ein Framework veröffentlicht, das offenlegt, wie instabil aktuelle LLM-Benchmarks sind. Die Analyse zeigt: Ranking-Positionen verschieben sich massiv je nach Messmethode.
SECURITYDUPIN: Wie Machine Learning Cyberangriffe aufspürt
Forscher präsentieren DUPIN, ein System das mit unbeaufsichtigtem Pretraining auf massiven Audit-Logs lernt und dann mit wenigen Beispielen Angriffe erkennt. Der Ansatz wurde auf 38-52 Tagen Daten trainiert und gegen 25 APT-Kampagnen getestet.

