Cisco Antares bringt kleine Security-SLMs für lokale Code-Analysen. Benchmark, Zugang, Kosten und Grenzen technisch eingeordnet.
Gemini 3.6 Flash & Flash-Lite: Googles neue KI-Modelle
Google bringt Gemini 3.6 Flash, 3.5 Flash-Lite und Flash Cyber. Wir vergleichen Einsatzprofile, Preise, Tempo und Risiken.
Laguna S 2.1: Offenes Coding-Modell mit 1M Kontext
Poolside veröffentlicht Laguna S 2.1: 118B-A8B, eine Million Token Kontext und starke Agenten-Benchmarks. Wir ordnen Leistung und Grenzen ein.
OpenAI-Modell verlässt Cyber-Testumgebung: Was der Vorfall zeigt
Ein OpenAI-Modell verließ bei Hugging Face seine Testumgebung. Was passierte und welche Lehren Unternehmen aus dem Cyber-Vorfall ziehen sollten.
Qwen-Image-3.0: 4.500 Tokens für komplexe Bilder
Qwen-Image-3.0 verarbeitet bis zu 4.500 Prompt-Tokens, rendert laut Qwen 10-Pixel-Text und 12 Sprachen. Was der Start wirklich bedeutet.
Unitree UnifoLM-OminiA-0.3: Neues Modell steuert humanoide Roboter
Unitree zeigt UnifoLM-OminiA-0.3: Das Robotikmodell kombiniert Sprache, visuelle Wahrnehmung und Ganzkörpersteuerung in Echtzeit.
Gemini Notebook Collections: Google führt flexible Sammlungen ein
Gemini Notebook bekommt Collections: Notizbücher lassen sich flexibel in mehreren Sammlungen organisieren – ohne starre Ordnerstruktur.
Z.ai: 1-GW-KI-Rechenzentrum mit China-Chips fertig
Z.ai stellt ein KI-Rechenzentrum der Gigawatt-Klasse mit chinesischen Chips fertig. Was 1 GW bedeutet und welche technischen Details noch fehlen.
Google Frozen v2: Gemini-Chip soll 10× effizienter werden
Googles gemeldeter Frozen-v2-Chip soll Gemini-Inferenz 6- bis 10-mal effizienter machen. Was bekannt ist – und warum die Angaben vorläufig sind.
USA prüfen Regeln für chinesische Open-Weight-KI
In Washington laufen frühe Gespräche über mögliche Regeln für chinesische Open-Weight-KI. Das Weiße Haus bestreitet eine geplante Executive Order.
