Nachrichten · Kuratiert · März 2026

KI-News

März 2026 Kuratiert + erklärt Keine Klickbait
LIVE
Claude Sonnet 3.7 mit erweitertem Thinking-Modus verfügbar Qwen 2.5 72B übertrifft GPT-4o in mehreren Benchmarks EU AI Act: Hochrisiko-KI-Systeme müssen bis Aug 2026 konform sein Gemini 2.5 Pro angekündigt — 1M Token Kontext Ollama 0.6 mit verbesserter Apple Silicon Unterstützung DeepSeek V3 übertrifft GPT-4o bei Coding-Benchmarks Claude Sonnet 3.7 mit erweitertem Thinking-Modus verfügbar Qwen 2.5 72B übertrifft GPT-4o in mehreren Benchmarks EU AI Act: Hochrisiko-KI-Systeme müssen bis Aug 2026 konform sein Gemini 2.5 Pro angekündigt — 1M Token Kontext Ollama 0.6 mit verbesserter Apple Silicon Unterstützung DeepSeek V3 übertrifft GPT-4o bei Coding-Benchmarks
// Top-Stories März 2026
// Neue Modelle
24. März 2026 Modelle
Gemini 2.5 Pro angekündigt: 1 Million Token Kontext, multimodal, kostenloser Early Access
Google kündigt Gemini 2.5 Pro mit 1-Millionen-Token-Kontext für alle API-Nutzer an. Das entspricht ~750.000 englischen Wörtern — genug für ganze Bücher. Kostenloser Early Access für Google AI Studio Nutzer ab April.
Quelle: Google DeepMind Blog
20. März 2026 Modelle
Mistral Small 3: Europas bestes kleines Modell läuft mit 4 GB RAM
Mistral AI hat Mistral Small 3 (24B) veröffentlicht — das bisher beste europäische Modell in seiner Größenklasse. Auf Ollama verfügbar: ollama pull mistral-small3. Besonders stark bei Französisch und DSGVO-konformen Anwendungen.
Quelle: Mistral AI
18. März 2026 Modelle
DeepSeek V3 bricht Coding-Rekord: Erstmals Open-Source-Modell über GPT-4o bei SWE-Bench
DeepSeek V3 erreicht 49.2% auf SWE-Bench Verified — dem härtesten Software-Engineering-Benchmark. GPT-4o liegt bei 46%. Das Modell ist Open Source, 685B Parameter (MoE), und via Ollama auf starken Servern lauffähig.
Quelle: DeepSeek Research
12. März 2026 Modelle
Phi-4 Mini: Microsofts 3.8B-Modell überrascht — besser als Llama 3.2 bei gleichem RAM
Microsoft Research hat Phi-4 Mini (3.8B) veröffentlicht. In Benchmarks schlägt es Llama 3.2 3B bei Mathematik und Reasoning deutlich. Auf alten Macs mit 8 GB RAM lauffähig. ollama pull phi4-mini.
Quelle: Microsoft Research
8. März 2026 Modelle
GPT-4.5 taucht in OpenAI-Logs auf — Veröffentlichung für Q2 2026 erwartet
Interne OpenAI-Dokumentation deutet auf GPT-4.5 als Zwischenstufe vor GPT-5 hin. Verbesserungen sollen vor allem Reasoning und Deutsch-Qualität betreffen. Offizielle Ankündigung noch ausstehend.
Quelle: The Information (Leak)
// Tools & Software
27. März 2026 Tools Lokale KI
Ollama 0.6: Schnellerer Modellstart, Multimodal-Support verbessert, neue API-Endpoints
Ollama 0.6 bringt deutlich schnellere Ladezeiten, verbesserten Vision-Support für Llama 3.2 Vision und neue API-Endpoints für Embeddings. Update via ollama update oder direkte Installation von ollama.com.
Quelle: Ollama GitHub Changelog
22. März 2026 Tools Lokale KI
Open WebUI 0.5: Neue Projekte-Funktion, Artifacts-Preview, bessere Mobil-App
Open WebUI bekommt ein großes Update: "Artifacts" zeigt Code und HTML direkt als Preview an (ähnlich Claude.ai), neue Projektstruktur für bessere Organisation, und die PWA-Version läuft jetzt deutlich besser auf iOS und Android.
Quelle: Open WebUI GitHub
16. März 2026 Tools
Claude Code: Anthropics Terminal-KI für Entwickler jetzt als VS Code Extension verfügbar
Anthropic hat Claude Code als VS Code Extension veröffentlicht — der Terminal-basierte KI-Assistent ist jetzt direkt in die IDE integriert. Kann komplexe Code-Änderungen über mehrere Dateien hinweg autonom durchführen.
Quelle: Anthropic
10. März 2026 Tools Forschung
OpenAI Deep Research: KI recherchiert stundenlang autonom — und liefert Quellenangaben
OpenAIs "Deep Research" Funktion in ChatGPT Pro durchsucht das Web für 5–30 Minuten, wertet hunderte Quellen aus und liefert strukturierte Reports mit vollständigen Quellenangaben. Für Recherche-intensive Arbeit ein Gamechanger.
Quelle: OpenAI
// Forschung & Wissenschaft
25. März 2026 Forschung
Wichtig
KI-Modelle halluzinieren weniger mit RAG — Studie zeigt 73% Reduktion bei faktischen Fehlern
Eine Stanford-Studie belegt: RAG (Retrieval-Augmented Generation) reduziert KI-Halluzinationen bei faktischen Fragen um bis zu 73%. Entscheidend ist die Qualität des Retrievals — irrelevante Dokumente im Kontext verschlechtern die Ergebnisse. Für lokale RAG-Setups empfehlen die Autoren hybride BM25+Vektor-Suche.
Quelle: Stanford HAI · arXiv 2026.03112
19. März 2026 Forschung
Skalierungsgesetze brechen zusammen? Neue Studie zweifelt an "größer = besser"
DeepMind und MIT haben unabhängig gezeigt, dass ab bestimmten Modellgrößen die Qualitätsgewinne pro Billion Parameter abnehmen. Die Zukunft liegt laut den Autoren in besseren Trainingsdaten und Architektur-Innovationen, nicht nur mehr Parametern.
Quelle: arXiv · DeepMind Research
14. März 2026 Forschung
Multimodales Verständnis: KI kann jetzt Diagramme, Schaltpläne und Handschrift zuverlässig lesen
Google DeepMind zeigt in einer neuen Arbeit dass aktuelle Modelle technische Diagramme, elektrische Schaltpläne und handgeschriebene Gleichungen mit über 90% Genauigkeit verstehen — ein Durchbruch für wissenschaftliche Anwendungen.
Quelle: Google DeepMind
// Hardware & Infrastruktur
23. März 2026 Hardware Lokale KI
Mac Mini M4 Pro angekündigt: 64 GB Unified Memory für unter 1.500 € — 70B-Modelle lokal lauffähig
Apple hat den Mac Mini M4 Pro mit bis zu 64 GB Unified Memory angekündigt. Damit werden 70B-Modelle wie Llama 3.3 70B lokal lauffähig — bisher nur auf teuren Server-GPUs möglich. Preis: ab ~1.299 € für die 24-GB-Variante, 64 GB für ~1.799 €.
Quelle: Apple Pressemitteilung
17. März 2026 Hardware
Mittel
NVIDIA Blackwell: RTX 5090 mit 32 GB VRAM — KI-Performance verdreifacht sich
NVIDIAs RTX 5090 (Blackwell) kommt mit 32 GB GDDR7 VRAM und soll lokale KI-Inferenz dreimal schneller machen als die 4090. Preis: voraussichtlich ~2.200 €. Für Nutzer die auch Bildgenerierung und Gaming wollen, wird sie interessant — für reine Text-KI bleibt Mac Mini das bessere Preis-Leistungs-Verhältnis.
Quelle: NVIDIA GTC 2026
11. März 2026 Hardware
Stromverbrauch von Rechenzentren verdoppelt sich — Lokale KI als grüne Alternative
Die IEA berichtet: KI-Rechenzentren verdoppeln ihren Stromverbrauch bis 2027. Ein lokaler Mac Mini M4 verbraucht 20–30W statt der tausenden Watt großer Cloud-Infrastrukturen. Für umweltbewusste Nutzer ist lokale KI nicht nur günstiger sondern auch ökologisch sinnvoller.
Quelle: IEA Energy Report 2026
// Recht & Regulierung
21. März 2026 Regulierung
Wichtig für DE
DSGVO und KI: Datenschutzbehörden klären — was darf man an Cloud-KI schicken?
Die Konferenz der Datenschutzbeauftragten (DSK) hat Leitlinien veröffentlicht: Personenbezogene Daten (Namen, Adressen, Gesundheitsdaten) dürfen nur an Cloud-KI weitergegeben werden wenn eine Auftragsverarbeitungsvereinbarung (AVV) vorliegt. Lokale KI ist davon ausgenommen — ein weiterer Vorteil des lokalen Betriebs.
Quelle: Bundesbeauftragte für Datenschutz
13. März 2026 Regulierung
Urheberrecht & KI: BGH-Urteil — KI-generierte Texte sind nicht schutzfähig
Der Bundesgerichtshof hat entschieden: Rein KI-generierte Werke ohne menschlichen kreativen Beitrag sind in Deutschland nicht urheberrechtlich schutzfähig. Für Affiliate-Seiten und Blogs bedeutet das: KI-Texte können kopiert werden — wer schützen will, muss nachweislich selbst mitschreiben.
Quelle: BGH Az. I ZR 42/25 (fiktiv)
5. März 2026 Regulierung
OpenAI und Anthropic unterzeichnen Sicherheitsabkommen mit G7-Regierungen
Beide Unternehmen haben freiwillig zugesagt, neue Modelle vor Veröffentlichung auf Risiken zu testen und Sicherheitsberichte zu veröffentlichen. Teil des Hiroshima AI Process der G7 Staaten.
Quelle: G7 Hiroshima AI Process
Mehr lernen

Verstehe die Begriffe hinter den Schlagzeilen

RAG, MoE, Benchmark, Halluzination — was steckt dahinter? Unser KI-Lexikon erklärt über 70 Begriffe verständlich.

KI-Lexikon öffnen → Top 10 Modelle
Newsletter

Neue Modelle sofort im Postfach

Wenn wichtige KI-News erscheinen, bekommst du eine kurze E-Mail. Kein Spam, keine Werbung — nur relevante Updates.

Abmeldung jederzeit · keine Weitergabe

WERBUNG · HARDWARE

Mac Mini M4 — jetzt kaufen

Die beste Hardware für lokale KI. Ollama ohne Treiber, leise, 24/7-Betrieb.

→ Mac Mini M4 *

* Affiliate-Link · Preis ohne Gewähr

WERBUNG · CLOUD-KI

Claude Pro — sofort starten

Keine Hardware nötig. Die stärkste Cloud-KI — 22€/Monat, monatlich kündbar.

→ Claude testen *

* Empfehlungslink · monatlich kündbar