Xiaomi MiMo-V2.6 bringt eine Million Token Kontext

Xiaomi MiMo-V2.6 bietet 1 Million Token Kontext, multimodale Eingaben und offene Modellgewichte für eigene KI-Setups.

Heller KI-Prozessor mit Symbolen für Text, Bild, Video und Audio als Motiv für Xiaomi MiMo-V2.6.

Xiaomi hat am 22. September 2026 die Modellreihe MiMo-V2.6 veröffentlicht. Pro und Flash verarbeiten Text, Bilder, Video und Audio und unterstützen laut Xiaomi ein Kontextfenster von einer Million Token.

Für Unternehmen ist vor allem die Kombination aus offenen Modellgewichten, API-Zugang und langem Kontext interessant. Damit wächst die Auswahl zwischen Cloud AI und selbst betriebenen KI-Modellen um eine weitere Modellfamilie.

Was Xiaomi mit MiMo-V2.6 veröffentlicht

Die Reihe umfasst MiMo-V2.6-Pro und MiMo-V2.6-Flash. Xiaomi stellt beide Modelle über die eigene API bereit und veröffentlicht zusätzlich Modellgewichte sowie einen technischen Bericht. Hinzu kommt das kleinere MiMo-V2.6-Distill-Qwen-9B.

Xiaomi veröffentlicht außerdem mehr als 7.000 Umgebungen für Reinforcement Learning. Sie decken unter anderem Softwareentwicklung, Schwachstellenreproduktion, wissensintensive Aufgaben und Webentwicklung ab. Bestandteile des RL-Trainingsframeworks und sogenannte Harnesses stehen ebenfalls zur Verfügung.

Der Hersteller bezeichnet die Veröffentlichung als vollständig Open Source. Öffentlich belegt sind unter anderem Modellgewichte, technischer Bericht, RL-Code und Trainingsressourcen. Für die Modelle selbst lässt sich damit mindestens eine Open-Weights-Verfügbarkeit eindeutig feststellen.

MiMo-V2.6 verarbeitet bis zu eine Million Token

MiMo-V2.6-Pro nutzt eine Sparse-Mixture-of-Experts-Architektur. Die Modellkarte nennt rund 1,02 Billionen Parameter, von denen pro Token 42 Milliarden aktiviert werden. Als Eingaben unterstützt das Modell Text, Bilder, Video und Audio. Die Ausgabe erfolgt als Text.

Das Kontextfenster umfasst eine Million Token. Lange Kontexte können bei großen Codebeständen, umfangreichen Dokumentensammlungen oder länger laufenden Agentenprozessen relevant werden. Die maximale Kontextgröße allein sagt jedoch nichts darüber aus, wie zuverlässig das Modell Informationen über diese gesamte Länge verarbeitet.

Open Weights ermöglichen eigene Betriebsmodelle

Die Gewichte von MiMo-V2.6-Pro stehen auf Hugging Face unter MIT-Lizenz bereit. Die Modellseite dokumentiert unter anderem Bereitstellung über Transformers, vLLM und SGLang. Auch Quantisierungen für weitere Laufzeitumgebungen werden dort angeboten.

Damit lässt sich das Modell grundsätzlich auf eigener Infrastruktur einsetzen. Wie praktikabel das bei dieser Modellgröße ist, hängt jedoch von Hardware, Quantisierung, Inferenzsoftware und den gewünschten Antwortzeiten ab.

Die grundsätzlichen Anforderungen ähneln anderen Szenarien, in denen Unternehmen KI lokal betreiben. Offene Gewichte ersetzen dabei keine Produktionsarchitektur. Zugriffsschutz, Monitoring, Updates, Datenklassifizierung und belastbare Betriebsprozesse bleiben notwendig.

Wie MiMo-V2.6 in unabhängigen Benchmarks abschneidet

Artificial Analysis bewertet MiMo-V2.6-Pro aktuell mit 46 Punkten im eigenen Intelligence Index. Innerhalb der dort verglichenen Klasse offener Modelle steht MiMo-V2.6-Pro derzeit auf Rang eins von 114 erfassten Modellen.

Das Ergebnis ist eine Benchmark-Messung und kein allgemeiner Nachweis für die beste Modellwahl. Qualität kann je nach Anwendung, Prompting, Sprache, Latenz und Sicherheitsanforderungen deutlich variieren. Für produktive Unternehmensanwendungen bleiben eigene Tests mit realen Workloads entscheidend.

Die Ausrichtung auf Agenten und lange Aufgabenketten passt zugleich zu einer Entwicklung, die IT-Dock bereits beim Thema Agentic AI betrachtet hat. Modelle werden zunehmend nicht nur für einzelne Antworten, sondern als Bestandteil längerer automatisierter Abläufe eingesetzt.

Was MiMo-V2.6 für Unternehmen interessant macht

Neben dem eigenen Betrieb bietet Xiaomi die Modelle über eine API an. Artificial Analysis weist für MiMo-V2.6-Pro derzeit 0,435 US-Dollar je Million nicht gecachter Input-Token und 0,87 US-Dollar je Million Output-Token aus.

MiMo-V2.6-Flash kostet laut Xiaomi 0,14 US-Dollar je Million nicht gecachter Input-Token und 0,28 US-Dollar je Million Output-Token. Für Cache-Treffer nennt Xiaomi 0,0028 US-Dollar je Million Token.

Damit entsteht eine weitere Option für Unternehmen, die zwischen eigener Inferenz und API-Nutzung abwägen. Bei hohen Volumina beeinflussen Hardwarebedarf, Auslastung, Antwortzeit und Tokenpreise die Gesamtkosten stärker als einzelne Benchmarkwerte.

Welche Fragen zum Unternehmenseinsatz noch offen sind

Die Modellreihe ist erst seit dem 22. September verfügbar. Belastbare Praxiserfahrungen zu Stabilität, Hardwarebedarf, Support und Betrieb in europäischen Unternehmensumgebungen liegen deshalb noch kaum vor.

Auch ein Kontextfenster von einer Million Token sollte nicht mit garantierter Ergebnisqualität gleichgesetzt werden. Vor einem produktiven Einsatz sind Tests mit eigenen Dokumenten, Sicherheitsanforderungen und typischen Workloads notwendig.

Xiaomi MiMo-V2.6 erweitert den Markt für offene KI-Modelle um eine große multimodale Modellfamilie. Für IT-Entscheider sind besonders offene Gewichte, API-Kosten und alternative Betriebsmodelle relevant.

Der IT-Dock Newsletter bündelt regelmäßig Entwicklungen rund um KI-Infrastruktur, Cloud und Unternehmens-IT.

Weiterführende Artikel

News
02 Okt. 2026 3 Min. Lesezeit

Smart Country Convention 2026: KI trifft Verwaltung

Smart Country Convention 2026 in Berlin. Portugal, Verwaltungs-KI und digitale Infrastruktur prägen das Programm.

IT-Dock Redaktion Jetzt lesen →
News
01 Okt. 2026 3 Min. Lesezeit

Windows 11 26H2: Rollout startet mit kleinem Update

Windows 11 26H2 startet: So funktioniert das kleine Update und diese Supportfristen gelten jetzt für Unternehmen.

IT-Dock Redaktion Jetzt lesen →
News
01 Okt. 2026 4 Min. Lesezeit

KI-Modellwechsel: Studie untersucht verspätete Migrationen

Viele erfasste Apps migrierten erst nach Abschaltung. Was die Studie zeigt und IT-Teams prüfen sollten.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 2 Min. Lesezeit

Star Blizzard: Gefälschte Einladungen verbreiten Malware

Microsoft erklärt RedFlick und nennt Schutzmaßnahmen für IT-Teams.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 3 Min. Lesezeit

Nvidia will KI-Agenten bei Grenzüberschreitungen stoppen

So arbeiten OpenShell und Sentry und das müssen Firmen prüfen.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 4 Min. Lesezeit

Microsoft Copilot: Neue Agenten kosten nach Verbrauch

Microsoft Copilot bekommt Home, Code und Autopilot. Die Funktionen starten schrittweise, Agenten kosten nach Verbrauch.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 5 Min. Lesezeit

Microsoft-Supportende: Office 2021 und Windows 11 24H2

Microsoft-Supportende im Oktober: das sollten Unternehmen jetzt prüfen.

IT-Dock Redaktion Jetzt lesen →
News
29 Sep. 2026 2 Min. Lesezeit

GPT-6.1 Astra: OpenAI stoppt Veröffentlichung

GPT-6.1 Astra kommt vorerst nicht: OpenAI stoppt die Veröffentlichung nach Tests zu Berechtigungen und Transparenz.

IT-Dock Redaktion Jetzt lesen →
News
29 Sep. 2026 4 Min. Lesezeit

One UI 9: Diese Galaxy-Geräte haben das Update schon

Für ältere Modelle fehlen Termine. Was Samsung bestätigt und IT-Teams prüfen.

IT-Dock Redaktion Jetzt lesen →
News
28 Sep. 2026 4 Min. Lesezeit

Citrix NetScaler: Zwei kritische Lücken werden ausgenutzt

Betroffene Versionen, Updates und Hinweise zur Prüfung auf Kompromittierung.

IT-Dock Redaktion Jetzt lesen →

Kommentare (0)

Noch keine Kommentare vorhanden.

Back to top