MiMo-V2.6-Pro ist die neueste Version von Xiaomi und versucht, etwas Ungewöhnliches zu tun: ein KI-Modell zu verkaufen, das sowohl preiswert als auch vernünftig intelligent ist, selbst wenn es viel redet und langsam denkt. Das Modell, das am 21. September 2026 veröffentlicht wurde, ist ein Reasoning-Modell mit einem Kontextfenster von 1 Mio. Token. Es unterstützt Text-, Bild-, Sprach- und Videoeingaben und erzeugt Texteausgaben. Sein Intelligence Index Wert beträgt 46, was es deutlich über dem Durchschnitt vergleichbarer Modelle mit einem Median von 18 platziert.
Der Haken ist der Preis. MiMo-V2.6-Pro kostet 0,43 US-Dollar pro 1 Mio. Eingabetoken und 0,87 US-Dollar pro 1 Mio. Ausgabetoken. Außerdem benötigt es über 2 Sekunden, um sein erstes Token zu erzeugen, und erzeugt bei jeder Auswertung satte 140 Mio. Ausgabetoken. Das ist eine Menge Geschwätz für ein Modell, das preiswert sein soll.
Intelligenz auf einen Blick
Der Intelligence Index ist die Zahl, an der Xiaomi den Ruf des Modells aufgebaut hat. Ein Wert von 46 platziert MiMo-V2.6-Pro über dem Median von 18 bei vergleichbaren Modellen. Der Index testet Modelle in den Bereichen Reasoning, Wissen, Mathematik und Programmierung und ist ein zusammengesetzter Benchmark und kein einzelner Test.
Der Wert spiegelt die Leistung des Modells bei bestimmten Fähigkeiten und Branchen wider. Der Index umfasst Bewertungen von Agent-bezogener Wissensarbeit, Agent-bezogenen Aufgaben in der realen Welt, Agent-bezogenen SaaS-Workflows, Agent-bezogener Programmierung und Terminalnutzung, Reasoning und Wissen, professioneller Dokumenten-Reasoning, Physik-Reasoning und mehr. Er misst auch Agent-bezogene Geschäftsprozesse, quantitative Analyse in Tabellenkalkulationen und Dokumenten, Agent-bezogenen Werkzeuggebrauch und Kubernetes-Incident-Root-Cause-Analyse.
Der Index testet außerdem visuelles Reasoning und medizinisches Long-Context-Reasoning. Er umfasst den AA-Briefcase Elo und den AA-Omniscience Index, die Intelligenz über eine Reihe von Branchen hinweg messen.
Was an dem Index bemerkenswert ist, ist, dass er ein Komposit ist. Er misst Agent-bezogene Wissensarbeit, Agent-bezogene Aufgaben in der realen Welt, Agent-bezogene SaaS-Workflows, Agent-bezogene Programmierung und Terminalnutzung, Reasoning und Wissen, professionellen Dokumenten-Reasoning, Physik-Reasoning oder eine andere einzelne Fähigkeit nicht isoliert. Er misst die Leistung des Modells in all diesen Bereichen gleichzeitig.
Das ist der springende Punkt. Der Index ist kein Test einer einzelnen Fähigkeit. Er ist ein Test der allgemeinen Intelligenz eines Modells, und ein Wert von 46 liegt deutlich über dem Median.
Die Preisaufschlüsselung
Interessant wird es bei den Preisen. MiMo-V2.6-Pro kostet 0,43 US-Dollar pro 1 Million Eingabetoken und 0,87 US-Dollar pro 1 Million Ausgabetoken. Das ist etwas teuer für die Eingabegeschwindigkeit und moderat preiswert für die Ausgabegeschwindigkeit, verglichen mit Modellen ähnlicher Größe. Das gemischte Verhältnis von 7:2:1 für Cache-Treffer/Eingabe/Ausgabe führt zu einem Preis von 0,18 US-Dollar pro 1 Million Token.
Das Modell ist langsamer als der Durchschnitt, mit einem Durchsatz von 54 Token pro Sekunde. Es dauert auch über 2 Sekunden, bis es sein erstes Token produziert. Diese Latenzzeit summiert sich, wenn Sie 140 Millionen Ausgabetoken generieren.
Das Ausgabevolumen ist ebenfalls ein Problem. Ein Modell, das 140 Millionen Ausgabetoken generiert, wird lange brauchen, um fertig zu werden, egal wie schnell es denkt. Die End-to-End-Antwortzeit wird basierend auf der Zeit bis zum ersten Token, der „Denkzeit“ für Reasoning-Modelle und der Ausgabegeschwindigkeit berechnet.
Die Design-Kompromisse
MiMo-V2.6-Pro ist ein Mixture of Experts (MoE)-Modell mit insgesamt 1,0 Billionen Parametern, aber während der Inferenz werden nur 42 Milliarden aktive Parameter verwendet. Das Modell verfügt über ein Kontextfenster von 1 Million Token, das groß ist und ihm viel Spielraum gibt, um lange Gespräche und Dokumentenhistorien zu verarbeiten. Es ist Open Weights, was bedeutet, dass seine öffentlichen Gewichte heruntergeladen und selbst gehostet werden können, und es wird unter der MIT-Lizenz veröffentlicht, die eine kommerzielle Nutzung ermöglicht.
Das Modell unterstützt die Eingabe von Bildern und kann Bilder analysieren, beschreiben und Fragen dazu beantworten. Es ist multimodal und verarbeitet Text-, Bild-, Sprach- und Videoeingaben und generiert Texte ausgaben. Das Modell ist über einen API-Anbieter verfügbar.
„MiMo-V2.6-Pro gehört zu den führenden Modellen in Bezug auf Intelligenz und ist preiswert im Vergleich zu anderen Open-Weight-Modellen ähnlicher Größe. Es ist auch langsamer als der Durchschnitt und etwas ausführlich.“
Das ist die ehrliche Bewertung des Modells. Es ist intelligent und erschwinglich, aber es ist langsam und gesprächig. Das sind nicht unbedingt schlechte Eigenschaften. Ein intelligentes Modell ist nützlich. Ein erschwingliches Modell ist zugänglich. Aber ein langsames und gesprächiges Modell ist frustrierend.
Wie die Vergleiche funktionieren
Die Analyse von Intelligenz und Leistung vergleicht MiMo-V2.6-Pro mit Modellen der gleichen Klasse. Metriken werden mit Modellen der gleichen Klasse verglichen, einschließlich nicht-denkender Modelle, denkender Modelle, Open-Weights-Modellen und proprietären Modellen.
- Nicht-denkende Modelle werden nur mit anderen nicht-denkenden Modellen verglichen.
- Denkende Modelle werden sowohl mit denkenden als auch mit nicht-denkenden Modellen verglichen.
- Open-Weights-Modelle werden nur mit anderen Open-Weights-Modellen der gleichen Größenklasse verglichen: klein (≤4B Parameter), mittel (4B–40B Parameter), groß (40B–150B Parameter) und sehr groß (>150B Parameter).
- Proprietäre Modelle werden mit proprietären und Open-Weights-Modellen des gleichen Preisrahmens verglichen, unter Verwendung eines gemischten Preisverhältnisses von 3:1 für Eingabe/Ausgabe: <0,15 US-Dollar pro 1 Mio. Token, 0,15–1 US-Dollar pro 1 Mio. Token und >1 US-Dollar pro 1 Mio. Token.
Die Vergleiche basieren auf einer Reihe von Metriken, darunter Intelligenz, Ausgabe-Token, Preisgestaltung, Geschwindigkeit und Latenz. Xiaomis API ist die Datenquelle, und die Analyse von artificialanalysis.ai stützt sich auf Vergleiche mit Modellen ähnlicher Größe und mit proprietären Modellen.
Das Urteil zum Modell
MiMo-V2.6-Pro ist ein leistungsfähiges Modell mit echten Stärken. Sein Intelligenzindex von 46 liegt deutlich über dem Durchschnitt, und seine Multimodal-Unterstützung sowie die MIT-Lizenz machen es zu einer praktischen Wahl für Entwickler, die auf Open Weights aufbauen möchten. Die 140 Millionen generierten Ausgabe-Token sind ein Feature und kein Bug für Benutzer, die detaillierte Antworten wünschen.
Aber auch die Schwächen des Modells sind real. Sein Durchsatz ist langsamer als der Median, und seine Latenz ist höher als der Durchschnitt. Die Preisgestaltung von 0,43 US-Dollar pro 1 Mio. Eingabe-Token und 0,87 US-Dollar pro 1 Mio. Ausgabe-Token liegt über dem Median, was bedeutet, dass es nicht die günstigste Option ist.
Die 0,87 US-Dollar pro 1 Mio. Ausgabe-Token des Modells sind mäßig teuer, was eine Erleichterung für Benutzer ist, die sich mehr für die Antworten als für die Fragen interessieren. Das gemischte Verhältnis von 7:2:1 Cache-Hits/Eingabe/Ausgabe führt zu einem Preis von 0,18 US-Dollar pro 1 Mio. Token, was ein angemessener Wert für ein Modell dieser Größe ist.
Das Modell verfügt über 42 Milliarden aktive Parameter und ein Kontextfenster von 1 Million Token, was es in die Lage versetzt, komplexe Aufgaben zu bewältigen, aber die langsame Durchsatzrate und das hohe Ausgabevolumen bedeuten, dass es nicht das schnellste Modell ist. Nutzer, die schnelle Antworten benötigen, sollten sich an anderer Stelle umsehen. Nutzer, die detaillierte Antworten benötigen, sollten MiMo-V2.6-Pro in Betracht ziehen.
Das Modell ist unter der MIT-Lizenz lizenziert und verfügt über ein offenes Gewichtsdesign, was bedeutet, dass es kommerziell kostenlos genutzt werden kann, was einen deutlichen Vorteil darstellt. Das Unternehmen hat MiMo-V2.6-Pro veröffentlicht, und die Analyse von Intelligenz und Leistung liefert eine Aufzeichnung der Leistung und der Preisgestaltung, die es zu berücksichtigen gilt. Diese Aufzeichnung zeigt, dass Xiaomi bereit ist, seine eigenen Bewertungen seiner Modelle zu veröffentlichen, was ein nützliches Signal für Nutzer ist, die wissen wollen, was sie bekommen.
Quelle: „MiMo-v2.6-Pro: Intelligence, Performance and Price Analysis“, artificialanalysis.ai.
Das Notizbuch abonnieren.
Die besten Geschichten des Tages und jedes neue Urteil, in klarem Deutsch, um sieben im Postfach. Eine Mail am Tag, nicht mehr.

