MiMo-V2.5: Xiaomis multimodala modell
1M tokens · Text / Vision / Audio / Video / Code · Prompt cache
Okou kör inte längre MiMo-V2.5. Denna sida behålls som referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete, använd GPT 5.6 Luna.
Se GPT 5.6 LunaAnvänd den för kostnadskänsliga agenter som behöver inspektera blandade medier tillsammans med text eller kod. Det är inte en dedikerad kodningsleverantörsrutt som Moonshot eller en Z.AI direktväg som GLM, så håll Sonnet eller Kimi i reserv när verktygsroutingskvalitet är den huvudsakliga begränsningen.
Vad är MiMo-V2.5?
Juni 2026
Modellen kombinerar ett 1M-token kontextfönster med stöd för text-, bild-, ljud- och videoinmatning. Det gör den till ett praktiskt lågprisval när en agent måste läsa media-tung bevisning tillsammans med vanlig text.
Specifikationer i korthet
MiMo-V2.5 prissättning
Leverantörens listpris, per 1M tokens.
Hur MiMo-V2.5 beter sig i praktiken
Observerat beteende från produktionsagentkörningar.
Multimodal täckning
MiMo-V2.5 är den billiga vägen för att kombinera text, bilder, ljud och videoingångar i ett agentsteg.
Stort sammanhang
Kontextfönstret på 1M-token ger agenter tillräckligt med utrymme för långa dokument, transkriptioner och stödjande filer utan aggressiv chunking.
Bästa agentuppgifter för MiMo-V2.5
Forskning med blandade medier
Använd MiMo-V2.5 när agenten behöver granska skärmbilder, klipp, transkriptioner och skriftliga anteckningar tillsammans innan en strukturerad brief produceras.
Dokumentgranskning med stor kontext
Ladda långt källmaterial med bilder eller mediareferenser och be om tvärdokumentfynd utan att omedelbart gå över till en premiummodell.
När man ska hoppa över MiMo-V2.5
Hoppa över MiMo-V2.5 när du behöver den starkaste Claude-stilverktygsroutningen, eller när arbetsflödet endast är textbaserat och en billigare smal modell är tillräcklig.
MiMo-V2.5 vs andra modeller
MiMo-V2.5 vs Kimi K2.7 Code
Kimi är den starkare kodningsfokuserade Moonshot-vägen. MiMo-V2.5 vinner när bred multimodal input och en större 1M kontext är viktigare.
MiMo-V2.5 vs Claude Sonnet 4.6
Sonnet förblir den säkrare premiumstandarden för verktygsrouting och hård resonemang. MiMo-V2.5 är den billigare multimodala utforskningsvägen.
MiMo-V2.5 vs Hy3 Förhandsgranskning
Hy3 Preview är billigare och endast text med 256K kontext. MiMo-V2.5 passar bättre när bild, ljud, video eller ett 1M-fönster behövs.
Tillgänglighet av MiMo-V2.5 på Okou
MiMo-V2.5 har tagits bort från Okou-sortimentet, så det kan inte längre väljas i chatt eller i ett arbetsflöde, och det är inte tillgängligt med din egen API-nyckel. GPT 5.6 Luna täcker samma kostnadsbesparande nivå.

