Alla modeller

MiMo-V2.5: Xiaomis multimodala modell

1M tokens · Text / Vision / Audio / Video / Code · Prompt cache

Okou kör inte längre MiMo-V2.5. Denna sida behålls som referens för dess specifikationer, prissättning och benchmarks. För samma typ av arbete, använd GPT 5.6 Luna.

Se GPT 5.6 Luna

Använd den för kostnadskänsliga agenter som behöver inspektera blandade medier tillsammans med text eller kod. Det är inte en dedikerad kodningsleverantörsrutt som Moonshot eller en Z.AI direktväg som GLM, så håll Sonnet eller Kimi i reserv när verktygsroutingskvalitet är den huvudsakliga begränsningen.

Vad är MiMo-V2.5?

Juni 2026

Modellen kombinerar ett 1M-token kontextfönster med stöd för text-, bild-, ljud- och videoinmatning. Det gör den till ett praktiskt lågprisval när en agent måste läsa media-tung bevisning tillsammans med vanlig text.

Specifikationer i korthet

FamiljXiaomi MiMo
ModaliteterText, bild, ljud, video, kod
SpråkFlerspråkig
KontextfönsterUpp till 1M tokens
Prompt-cachelagringCacheläsningar stöds

MiMo-V2.5 prissättning

Leverantörens listpris, per 1M tokens.

Inmatning$0.14
Utdata$0.28
Cacheläsning$0.003
CacheskrivningEj fakturerad

Hur MiMo-V2.5 beter sig i praktiken

Observerat beteende från produktionsagentkörningar.

Multimodal täckning

MiMo-V2.5 är den billiga vägen för att kombinera text, bilder, ljud och videoingångar i ett agentsteg.

Stort sammanhang

Kontextfönstret på 1M-token ger agenter tillräckligt med utrymme för långa dokument, transkriptioner och stödjande filer utan aggressiv chunking.

Bästa agentuppgifter för MiMo-V2.5

Forskning med blandade medier

Använd MiMo-V2.5 när agenten behöver granska skärmbilder, klipp, transkriptioner och skriftliga anteckningar tillsammans innan en strukturerad brief produceras.

Dokumentgranskning med stor kontext

Ladda långt källmaterial med bilder eller mediareferenser och be om tvärdokumentfynd utan att omedelbart gå över till en premiummodell.

När man ska hoppa över MiMo-V2.5

Hoppa över MiMo-V2.5 när du behöver den starkaste Claude-stilverktygsroutningen, eller när arbetsflödet endast är textbaserat och en billigare smal modell är tillräcklig.

MiMo-V2.5 vs andra modeller

MiMo-V2.5 vs Kimi K2.7 Code

Kimi är den starkare kodningsfokuserade Moonshot-vägen. MiMo-V2.5 vinner när bred multimodal input och en större 1M kontext är viktigare.

MiMo-V2.5 vs Claude Sonnet 4.6

Sonnet förblir den säkrare premiumstandarden för verktygsrouting och hård resonemang. MiMo-V2.5 är den billigare multimodala utforskningsvägen.

MiMo-V2.5 vs Hy3 Förhandsgranskning

Hy3 Preview är billigare och endast text med 256K kontext. MiMo-V2.5 passar bättre när bild, ljud, video eller ett 1M-fönster behövs.

Tillgänglighet av MiMo-V2.5 på Okou

MiMo-V2.5 har tagits bort från Okou-sortimentet, så det kan inte längre väljas i chatt eller i ett arbetsflöde, och det är inte tillgängligt med din egen API-nyckel. GPT 5.6 Luna täcker samma kostnadsbesparande nivå.