MiMo-V2.5on Krater.ai
MiMo-V2.5 is a native omnimodal model by Xiaomi. It delivers Pro-level agentic performance at roughly half the inference cost, while surpassing MiMo-V2-Omni in multimodal perception across image and video understanding
Released April 22, 2026
Specifications
MiMo-V2.5 at a glance
Context
1.1M tokens
Max output
131.1K tokens
Input
Text, Audio, Image, Video
Output
Text
Input price
$0.14 / 1M
Output price
$0.28 / 1M
Capabilities
What it is good at
Catalog capabilities
- Accepts image input
- Generates text responses
- Supports tool calling
- Supports structured outputs
Good for
Benchmarks
Catalog data, not Krater benchmarks.
Coding index score
56.8
Agentic index score
24.4
Intelligence index score
38
Design Arena dataviz rank
#21
Design Arena codecategories rank
#23
Compare
Compare MiMo-V2.5
MiMo-V2.5 vs MiMo-V2.5-Pro
MiMo-V2.5-Pro is Xiaomi’s flagship model, delivering strong performance in general agentic capabilities, complex software engineering, and long-horizon tasks, with top rankings on benchmarks such as ClawEval, GDPVal, and SWE-bench Pro
Open comparisonMiMo-V2.5 vs MiMo-V2-Omni
MiMo-V2-Omni is a frontier omni-modal model that natively processes image, video, and audio inputs within a unified architecture.
Open comparisonMiMo-V2.5 vs MiMo-V2-Flash
MiMo-V2-Flash is an open-source foundation language model developed by Xiaomi.
Open comparisonFAQ
Questions about MiMo-V2.5
Clear answers based on the model catalog and Krater access.
Use MiMo-V2.5 in your API
Connect with Krater's unified API.