MiMo-V2-Omni je průlomový omnimodální model, který nativně zpracovává obrazové, video a audio vstupy v rámci jednotné architektury. Kombinuje silné multimodální vnímání s agenty schopnostmi – vizuálním ukotvením, vícestupňovým plánováním, používáním nástrojů a prováděním kódu – díky čemuž je vhodný pro komplexní úkoly v reálném světě, které zahrnují různé modality. Kontextové okno o velikosti 256K.
X
Xiaomi 18. 3. 2026
Xiaomi: MiMo-V2-Omni
xiaomi/mimo-v2-omni $0.4 / 1M vstup
$2 / 1M výstup
262k kontext
66k max výstup
Reklama
Co plyne z ceníku a parametrů
Strojový rozbor · needitováno · medián ročníku 2026: vstup 0,4 $/M, výstup 2,2 $/M, kontext 400 000 tokenů
- Vstup 0,4 $/M je kolem mediánu, výstup 2 $/M kolem mediánu.
- Při 2 M vstupních a 500 k výstupních tokenů měsíčně vyjde na 1,8 $.
- Na vstupu přijme obrázky a video, nejen text.
- Audio přijme na vstupu, na výstupu vrací text.
Odvozeno výpočtem z ceníku a limitů, bez jazykového modelu. Neříká nic o kvalitě modelu — tu zatím neměříme.
Detailní popis
Zdroj popisu neevidujeme; text prošel strojovým zpracováním. Není redakčně ověřený a není doporučením.