Gemma 4 26B A4B IT je model typu Mixture-of-Experts (MoE) s doladěnými instrukcemi od Google DeepMind. Navzdory celkovému počtu 25,2 miliard parametrů se během inference aktivuje pouze 3,8 miliardy parametrů na token – poskytuje tak kvalitu blížící se 31B při zlomku výpočetních nákladů. Podporuje multimodální vstup včetně textu, obrázků a videa (až 60 sekund při 1 snímku za sekundu). Nabízí kontextové okno o velikosti 256 tisíc tokenů, nativní volání funkcí, konfigurovatelný režim myšlení/usuzování a podporu strukturovaného výstupu. Uvolněno pod licencí Apache 2.0.
G
Google 3. 4. 2026
Google: Gemma 4 26B A4B
google/gemma-4-26b-a4b-it $0.13 / 1M vstup
$0.4 / 1M výstup
262k kontext
262k max výstup
Co plyne z ceníku a parametrů
Strojový rozbor · needitováno · medián ročníku 2026: vstup 0,4 $/M, výstup 2,2 $/M, kontext 400 000 tokenů
- Vstup 0,13 $/M je o 68 % pod mediánem, výstup 0,4 $/M o 82 % pod mediánem.
- Výstup je jen 3,08× dražší než vstup (obvykle 5,5×) a v absolutní ceně 0,4 $/M zůstává pod mediánem ročníku.
- Při 2 M vstupních a 500 k výstupních tokenů měsíčně vyjde na 0,46 $.
- Maximální výstup 262 144 tokenů je neobvykle velký. Pozor na náklad: jedna plná odpověď stojí 0,1 $.
- Na vstupu přijme obrázky a video, nejen text.
Odvozeno výpočtem z ceníku a limitů, bez jazykového modelu. Neříká nic o kvalitě modelu — tu zatím neměříme.
Detailní popis
Zdroj popisu neevidujeme; text prošel strojovým zpracováním. Není redakčně ověřený a není doporučením.