Gemini 2.5 Flash-Lite je odlehčený model pro usuzování z rodiny Gemini 2.5, optimalizovaný pro ultra-nízkou latenci a nákladovou efektivitu. Nabízí vylepšenou propustnost, rychlejší generování tokenů a lepší výkon v běžných benchmarkách ve srovnání s dřívějšími modely Flash. Ve výchozím nastavení je “myšlení” (tj. víceprůchodové usuzování) deaktivováno, aby se upřednostnila rychlost, ale vývojáři jej mohou povolit prostřednictvím parametru Reasoning API a selektivně tak vyměnit náklady za inteligenci.
G
Google 25. 9. 2025
Google: Gemini 2.5 Flash Lite Preview 09-2025
google/gemini-2.5-flash-lite-preview-09-2025 $0.1 / 1M vstup
$0.4 / 1M výstup
1.0M kontext
66k max výstup
Reklama
Co plyne z ceníku a parametrů
Strojový rozbor · needitováno · medián ročníku 2025: vstup 0,3 $/M, výstup 1,68 $/M, kontext 200 000 tokenů
- Vstup 0,1 $/M je o 67 % pod mediánem, výstup 0,4 $/M o 76 % pod mediánem.
- Při 2 M vstupních a 500 k výstupních tokenů měsíčně vyjde na 0,4 $.
- Kontextové okno 1 048 576 tokenů patří k největším v ročníku (horní čtvrtina, medián 200 000).
- Na vstupu přijme obrázky a video, nejen text.
- Audio přijme na vstupu, na výstupu vrací text.
Odvozeno výpočtem z ceníku a limitů, bez jazykového modelu. Neříká nic o kvalitě modelu — tu zatím neměříme.
Detailní popis
Zdroj popisu neevidujeme; text prošel strojovým zpracováním. Není redakčně ověřený a není doporučením.