Gemma 3n E4B je optimalizována pro efektivní spouštění na mobilních zařízeních a zařízeních s omezenými zdroji, jako jsou telefony, notebooky a tablety. Podporuje multimodální vstupy – včetně textu, vizuálních dat a zvuku – umožňující různorodé úlohy, jako je generování textu, rozpoznávání řeči, překlad a analýza obrazu. Díky využití inovací, jako je Per-Layer Embedding (PLE) caching a architektura MatFormer, Gemma 3n dynamicky spravuje využití paměti a výpočetní zátěž selektivní aktivací parametrů modelu, což výrazně snižuje požadavky na zdroje za běhu.
Tento model podporuje širokou jazykovou škálu (trénován ve více než 140 jazycích) a nabízí flexibilní kontextové okno s 32 tisíci tokeny. Gemma 3n dokáže selektivně načítat parametry, optimalizovat paměť a výpočetní efektivitu na základě úlohy nebo schopností zařízení, díky čemuž je vhodná pro aplikace zaměřené na soukromí, s offline funkcemi a pro AI řešení přímo na zařízení. Více informací v blogovém příspěvku