Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of Qwen3.8 Max, with 95 billion active parameters out of 2.4 trillion total. It is…
Unikátní charakteristiky
Tento model představuje masivní open-weight MoE architekturu s 2.4 biliony parametrů, z nichž je pouze 95 miliard aktivních při inferenci. Nabízí obrovské kontextové okno 1 milion tokenů a nadstandardní délku výstupu přes 52 tisíc tokenů, což jej činí technicky vysoce specializovaným pro generování rozsáhlých dokumentů.
Silné stránky
Extrémní délka výstupu
Podporuje generování až 52 429 tokenů v jednom výstupu, což je ideální pro psaní celých knih, reportů nebo rozsáhlých kódových bází bez nutnosti iterativního dotazování.
Efektivita MoE architektury
Díky aktivaci pouze 95B parametrů z celkových 2.4T dosahuje vysokého výkonu při zachování relativně přijatelných nároků na výpočetní výkon během inference.
Kapacita kontextu
Plná podpora 1 000 000 tokenů na vstupu umožňuje hloubkovou analýzu rozsáhlých repozitářů a dlouhých dokumentů.
Slabé stránky
Vyšší cena výstupu
Cena 6.00 USD za milion výstupních tokenů je relativně vysoká ve srovnání s modely jako DeepSeek V4 Pro nebo OpenAI GPT-5.6 Luna.
Absence multimodality
Model podporuje pouze text-to-text operace, chybí nativní zpracování obrazu, videa nebo zvuku.
Náročnost na self-hosting
Přes open-weight povahu vyžaduje celková velikost 2.4T parametrů masivní infrastrukturu a obrovskou kapacitu VRAM pro lokální běh.