← Zpět na novinky

Nvidia vydala Nemotron 3.5 Lightning: malý model s rychlostí 670 tokenů za sekundu

2026-08-12 · 6 min čtení

Nvidia zveřejnila open-weight model Nemotron 3.5 Lightning s 3,6 miliardami aktivních parametrů, který na Intelligence Indexu dosahuje výsledků srovnatelných s čtyřikrát větším gpt-oss-120b. Hlavním trumfem je rychlost přes 670 tokenů za sekundu.

Nvidia vydala Nemotron 3.5 Lightning: malý model s rychlostí 670 tokenů za sekundu

Nvidia 12. srpna 2026 zveřejnila open-weight model Nemotron 3.5 Lightning, který pracuje s 3,6 miliardami aktivních parametrů a přitom na Intelligence Indexu dosahuje výsledků srovnatelných s OpenAI modelem gpt-oss-120b — tedy modelem přibližně čtyřikrát větším. Situace k 2026-08-12: jde o čerstvou novinku, takže zatím chybí nezávislá ověření na širší škále úloh a chybí i podrobná technická dokumentace.

Co je nového

Nemotron 3.5 Lightning je „open-weight" model — Nvidia veřejně zveřejnila natrénované váhy, takže si je kdokoliv může stáhnout, spustit na vlastním hardwaru nebo upravit. Tím se liší od uzavřených modelů dostupných jen přes placené API, jako jsou GPT-5.6 Sol nebo Claude Opus 5.

Klíčová čísla ze zdroje:

Model využívá architekturu MoE (Mixture of Experts), díky které stačí pro odpověď aktivovat jen část celkových parametrů — proto se mluví o „aktivních" parametrech. Celkový počet parametrů modelu Nvidia k datu vydání nezveřejnila. Nvidia tu jasně sází na kompromis „dost dobrý a extrémně rychlý" místo honby za absolutní špičkou v nejnáročnějších testech uvažování.

Jak to vyzkoušet

Model by měl být dostupný na Hugging Face pod účtem Nvidia. Přesný název repozitáře (očekává se ve formátu podobném `nvidia/Nemotron-3.5-Lightning`) se může při ostrém vydání lišit, proto je nejjistější vyhledat přímo frázi „Nemotron 3.5 Lightning" ve vyhledávání na Hugging Face.

Praktický postup: 1. Otevřete huggingface.co, do vyhledávání zadejte „Nemotron 3.5 Lightning" a najděte oficiální stránku modelu od Nvidie. 2. Model stáhněte pomocí knihovny `transformers` v Pythonu, případně přes `ollama`, pokud repozitář podporu pro tento nástroj nabízí. 3. Pokud nemáte vlastní GPU, zkuste Hugging Face Spaces — u podobných vydání Nvidia nebo komunita obvykle připraví interaktivní demo přímo v prohlížeči.

Ukázkový prompt pro otestování rychlosti a kvality odpovědí:

Shrň mi v pěti bodech hlavní rozdíly mezi SQL a NoSQL databázemi. 
Každý bod doplň konkrétním příkladem databázového systému.

Tento prompt prověří jak faktickou přesnost, tak schopnost strukturovat výstup do bodů.

Kdy se to nehodí

Nemotron 3.5 Lightning není vhodná volba tam, kde je klíčová maximální přesnost:

Co to znamená pro tebe

Pro vývojáře a firmy, které potřebují zpracovat velké množství jednodušších dotazů rychle, je Nemotron 3.5 Lightning zajímavá volba — nižší počet aktivních parametrů obvykle znamená nižší nároky na výpočetní výkon při stejném počtu obsloužených požadavků, i když přesná čísla spotřeby paměti Nvidia nezveřejnila.

Pro běžného uživatele, který si chce model jen vyzkoušet doma, je důležité hlavně to, že jde o volně stažitelný model bez měsíčního předplatného — omezením je spíš dostupnost vhodného hardwaru a znalost práce s nástroji jako `transformers` nebo `ollama`, ne cena.

Pro pokročilé

Díky architektuře MoE aktivuje model při každém dotazu jen část svých parametrů, což šetří výpočetní výkon oproti klasickému „hustému" modelu stejné celkové velikosti. Přesné hardwarové nároky (VRAM, podporované kvantizace) Nvidia při vydání nezveřejnila. Vzhledem k tomu, že jde o open-weight model, lze do budoucna očekávat, že komunita připraví i kvantizované verze v běžných formátech, jak bývá u podobných vydání zvykem — oficiálně to ale Nvidia nepotvrdila. Podmínky licence pro komerční využití nejsou v dostupných zdrojích specifikovány; před nasazením ve firmě je potřeba ověřit je přímo na stránce modelu na Hugging Face.

Zdroj informací: The Decoder (https://the-decoder.com/nvidias-open-weight-nemotron-3-5-lightning-prioritizes-speed-over-maximum-intelligence/)

Související nástroje

Téma: Open-source modely

Přečtěte si dál