← Zpět na novinky

Gemini 3.7 Flash: Google srazil cenu o polovinu tři týdny po předchozí verzi

2026-08-14 · 6 min čtení

Google vydal 13. srpna 2026 model Gemini 3.7 Flash — jen tři týdny po verzi 3.6 Flash. Podle Googlu je o 50 % levnější než předchůdce a míří hlavně na programování a AI agenty. Konkrétní ceník za tokeny ale zatím zveřejněn nebyl.

Gemini 3.7 Flash: Google srazil cenu o polovinu tři týdny po předchozí verzi

Google vydal 13. srpna 2026 model Gemini 3.7 Flash, který má stát o 50 % méně než Gemini 3.6 Flash z 21. července 2026. Mezi oběma verzemi tedy uplynuly tři týdny — i na poměry současného tempa vydávání jazykových modelů jde o neobvykle krátký cyklus. Situace k 14. 8. 2026: 3.7 Flash je nejnovější model řady Flash od Googlu.

Co je nového

Hlavní změna je cenová. Google uvádí, že Gemini 3.7 Flash je oproti verzi 3.6 Flash poloviční co do ceny. Přesné sazby za milion vstupních a výstupních tokenů ale ke dni vydání článku nemáme z ověřeného zdroje k dispozici a Google účtuje výhradně v dolarech — oficiální ceník v korunách pro evropský trh neexistuje. Aktuální čísla je potřeba dohledat v ceníku Google AI pro vývojáře.

Slovo „Flash" v názvu znamená rychlou a levnou třídu modelu. Není to vlajkový model určený na nejtěžší úlohy, ale takzvaný workhorse — model pro objemné, každodenní nasazení, kde se počítá každý dolar za tisíce nebo miliony dotazů.

Google model profiluje do dvou oblastí:

Údaje o výkonu pocházejí z vlastního měření Googlu. Nezávislé ověření třetí stranou zatím k dispozici není a Google nezveřejnil, na kterých konkrétních testovacích sadách měřil. Čísla od výrobce modelu je vždy rozumné brát jako marketingový podklad, ne jako nezávislý audit.

Kontextové okno modelu je 1 milion tokenů. Tokeny jsou kousky textu, na které si model větu rozděluje — u češtiny výrazně kratší než u angličtiny, takže reálný počet českých slov, který se do okna vejde, je znatelně nižší než u anglického textu.

Jak to vyzkoušet

Model je dostupný přes Google AI Studio (aistudio.google.com) pro jednotlivce a přes Vertex AI pro firemní nasazení s SLA.

1. Přihlas se Google účtem na aistudio.google.com. 2. V rozbalovacím seznamu modelů vpravo nahoře vyber Gemini 3.7 Flash. 3. Zadej prompt do textového pole a odešli.

Podmínky bezplatného používání AI Studia se v EU liší a Google je mění — ověř si je před testem přímo na stránce s ceníkem.

Na otestování kódovacích schopností se hodí zadání, které kombinuje psaní kódu, ošetření chyb a jazykový požadavek:

Napiš Python funkci, která načte CSV soubor se sloupci 'jmeno' a 'vek',
odfiltruje řádky s věkem pod 18 let a výsledek uloží do nového CSV.
Ošetři tři situace: soubor neexistuje, chybí očekávaný sloupec,
hodnota ve sloupci 'vek' není číslo.
Komentáře piš česky. Na konci vypiš, kolik řádků bylo odfiltrováno.

Kvalitu poznáš podle toho, jestli model skutečně ošetří všechny tři chybové stavy, nebo jen ten první a zbytek odbyde obecným `try/except`.

Kdy se to nehodí

Na náročné uvažování. Flash je zrychlená třída. Pokud potřebuješ vícekrokovou analýzu, právní nebo finanční rozbor dlouhých dokumentů či kreativní psaní s citem pro styl, sáhni po vlajkovém modelu — u Googlu je to Gemini 3.1 Pro, u konkurence Claude Opus 5 nebo GPT-5.6 Sol.

Když potřebuješ nezávisle ověřená čísla. Dokud výsledky nepotvrdí třetí strana, nemáš jak porovnat 3.7 Flash s konkurencí jinak než vlastním testem na svých datech.

Když plánuješ rozpočet. Bez zveřejněného ceníku za milion tokenů nelze úsporu spočítat dopředu. Vzorec je jednoduchý — (počet vstupních tokenů × sazba za vstup) + (výstupní tokeny × sazba za výstup) — ale bez sazby ti nepomůže.

Když je model nasazený v produkci přes API. Rychlé střídání verzí znamená, že model, na kterém máš odladěné prompty, může být za měsíc nahrazený jiným. Odpovědi nové verze se mohou lišit formátem i délkou.

Co to znamená pro tebe

Pokud používáš Gemini jen v chatu v prohlížeči, změna se tě prakticky netýká.

Zajímavá je pro ty, kdo platí za API volání — provozují chatbota na webu, automaticky zpracovávají dokumenty nebo generují popisky produktů. Půlka ceny oproti verzi staré tři týdny je u objemných provozů znatelný rozdíl, ale konkrétní úsporu si spočítáš až podle zveřejněného ceníku a svého reálného počtu tokenů.

Pro pokročilé

Model je dostupný přes Gemini API i Vertex AI. Přesný řetězec identifikátoru modelu, sazby za tokeny, limity požadavků za minutu a případný termín odstavení starších Flash verzí najdeš v oficiální dokumentaci na ai.google.dev — v tuto chvíli nemáme tyto údaje z ověřeného zdroje potvrzené a nemá smysl je odhadovat. Před nasazením otestuj model na vlastní sadě dotazů: u modelů levné třídy bývá rozdíl mezi benchmarkem a reálným provozem větší než u vlajkových modelů.

Zdroj informací: The Decoder (https://the-decoder.com/gemini-3-7-flash-lands-with-coding-gains-and-undercuts-its-three-week-old-predecessors-price-by-50/). Ceníky a limity Google AI Studia ověřuj na https://ai.google.dev/pricing.

Související nástroje

Téma: Gemini a Google · Ceny a bezplatné tarify

Přečtěte si dál