Nejrozšířenější AI ekosystém — Custom GPTs, Assistants, Realtime API
Univerzální nasazení — od běžné práce přes obsah a kódování po produkční AI aplikace a hlasové agenty.
Modely
GPT-5.6 Sol — Nová vlajková loď (GA 9. 7. 2026) — dle OpenAI dosud nejlepší coding model, o 54 % vyšší tokenová efektivita při kódování, komplexní reasoning a agentické workflow
GPT-5.6 Terra — Střední varianta rodiny 5.6 — kompromis výkonu a ceny pro každodenní práci
GPT-5.6 Luna — Nejlehčí a nejrychlejší z rodiny 5.6 — objemové a rychlé úlohy
GPT-5.5 / 5.5 Pro — Předchozí generace — postupně nahrazována rodinou GPT-5.6; Pro dál v ChatGPT Pro ($200/měs)
GPT-5.4 mini — Starší levný model ($0,75/$4,50 za 1M) — v API pořád je, ale GPT-5.6 Luna je levnější i novější
GPT-5.4 nano — Nejmenší model předchozí řady pro jednoduché klasifikace a extrakce ($0,20/$1,25 za 1M)
GPT Image — Generování a editace obrázků integrované v ChatGPT a API (nástupce DALL-E)
Whisper — Speech-to-text model pro přepis audio/video
TTS — Text-to-speech s 6 hlasy, přirozená intonace
Embeddings — text-embedding-3-small/large pro RAG a sémantické vyhledávání
Silné stránky
Nejrozšířenější ekosystém s největší komunitou — dle výzkumu OpenAI (8/2026) tvoří Codex 64 % výstupních tokenů u firemních zákazníků
Špičkový výkon napříč textem, obrazem i hlasem
Custom GPTs a bohaté API pro vývojáře
Multimodální — text, obrázky, hlas i video v jednom
Anthropic
Claude Opus 5 a Fable 5, MCP, Claude Code a Cowork — špička v kódování a agentech
Kódování, agentické workflow, právní a analytické dokumenty, bezpečné nasazení v firmách.
Modely
Claude Fable 5 — Nejschopnější veřejně dostupný model (třída Mythos) — 1M token kontext, špička v kódování i znalostní práci. Od 19. 7. 2026 v placených plánech přes usage kredity; API $10/$50 za 1M tokenů (nejdražší GA model na trhu)
Claude Mythos 5 — Stejný model bez dodatečných bezpečnostních klasifikátorů — dostupný pouze prověřeným organizacím (Project Glasswing)
Claude Opus 5 — Vlajkový model (24. 7. 2026) — složité agentické workflow, code review a strategické dokumenty; $5/$25 za 1M tokenů, dostupný v API, Claude.ai, Claude Code i Cowork
Claude Opus 4.8 — Předchozí vlajkový model — adaptivní reasoning, nadále dostupný
Claude Sonnet 5 — Nejlepší poměr cena/výkon — od 30. 6. 2026 výchozí model pro Free i Pro a doporučená volba pro většinu API úloh; 1M kontext, $2/$10 za 1M tokenů
Claude Sonnet 4.6 — Předchozí generace středního modelu — nadále dostupná, pro nové projekty už ale není doporučená
Claude Haiku 4.5 — Rychlý a levný model pro jednoduché úkoly a real-time aplikace
Extended Thinking — Adaptivní reasoning pro matematiku, logiku a komplexní úlohy — dostupné u Opus a Sonnet modelů
Claude Code — Specializovaný agent pro kódování přes CLI, desktop i mobil
Silné stránky
Claude Opus 5 (7/2026) — vlajkový model za rozumnou cenu ($5/$25 za 1M tokenů)
Špička v kódování a dlouhých dokumentech
Nejvyšší odolnost vůči prompt-injection (bezpečnost)
MCP protokol pro propojení s nástroji a daty — specifikace 2026-07-28 přinesla bezstavové jádro a silnější přihlašování (OAuth/OIDC); starší servery je potřeba upravit
Claude Code a Cowork pro agentickou práci
Claude Cowork má od 8/2026 vlastní vestavěný prohlížeč přímo v desktopové aplikaci — pro řadu webových úkolů už není potřeba rozšíření Claude pro Chrome.
Práce s velkými dokumenty, multimédii a uživatelé žijící v Google ekosystému (Gmail, Docs, Android).
Modely
Gemini 3.5 Pro (zatím nevydán) — Google ji cílil na 17. 7. 2026, ale k 8/2026 stále nevyšla — dle Googlu se testuje s vybranými partnery a vyjde, „až bude připravená“. Neoficiálně 2M token kontext a Deep Think vrstva
Gemini 3.7 Flash — Nejnovější vydaný model (GA 13. 8. 2026) — rychlá multimodální práce
Gemini 3.6 Flash — Vydán 21. 7. 2026 spolu s 3.5 Flash-Lite — rychlý model pro běžné úlohy
Gemini 3.5 Flash-Lite — Nejúspornější varianta Flash řady (GA 21. 7. 2026) — objemové a levné zpracování
Gemini 3.5 Flash — Výchozí model Gemini aplikace — rychlý, multimodální, skvělý poměr cena/výkon
Gemini 3.1 Pro — Nejsilnější Pro model dostupný v API (2/2026) — 1M token kontext, Deep Think mode, kód a multimodalita. Dokud nevyjde 3.5 Pro, je to vlajková volba
Gemini 3 Deep Think — Režim hlubokého uvažování pro matematiku, vědu a složité problémy
Gemini Omni — Nová generace generování videa se zvukem (nástupce Veo)
Nano Banana 2 — Aktuální model pro generování a editaci obrázků (gemini-3.1-flash-image, GA 28. 5. 2026) — 4K výstup, nástupce řady Imagen. Verze Lite a Pro pro levnější a prémiové nasazení
Lyria 3 Pro — Generování hudby z textového zadání
NotebookLM — Specializovaný produkt pro analýzu dokumentů a zdrojů
Gemini Embeddings — Embeddings pro RAG aplikace
Silné stránky
Obří kontextové okno pro rozsáhlé dokumenty
Hluboká integrace s Google Workspace a Androidem
Silné multimodální schopnosti (Veo na video, Imagen na obraz)
Velkorysý free tier
Mistral AI
Evropský open-weight LLM — GDPR, self-hosting, reasoning (Magistral), OCR a Agents API
Evropské firmy s důrazem na GDPR, self-hosting a datovou suverenitu; nákladově efektivní nasazení.
Modely
Mistral Large 3 — Vlajkový open-weight multimodální model s velkým kontextem — nejsilnější model Mistralu pro reasoning, analýzu i generování obsahu
Magistral — První reasoning model Mistralu (6/2025) — vícekrokové logické uvažování; Magistral Small je open-source (24B), Medium přes API
Mistral OCR 4 — Extrakce textu z dokumentů a obrázků (6/2026) — PDF, scany, faktury, 170 jazyků, bounding boxy; $4 za 1000 stran
Mistral Medium 3.5 — Vyvážený model pro firemní nasazení — výkon za nízkou cenu
Devstral 2 — Specializovaný model pro software development — coding + code review
Codestral — Rychlý coding model pro autocomplete — integrace ve VS Code a JetBrains
Mistral Small — Levný a rychlý model pro jednoduché úkoly
Mistral Embed — Embedding model pro RAG aplikace — jeden z nejlepších na trhu
Mistral Nemo — Multilingual model — výborný pro jazyky mimo angličtinu
Silné stránky
Evropský provider — GDPR a data v EU
Open-weight modely k self-hostingu
Konkurenceschopná cena a rychlost — reasoning i OCR modely za zlomek ceny konkurence
Vhodné pro firmy řešící suverenitu dat
Meta AI / Llama
Llama 4 open-weight + nová řada Muse od Superintelligence Labs
Vývojáři a firmy chtějící self-hosting, fine-tuning na vlastní data a nezávislost na cloudových providerech.
Modely
Muse Spark — První uzavřený frontier model Mety (8. 4. 2026, Meta Superintelligence Labs) — váhy nejsou veřejné. Zpočátku jen v aplikaci a na webu Meta AI plus v neveřejném API preview.
Muse Glimmer — Open-weight model, 30B parametrů, licence Apache 2.0 (10. 8. 2026). Určený pro lokální agenty — rozběhne se na jedné herní grafice s 24 GB paměti. Volnější licence než Llama 4.
Llama 4 Scout — Efektivní model pro zpracování textu a reasoning — 17B aktivních parametrů (MoE)
Llama 4 Maverick — Silnější model pro komplexní úkoly — multimodální
Llama 4 Behemoth — Ohlášen v 4/2025 jako největší Llama (288B aktivních parametrů), ale nikdy nevyšel — žádné veřejné váhy ani API. Meta mezitím přesunula vývoj nejsilnějších modelů k uzavřené řadě Muse.
Llama 3.3 70B — Stabilní a dobře testovaný model pro produkci
CodeLlama — Specializovaný model pro generování kódu
Silné stránky
Nejpopulárnější open-weight rodina (Llama)
Zdarma k použití i komerčně (dle licence)
Obří komunita, nástroje a fine-tuny
Plná kontrola při self-hostingu
xAI (Grok)
Grok 4.6 — real-time data z X, agresivní ceny API ($2/$6 za 1M tokenů)
Aktuální dění a research nad živými daty z X, levné agentické API úlohy, kódování s dobrým poměrem cena/výkon.
Modely
Grok 4.6 — Vlajkový model — kódování, agentické úlohy a znalostní práce; $2/$6 za 1M tokenů (cached vstup $0,50), kontext 500K
Grok 4.5 — Předchozí vlajková loď (8. 7. 2026) — kódování a agentické úlohy, dostupný i v Cursoru
Grok 4.3 — Předchozí vlajková loď (4/2026) — nativní video vstup, generování PDF/tabulek/prezentací, znalosti do 12/2025
Grok 4 mini — Levná a rychlá varianta pro objemové úlohy
Grok Imagine — Generování obrázků a krátkých videí v aplikaci Grok
Silné stránky
Real-time přístup k datům z X/Twitteru — aktuální dění bez zpoždění
Výrazně levné API — Grok 4.6 za $2/$6 na 1M tokenů (zlomek ceny špičky), 500K kontext
Nativní video vstup a generování dokumentů (PDF, tabulky, prezentace)
Konfigurovatelný reasoning effort — platíš jen za přemýšlení, které potřebuješ
DeepSeek
V4 — špičkový reasoning za zlomek ceny, open-weight, thinking mode
Nákladově efektivní reasoning a bulk zpracování přes API; self-hosting pro firmy, které chtějí špičkový open-weight model.
Modely
DeepSeek V4-Pro — Vlajkový model — 1M kontext, thinking mode, reasoning na úrovni špičky; stable verze ohlášena na 24. 7. 2026
DeepSeek V4-Flash — Levný a rychlý — $0.14/$0.28 za 1M tokenů, nejlevnější silný model na trhu
DeepSeek R2 — Reasoning řada — krokové uvažování pro matematiku a logiku
DeepSeek Coder — Specializace na kód — oblíbený v open-source komunitě
Silné stránky
Řádově nejlevnější silné modely — V4-Flash od $0.14/1M tokenů
Open-weight — možnost self-hostingu a plné kontroly nad daty
Reasoning (thinking mode) srovnatelný se západní špičkou
Aplikace i API zdarma/velmi levně — ideální na experimenty