Firma Plaud představila limitovanou edici sluchátek Plaud One Explorer Edition za 249,99 USD. Zařízení umí nahrávat konverzace, přepisovat je a shrnovat pomocí AI, a to i offline díky vestavěné 4G eSIM v nabíjecím pouzdře.
Google 26. srpna 2026 oznámil nový model pro převod řeči na text s názvem Gemini 3.5 Transcribe, zatím ve veřejné preview fázi. Model nahrazuje starší Chirp 3, zvládá přes 85 jazyků a míří i do Chromu.
Adobe zpřístupnilo tři nové AI nástroje pro práci se zvukem přímo ve Firefly. Zároveň platforma přivítala Google Gemini Omni Flash jako další dostupný model.
Suno vydalo verzi Studio 2.0 s podporou MIDI, vlastními efekty a chatbotem pro úpravy. Generátor hudby se tím přibližuje plnohodnotnému hudebnímu softwaru a reaguje na nejžádanější funkci od uživatelů.
OpenAI popsalo, jak funguje GPT Live — hlasový režim ChatGPT, který průběžně poslouchá a nečeká na pevný signál konce věty. Vývoj od návrhu po nasazení trval šest měsíců. Ukazujeme, jak funkci vyzkoušet a kdy se naopak nehodí.
Čínská firma ByteDance zveřejnila model Seedance 2.5, který umí vytvořit video i se zvukem v jednom kroku. Klipy mohou trvat až 30 sekund, což je třikrát více než u srovnatelného modelu od Googlu. Nástroj cílí zejména na týmy tvořící reklamní obsah.
Google vydal nový hudební model Lyria 3.5 a integroval ho do nástroje Google Flow Music. Klíčová novinka zvaná Selective Section Painting dovoluje upravit konkrétní úsek skladby, aniž by se muselo začínat od nuly.
OpenAI přidalo do svého API dva nové modely pro rozpoznávání řeči — GPT Transcribe a GPT Live Transcribe. Oproti předchůdci Whisper jsou přesnější, jenže ElevenLabs, Google ani Mistral zatím nepřekonaly.
Hlasové modely se za poslední rok zrychlily natolik, že diskrétní gesto na prstu stačí ke spuštění plnohodnotného AI asistenta. Ukazujeme, jak si takové propojení sestavit už dnes a kde jsou jeho limity.
Anthropic rozšiřuje hlasový režim svého AI asistenta Claude na výkonnější modely Opus a Sonnet. Dosud byl k dispozici jen u rychlejšího, ale méně schopného Haiku. Novinka zároveň přináší integraci do populárních aplikací, jako jsou Gmail, Slack nebo Canva.
Hudebník 1010Benja použil AI nástroj Suno k vytvoření skladby, která zaujala i novináře skeptické vůči generativní hudbě. Je to důkaz, že AI hudba konečně dospívá?
Podle amerického serveru Bloomberg pracuje OpenAI na svém prvním fyzickém zařízení — chytrém reproduktoru, který umožní hlasový rozhovor s ChatGPT. Přístroj by mohl dorazit ještě letos a od konkurence ho má odlišovat kamera a senzory schopné vnímat okolní prostředí.
OpenAI spustilo novou generaci hlasových modelů nazvanou GPT-Live, která pohání funkci ChatGPT Voice. Rozhovor s umělou inteligencí by měl být přirozenější, plynulejší a blíže skutečnému lidskému dialogu.
OpenAI vydalo aktualizované hlasové modely, které zvládají simultánní mluvení i poslouchání. Díky tomu se konverzace s AI přibližuje přirozenému lidskému dialogu a otevírají se dveře pro živý překlad v reálném čase.
Apple v betaverzi iOS 27 přidává dva nové posuvníky pro hlas Siri — tempo řeči a expresivitu. Jde o první krok k personalizovanému hlasovému asistentovi postaveném na generativní AI.
Od generování záběrů přes realistický hlas až po finální střih — AI dnes zvládne většinu kroků při tvorbě videa. Přinášíme přehled hlavních nástrojů, konkrétní postup a popis situací, kdy AI nestačí.