# Akt 3: Vdechněte svému podcastu život 🎤 ![lab3](../../../../translated_images/cs/lab3.b009c55c4442250b.webp) ## Velké finále Zkoumali jste témata. Napsali scénáře. Teď přichází ta třešnička na dortu: proměnit váš text na skutečné podcastové audio s realistickými hlasy! Představujeme **VibeVoice** — otevřenou technologii TTS (text-na-řeč) od Microsoft Research, která vytváří: - 🎭 Přirozeně znějící konverzace - 👥 Více mluvčích (až 4!) - ⏱️ Dlouhé audio (až 90 minut!) - 🎵 Expresivní podání (žádné robotické hlasy!) Tohle je technologie za syntetickými podcasty. Pojďme vytvořit ten váš! ## Co je VibeVoice? (To fakt cool) VibeVoice je dar od Microsoft Research světu. Je navrženo speciálně pro podcastové konverzační audio. ### Proč je to skvělé 🔥 * **⏱️ Maratonské sezení**: Generuje až 90 minut nepřetržité řeči (to je celá epizoda podcastu!) * **👥 Kouzlo více mluvčích**: Až 4 různé hlasy s konzistentními osobnostmi * **⚡ Extra efektivní**: Používá ultra nízkou snímkovou frekvenci 7,5 Hz šetřící výpočetní výkon * **🧠 Chytré audio**: Kombinace LLM (rozumí kontextu) a difuzního modelu (vytváří realistické audio) * **🎭 Přirozený tok**: Automaticky řeší střídání, pauzy a rytmus konverzace **Překlad**: VibeVoice nečte váš scénář jen tak — *hraje* ho jako skuteční lidé, kteří mluví. --- ## Než začnete 🚀 **Co potřebujete**: * 🐍 **Python 3.10+** (už jej máte z Aktů 1 a 2) * 🚀 **uv** (rychlý správce balíčků pro Python — nainstalujeme jej) * 📝 **Váš scénář**: Soubor `podcast.txt` z Aktu 2 (v `../03.Application/`) **Tip pro profíky**: Tento krok vyžaduje dobré internetové připojení pro stažení předtrénovaného modelu. Dejte si kávu! ☕ --- ## Jdeme na to! Snadná cesta 🎬 Udělal jsme to opravdu jednoduché. Jeden shell skript zvládne vše. ### Proces 1. **Nastavte práva spustitelnosti**: ```bash chmod +x run_vibe_voice.sh ``` 2. **Spusťte ho**: ```bash ./run_vibe_voice.sh ``` 3. **Počkejte na kouzlo** (poprvé může trvat několik minut) ### Co se děje v zákulisí 🎭 Skript je vlastně váš automatizovaný zvukový inženýr: 1. **📥 Stáhne VibeVoice**: Naklonuje oficiální repozitář z GitHubu 2. **📦 Nainstaluje závislosti**: Používá `uv pip` pro bleskovou instalaci balíčků 3. **🎬 Generuje audio**: Spustí inferenční skript s: * `--model_path`: Předtrénovaný model VibeVoice-7B * `--txt_path`: Váš scénář `podcast.txt` * `--speaker_names`: Přidělí hlasy (standardně Xinran & Anchen) **Výsledek**: Váš scénář se promění v opravdovou epizodu podcastu! 🎉 --- ## Vaše mise 🎯 Udělejme to zajímavé: ### Úkol 1: Vytvořte obsah Upravte `../03.Application/podcast.txt` s konverzací mezi dvěma lidmi. Ať je to o technologiích, koníčcích, čemkoliv! Jen ať to zní jako skutečný rozhovor. **Příklad formátu**: ``` Speaker 1: Hey! Did you hear about the new AI model? Speaker 2: No way! Tell me more! Speaker 1: It's called... ``` ### Úkol 2: Generujte audio Spusťte skript a sledujte kouzlo. Poprvé to trvá déle (stahování modelu). ### Úkol 3: Poslouchejte a analyzujte - Zní to přirozeně? - Mají mluvčí odlišné hlasy? - Je střídání plynulé? - Jsou tam nějaké robotické momenty? ### Úkol 4: Experimentujte (pro odvážné) Upravte `run_vibe_voice.sh` a změňte `--speaker_names`, zkuste různé kombinace hlasů. VibeVoice má několik předtrénovaných hlasů! **Bonusová výzva**: Zkuste konverzaci se 3 mluvčími! 🎆 --- ## Naučte se víc 📚 * **🏠 Domovská stránka projektu**: [VibeVoice oficiální stránka](https://microsoft.github.io/VibeVoice/) * **🤗 Předtrénovaný model**: [Hugging Face - VibeVoice-7B](https://huggingface.co/vibevoice/VibeVoice-7B) * **📖 Výzkumný článek**: Ponořte se do technologie (pokud vás to zajímá) > **⚠️ Upozornění na odpovědné AI**: VibeVoice je mocný nástroj. Používejte jej eticky! Nevytvářejte deepfakes ani zavádějící obsah. Tvořte skvělé věci, které pomáhají lidem. 🙏 --- ## 🏆 Gratulujeme! Dokončili jste to! Právě jste dokončili celý proces: 1. ✅ **Akt 1**: Vytvořili AI agenty s vlastními nástroji 2. ✅ **Akt 2**: Zorganizovali workflow více agentů 3. ✅ **Akt 3**: Vygenerovali skutečné podcastové audio **Teď máte**: - Fungujícího AI asistenta pro výzkum - Kompletní produkční workflow podcastu - Skutečný audio soubor, který můžete sdílet ### Co dál? 🚀 **Spusťte svůj podcast!** - Nahrajte na podcastové platformy - Sdílejte na sociálních sítích - Vylepšujte a iterujte **Stále stavte dál!** - Zkoušejte různá témata - Experimentujte s více mluvčími - Přidejte podkresovou hudbu - Postavte webové rozhraní - Automatizujte celý proces **Sdílejte svou práci!** Označte nás! Ukážte světu, co jste vytvořili. Revoluce AI podcastů začíná u vás. 🎙️ --- **Otázky? Nápady? Příběhy o úspěchu?** Napište je do workshopového chatu! **Vítejte v budoucnosti tvorby obsahu.** 🌟 --- **Prohlášení o vyloučení odpovědnosti**: Tento dokument byl přeložen pomocí služby pro překlad s využitím umělé inteligence [Co-op Translator](https://github.com/Azure/co-op-translator). I když usilujeme o přesnost, mějte prosím na paměti, že automatizované překlady mohou obsahovat chyby nebo nepřesnosti. Původní dokument v jeho rodném jazyce by měl být považován za závazný zdroj. Pro důležité informace se doporučuje profesionální lidský překlad. Nejsme zodpovědní za jakékoliv nedorozumění nebo mylné výklady vyplývající z použití tohoto překladu.