# Akt 3: Giv Din Podcast Liv 🎤 ![lab3](../../../../translated_images/da/lab3.b009c55c4442250b.webp) ## Den Store Finale Du har forsket i emner. Du har skrevet manuskripter. Nu til prikken over i’et: at omdanne din tekst til ægte podcasteksempel med realistiske stemmer! Mød **VibeVoice** — Microsoft Researchs open source TTS (tekst-til-tale) magi, der skaber: - 🎭 Naturligt klingende samtaler - 👥 Flere talere (op til 4!) - ⏱️ Langformet lyd (op til 90 minutter!) - 🎵 Udtryksfuld levering (ikke robotstemmer!) Dette er teknologien bag syntetiske podcasts. Lad os lave din! ## Hvad er VibeVoice? (Det Seje) VibeVoice er Microsoft Researchs gave til verden. Det er specielt designet til podkast-lignende samtale-lyd. ### Hvorfor det er fedt 🔥 * **⏱️ Marathon Sessions**: Genererer op til 90 minutters kontinuerlig tale (det er en hel episode!) * **👥 Multi-Taler Magi**: Op til 4 forskellige stemmer med konsistente personligheder * **⚡ Utrolig effektiv**: Bruger ultralav 7,5 Hz rammefrekvens for at spare beregningskraft * **🧠 Smart Lyd**: Kombinerer en LLM (forstår kontekst) med en diffusionsmodel (skaber realistisk lyd) * **🎭 Naturlig Flow**: Håndterer taletur, pauser og samtalerytme automatisk **Oversættelse**: VibeVoice læser ikke bare dit manuskript — det *optræder* som rigtige mennesker der taler. --- ## Før Du Begynder 🚀 **Det du skal bruge**: * 🐍 **Python 3.10+** (det har du allerede fra Akt 1 & 2) * 🚀 **uv** (en hurtig Python pakkehåndtering — den installerer vi) * 📝 **Dit Manuskript**: Filen `podcast.txt` fra Akt 2 (i `../03.Application/`) **Tip**: Dette trin kræver en god internetforbindelse til at downloade den præ-trænede model. Tag en kop kaffe! ☕ --- ## Lad os køre! Den nemme måde 🎬 Vi har gjort det idiot-sikkert. Ét shell-script klarer det hele. ### Processen 1. **Gør det eksekverbart**: ```bash chmod +x run_vibe_voice.sh ``` 2. **Kør det**: ```bash ./run_vibe_voice.sh ``` 3. **Vent på magien** (det kan tage et par minutter første gang) ### Hvad sker der bag kulisserne 🎭 Scriptet er grundlæggende din automatiserede lydtekniker: 1. **📥 Downloader VibeVoice**: Kloner den officielle repo fra GitHub 2. **📦 Installerer afhængigheder**: Bruger `uv pip` for lynhurtig pakkeinstallation 3. **🎬 Genererer lyd**: Kører inferensscriptet med: * `--model_path`: Den præ-trænede VibeVoice-7B model * `--txt_path`: Dit `podcast.txt` manuskript * `--speaker_names`: Tildeler stemmer (Xinran & Anchen som standard) **Resultat**: Dit manuskript bliver en rigtig podcastepisode! 🎉 --- ## Din Mission 🎯 Lad os gøre det interessant: ### Opgave 1: Lav Indhold Rediger `../03.Application/podcast.txt` med en samtale mellem to personer. Lad det handle om tech, hobbyer, hvad som helst! Bare gør det samtalende. **Format Eksempel**: ``` Speaker 1: Hey! Did you hear about the new AI model? Speaker 2: No way! Tell me more! Speaker 1: It's called... ``` ### Opgave 2: Generer Lyd Kør scriptet og se magien ske. Første gang tager det længere tid (download af modellen). ### Opgave 3: Lyt & Analyser - Lyder det naturligt? - Har talerne forskellige stemmer? - Er turtagningen glidende? - Er der robot-øjeblikke? ### Opgave 4: Eksperimenter (for de modige) Rediger `run_vibe_voice.sh` og skift `--speaker_names` for at prøve forskellige stemmekombinationer. VibeVoice har flere præ-trænede stemmer! **Bonusudfordring**: Prøv en samtale med 3 talere! 🎆 --- ## Lær Mere 📚 * **🏠 Projekt Hjemmeside**: [VibeVoice Officiel Side](https://microsoft.github.io/VibeVoice/) * **🤗 Præ-trænet Model**: [Hugging Face - VibeVoice-7B](https://huggingface.co/vibevoice/VibeVoice-7B) * **📖 Forskningsartikel**: Dyk dybt ned i teknologien (hvis det interesserer dig) > **⚠️ Ansvarlig AI påmindelse**: VibeVoice er kraftfuldt. Brug det etisk! Skab ikke deepfakes eller vildledende indhold. Lav seje ting der hjælper folk. 🙏 --- ## 🏆 Tillykke! Du Klarer Det! Du har lige fuldført hele forløbet: 1. ✅ **Akt 1**: Byggede AI-agenter med brugerdefinerede værktøjer 2. ✅ **Akt 2**: Orkestrerede et multi-agent workflow 3. ✅ **Akt 3**: Genererede ægte podcasteksempel **Du har nu**: - En fungerende AI forskningsassistent - Et fuldt podcast produktionsworkflow - En reel lydfil du kan dele ### Hvad nu? 🚀 **Start din podcast!** - Upload til podcastplatforme - Del på sociale medier - Iterér og forbedr **Bliv ved med at bygge!** - Prøv forskellige emner - Eksperimentér med flere talere - Tilføj baggrundsmusik - Byg et webinterface - Automatiser det hele **Del dit arbejde!** Tag os! Vis verden hvad du har bygget. AI podcast revolutionen starter med dig. 🎙️ --- **Spørgsmål? Ideer? Succeshistorier?** Smid dem i workshop-chatten! **Velkommen til fremtidens indholdsskabelse.** 🌟 --- **Ansvarsfraskrivelse**: Dette dokument er oversat ved hjælp af AI-oversættelsestjenesten [Co-op Translator](https://github.com/Azure/co-op-translator). Selvom vi bestræber os på nøjagtighed, bedes du være opmærksom på, at automatiserede oversættelser kan indeholde fejl eller unøjagtigheder. Det oprindelige dokument på dets modersmål bør betragtes som den autoritative kilde. For kritisk information anbefales professionel menneskelig oversættelse. Vi er ikke ansvarlige for misforståelser eller fejltolkninger, der opstår som følge af brugen af denne oversættelse.