# Babak 3: Hidupkan Podcast Anda 🎤 ![lab3](../../../../translated_images/ms/lab3.b009c55c4442250b.webp) ## Penamat Hebat Anda sudah meneliti topik. Anda sudah menulis skrip. Kini untuk kemuncak: menukar teks anda menjadi audio podcast sebenar dengan suara yang realistik! Masuk **VibeVoice** — sihir TTS (text-to-speech) sumber terbuka Microsoft Research yang mencipta: - 🎭 Perbualan yang kedengaran semula jadi - 👥 Pelbagai pencerita (sehingga 4!) - ⏱️ Audio bentuk panjang (sehingga 90 minit!) - 🎵 Penyampaian ekspresif (bukan suara robot!) Ini adalah teknologi di sebalik podcast sintetik. Mari buat podcast anda! ## Apa Itu VibeVoice? (Perkara Hebat) VibeVoice adalah hadiah daripada Microsoft Research kepada dunia. Ia direka khas untuk audio perbualan gaya podcast. ### Kenapa Ia Hebat 🔥 * **⏱️ Sesi Maraton**: Menjana sehingga 90 minit ucapan berterusan (itu satu episod penuh podcast!) * **👥 Magik Pelbagai Pencerita**: Sehingga 4 suara berbeza dengan personaliti konsisten * **⚡ Sangat Efisien**: Menggunakan kadar bingkai ultra-rendah 7.5 Hz untuk menjimatkan kuasa pengkomputeran * **🧠 Audio Pintar**: Menggabungkan LLM (faham konteks) dengan model difusi (mencipta audio realistik) * **🎭 Aliran Semula Jadi**: Mengurus giliran bercakap, jeda, dan irama perbualan secara automatik **Terjemahan**: VibeVoice bukan sekadar membaca skrip anda — ia *mempersembahkan* seperti orang sebenar bercakap. --- ## Sebelum Anda Mula 🚀 **Apa yang Anda Perlukan**: * 🐍 **Python 3.10+** (anda sudah ada dari Babak 1 & 2) * 🚀 **uv** (pengurus pakej Python yang pantas — kita akan pasang) * 📝 **Skrip Anda**: Fail `podcast.txt` dari Babak 2 (dalam `../03.Application/`) **Tip Pro**: Langkah ini memerlukan sambungan internet yang baik untuk memuat turun model terlatih. Habis kopi dulu! ☕ --- ## Jom Mulakan! Cara Mudah 🎬 Kami telah permudahkan proses ini. Satu skrip shell buat semuanya. ### Prosesnya 1. **Beri kebenaran laku**: ```bash chmod +x run_vibe_voice.sh ``` 2. **Jalankan**: ```bash ./run_vibe_voice.sh ``` 3. **Tunggu keajaiban** (ini mungkin ambil masa beberapa minit buat pertama kali) ### Apa yang Berlaku Di Sebalik Tabir 🎭 Skrip ini adalah jurutera bunyi automatik anda: 1. **📥 Muat turun VibeVoice**: Klon repositori rasmi dari GitHub 2. **📦 Pasang Kebergantungan**: Guna `uv pip` untuk pemasangan pakej pantas 3. **🎬 Jana Audio**: Jalankan skrip inferens dengan: * `--model_path`: Model VibeVoice-7B yang telah dilatih * `--txt_path`: Skrip `podcast.txt` anda * `--speaker_names`: Tetapkan suara (Xinran & Anchen secara lalai) **Hasil**: Skrip anda menjadi episod podcast sebenar! 🎉 --- ## Misi Anda 🎯 Mari buat ini menarik: ### Tugasan 1: Cipta Kandungan Sunting `../03.Application/podcast.txt` dengan perbualan antara dua orang. Boleh tentang teknologi, hobi, apa saja! Pastikan ia seperti perbualan. **Contoh Format**: ``` Speaker 1: Hey! Did you hear about the new AI model? Speaker 2: No way! Tell me more! Speaker 1: It's called... ``` ### Tugasan 2: Jana Audio Jalankan skrip dan saksikan keajaiban berlaku. Kali pertama akan ambil masa lebih lama (memuat turun model). ### Tugasan 3: Dengar & Analisa - Adakah ia kedengaran semula jadi? - Adakah pencerita ada suara yang berbeza? - Adakah giliran bercakap berjalan lancar? - Ada saat robotik ke? ### Tugasan 4: Eksperimen (Untuk Berani) Sunting `run_vibe_voice.sh` dan tukar `--speaker_names` untuk cuba kombinasi suara berbeza. VibeVoice ada banyak suara terlatih! **Cabaran Bonus**: Cuba perbualan 3 pencerita! 🎆 --- ## Ketahui Lebih Lanjut 📚 * **🏠 Laman Projek**: [Laman Rasmi VibeVoice](https://microsoft.github.io/VibeVoice/) * **🤗 Model Terlatih**: [Hugging Face - VibeVoice-7B](https://huggingface.co/vibevoice/VibeVoice-7B) * **📖 Kertas Penyelidikan**: Selami teknologi ini (jika anda berminat) > **⚠️ Peringatan AI Bertanggungjawab**: VibeVoice sangat berkuasa. Guna dengan etika! Jangan cipta deepfake atau kandungan yang menipu. Cipta karya hebat yang membantu orang. 🙏 --- ## 🏆 Tahniah! Anda Berjaya! Anda baru sahaja menyelesaikan keseluruhan proses: 1. ✅ **Babak 1**: Bina agen AI dengan alat khusus 2. ✅ **Babak 2**: Kewangannya aliran kerja multi-agen 3. ✅ **Babak 3**: Jana audio podcast sebenar **Anda kini ada**: - Pembantu penyelidik AI berfungsi - Aliran kerja penuh penghasilan podcast - Fail audio sebenar yang boleh dikongsi ### Apa Seterusnya? 🚀 **Lancarkan podcast anda!** - Muat naik ke platform podcast - Kongsi di media sosial - Ulang dan perbaiki **Teruskan membina!** - Cuba topik berbeza - Eksperimen dengan lebih pencerita - Tambah muzik latar - Bangunkan antara muka web - Automatikkan keseluruhan proses **Kongsi hasil kerja anda!** Tag kami! Tunjukkan dunia apa yang anda bina. Revolusi podcast AI bermula dengan anda. 🎙️ --- **Soalan? Idea? Cerita kejayaan?** Kongsi dalam sembang bengkel! **Selamat datang ke masa depan penciptaan kandungan.** 🌟 --- **Penafian**: Dokumen ini telah diterjemahkan menggunakan perkhidmatan terjemahan AI [Co-op Translator](https://github.com/Azure/co-op-translator). Walaupun kami berusaha untuk ketepatan, sila ambil perhatian bahawa terjemahan automatik mungkin mengandungi kesilapan atau ketidaktepatan. Dokumen asal dalam bahasa asalnya harus dianggap sebagai sumber yang sahih. Untuk maklumat penting, terjemahan profesional oleh manusia adalah disyorkan. Kami tidak bertanggungjawab atas sebarang salah faham atau tafsiran yang salah yang timbul daripada penggunaan terjemahan ini.