# Акт 3: Оживіть свій подкаст 🎤 ![lab3](../../../../translated_images/uk/lab3.b009c55c4442250b.webp) ## Великий фінал Ви дослідили теми. Ви написали сценарії. Тепер — родзинка на торті: перетворення тексту в справжнє аудіо подкасту з реалістичними голосами! Зустрічайте **VibeVoice** — магія текст-в-мову з відкритим кодом від Microsoft Research, яка створює: - 🎭 Натуральні розмови - 👥 Кілька дикторів (до 4-х!) - ⏱️ Довге аудіо (до 90 хвилин!) - 🎵 Експресивне виконання (без роботоподібних голосів!) Це технологія за синтетичними подкастами. Зробимо ваш! ## Що таке VibeVoice? (Круті штуки) VibeVoice — подарунок від Microsoft Research світу. Спеціально розроблений для аудіо у стилі подкастів з діалогами. ### Чому це круто 🔥 * **⏱️ Марфонські сесії**: Створює до 90 хвилин безперервної мови (повний епізод подкасту!) * **👥 Магія кількох дикторів**: До 4 різних голосів з узгодженими характерами * **⚡ Надзвичайно ефективний**: Використовує ультранизьку частоту кадрів 7,5 Гц для економії обчислювальних ресурсів * **🧠 Розумне аудіо**: Поєднує LLM (розуміє контекст) з дифузійною моделлю (створює реалістичне аудіо) * **🎭 Натуральний потік**: Автоматично опрацьовує черговість говоріння, паузи та ритм бесіди **Переклад**: VibeVoice не просто читає ваш сценарій — воно *виконує* його як справжні люди. --- ## Перед тим, як почати 🚀 **Що потрібно**: * 🐍 **Python 3.10+** (вже маєте з Актів 1 і 2) * 🚀 **uv** (швидкий менеджер пакетів для Python — ми його встановимо) * 📝 **Ваш сценарій**: файл `podcast.txt` з Акта 2 (в `../03.Application/`) **Порада**: Цей крок вимагає хорошого інтернет-з’єднання для завантаження попередньо навчену модель. Візьміть каву! ☕ --- ## Поїхали! Легкий спосіб 🎬 Ми зробили це дуже просто. Один shell скрипт робить усе. ### Процес 1. **Зробити скрипт виконуваним**: ```bash chmod +x run_vibe_voice.sh ``` 2. **Запустити його**: ```bash ./run_vibe_voice.sh ``` 3. **Чекати на магію** (перший запуск може зайняти кілька хвилин) ### Що відбувається за лаштунками 🎭 Скрипт — це ваш автоматизований звукорежисер: 1. **📥 Скачує VibeVoice**: Клонує офіційний репозиторій з GitHub 2. **📦 Встановлює залежності**: Використовує `uv pip` для дуже швидкого встановлення пакетів 3. **🎬 Генерує аудіо**: Запускає скрипт інференсу з параметрами: * `--model_path`: Попередньо натренована модель VibeVoice-7B * `--txt_path`: Ваш сценарій `podcast.txt` * `--speaker_names`: Призначає голоси (за замовчуванням Xinran & Anchen) **Результат**: Ваш сценарій стає справжнім епізодом подкасту! 🎉 --- ## Ваше завдання 🎯 Давайте зробимо це цікавішим: ### Завдання 1: Створіть вміст Відредагуйте `../03.Application/podcast.txt` з розмовою між двома людьми. Про технології, хобі, що завгодно! Головне — щоб було у стилі діалогу. **Приклад формату**: ``` Speaker 1: Hey! Did you hear about the new AI model? Speaker 2: No way! Tell me more! Speaker 1: It's called... ``` ### Завдання 2: Згенеруйте аудіо Запустіть скрипт і спостерігайте за магією. Перший раз займе довше (завантаження моделі). ### Завдання 3: Послухайте та проаналізуйте - Звучить натурально? - Чи мають диктори відмінні голоси? - Чи плавно відбувається черговість говоріння? - Чи були якісь роботоподібні моменти? ### Завдання 4: Експериментуйте (для сміливих) Відредагуйте `run_vibe_voice.sh` і змініть `--speaker_names`, щоб спробувати різні комбінації голосів. У VibeVoice є багато попередньо навчених голосів! **Бонус Виклик**: Спробуйте розмову трьох дикторів! 🎆 --- ## Дізнайтеся більше 📚 * **🏠 Головна сторінка проекту**: [Офіційний сайт VibeVoice](https://microsoft.github.io/VibeVoice/) * **🤗 Попередньо натренована модель**: [Hugging Face - VibeVoice-7B](https://huggingface.co/vibevoice/VibeVoice-7B) * **📖 Наукова стаття**: Заглибтеся у технології (якщо це вам цікаво) > **⚠️ Нагадування про відповідальне використання ШІ**: VibeVoice – потужний інструмент. Використовуйте його етично! Не створюйте дипфейки чи оманливий контент. Створюйте круті речі, які допомагають людям. 🙏 --- ## 🏆 Вітаємо! Ви зробили це! Ви щойно пройшли повний процес: 1. ✅ **Акт 1**: Побудували AI-агентів із власними інструментами 2. ✅ **Акт 2**: Налаштували роботу кількох агентів 3. ✅ **Акт 3**: Згенерували справжнє аудіо подкасту **Тепер у вас є**: - Робочий AI-дослідницький помічник - Повний робочий процес створення подкасту - Реальний аудіофайл, яким можна поділитися ### Що далі? 🚀 **Запускайте свій подкаст!** - Завантажуйте на платформи подкастів - Діліться в соцмережах - Вдосконалюйте та розвивайтесь **Продовжуйте будувати!** - Спробуйте інші теми - Експериментуйте з більшою кількістю дикторів - Додайте фонову музику - Створіть веб-інтерфейс - Автоматизуйте все **Діліться своєю роботою!** Відмічайте нас! Показуйте світу, що ви створили. Революція AI-подкастів починається з вас. 🎙️ --- **Питання? Ідеї? Історії успіху?** Пишіть у чат воркшопу! **Ласкаво просимо у майбутнє створення контенту.** 🌟 --- **Відмова від відповідальності**: Цей документ був перекладений за допомогою сервісу автоматичного перекладу [Co-op Translator](https://github.com/Azure/co-op-translator). Хоч ми і прагнемо до точності, будь ласка, майте на увазі, що автоматичний переклад може містити помилки чи неточності. Оригінальний документ рідною мовою слід вважати авторитетним джерелом. Для критичної інформації рекомендується звертатися до професійного людського перекладу. Ми не несемо відповідальності за будь-які непорозуміння або неправильні тлумачення, що виникли внаслідок використання цього перекладу.