Кейс

ActVoice

Доступная студия аудиоспектаклей: сцены, синтез речи, звуковые эффекты и серверная сборка через REST/MCP.

Активныйдоступность · аудио · AI

Аудиоспектакль из сцен, реплик и звуков

ActVoice — серверная студия аудиоспектаклей, рассчитанная на людей и ИИ-агентов. Человек работает через веб-интерфейс или API, агент — через MCP или REST API. В проекте задаются персонажи, сцены, реплики, фон и звуковые события; сервер собирает итоговое аудио.

Что описано в реализации

В README перечислены синтез речи через Edge TTS, локальный RHVoice и резервный переход с Edge на RHVoice. Проекты и задания хранятся в SQLite. После сборки доступны MP3, WAV и манифест с данными о голосах и времени реплик.

Звуки можно привязывать к началу сцены, её концу, моменту до или после реплики. Сервер измеряет длительность речи и рассчитывает положение звуков. Это позволяет менять реплики без ручного пересчёта всей временной шкалы.

Встроенная языковая модель для MVP не обязательна: агент может подготовить структуру снаружи. Режим с пользовательским ключом OpenAI в README отмечен как будущий, поэтому здесь он не заявлен как готовая функция.

Проект связан с проектированием ИИ-процессов, API-интеграциями и доступностью творческих инструментов. Описание архитектуры не заменяет проверку конкретной развёрнутой версии.

Источники

Ссылки

Связанные услуги