Озвучка, музыка, голоса и аватары — теперь через API и MCP

Музыка и озвучка запускаются через публичный API и MCP тем же запросом, что изображения и видео. Голоса аккаунта и аватары Студии стали доступны на чтение и подставляются в генерацию. Один ключ и один баланс токенов.

Через публичный API Givon генерировались изображения и видео. Музыка и озвучка оставались только в интерфейсе, поэтому звуковую часть ролика приходилось доделывать руками.

Музыка и озвучка в контракте генерации

Контракт прежний: запрос уходит, возвращается идентификатор генерации, по нему опрашивается статус и забирается результат. Расширился список типов — к изображению и видео добавились музыка и озвучка.

Допустимые поля объявляет схема модели, доступная через GET /api/v1/models/{id}. Для музыки это стиль, текст песни, пол вокала и переключатель инструментала, для озвучки — текст, голос и манера подачи. Оценка стоимости возвращается до старта генерации.

Голос дополняет кадр, а музыка задаёт ролику ритм.

Голоса и аватары доступны на чтение

Голоса и аватары — не модели, а ресурсы аккаунта, и до сих пор они существовали только внутри интерфейса. GET /api/v1/voices отдаёт склонированные голоса вместе с базовыми, GET /api/v1/avatars — аватаров Студии с их готовыми ракурсами.

В генерации они работают как обычные входы: идентификатор голоса передаётся в озвучку, снимки аватара — как референсы изображения или видео. Клонирование голоса и сборка аватара остаются в кабинете, наружу открыто использование.

MCP для AI-агентов

MCP — стандарт, по которому AI-агенты подключают внешние инструменты. Сервер Givon даёт агенту тот же набор действий, что и REST: найти модель, прочитать её схему, перечислить голоса и аватаров, запустить генерацию, проверить статус, узнать баланс.

Агент сам читает поля выбранной модели и формирует корректный запрос, поэтому параметры не зашиваются в код заранее.

Частые вопросы

Читай также