Через публичный API Givon генерировались изображения и видео. Музыка и озвучка оставались только в интерфейсе, поэтому звуковую часть ролика приходилось доделывать руками.
Музыка и озвучка в контракте генерации
Контракт прежний: запрос уходит, возвращается идентификатор генерации, по нему опрашивается статус и забирается результат. Расширился список типов — к изображению и видео добавились музыка и озвучка.
Допустимые поля объявляет схема модели, доступная через GET /api/v1/models/{id}. Для музыки это стиль, текст песни, пол вокала и переключатель инструментала, для озвучки — текст, голос и манера подачи. Оценка стоимости возвращается до старта генерации.
Голоса и аватары доступны на чтение
Голоса и аватары — не модели, а ресурсы аккаунта, и до сих пор они существовали только внутри интерфейса. GET /api/v1/voices отдаёт склонированные голоса вместе с базовыми, GET /api/v1/avatars — аватаров Студии с их готовыми ракурсами.
В генерации они работают как обычные входы: идентификатор голоса передаётся в озвучку, снимки аватара — как референсы изображения или видео. Клонирование голоса и сборка аватара остаются в кабинете, наружу открыто использование.
MCP для AI-агентов
MCP — стандарт, по которому AI-агенты подключают внешние инструменты. Сервер Givon даёт агенту тот же набор действий, что и REST: найти модель, прочитать её схему, перечислить голоса и аватаров, запустить генерацию, проверить статус, узнать баланс.
Агент сам читает поля выбранной модели и формирует корректный запрос, поэтому параметры не зашиваются в код заранее.


