Kie AI MCP — генерация изображений для ИИ-агентов
До: чтобы сгенерировать изображение во время ИИ-сессии, приходилось выходить из диалога, открывать браузер и вручную вставлять результат обратно. После: Claude и другие MCP-совместимые агенты генерируют, опрашивают статус и сохраняют изображения прямо внутри сессии — от одного промпта до готового файла, без переключения контекста.

Стек
Задача
У ИИ-агентов, работающих с визуальным контентом, не было встроенного способа генерировать изображения. Каждый запрос требовал от пользователя открыть отдельный инструмент, вручную запустить генерацию, скачать результат и вернуть его обратно в диалог. Для процессов, где нужны десятки изображений — товарные фото, контент для соцсетей, пакетные иллюстрации — этот обходной путь становился узким местом.
Рассмотренные варианты
- Попросить Claude написать Python-скрипт — разовое и хрупкое решение, требующее от пользователя запускать код вне агента. Не подходит для повторяющихся процессов и нетехнических пользователей.
- Кастомный REST-бэкенд с эндпоинтом генерации изображений — работает, но требует запуска и поддержки сервера. Добавляет инфраструктурные накладные расходы там, где хватило бы одного бинарника.
- MCP-сервер, оборачивающий API Kie AI напрямую — выбранный вариант. Один бинарник на Go, никакого сервера для поддержки, нативная интеграция с Claude Desktop и Claude Code через протокол MCP.
Решение
Лёгкий MCP-сервер на Go предоставляет агенту пять инструментов: создать задачу, опросить её статус, сгенерировать и дождаться результата, а также запустить несколько генераций параллельно. Агент передаёт промпт и стиль, сервер выполняет вызов API, опрашивает статус до готовности изображения, скачивает его и записывает на диск — возвращая агенту путь к файлу.
Реализация
Сервер построен на mcp-go и взаимодействует с REST API Kie AI. Каждый инструмент чётко соответствует этапу жизненного цикла генерации: create_visual_task отправляет задачу и возвращает её ID, get_visual_task проверяет статус, а generate_visual объединяет оба шага в один блокирующий вызов. generate_visual_batch запускает несколько генераций параллельно с настраиваемым числом воркеров — полезно для пакетных контент-конвейеров.
Конфигурация полностью задаётся через переменные окружения — никаких конфигурационных файлов, .env в продакшене не требуется. Ключ API передаётся через блок env хоста MCP, оставаясь вне репозитория и вне логов вызовов инструментов. Каталог вывода, модель, интервал опроса и поведение HTTP-повторов настраиваются без перекомпиляции.
Результат
Генерация изображений стала полноценной операцией внутри сессии агента. Один вызов инструмента даёт готовый файл — агент может ссылаться на него, описывать его или передавать путь на следующий шаг процесса. Пакетный режим обрабатывает задачи с несколькими изображениями параллельно, сокращая общее время пропорционально числу воркеров.
Открыт для работы по контракту
Я доступен для работы по контракту. Если у вас есть интересная идея проекта — запишитесь на звонок через Calendly.
Записаться на 30-минутный звонок