Vizgen
Визуальный редактор для работы с контентом: генерация карточек товара, визуализация и апскейл — доставляется через REST API.
Vizgen — подробно
Vizgen — не генератор фото кухонь и не обёртка над одной AI-моделью, а платформа, на которой можно собрать свой конвейер генерации визуального контента: от точечной обработки фото (удалить фон, поменять размер под площадку) до многошаговых цепочек, где на каждом узле выбирается своя модель, своё качество и своя длительность (для видео), а промпт можно написать и переписать вручную. Готовый результат не заканчивает цепочку — его можно тут же продолжить собирать в карточку товара для интернет-магазина или маркетплейса, в отдельном canvas-редакторе, похожем на Figma. Каждую собранную цепочку можно сохранить как свой кейс и запускать повторно без пересборки заново.
Кухонный пайплайн — тот, с которого Vizgen начинался, — в платформе остался, но как один из шести преднастроенных кейсов-примеров, а не тема продукта. Рядом с ним — мебель для каталога, фэшн-съёмка на модели, интерьеры с декором, оживление кадра в видео и свободная генерация по тексту.
Задача
У бизнеса, который регулярно производит визуальный контент, редко есть одна задача — обычно их несколько одновременно: карточка товара, фото коллекции на модели, визуализация интерьера, короткое рекламное видео, сама карточка для маркетплейса с описанием. Под каждую задачу обычно свой инструмент, своя подписка, свой человек, который умеет им пользоваться — и результат одного шага не переиспользуется в следующем.
Даже внутри одной задачи генерация — не финал. Сырое изображение почти всегда нужно доработать: убрать фон, вписать в нужные пропорции под конкретную площадку, зеркально отразить. Дальше это изображение нужно превратить в карточку — с текстом, ценником, версткой под маркетплейс или сайт. Обычно это снова отдельный редактор и ручная сборка.
Третья часть задачи — выбор модели. Для фотореалистичного изображения нужна одна модель, для сохранения лица человека на разных ракурсах — другая, для видео важны конкретная длительность и разрешение, которые не все модели поддерживают одинаково и которые напрямую влияют на цену генерации. Без интерфейса, где это можно выбрать осознанно, пользователь либо берёт первую попавшуюся модель, либо не может настроить сценарий под свою задачу вообще.
Решение
Общая идея: не один жёсткий пайплайн, а конструктор из атомарных узлов генерации, которые пользователь (или готовый шаблон) соединяет в цепочку.
Источник (фото или текст) → узел за узлом: генерация / описание / удаление фона / видео → результат → при желании — сразу в редактор карточек → сохранение цепочки как своего кейса.
Каждый узел — это самостоятельный шаг с собственными настройками: какая модель, какое качество, для видео — какая длительность и разрешение, какой промпт. Цепочки можно собирать с нуля в визуальном нод-редакторе или взять один из готовых кейсов-примеров, запустить как есть или открыть как редактируемый граф и подстроить под себя. Результат генерации можно одним действием отправить в отдельный canvas-редактор карточек и уже там собрать раскладку для маркетплейса. Любую собранную цепочку можно сохранить как своё решение и запускать повторно без пересборки.
Как работает
Нод-редактор — конструктор цепочки генерации
Цепочка собирается из блоков: исходное фото или текст → генерация изображения → описание картинки текстом → видео по кадру → результат. У каждого блока свой выбор модели и формата, а общие настройки задаются один раз на всю цепочку — промпт не превращается в одну длинную нечитаемую простыню.
Готовые решения и личные кейсы
Для типовых задач есть каталог готовых цепочек:
- Фотореалистичная картинка — генерация по текстовому описанию.
- Фэшн — по фото вещи новая модель в этой одежде в трёх ракурсах.
- Кухни — рендер превращается в фотореалистичную визуализацию.
- Мебель для каталога — удаление фона и чистый студийный фон под маркетплейс.
- Интерьеры — улучшение света и ненавязчивый декор.
- Карточки для маркетплейса — изображение товара и готовое описание по фото.
- Оживить кадр — короткое видео из статичного изображения.
Любую готовую цепочку можно поменять перед запуском, а свою — сохранить и запускать повторно без захода в редактор.
От картинки — к карточке товара
Результат генерации одной кнопкой переносится в редактор карточек, где собирается макет: фон, слои, текст. Скачивать картинку и загружать её в другой инструмент не нужно.
Обработка фото как отдельный инструмент
Удаление фона, отражение и ресайз под формат площадки доступны в любой генерации. Ресайз точный, без нейросетевой дорисовки — под пропорции маркетплейса, соцсети или сайта.
Видео
Пользователь выбирает модель, качество, пропорции, длительность и звук, пишет промпт. Видео строится по одному кадру или по паре «первый — последний кадр», если модель это умеет. Готовый ролик сохраняется в хранилище платформы.
Контроль качества для кухонь
В кухонном сценарии результат дополнительно проверяет vision-модель: совпадают ли планировка и цвета с исходным рендером, не сдвинулась ли мойка или техника. По тому же анализу автоматически пишется продающее описание кухни.
API для внешних сервисов
Возможности платформы доступны через REST API по ключу: внешняя система отправляет задачу и получает результат. Внутри — очередь генераций, лимиты, кредиты и учёт себестоимости каждой генерации. Подтверждённый внешний клиент API на сегодня — сервис проектирования кухонь.
Ключевые особенности
Конструктор, а не один сценарий. Атомарные узлы генерации (текст→фото, фото→фото, описание, видео, удаление фона) собираются в любую цепочку — кухни, мебель, фэшн и видео работают на одних и тех же строительных блоках, а не на разных пайплайнах.
Модель, качество и длительность выбираются на каждом шаге. Для изображения — модель и разрешение, для видео — ещё и длительность, звук и режим кадра; список моделей и их реальные ограничения подтягиваются от провайдера, а не зашиты статично.
Готовые кейсы под конкретные сферы. Шесть преднастроенных примеров — мебель, фэшн, интерьеры, кухни, видео, свободная генерация — можно запустить как есть или открыть как редактируемый граф.
Генерация продолжается сборкой карточки. Результат из нод-редактора одной кнопкой попадает в отдельный canvas-редактор карточек — верстка товарной карточки для маркетплейса делается сразу поверх сгенерированного изображения, без ручного экспорта.
Цепочка сохраняется и переиспользуется. Любую собранную или доработанную цепочку можно сохранить как своё решение и запускать снова без повторной сборки; видно, из какого каталожного примера она произошла, если так и было.
Обработка фото — общий инструмент платформы. Удаление фона и ресайз под формат площадки доступны в любой цепочке, а не только в кухонном пайплайне.
Функциональность доступна как встраиваемый API — задача уходит в очередь, результат приходит по callback; подтверждено реальной интеграцией.
Техническая реализация
Backend — FastAPI поверх PostgreSQL, модульно разложен по прикладным доменам (генерация изображений, видео, нод-цепочки, редактор карточек, каталог мебельных модулей, кредиты, контент-операции, админка, внешние интеграции) — не один монолитный пайплайн, а набор соседних приложений на общей инфраструктуре очереди и авторизации.
Нод-редактор построен на React Flow, редактор карточек — на Konva/react-konva; это два разных canvas-инструмента, соединённых явной передачей результата (сгенерированное изображение становится шаблоном карточки по нажатию кнопки, а не общим состоянием одного холста). Сохранённые цепочки хранятся в базе с флагом «это личное решение» и ссылкой на исходный каталожный пример, если цепочка была из него склонирована, — так и в БД, и в интерфейсе видно происхождение переиспользуемого кейса.
Слой интеграции с AI-провайдерами вынесен отдельно от бизнес-логики узлов: за выбором модели в узле стоит абстракция, которая ходит к нужному провайдеру (основной шлюз изображений, отдельный шлюз видео, вспомогательный провайдер для экспериментальных моделей) — смена или деградация одного провайдера не требует переписывания пайплайнов поверх него.
Постобработка изображения (удаление фона, зеркало, ресайз) — параметры на уровне обычного запроса генерации, а не отдельная кухонная ветка кода, поэтому доступна из любого узла и любого кейса.
Кухонный пайплайн и его vision-контроль качества остаются отдельным, наиболее зрелым прикладным модулем поверх той же платформы — с собственным двухшаговым сценарием (materialize + decor) и накопительным логом оценок качества.
Очередь генераций реализована прямо в базе — задачи разбираются несколькими воркерами параллельно без отдельного брокера сообщений. Авторизация — на JWT, финансовая аналитика в админ-панели считается на уровне отдельной генерации.
Персональная настройка сейчас реализована на уровне аккаунта и его цепочек — слои промптов, личные сохранённые решения; отдельный разворачиваемый контур под конкретного B2B-клиента, сверх мультитенантности по API-ключу, в продукте пока не выделен.
Технологический стек
Backend: FastAPI (Python) — backend и REST API; SQLAlchemy + Alembic — данные и миграции; PostgreSQL — хранение, очередь, кредиты, цепочки, карточки; httpx — запросы к AI-провайдерам; Pillow — ресайз и кроп изображений; rembg (U²-Net, alpha matting) — удаление фона как самостоятельный строительный блок; JWT — авторизация; boto3 — объектное хранилище медиа.
Frontend: Next.js + React — веб-интерфейс; TanStack Query — серверное состояние и кэш; Zustand — клиентское состояние; React Flow (@xyflow/react) — нод-редактор цепочек генерации; Konva / react-konva — отдельный canvas-редактор карточек товара.
AI/ML: Flux 2 Pro (black-forest-labs/flux.2-pro, через OpenRouter) — основная фотореалистичная генерация, в том числе кухонный и большинство кейсов-примеров; self-hosted Flux (schnell) — модель по умолчанию для свободной генерации по тексту, без внешней стоимости за запрос; Gemini 2.5 Flash — vision-контроль качества и анализ состава кухни; Gemini 3.1 Flash Image — генерация фэшн-модели с сохранением личности между ракурсами; DeepSeek — продающие тексты по извлечённым данным; GPT-4.1 mini — генерация и валидация SEO-контента; видео-модели через отдельный видео-шлюз OpenRouter — каталог запрашивается динамически (в примерах кейса — Seedance 2.0 Fast как самая дешёвая image-to-video модель по умолчанию); fal.ai — экспериментальные модели геометрического контроля и 3D-генерации (приостановлено); rembg (U²-Net) — сегментация фона.
Инфраструктура: Docker Compose — backend, воркер и frontend в отдельных контейнерах.
Что получилось
Платформа реально работает как конструктор, а не как один пайплайн под кухни: шесть готовых кейсов-примеров покрывают разные сферы (мебель, фэшн, интерьеры, кухни, видео, свободная генерация) на общих строительных блоках нод-редактора, а не на разных изолированных скриптах. Модель, качество и — для видео — длительность выбираются на каждом шаге, список моделей и их реальные ограничения подтягиваются у провайдера.
Сохранение цепочки как личного переиспользуемого решения реализовано и работает — с прослеживаемым происхождением от каталожного примера, если чейн был из него склонирован. Переход от сгенерированного результата к сборке карточки для маркетплейса в отдельном canvas-редакторе реализован как явный однокликовый мостик между двумя инструментами.
Обработка фото (удаление фона, ресайз, зеркало) реализована как параметр общего эндпоинта генерации, доступный в любом кейсе, а не как кухонная особенность. Кухонный пайплайн со своим vision-контролем качества остался самым технически глубоким из шести кейсов, но перестал быть единственной темой продукта. B2B REST API с очередью, кредитами и финансовой аналитикой по-прежнему реализован и подтверждён внешней интеграцией.
Где можно использовать
Каталоги мебели и товаров — готовый кейс «Мебель для каталога»: удаление фона и перенос на чистый студийный фон под сетку маркетплейса.
Фэшн-бренды и интернет-магазины одежды — кейс «Фэшн: одежда на модели» генерирует одну и ту же модель в нескольких ракурсах по фото вещи, без съёмки с живым человеком.
Системы кухонного и мебельного проектирования — исходный кухонный кейс и B2B API для встраивания в CAD-системы, подтверждённые реальной интеграцией с внешней системой проектирования.
Дизайн интерьеров — кейс «Интерьеры с декором» превращает CAD-рендер в фото с улучшенным светом и минимальным декором.
Соцсети и реклама — кейс «Оживить кадр, видео» и общий видео-контур с выбором модели/длительности для коротких промо-роликов.
Любой продавец на маркетплейсе — кейс «Карточки для маркетплейса» и редактор карточек для готовой верстки под площадку.
Продукты без штатной команды разработки — визуальный нод-редактор и сохраняемые личные решения как инструмент для нетехнического пользователя, который хочет собрать свой сценарий один раз и переиспользовать.
Список из шести кейсов зафиксирован в коде как есть на момент анализа; если Роман имеет в виду более широкую заявленную линейку под клиентов — это стоит сверить отдельно.
Что дальше
Уже реализовано и работает: платформа-конструктор с нод-редактором, шесть готовых кейсов-примеров (мебель, фэшн, интерьеры, кухни, видео, свободная генерация), сохранение цепочек как личных решений, переход результата в редактор карточек, видео-генерация с выбором модели/качества/длительности, обработка фото как общий инструмент, B2B API с очередью и кредитами, кухонный vision-контроль качества, SEO-контент-контур для блога.
В планах — AI-конфигуратор кухонь: пользователь загружает референсное фото и параметры, сервис собирает компоновку и передаёт на генерацию. Backend и API для сценария готовы, интерфейс ещё не реализован — это теперь развитие одного из шести кейсов, а не главное продуктовое направление.
Запланирован возврат к экспериментам с геометрическим контролем сцены через карту глубины — приостановлен, нужна калибровка баланса геометрии и цвета. Эксперимент с 3D-генерацией кухни по одному ракурсу признан недостаточным — рассматривается переход на генерацию по нескольким ракурсам.
Нужен визуал и описания без фотостудии?
Посмотрим на ваш ассортимент и процесс контента: что можно генерировать уже сейчас, а где нужна съёмка.
Ещё в портфолио
KILLOOS
Интеллектуальная система бизнес-аналитики, переводит данные в управленческие решения и предупреждает риски до потерь.
Подробнее →Georeis
Диспетчеризация доставки и приложение водителя: маршрут по фото путевого листа → оптимизированный план на день.
Подробнее →Geo101
Приложение для активных путешественников: GPX-маршруты и офлайн-навигация для трейла, эндуро и пешего туризма.
Подробнее →Kitchen 3D Planner
Планировщик кухни для мебельных компаний: подбор модулей, фасадов и техники по размерам помещения, с 3D-сборкой на выходе.
Подробнее →Driver.Georeis
Приложение для водителей Georeis: распознаёт адреса с фото путевого листа, сверяет по адресной базе и строит порядок объезда с расчётом времени прибытия.
Подробнее →OpenSEO
Генерация SEO-статей по заданной структуре — с очеловечиванием стиля и независимой валидацией результата перед публикацией.
Подробнее →DeviceHub
Единый сервис метрик для физических устройств на столе: тянет данные сразу из нескольких продуктов и отдаёт готовые экраны без перепрошивки.
Подробнее →Rilso
Рабочее место для упаковки рилсов: из сырого видео — превью, транскрипт, вшитые субтитры, обложка, текст публикации, хэштеги и архив на экспорт.
Подробнее →Лабсервер
Собственный GPU-сервер для тестирования моделей, подбора параметров и сборки MVP в закрытом контуре — без выхода данных наружу.
Подробнее →