Последний месяц я пытаюсь сделать то, что, как оказалось, гораздо сложнее написания кода.
Придумать хороший продукт.
Не просто интересную идею, которая кажется классной разработчику, а продукт, для которого существует реальный рынок и люди готовы платить. И чем дольше я об этом думаю, тем сильнее убеждаюсь: написать MVP зачастую проще, чем понять, что именно нужно написать.
С чего всё началось
Изначально я хотел сделать сервис для транскрибации аудио и видео.
Идея казалась вполне логичной: загружаешь видео, получаешь текстовую расшифровку в удобном формате, а затем одной кнопкой делаешь краткую выжимку содержания. Тем более спрос на такую услугу действительно есть.
Например, запрос «видео в текст» в Яндекс Вордстат показывает порядка 30 тысяч запросов в месяц.
Я даже успел навайбкодить первый MVP: сделал сайт, бэкенд и подключил свои нейронные сети. Казалось бы — вот он, продукт.
Но когда начал смотреть на рынок внимательнее, возникло ощущение, что я немного опоздал. Сервисов для транскрибации уже огромное количество. Причём многие из них делают примерно одно и то же.
И я начал задавать себе довольно неприятный вопрос:
А зачем кому-то нужен ещё один транскрибатор?
Можно, конечно, сделать интерфейс красивее, добавить ещё одну нейросеть или придумать пару дополнительных функций. Но это уже начинало походить на попытку найти оправдание идее, а не на поиск реальной потребности.
От транскрибации к субтитрам
В какой-то момент я начал думать не о самой расшифровке, а о том, что люди делают с полученным текстом дальше. И здесь я пришёл к коротким видео.
Reels, Shorts, TikTok и другие вертикальные форматы давно превратили субтитры в отдельный элемент дизайна видео. Это уже не просто текст в нижней части экрана.
Большие слова, выделение отдельных фраз, анимация, изменение размера и цвета, размещение текста рядом с объектами в кадре — всё это используется для того, чтобы удерживать внимание зрителя.
Так появилась идея сделать сервис не для транскрибации, а для создания и редактирования эффектных субтитров для коротких видео. И это уже совсем другой продукт.
Сначала идея выглядела довольно просто: распознать речь, получить таймкоды и дать пользователю удобный редактор. Но чем больше я над ней думал, тем больше появлялось возможностей:
- определять объекты в кадре и не перекрывать их субтитрами;
- автоматически выделять важные слова;
- добавлять анимации;
- подбирать оформление под конкретное видео;
- автоматически находить моменты, которые стоит визуально подчеркнуть.
А дальше фантазия разработчика начинает разгоняться: B-roll, автоматический монтаж, синхронизация губ, работа с аудиодорожкой, редактирование видео с помощью AI-агента.
В какой-то момент я понял, что таким образом очень легко придумать продукт лет на пять вперёд. Поэтому решил остановиться и начать с гораздо более простой вещи — сделать нормальный редактор субтитров.
Что я в итоге сделал
Так появился мой первый SaaS — .

Основная идея сервиса простая: загрузить видео, автоматически получить субтитры и быстро привести их в нормальный вид.
Сервис распознаёт речь в видео и создаёт субтитры с таймкодами. После этого видео можно открыть в редакторе.
Если распознавание где-то ошиблось, текст можно сразу исправить. Если субтитр появляется слишком рано или слишком поздно — изменить тайминг.
То есть AI делает рутинную часть работы, а человек получает возможность быстро проверить и поправить результат. И для меня это довольно важный принцип продукта.
AI не обязательно должен делать всё самостоятельно. Иногда гораздо полезнее автоматизировать 80% скучной работы и оставить человеку последние 20%, где требуется контроль и принятие решений.
Субтитры — это уже не просто текст
Отдельная часть проекта — оформление.
Если посмотреть на популярные Reels и Shorts, становится заметно, что субтитры там часто являются полноценной частью визуального стиля. Поэтому обычного текстового редактора недостаточно.
Нужно управлять шрифтом, размером, цветом, выделением слов, фоном, обводкой, количеством строк и расположением текста. При этом не хочется каждый раз настраивать всё с нуля.
Поэтому я добавил готовые стили:
- Minimal — простой минималистичный вариант;
- Beauty — более выразительный стиль;
- Business — сдержанное оформление для делового контента.
Выбираешь подходящий вариант, при необходимости что-то меняешь — и можно продолжать работу.
В итоге базовый сценарий получился таким:
Видео → распознавание → субтитры → редактирование → оформление → готовое видео.
Но самое интересное начинается дальше
Пока это только первая версия продукта. И я специально стараюсь не превращать его сразу в комбайн из сотни AI-функций. Хотя соблазн очень большой.
Потому что если начать смотреть на видео как на набор данных, то возможностей действительно огромное количество:
- можно анализировать не только речь, но и изображение;
- понимать, что находится в кадре;
- определять, где находится человек;
- выбирать свободное место для субтитров;
- понимать контекст сказанного;
- автоматически менять оформление в зависимости от содержания;
- находить важные моменты;
- добавлять B-roll.
А в перспективе вообще отказаться от классического видеоредактора и дать пользователю возможность просто написать:
«Сделай из этого видео динамичный Reels в стиле моего канала».
И получить готовый результат.
Но это уже следующий этап. Сейчас мне гораздо интереснее проверить более простую гипотезу:
Будет ли людям действительно нужен удобный инструмент для создания и редактирования субтитров?
Потому что именно здесь начинается настоящий продукт. Не с количества AI-фич, а с того, решает ли он конкретную проблему и готовы ли люди возвращаться к нему снова.
Поэтому пока я просто делаю, пробую и смотрю, что из этого получится.
Это мой первый самостоятельный SaaS, и мне самому интересно пройти весь путь — от идеи и первых строк кода до первых пользователей и, возможно, первых денег.
Если хотите следить за тем, что из этого получится, я пишу об этом в своём Telegram-канале:
Сам проект:
Нет комментариев
Комментарии доступны после входа