Задача
У практикующих экспертов – психологов, юристов, коучей, маркетологов – есть парадокс: говорить о своём деле они могут часами, а писать не могут совсем. Нет времени, нет навыка, «сяду за статью в выходные» не наступает никогда. При этом личный бренд без публикаций не строится: клиенты гуглят эксперта перед покупкой, а гуглить нечего.
Вторая половина проблемы – площадка. Свой сайт с блогом – это месяцы и бюджет; соцсети не индексируются толком и не принадлежат автору. Захотелось решить обе беды одним продуктом: говоришь – публикуешься.
Решение
Приложение с одной большой кнопкой записи: эксперт наговаривает мысль, как голосовое сообщение другу. Дальше работает конвейер:
| ЭТАП | ЧТО ПРОИСХОДИТ |
|---|---|
| Расшифровка | речь превращается в текст за время короче самой записи |
| «Очистить с ИИ» | уходят «эээ», повторы, оговорки и обрывки мыслей; смысл и формулировки остаются авторскими |
| Генерация | из очищенной мысли собирается статья или серия постов – формат, структура и длина под выбранную соцсеть |
| Правка и публикация | автор проходит по тексту глазами и отправляет на витрину в один тап |
Принципиальное правило: ИИ строит текст только из того, что сказал эксперт, ничего не досочиняя от себя. Ценность продукта – опыт и формулировки автора, а не фантазия модели.
Публикуется всё на портал-витрину ExpertRank – это отдельная большая система со своей SEO-механикой, о ней – отдельный кейс. Приложение ставится с expertrank.ru.
Расшифровка без GPU
Сердце конвейера – распознавание речи: Whisper large-v3-turbo, но с инженерным твистом – он работает на процессоре, без видеокарты вообще. Сервер на мощном десктопном Ryzen расшифровывает голос быстрее, чем эксперт успевает налить кофе, а экономика радикально проще: никакой аренды GPU, никаких поминутных тарифов облачных распознавалок, данные не покидают сервер. Для продукта, где аудио – это профессиональные откровения экспертов, последнее не бонус, а требование.
Очередь устроена честно: записи обрабатываются фоновыми воркерами, эксперт видит статус и может закрыть приложение – готовый текст догонит его уведомлением. Пиковые записи не толкаются локтями: конвейер переваривает их по очереди, а не падает.
Одна кодовая база – три платформы
Приложение написано один раз: из единого кода собираются Android-версия (APK ставится по прямой ссылке, без магазинов и их комиссий), PWA для iPhone – открыл адрес, добавил на экран, работает как приложение – и обычная веб-версия. Для нишевого продукта это решающая экономика: три платформы по цене одной разработки, и каждая правка доезжает до всех пользователей одновременно, без ожидания ревью в сторах. APK при этом раздаётся по постоянной прямой ссылке с сайта – установка в два тапа, без аккаунтов в магазинах и комиссий площадок.
Как это работает
- шаг 01Эксперт наговаривает – в приложении, по дороге между консультациями. Пять минут голоса.
- шаг 02Расшифровка – речь становится текстом, «эээ» и повторы вычищаются, мысль остаётся авторской.
- шаг 03Генерация – статья или серия постов под выбранную соцсеть, по структуре и длине площадки.
- шаг 04Правка и публикация – автор проходит текст глазами и отправляет на свою витрину в один тап.
Результат
Приложение запущено на всех трёх платформах и работает в связке с порталом: голос – в кармане, публикация – на витрине. Расшифровка и генерация крутятся на одном сервере с самим порталом – отдельная инфраструктура под ИИ не понадобилась.
Стек
Фронт – один репозиторий на все платформы; конвейер расшифровки и генерации – контейнеры на том же сервере, что и портал.
Почему не «диктофон плюс чат с нейросетью»
Формально то же самое можно собрать руками: записал голосовое, скинул в расшифровщик, вставил в чат, попросил статью. На практике эта цепочка умирает на третьем разе: пять приложений, копипаста, каждый раз заново объяснять модели формат. Продукт побеждает связку инструментов ровно тем, что в нём нет швов: одна кнопка записи, форматы площадок зашиты в конвейер, история записей под рукой, а от мысли до публикации – один тап. Привычка образуется только тогда, когда путь короче, чем лень.
Уроки по дороге
Главное открытие – психологическое: эксперты, которые год «собирались написать статью», наговаривают по три заметки в неделю. Говорить – не страшно, страшен чистый лист; конвейер убирает именно его. Второй урок – про качество: черновик, собранный из собственных слов автора, люди правят охотно и быстро, а «идеальный» текст, написанный моделью с нуля, вызывает отторжение – не моё. И третий, инженерный: мобильная разработка на одной кодовой базе экономит месяцы, но требует дисциплины тестирования на реальных устройствах – эмулятор прощает то, что телефон не простит.
Вопросы и ответы
Почему именно голос, а не «ИИ, напиши мне статью»?
Потому что ценность – в голове эксперта, а не в модели. Надиктованная мысль – это его опыт, кейсы и формулировки; конвейер лишь придаёт им форму. Статья «из ниоткуда» читается как вода и топит доверие – ровно то, что эксперту нужнее всего.
ИИ не переврёт смысл при чистке?
Чистка убирает оговорки и повторы, не трогая содержание, а перед публикацией автор видит и правит текст в редакторе. Последнее слово всегда за человеком – это его имя под статьёй.
Зачем распознавание на CPU, если все берут GPU?
Быстрый процессор справляется с расшифровкой быстрее реального времени, а серверу без GPU не нужны ни дорогая аренда, ни поминутные тарифы облачных сервисов. Плюс приватность: аудио не уходит третьим лицам.
Можно делать посты для соцсетей?
Да. Приложение собирает посты под 9 соцсетей – каждой площадке свой формат и длина, – умеет усиливать текст хуком и строить серии продающих постов, работающие как воронка: от прогрева к предложению.
Это работает на iPhone?
Да, через PWA: эксперт открывает адрес, добавляет иконку на экран – и получает то же приложение, что на Android, без App Store. Код один, поведение одинаковое.
Куда уходит готовая статья?
На личную витрину эксперта на портале ExpertRank – с профилем, категориями и полной поисковой разметкой. Портал – отдельная система, о ней отдельный кейс.