Обсудить задачу
кейс · голосовой ии · приложение работает

ExpertSpeech: эксперт наговаривает – ИИ превращает голос в статьи и посты

коротко

Мобильное приложение для экспертов: психолог, юрист или маркетолог надиктовывает мысль как голосовое сообщение – ИИ расшифровывает речь, вычищает оговорки и собирает из сказанного статью или серию постов под выбранную соцсеть. Пять минут голоса по дороге между консультациями – и публикация, на которую руками ушёл бы вечер. Одна кодовая база – Android, iPhone (PWA) и веб.

ExpertSpeech и ExpertRank – голос эксперта превращается в статьи на личном SEO-хабе
рис. 01 / приложение и порталв проде
ОТРАСЛЬэксперты · инфобизнес
ФОРМАТприложение + PWA
ЗАПУСКиюль 2026
СТАТУСработает · 3 платформы

Задача

У практикующих экспертов – психологов, юристов, коучей, маркетологов – есть парадокс: говорить о своём деле они могут часами, а писать не могут совсем. Нет времени, нет навыка, «сяду за статью в выходные» не наступает никогда. При этом личный бренд без публикаций не строится: клиенты гуглят эксперта перед покупкой, а гуглить нечего.

Вторая половина проблемы – площадка. Свой сайт с блогом – это месяцы и бюджет; соцсети не индексируются толком и не принадлежат автору. Захотелось решить обе беды одним продуктом: говоришь – публикуешься.

Решение

Приложение с одной большой кнопкой записи: эксперт наговаривает мысль, как голосовое сообщение другу. Дальше работает конвейер:

ЭТАПЧТО ПРОИСХОДИТ
Расшифровкаречь превращается в текст за время короче самой записи
«Очистить с ИИ»уходят «эээ», повторы, оговорки и обрывки мыслей; смысл и формулировки остаются авторскими
Генерацияиз очищенной мысли собирается статья или серия постов – формат, структура и длина под выбранную соцсеть
Правка и публикацияавтор проходит по тексту глазами и отправляет на витрину в один тап

Принципиальное правило: ИИ строит текст только из того, что сказал эксперт, ничего не досочиняя от себя. Ценность продукта – опыт и формулировки автора, а не фантазия модели.

Публикуется всё на портал-витрину ExpertRank – это отдельная большая система со своей SEO-механикой, о ней – отдельный кейс. Приложение ставится с expertrank.ru.

Расшифровка без GPU

Сердце конвейера – распознавание речи: Whisper large-v3-turbo, но с инженерным твистом – он работает на процессоре, без видеокарты вообще. Сервер на мощном десктопном Ryzen расшифровывает голос быстрее, чем эксперт успевает налить кофе, а экономика радикально проще: никакой аренды GPU, никаких поминутных тарифов облачных распознавалок, данные не покидают сервер. Для продукта, где аудио – это профессиональные откровения экспертов, последнее не бонус, а требование.

Очередь устроена честно: записи обрабатываются фоновыми воркерами, эксперт видит статус и может закрыть приложение – готовый текст догонит его уведомлением. Пиковые записи не толкаются локтями: конвейер переваривает их по очереди, а не падает.

Одна кодовая база – три платформы

Приложение написано один раз: из единого кода собираются Android-версия (APK ставится по прямой ссылке, без магазинов и их комиссий), PWA для iPhone – открыл адрес, добавил на экран, работает как приложение – и обычная веб-версия. Для нишевого продукта это решающая экономика: три платформы по цене одной разработки, и каждая правка доезжает до всех пользователей одновременно, без ожидания ревью в сторах. APK при этом раздаётся по постоянной прямой ссылке с сайта – установка в два тапа, без аккаунтов в магазинах и комиссий площадок.

Как это работает

  1. шаг 01Эксперт наговаривает – в приложении, по дороге между консультациями. Пять минут голоса.
  2. шаг 02Расшифровка – речь становится текстом, «эээ» и повторы вычищаются, мысль остаётся авторской.
  3. шаг 03Генерация – статья или серия постов под выбранную соцсеть, по структуре и длине площадки.
  4. шаг 04Правка и публикация – автор проходит текст глазами и отправляет на свою витрину в один тап.

Результат

5 мин
голоса – готовая статья
3
платформы из одной кодовой базы
0
GPU в конвейере распознавания

Приложение запущено на всех трёх платформах и работает в связке с порталом: голос – в кармане, публикация – на витрине. Расшифровка и генерация крутятся на одном сервере с самим порталом – отдельная инфраструктура под ИИ не понадобилась.

Стек

Expo / React Native PWA APK без сторов Whisper large-v3-turbo · CPU LLM-генерация Docker

Фронт – один репозиторий на все платформы; конвейер расшифровки и генерации – контейнеры на том же сервере, что и портал.

Почему не «диктофон плюс чат с нейросетью»

Формально то же самое можно собрать руками: записал голосовое, скинул в расшифровщик, вставил в чат, попросил статью. На практике эта цепочка умирает на третьем разе: пять приложений, копипаста, каждый раз заново объяснять модели формат. Продукт побеждает связку инструментов ровно тем, что в нём нет швов: одна кнопка записи, форматы площадок зашиты в конвейер, история записей под рукой, а от мысли до публикации – один тап. Привычка образуется только тогда, когда путь короче, чем лень.

Уроки по дороге

Главное открытие – психологическое: эксперты, которые год «собирались написать статью», наговаривают по три заметки в неделю. Говорить – не страшно, страшен чистый лист; конвейер убирает именно его. Второй урок – про качество: черновик, собранный из собственных слов автора, люди правят охотно и быстро, а «идеальный» текст, написанный моделью с нуля, вызывает отторжение – не моё. И третий, инженерный: мобильная разработка на одной кодовой базе экономит месяцы, но требует дисциплины тестирования на реальных устройствах – эмулятор прощает то, что телефон не простит.

Вопросы и ответы

Почему именно голос, а не «ИИ, напиши мне статью»?

Потому что ценность – в голове эксперта, а не в модели. Надиктованная мысль – это его опыт, кейсы и формулировки; конвейер лишь придаёт им форму. Статья «из ниоткуда» читается как вода и топит доверие – ровно то, что эксперту нужнее всего.

ИИ не переврёт смысл при чистке?

Чистка убирает оговорки и повторы, не трогая содержание, а перед публикацией автор видит и правит текст в редакторе. Последнее слово всегда за человеком – это его имя под статьёй.

Зачем распознавание на CPU, если все берут GPU?

Быстрый процессор справляется с расшифровкой быстрее реального времени, а серверу без GPU не нужны ни дорогая аренда, ни поминутные тарифы облачных сервисов. Плюс приватность: аудио не уходит третьим лицам.

Можно делать посты для соцсетей?

Да. Приложение собирает посты под 9 соцсетей – каждой площадке свой формат и длина, – умеет усиливать текст хуком и строить серии продающих постов, работающие как воронка: от прогрева к предложению.

Это работает на iPhone?

Да, через PWA: эксперт открывает адрес, добавляет иконку на экран – и получает то же приложение, что на Android, без App Store. Код один, поведение одинаковое.

Куда уходит готовая статья?

На личную витрину эксперта на портале ExpertRank – с профилем, категориями и полной поисковой разметкой. Портал – отдельная система, о ней отдельный кейс.

автор – Семенов Евгений, Forward Deployed Software Engineer
ещё кейсы

Похожие проекты

все кейсы →

Похожая задача?

Хотите свой SaaS – конвейер, витрину, приложение? Расскажите идею: за пару дней честно скажу, из чего он соберётся и что потребуется.

Обсудить задачу
статьи по теме

Разобрано в блоге

все статьи →