evrone.solutions
evrone/
ai-voice_
№32
AI

Evrone AI Voice

Голосовой ассистент по контенту

Голосовой RAG по контенту

Голосовой ассистент отвечает на вопросы слушателя по материалу, который он слушает — курсу, аудиокниге, серии подкаста: что случилось с героем, чем закончилась глава, что предшествовало событию. Работает он не на общих знаниях модели, а на тексте самого материала — находит подходящие фрагменты и строит ответ по ним, не выдумывая. Главное требование не к красоте формулировок, а к честности источника: ассистент обязан отвечать только по тому материалу, который слушатель воспроизводит, и никогда не подмешивать факты из другого, даже похожего по теме. Иначе голосовой помощник превращается в источник уверенно звучащей путаницы — расскажет о сюжете одной книги фактами из совсем другой. Отсюда изоляция между материалами на уровне поиска, честное «не нашёл», когда ответа действительно нет, и сам голос как равноправный канал — с перебиванием на лету и памятью диалога, а не просто начиткой текста вслух.

Подробное описание

Прототип закрывает цикл «прослушал → спросил или обсудил голосом → получил живой голосовой ответ»: куратор загружает материал по главам, каждая озвучивается автоматически, слушатель проходит главы по порядку и в любой момент открывает отдельный диалоговый экран — задаёт вопрос голосом или текстом по материалу целиком, ответ стримится текстом сразу и озвучивается по предложениям по мере готовности, с подсветкой процитированного места и возможностью перебить звучащий ответ новым вопросом, не дожидаясь конца. Настоящая модель и живой облачный голос подключаются одним переключателем по ключу заказчика — до этого работает бесплатная заглушка (детерминированное цитирование текста, браузерный голос).

Материалы и главы

  • Материал делится на главы куратором вручную — у каждой свой текст и своя озвучка
  • Статус главы по слушателю: «не прочитано» / «читаем» / «прочитано», следующая глава разблокируется по мере прослушивания
  • Автоматический синтез озвучки при сохранении главы, если куратор не приложил свой аудиофайл
  • Ошибка синтеза не блокирует сохранение текста — глава помечается «нет аудио», можно пересинтезировать позже
  • Куратор может скопировать себе уже добавленный материал другого куратора — независимая копия, с переиспользованием готового файла озвучки вместо повторного платного синтеза

Поиск и ответ

  • Поиск и ответ опираются на весь материал целиком, не на одну главу — жёсткая изоляция только между разными материалами библиотеки
  • Мягкое уточнение по схожести слов перед честным отказом — ловит опечатки и неточные формулировки, не требует точной цитаты
  • При включённой модели и нескольких материалах сразу — дополнительная попытка уточнить по списку названий, прежде чем честно сдаться
  • Честный ответ «не нашёл» в тоне, зафиксированном под аудиторию сборки (прямой навигационный или мягкий поощряющий) — без подмены пустого ответа общими рассуждениями
  • Диалоговая память доходит и до поиска фрагментов, не только до генерации ответа — короткий follow-up без ключевых слов ищется с учётом истории диалога
  • Вопросы о самом ассистенте («что ты умеешь?») отвечаются сразу, в обход поиска и модели

Голос

  • Запись голосом или напечатанный текст — равноценные способы задать вопрос, ни один не запасной
  • Распознавание речи (STT) и синтез ответа (TTS) — браузерные по умолчанию, облачные при включённой модели, тем же переключателем, что и языковая модель
  • Перебивание кнопкой — повторное нажатие во время звучания ответа сразу его останавливает и открывает запись нового вопроса
  • Озвучка ответа — по предложениям, синхронно со стримом текста, не одним куском после полной генерации
  • Выбор голоса ответа — отдельно от голоса, которым озвучена сама глава, запоминается в браузере слушателя
  • Подсветка цитируемого фрагмента в расшифровке главы, пока звучит озвучка ответа

Диалог

  • Отдельный полноэкранный диалоговый экран на материал целиком, не мелкий виджет поверх плеера
  • Доступен, как только материал открыт слушателю — не требует дослушать текущую главу до конца
  • История реплик персистентна — сохраняется между визитами, диалог можно продолжить позже

Общая библиотека без входа

  • Анонимный доступ ко всем включённым материалам библиотеки сразу, без регистрации
  • Тот же голосовой/текстовый диалог, поиск сразу по всем материалам, видимым посетителю
  • Скрытие отдельных материалов из поиска — только в браузере посетителя, без изменений на сервере
  • Личность посетителя — короткоживущий токен сессии, история не хранится постоянно
  • Переход к полноценной регистрации в любой момент, без потери того, что делал анонимно

Прогресс, приглашения и видимость

  • Прогресс прослушивания — своя позиция воспроизведения и статус для каждой пары слушатель+глава
  • Приглашение слушателя куратором по email — связь становится активной только после подтверждения слушателем
  • Один слушатель может быть одновременно привязан к нескольким кураторам, каждый видит его независимо от других
  • Группы — инструмент куратора для массовых операций (например, скрыть материал сразу для нескольких слушателей)
  • Видимость материала — на уровне всей библиотеки, конкретного слушателя или его группы, независимые условия

Администрирование

  • Настройка модели — облачный провайдер и ключ, которые указал заказчик, один переключатель для языковой модели и голоса разом
  • Аналитика вопросов — частые темы, доля ответов «не нашёл» по материалу и по всей библиотеке
  • Управление кураторами и связями «куратор—слушатель», включая принудительную привязку в обход подтверждения

Роли и права

  • Слушатель — слушать доступные материалы по главам, задавать голосовые и текстовые вопросы, вести диалог, подтверждать или отклонять приглашения от кураторов
  • Куратор — добавлять свои материалы по главам, копировать себе чужие уже включённые материалы, приглашать своих слушателей, управлять группами и видимостью, включать настоящую модель
  • Администратор — видеть и модерировать весь стенд целиком, принудительно привязывать слушателя к куратору, видеть аналитику по всей библиотеке, настраивать модель

Что не входит

Голос — либо браузерный (заглушка, работает целиком на клиенте), либо настоящий облачный провайдер по ключу заказчика, третьего варианта нет. Поиск фрагментов — свой лексический алгоритм, не векторный/семантический и не завязан на индексацию.

  • Живое прерывание без нажатия кнопки — постоянное прослушивание микрофона в фоне и эхоподавление
  • Мультиязычность интерфейса и материалов
  • Автоматическая модерация текста материала при добавлении
  • Скрытие отдельных глав внутри видимого материала — только материал целиком
  • Реальная отправка приглашений по email — заглушка-уведомление внутри интерфейса
  • Редактирование состава глав уже опубликованного и частично прослушанного материала
  • Автоматическая очистка/TTL аудиофайлов голосовых вопросов вошедшего в систему слушателя — хранятся постоянно
  • Явное действие «начать диалог заново» — история накапливается без сброса
  • Перенос памяти диалога между разными материалами одного слушателя
  • Отдельное мобильное приложение — только адаптивный веб
// демо-стенд
Попробуйте прототип прямо сейчас
url ai-voice.evrone.solutions/public
логин evrone
пароль s0lut10ns
инструкция к стенду

Публичный чат-обсуждение без входа: на главной странице сайта сразу видны все материалы библиотеки, можно скрыть ненужные и задать голосом или текстом вопрос сразу по всем оставшимся — ассистент сам понимает, к какому материалу относится вопрос, и честно говорит, если ответа нет ни в одном. История разговора живёт, пока не закрыл вкладку надолго (около получаса), дальше начинается с чистого листа

Учётки внутри сайта (видны на странице входа):

Ребёнок (слушатель) — vanya.listener@ai-voice.demo / listener12345 Родитель (куратор) — olya.curator@ai-voice.demo / curator12345 Родитель (куратор) — igor.curator@ai-voice.demo / curator12345 Администратор — admin@ai-voice.demo / admin12345

Что посмотреть: библиотеку материалов по главам с прогрессом; под слушателем — голосовой или текстовый вопрос и отдельный диалог «Обсудить» с памятью и перебиванием ответа на лету; под куратором — добавление материала по главам с автоматической озвучкой, копирование уже добавленного чужого материала себе, управление видимостью и группами слушателей; на главной странице сайта — общую библиотеку без входа (голосовой диалог сразу по всем материалам, без регистрации). С телефона работает так же.

Открыть демо-стенд →
Тестовые данные демо-стенда сбрасываются каждую ночь.
// расчёт доработок

Какие вам нужны доработки?

Опишите своими словами, что хотите изменить или добавить к прототипу — интеграции, дизайн, новые механики. AI сопоставит запрос с ТЗ прототипа и сразу покажет вилку часов и стоимости.

Оценка появится сразу, через несколько секунд
// заявка

Купить Evrone AI Voice

Вы можете купить:
код прототипа для быстрого запуска проекта исходники, картинки, дамп базы, инструкции — всё, что нужно, чтобы залить на сервер и сразу стартовать
или
комплект промптов под Claude Code, Codex и т. д. промпты, инструкции, дизайн-спецификация, данные и картинки для самостоятельной агентной разработки прототипа

Оставьте контакты — свяжемся, покажем прототип, проконсультируем и договоримся о передаче.

// ещё прототипы

Похожие прототипы