Evrone AI Voice
Голосовой RAG по контенту
Голосовой ассистент отвечает на вопросы слушателя по материалу, который он слушает — курсу, аудиокниге, серии подкаста: что случилось с героем, чем закончилась глава, что предшествовало событию. Работает он не на общих знаниях модели, а на тексте самого материала — находит подходящие фрагменты и строит ответ по ним, не выдумывая. Главное требование не к красоте формулировок, а к честности источника: ассистент обязан отвечать только по тому материалу, который слушатель воспроизводит, и никогда не подмешивать факты из другого, даже похожего по теме. Иначе голосовой помощник превращается в источник уверенно звучащей путаницы — расскажет о сюжете одной книги фактами из совсем другой. Отсюда изоляция между материалами на уровне поиска, честное «не нашёл», когда ответа действительно нет, и сам голос как равноправный канал — с перебиванием на лету и памятью диалога, а не просто начиткой текста вслух.
Подробное описание
Прототип закрывает цикл «прослушал → спросил или обсудил голосом → получил живой голосовой ответ»: куратор загружает материал по главам, каждая озвучивается автоматически, слушатель проходит главы по порядку и в любой момент открывает отдельный диалоговый экран — задаёт вопрос голосом или текстом по материалу целиком, ответ стримится текстом сразу и озвучивается по предложениям по мере готовности, с подсветкой процитированного места и возможностью перебить звучащий ответ новым вопросом, не дожидаясь конца. Настоящая модель и живой облачный голос подключаются одним переключателем по ключу заказчика — до этого работает бесплатная заглушка (детерминированное цитирование текста, браузерный голос).
Материалы и главы
- Материал делится на главы куратором вручную — у каждой свой текст и своя озвучка
- Статус главы по слушателю: «не прочитано» / «читаем» / «прочитано», следующая глава разблокируется по мере прослушивания
- Автоматический синтез озвучки при сохранении главы, если куратор не приложил свой аудиофайл
- Ошибка синтеза не блокирует сохранение текста — глава помечается «нет аудио», можно пересинтезировать позже
- Куратор может скопировать себе уже добавленный материал другого куратора — независимая копия, с переиспользованием готового файла озвучки вместо повторного платного синтеза
Поиск и ответ
- Поиск и ответ опираются на весь материал целиком, не на одну главу — жёсткая изоляция только между разными материалами библиотеки
- Мягкое уточнение по схожести слов перед честным отказом — ловит опечатки и неточные формулировки, не требует точной цитаты
- При включённой модели и нескольких материалах сразу — дополнительная попытка уточнить по списку названий, прежде чем честно сдаться
- Честный ответ «не нашёл» в тоне, зафиксированном под аудиторию сборки (прямой навигационный или мягкий поощряющий) — без подмены пустого ответа общими рассуждениями
- Диалоговая память доходит и до поиска фрагментов, не только до генерации ответа — короткий follow-up без ключевых слов ищется с учётом истории диалога
- Вопросы о самом ассистенте («что ты умеешь?») отвечаются сразу, в обход поиска и модели
Голос
- Запись голосом или напечатанный текст — равноценные способы задать вопрос, ни один не запасной
- Распознавание речи (STT) и синтез ответа (TTS) — браузерные по умолчанию, облачные при включённой модели, тем же переключателем, что и языковая модель
- Перебивание кнопкой — повторное нажатие во время звучания ответа сразу его останавливает и открывает запись нового вопроса
- Озвучка ответа — по предложениям, синхронно со стримом текста, не одним куском после полной генерации
- Выбор голоса ответа — отдельно от голоса, которым озвучена сама глава, запоминается в браузере слушателя
- Подсветка цитируемого фрагмента в расшифровке главы, пока звучит озвучка ответа
Диалог
- Отдельный полноэкранный диалоговый экран на материал целиком, не мелкий виджет поверх плеера
- Доступен, как только материал открыт слушателю — не требует дослушать текущую главу до конца
- История реплик персистентна — сохраняется между визитами, диалог можно продолжить позже
Общая библиотека без входа
- Анонимный доступ ко всем включённым материалам библиотеки сразу, без регистрации
- Тот же голосовой/текстовый диалог, поиск сразу по всем материалам, видимым посетителю
- Скрытие отдельных материалов из поиска — только в браузере посетителя, без изменений на сервере
- Личность посетителя — короткоживущий токен сессии, история не хранится постоянно
- Переход к полноценной регистрации в любой момент, без потери того, что делал анонимно
Прогресс, приглашения и видимость
- Прогресс прослушивания — своя позиция воспроизведения и статус для каждой пары слушатель+глава
- Приглашение слушателя куратором по email — связь становится активной только после подтверждения слушателем
- Один слушатель может быть одновременно привязан к нескольким кураторам, каждый видит его независимо от других
- Группы — инструмент куратора для массовых операций (например, скрыть материал сразу для нескольких слушателей)
- Видимость материала — на уровне всей библиотеки, конкретного слушателя или его группы, независимые условия
Администрирование
- Настройка модели — облачный провайдер и ключ, которые указал заказчик, один переключатель для языковой модели и голоса разом
- Аналитика вопросов — частые темы, доля ответов «не нашёл» по материалу и по всей библиотеке
- Управление кураторами и связями «куратор—слушатель», включая принудительную привязку в обход подтверждения
Роли и права
- Слушатель — слушать доступные материалы по главам, задавать голосовые и текстовые вопросы, вести диалог, подтверждать или отклонять приглашения от кураторов
- Куратор — добавлять свои материалы по главам, копировать себе чужие уже включённые материалы, приглашать своих слушателей, управлять группами и видимостью, включать настоящую модель
- Администратор — видеть и модерировать весь стенд целиком, принудительно привязывать слушателя к куратору, видеть аналитику по всей библиотеке, настраивать модель
Что не входит
Голос — либо браузерный (заглушка, работает целиком на клиенте), либо настоящий облачный провайдер по ключу заказчика, третьего варианта нет. Поиск фрагментов — свой лексический алгоритм, не векторный/семантический и не завязан на индексацию.
- Живое прерывание без нажатия кнопки — постоянное прослушивание микрофона в фоне и эхоподавление
- Мультиязычность интерфейса и материалов
- Автоматическая модерация текста материала при добавлении
- Скрытие отдельных глав внутри видимого материала — только материал целиком
- Реальная отправка приглашений по email — заглушка-уведомление внутри интерфейса
- Редактирование состава глав уже опубликованного и частично прослушанного материала
- Автоматическая очистка/TTL аудиофайлов голосовых вопросов вошедшего в систему слушателя — хранятся постоянно
- Явное действие «начать диалог заново» — история накапливается без сброса
- Перенос памяти диалога между разными материалами одного слушателя
- Отдельное мобильное приложение — только адаптивный веб
инструкция к стенду ↓
Публичный чат-обсуждение без входа: на главной странице сайта сразу видны все материалы библиотеки, можно скрыть ненужные и задать голосом или текстом вопрос сразу по всем оставшимся — ассистент сам понимает, к какому материалу относится вопрос, и честно говорит, если ответа нет ни в одном. История разговора живёт, пока не закрыл вкладку надолго (около получаса), дальше начинается с чистого листа
Учётки внутри сайта (видны на странице входа):
Ребёнок (слушатель) — vanya.listener@ai-voice.demo / listener12345 Родитель (куратор) — olya.curator@ai-voice.demo / curator12345 Родитель (куратор) — igor.curator@ai-voice.demo / curator12345 Администратор — admin@ai-voice.demo / admin12345
Что посмотреть: библиотеку материалов по главам с прогрессом; под слушателем — голосовой или текстовый вопрос и отдельный диалог «Обсудить» с памятью и перебиванием ответа на лету; под куратором — добавление материала по главам с автоматической озвучкой, копирование уже добавленного чужого материала себе, управление видимостью и группами слушателей; на главной странице сайта — общую библиотеку без входа (голосовой диалог сразу по всем материалам, без регистрации). С телефона работает так же.
Какие вам нужны доработки?
Опишите своими словами, что хотите изменить или добавить к прототипу — интеграции, дизайн, новые механики. AI сопоставит запрос с ТЗ прототипа и сразу покажет вилку часов и стоимости.
Купить Evrone AI Voice
Оставьте контакты — свяжемся, покажем прототип, проконсультируем и договоримся о передаче.
Похожие прототипы
RAG в приватном контуре: коннекторы к базам знаний, чат, цитирование источников.
Как Ламода, Золотое яблоко или МВидео
Как Вайлдберриз или Озон