Привет, я Uba

Разработчик ИИ-автоматизации

Все системы

11 из 24ИИ-системы / 11 из 24

Продукт

Работает

Undertone

Голосовой дневник, который слышит тон, а не только слова: каждые 2 секунды оценивает запись — спокойствие, радость, злость, грусть — и показывает смены тона.

Сделано с помощьюМодель тона ut-ser 3.2Распознавание эмоций в речиЛокальное распознавание речиОкна 2 с, шаг 0,5 с

Факты

Статус
Работает
Платформа
Приложение для телефона · веб-приложение
Сценарии
Запись · Результат · Сессии · Аналитика
Модель
ut-ser 3.2 на устройстве: спокойствие · радость · злость · грусть в каждом окне 2 с
Входные данные
Запись в реальном времени или аудиофайл (WAV, MP3, M4A, до 10 мин)
Конфиденциальность
Аудио шифруется и хранится 30 дней; тон и расшифровка остаются, пока вы их не удалите
Год
2026

РИС. 01 / ФИЛЬМ О ПРОДУКТЕ

Превью без звука · полная версия — со звуком

Для кого

Люди, которые проговаривают всё вслух и хотят понять, как их слышат другие: руководитель, который перед трудным звонком наговаривает короткую запись, человек, ведущий вечерний голосовой дневник, или любой, кто вместе с коучем по коммуникации работает над тем, как он звучит. Рассчитано на то, чтобы записывать на телефоне в моменте, а разбирать позже за компьютером.

Проблема

Голосовая заметка сохраняет, что вы сказали, но не то, как вы это сказали. Вспоминая трудный звонок или долгую неделю, вы помните слова, но не момент, когда голос стал напряжённым, сколько это длилось и о чём вы тогда говорили.

Продукт

Вы наговариваете запись на телефоне или за компьютером либо загружаете аудиофайл. Модель тона ut-ser 3.2 прямо на устройстве относит каждое 2-секундное окно к одному из тонов — спокойствие, радость, злость или грусть, — а параллельно пишется расшифровка, где у каждой фразы есть метка тона. Когда вы останавливаете запись, результат показывает общее соотношение тонов, шкалу времени с местами, где тон менялся, и фразы, в которых это проявилось; на компьютере к этому добавляются высота голоса, громкость, темп речи и паузы в сравнении с вашим собственным базовым уровнем голоса — видно, что именно в нём изменилось. В «Сессиях» каждая запись хранится в виде полосы тона, «Аналитика» показывает закономерности за недели, а отчёт по сессии можно отправить коучу: тон, расшифровка и признаки в голосе, но никогда не само аудио. Тон оценивается по голосу; это не диагноз.

РИС. 02 / КАК ЭТО РАБОТАЕТ

Как это работает

  1. Шаг 1: Запись

    Вы говорите — Undertone слушает. Каждый столбик волны появляется серым и окрашивается в цвет тона с отставанием в одно окно, кольцо перестраивает пропорции с каждым 2-секундным замером, а слово в его центре меняется, только когда меняется ваш тон. Живая подпись показывает последнюю фразу, как только она прозвучала, вместе с меткой тона.

  2. Шаг 2: Результат

    Когда вы останавливаете запись, сессия за несколько секунд проигрывается заново: дорожки тонов закрашиваются вслед за курсором воспроизведения, счётчики общего соотношения тонов бегут вверх, а ключевые моменты закрепляются вместе со своими словами. На компьютере курсор возвращается к напряжённому отрезку — злость 20 секунд и дольше с уверенностью от 70%, — скобка отмечает, сколько он длился, а столбики высоты голоса, громкости, темпа речи и пауз вырастают от вашего собственного базового уровня.

  3. Шаг 3: Сессии

    Каждая запись попадает в библиотеку в виде полосы тона по ходу записи — с длительностью, долей спокойствия, пиковым моментом и числом напряжённых отрезков. Можно оставить только сессии с напряжёнными отрезками или те, которыми вы поделились с коучем, и посмотреть превью любой из них — дорожки, соотношение тонов, пиковую цитату и связанные сессии, — прежде чем её открыть.

  4. Шаг 4: Аналитика

    «Аналитика» сводит вместе последние 7 или 30 дней: число сессий и время записи, соотношение тонов по неделям на фоне вашей средней доли спокойствия и каждый напряжённый отрезок со словами, прозвучавшими в пределах 30 секунд от него. Здесь же видно, в какое время суток вы звучите спокойнее всего, и ваш базовый уровень голоса, а еженедельный отчёт можно отправить коучу.

РИС. 03 / ЭКРАНЫ

Продукт — экран за экраном

Экран «Запись» Undertone на телефоне: большое кольцо с показанием «Calm» — уверенность 72%, тон ровный уже 18 с — и под ним доли спокойствия, радости, грусти и злости, волна, окрашенная по тону в синий и янтарный, живая подпись последней фразы, таймер записи на 0:42, кнопки остановки и паузы и ссылка, чтобы вместо этого загрузить аудиофайл.
Результат сессии Undertone на телефоне: заголовок о том, что сессия в основном спокойная, с напряжённым отрезком на 1:10, общее соотношение тонов — спокойствие 57%, злость 21%, радость 13% и грусть 9%, — шкала времени из четырёх дорожек с обведённым отрезком злости и три ключевых момента с метками тона и цитатами, а под ними кнопки «Replay» и «Export report».
Экран «Сессии» Undertone на телефоне: фильтры «All», «Tense» и «Shared», строка «Recording now» с живой полосой тона и прошлые сессии, сгруппированные по неделям, — у каждой полоса тона по ходу записи, длительность, доля спокойствия и число напряжённых отрезков.
Экран «Аналитика» Undertone на телефоне: переключатель на 7, 30 и 90 дней, итоги по сессиям, времени записи и доле спокойствия, недельный график соотношения тонов с красными точками на напряжённых отрезках, панель «9 tense stretches» со словами, прозвучавшими рядом с ними, и доля спокойствия по времени суток.

Веб-приложение

Тот же Undertone за компьютером: запись перед звонком с живой расшифровкой рядом с кольцом, разбор сессии с признаками в голосе за каждым отрезком, просмотр библиотеки по тону и закономерности месяца на одном экране.

Undertone — Запись
Страница «Запись» в веб-приложении Undertone: слева название сессии, теги, карточка с подсказкой и уровень микрофона; в центре кольцо тона с показанием «Calm 72%», кнопки сброса, остановки и паузы и подсказки по клавишам; справа живая расшифровка с точкой тона у каждой фразы и уже отмеченные моменты; внизу волна во всю ширину.
Undertone — Результат
Результат сессии в веб-приложении Undertone: заголовок с выделенными словами «tense stretch at 1:10», шкала времени с волной, четырьмя дорожками тонов, скобкой «Tense · 28 s» и заштрихованным окном с низкой уверенностью; ниже — расшифровка с меткой тона у каждой строки, панель «Why this is angry» с высотой голоса, громкостью, темпом речи и паузами относительно базового уровня говорящего и общее соотношение тонов в сравнении с последними 30 днями.
Undertone — Сессии
Библиотека «Сессии» в веб-приложении Undertone: фильтры «All», «Tense moments» и «Shared» над таблицей сессий — когда, длительность, полоса тона, доля спокойствия, пиковый момент и число напряжённых отрезков — и панель превью выбранной сессии с мини-дорожками, соотношением тонов, цитатой пикового момента и связанными сессиями.
Undertone — Аналитика
Страница «Аналитика» в веб-приложении Undertone за 30 дней: итоги по сессиям, времени записи, доле спокойствия и напряжённым отрезкам, недельная столбчатая диаграмма соотношения тонов с линией спокойствия за 30 дней, список напряжённых отрезков со словами, прозвучавшими рядом с каждым, под заголовком «7 of 9 came near vendor talk», доля спокойствия по времени суток, календарь сессий и базовый уровень голоса.

РИС. 04 / ВИЗУАЛЬНОЕ РЕШЕНИЕ

Визуальное решение

«Мягкий звук», светлая тема: тёплый бумажный фон, чернильный текст, никаких карточек на фоне и никаких теней, кроме одного мягкого ореола вокруг кнопки записи. Young Serif отвечает за заголовки, названия эмоций и крупные цифры; Plus Jakarta Sans — за всё остальное. У каждой эмоции один приглушённый цвет — синий у спокойствия, янтарный у радости, кирпичный у злости, фиолетовый у грусти, — и он всегда идёт вместе с подписью, а кнопки-таблетки, круглые кнопки с иконками и тонкие линии не дают экранам шуметь.

Палитра

  • Фон#F5F2EC
  • Чернила#221E2B
  • Спокойствие#3A6EA5
  • Радость#B7791F
  • Злость#B23A2E
  • Грусть#5B4B8A

Шрифты

Young Serif
Заголовки, названия эмоций, крупные цифры, таймеры
Plus Jakarta Sans
Всё остальное: расшифровка, подписи, кнопки, графики

РИС. 05 / ЯЗЫК АНИМАЦИИ

Язык анимации

«Сначала услышать, потом окрасить»: движение повторяет то, как работает модель. Звук появляется серым, курсор перескакивает по 2-секундным окнам, по одному за раз, а цвет тона ложится с отставанием в одно окно, потому что модель может оценить только то, что уже услышала. Пропорции в кольце, дорожках и графиках перестраиваются плавным сдвигом, а слова появляются целыми фразами, а не печатаются по буквам. Спокойно и неторопливо, без отскоков и свечения: самое драматичное на экране — смена одного слова.

Есть похожий проект?

Расскажите, что вы хотите создать. Разберём это на 30-минутном звонке.

Напишите мне вWhatsAppTelegram