Дизайн: убрать вопрос распознавания речи из задач репозитория

This commit is contained in:
Porfiry
2026-09-18 23:58:09 +03:00
parent a515008e19
commit b569f3ee31
3 changed files with 9 additions and 5 deletions
+7 -3
View File
@@ -40,9 +40,13 @@ sketches/003-three-pane-command/index.html # три панели + состо
## Что предстоит решить
1. **Откуда берётся распознавание речи.** В библиотеке `client` сейчас только текст
и картинки — аудио в протоколе нет. Варианты: звать распознавание напрямую
(у нас поднято на 88.125) либо сначала выяснить, как это делается на сервере агента.
1. **Какой вариант берём** — 1, 2 или 3 (или собрать гибрид).
2. **Запись на удержание** (говоришь, пока держишь) или **по нажатию** (нажал —
говоришь — нажал). В варианте 2 работает удержание пробела.
3. **Нужны ли папки** для диалогов, как в мобильном клиенте, или хватит поиска.
## Что сознательно не решается здесь
- **Откуда берётся распознавание речи.** Это отдельная тема и к интерфейсу не
относится: в дизайне показано только место кнопки и что происходит на экране
во время записи. Кто именно превращает голос в текст — решается потом.
+1 -1
View File
@@ -10,7 +10,7 @@
инструмента — серая плашка с командой. Видно, но не мешает.
- **Кнопка записи:** круглая, рядом с полем ввода. При записи — панель над полем
с волной, таймером и «Остановить и отправить».
- **Куда попадает распознанное:** в поле ввода. Проверил глазами — потом отправил.
- **Куда попадает расшифровка:** в поле ввода — сначала посмотреть, потом отправить.
## Что хорошо
- Меньше всего удивляет; подходит как «рабочая лошадь» на каждый день.
+1 -1
View File
@@ -15,7 +15,7 @@
## Что хорошо
- Голосом пользоваться реально удобно: видно, что тебя услышали, до отправки.
- Ошибка распознавания не улетает агенту — сначала показывается текст.
- Ошибку в тексте видно до отправки — можно поправить.
## Что слабо
- Больше элементов на экране, надо разбираться.