раздел 00

Зачем голос для работы с ИИ

Промпт для нейросети - это часто целый абзац: контекст, задача, примеры, пожелания. Печатать такое долго, и обычно лень. В итоге запрос выходит коротким и сухим, а ответ - слабым.

Голосовой ввод решает это. Вы зажимаете горячую клавишу, проговариваете мысль вслух, и текст сам появляется в поле чата. Говорить получается заметно быстрее, чем печатать, и мысль льётся свободнее.

Средний человек печатает примерно 40 слов в минуту, а говорит 130-150. Для длинного промпта это разница между «набью через силу» и «просто расскажу, что мне нужно».

Где голос особенно выручает

Длинные контекстные промпты
Когда нужно надиктовать много деталей и вводных - голосом это минута разговора вместо пяти минут печати.
Доработки ответа
«Сократи второй абзац, добавь пример, смени тон на дружелюбный» - проще сказать, чем набирать.
Думать вслух
Когда сами не до конца сформулировали задачу - проговорите её, модель разберётся в потоке мысли.
Когда руки заняты
Читаете документ, держите телефон, отошли от клавиатуры - диктовать всё равно можно.

Как это устроено в двух словах

Инструмент слушает микрофон, распознаёт вашу речь (на самом устройстве или в облаке) и вставляет готовый текст туда, где стоит курсор - в чат нейросети, в письмо, в заметку, куда угодно. Некоторые инструменты ещё и чистят речь: убирают «эээ», повторы и оговорки, расставляют знаки препинания.

Что разберём дальше

  • 01 - инструменты: Wispr Flow, встроенная диктовка macOS и Windows, Superwhisper, мобильные клавиатуры.
  • 02 - как пользоваться: поставить, назначить клавишу, диктовать и дорабатывать.
  • 03 - шпаргалка: сравнение, приёмы диктовки, приватность и словарь.