Голосовой ввод в Murmure: кому подойдёт офлайн-диктовка

Обзор Murmure 1.11.3: как работает локальный голосовой ввод, словарь и правила форматирования, кому подойдёт приложение и где его ограничения.

Monday, September 14, 2026Omid Saffari
Tools
  • MMurmure
Голосовой ввод в Murmure: кому подойдёт офлайн-диктовка

Murmure 1.11.3 стоит установить, если нужен бесплатный голосовой ввод на компьютере, который работает офлайн, и вы готовы обучить приложение своей технической лексике. На синтетическом образце для разработчиков длительностью 19.817 секунды словарь улучшил распознавание названий, но дал ложное срабатывание; шесть специально подобранных записей вместе с упорядоченными правилами форматирования исправили термины и путь к файлу — не хватило лишь финальной точки. Если нужны нулевая настройка или официальная поддержка от поставщика, лучше выбрать другое решение.

Голосовой ввод в Murmure: краткий вердикт

Murmure — приложение для диктовки текста на Windows, macOS и Linux. Удерживаете или переключаете сочетание клавиш, говорите, а встроенная модель Parakeet преобразует запись в текст на CPU. Перед вставкой в активное приложение результат можно исправить с помощью словаря и последовательно выполняемых правил замены. Необязательный этап с LLM работает локально либо отправляет расшифровку на OpenAI-совместимый сервер. Во втором случае граница приватности меняется, хотя само распознавание речи остаётся локальным. На момент проверки 14 сентября 2026 года на сайте Murmure была указана версия 1.11.3 и единственный бесплатный вариант с открытым исходным кодом.

Вердикт положительный, но с оговорками: Murmure подойдёт тем, кому важна локальная расшифровка и кто готов настроить последний этап обработки. Чудесного распознавания специальной лексики ждать не стоит. На воспроизводимом образце исходная модель справилась с распространёнными техническими терминами, однако для пригодного результата пришлось определить, какие ошибки исправлять словарём, а какие — правилами форматирования.

Сильные стороны
Что получается хорошо
10 points

  • Основное распознавание речи выполняется локально, без аккаунта и подписки.
  • Словарь влияет на декодирование, а не служит только списком слепых замен.
  • Последовательно выполняемые regex-правила позволяют детерминированно обрабатывать пути к файлам и повторяющиеся технические фразы.
  • В документации заявлена поддержка Windows, Mac на Intel и Apple Silicon, Linux X11 и Linux Wayland.
  • CLI и экспериментальный localhost API делают приложение полезнее обычной утилиты для диктовки из системного трея.
  • Словарь способен порождать ложные срабатывания: в тесте это произошло с двумя похожими названиями окружений.
  • В Linux Wayland нет режима push-to-talk, macOS требует трёх разрешений, а для Windows задокументирована проблема со спящим режимом.
  • Язык определяется автоматически, задать его вручную нельзя.
  • Текущая документация противоречит сама себе в вопросе прежнего пятиминутного ограничения записи.
  • Поведение удалённой LLM зависит от настроек конечной точки и модели, а внешняя обработка выводит текст расшифровки за пределы устройства.

Перед загрузкой важно не перепутать названия: в этом обзоре рассматривается Murmure с сайта murmure.app. Murmur из Microsoft Store, MurMur Voice-to-Text, Murmur для macOS и Murmur AI — другие продукты.

Кому подойдёт Murmure, а кому лучше пройти мимо

Murmure рассчитан на пользователей настольных систем с устойчивым повторяющимся словарём: названиями проектов и продуктов, командами, путями и фразами, которые имеет смысл настроить один раз. Особенно логичен такой выбор, когда аудио нельзя загружать в облако, а небольшая настройка обходится дешевле ежедневного исправления одних и тех же терминов.

Цены и характеристики продуктов в этом кратком списке проверены 14 сентября 2026 года.

ИнструментДля кого лучше всегоГде обрабатываются данныеТекущая стоимость ПО
Murmure 1.11.3Диктовка в разных настольных приложениях с собственными правиламиПо умолчанию локально; расшифровку можно передать необязательной LLM$0
DictareГолосовые команды для терминальных ИИ-агентов разработкиЛокально$0
Windows voice typingЭпизодическая диктовка без установки в Windows 10 или 11Онлайн-распознавание речи AzureВходит в Windows
Apple DictationЭпизодическая диктовка без установки на MacВ настройках клавиатуры указано, обрабатывается ли обычная Dictation на устройствеВходит в macOS

Выбирайте Murmure, если работа идёт сразу в редакторе, трекере задач, браузере, чате и терминале, а проблемная лексика везде одна и та же. Доступны обычная вставка через Ctrl+V, терминальная через Ctrl+Shift+V и имитация нажатий клавиш. Компромисс в том, что настройкой придётся заниматься самостоятельно.

Выбирайте Dictare, если вам нужна не диктовка обычного текста, а голосовое управление Claude Code, Codex, Gemini CLI, Aider, Pi или другим агентом командной строки. На действующем сайте Dictare указаны macOS и Linux, локальные Whisper или Parakeet, лицензия MIT и отсутствие подписки. Для такого сценария это более точный инструмент, но альтернативой для Windows он не является. Подробнее — в разборе стоимости Dictare и общем руководстве по голосовому управлению ИИ-агентами для программирования.

Выбирайте Windows voice typing, если установка и настройка создают больше проблем, чем облачная обработка. Microsoft указывает сочетание Windows+H и предупреждает, что для голосового ввода нужен интернет, поскольку функция использует службы распознавания речи Azure. Windows voice access — отдельная локальная функция для управления компьютером и набора текста; её стоит оценить, если офлайн-режим важен, но Murmure кажется слишком сложным. Microsoft объясняет различия.

Выбирайте Apple Dictation, если пользуетесь Mac и хотите встроенное решение операционной системы. По данным Apple, оно работает везде, где доступен ввод текста, а в настройках клавиатуры можно увидеть, обрабатывается ли обычная Dictation на самом устройстве. Явной связки словаря и regex-правил, как у Murmure, здесь нет, зато настройка проще. Актуальные сведения для установленной версии macOS и языка приведены в руководстве Apple по Dictation.

Не выбирайте ни один из этих четырёх вариантов как быстрый способ закупить решение для клинической практики. В Murmure есть пресеты словаря и промптов Medical, но сам по себе пресет не подтверждает клиническую валидацию, наличие соглашения по безопасности для организации или поддержку EHR. Специализированный продукт вроде Dragon Medical One создавался для клинической документации и профессиональной медицинской лексики. Окончательное решение всё равно зависит от юрисдикции организации, проверки безопасности, интеграций и договора.

Диктовка через Murmure Parakeet: сначала исходный результат

Murmure использует NVIDIA Parakeet TDT 0.6B v3: модель локально преобразует монофоническое аудио 16 kHz в текст, после чего применяются включённые этапы постобработки. Исходная расшифровка важна, потому что LLM способна придать слабому тексту гладкий вид, незаметно изменив смысл. Если сначала проверить слой распознавания, становится понятно, было ли название неверно услышано, неверно оформлено или произошло и то и другое. Последовательность описана в документации Murmure по расшифровке.

Воспроизводимый образец намеренно был сложным для универсальной диктовки:

Project Kieirra uses the NovusFlow adapter. Open slash opt slash NovusFlow slash releases slash v three slash worker dot pie. Update the Kubernetes namespace, the PostgreSQL schema, and the Pydantic validator. Replace staging dash west with staging dash east.

Запись синтезировали в eSpeak NG 1.52 американским английским голосом со скоростью 145 слов в минуту и высотой тона 45, а затем преобразовали в монофонический 16-битный WAV с частотой 16 kHz. Длительность файла — 19.817 секунды, в нём 39 слов. Тестовая система представляла собой среду Ubuntu 26.04.1 x86_64 с восемью виртуальными процессорами AMD EPYC-Rome, 15,608 MiB оперативной памяти и без доступного GPU.

Официальный Debian-пакет версии 1.11.3 занимал 624 MiB, а опубликованная контрольная сумма SHA-256 совпала с суммой загруженного файла. Размер AppImage составлял 693 MiB, его контрольная сумма тоже совпала. В минимальном контейнере Debian-пакет не запустился без графических зависимостей, поэтому AppImage использовался с изолированной обвязкой дисплея и библиотек. Это наблюдение о headless-среде тестирования, а не утверждение, что обычному настольному Ubuntu требуется такая же подготовка.

С параметром --no-dictionary Murmure выдал:

Project key reuse the novusflow adapter. Open slash opt slash novusflow slash releases slash v3 slash worker dot pie. Update the Kubernetes namespace, the poster SQL schema, and the Pydentic validator. Replace staging dash west with staging dash east.

Модель правильно распознала Kubernetes и структуру предложений. Ошибки затронули Kieirra, регистр NovusFlow, PostgreSQL, Pydantic, расширение файла и устное обозначение пути. От первой записи в журнале CLI до появления текста прошло около четырёх секунд, включая загрузку модели. Если разделить 19.817 секунды аудио примерно на четыре секунды, получится около 4.95-кратной скорости относительно реального времени на этой конкретной системе с CPU. Это результат одного синтетического теста на определённой машине, а не подтверждение отдельного заявления производителя о скорости.

Для обычной прозы такой исходный результат уже пригоден. Но для команды, примечания к релизу или задачи, где ошибка в одном сегменте пути может отнять больше времени, чем сэкономила диктовка, его недостаточно.

Пользовательский словарь помогает — пока не начинает мешать

Словарь Murmure не ограничивается заменой совпавшего текста после расшифровки. Он повышает вес терминов-кандидатов во время декодирования Parakeet, а затем исправляет написание близких вариантов с низкой уверенностью. Так можно спасти имя собственное до того, как оно превратится в постороннее общеупотребительное выражение. В документации по словарю также сказано, что длинный список ослабляет это усиление и повышает риск ложных срабатываний.

В первом проходе использовались восемь записей: Kieirra, NovusFlow, Kubernetes, PostgreSQL, Pydantic, staging-west, staging-east и worker.py. Результат выглядел так:

Project key reuse the NovusFlow adapter. Open slash opt slash NovusFlow slash releases slash v3 slash worker.py. Update the Kubernetes namespace, the PostgreSQL SQL schema, and the Pydantic validator. Replace staging-east west with staging-east east.

Прогресс заметен. NovusFlow получил нужный регистр, worker.py превратился в один токен, а Pydantic был исправлен. PostgreSQL стал ближе к цели, но рядом появилось дублированное SQL. Kieirra по-прежнему не распознался. Самое важное: две похожие записи для окружений помешали обычным произнесённым словам — обе фразы «staging dash» ещё до распознавания направления потянулись к staging-east.

Результат подтверждает предупреждение производителя: «меньше — лучше». Запись в словаре — кандидат для декодирования, а не гарантированная смысловая инструкция. Два фонетически близких варианта могут конкурировать, поэтому бездумно добавлять всё новые формы небезопасно.

В Murmure 1.11.3 допустимы записи из одного или двух слов, не более чем с одним пробелом. Поддерживаются буквы, диакритические знаки, пунктуация и дефисы; цифры и контекстно-зависимые записи не поддерживаются. После превышения 100 записей этап исправления орфографии отключается, хотя точные совпадения сохраняют регистр. Для большого корпоративного глоссария это конструктивное ограничение, а не малозначительная сноска.

Как правила форматирования исправляют техническую лексику

Правила форматирования Murmure — это детерминированные преобразования перед вставкой текста. Доступны режимы Contains, Exact match и Regex, а правила выполняются сверху вниз. Поэтому этот слой лучше подходит для фраз с заранее известным результатом, особенно путей к файлам и произносимых разделителей. Документация по правилам форматирования прямо относит к этому слою многословные замены, цифры, regex и голосовые команды.

В уточнённом тесте две конфликтующие записи staging удалили, оставив шесть терминов в словаре. Пять последовательных правил обработали то, с чем не справилось одно распознавание:

  • key reuse заменялось на Kieirra uses.
  • Один регистронезависимый regex преобразовывал произнесённую последовательность slash и dot в /opt/NovusFlow/releases/v3/worker.py.
  • PostgreSQL SQL заменялось на PostgreSQL.
  • staging dash west заменялось на staging-west.
  • staging dash east заменялось на staging-east.

Итоговая расшифровка:

Project Kieirra uses the NovusFlow adapter. Open /opt/NovusFlow/releases/v3/worker.py. Update the Kubernetes namespace, the PostgreSQL schema, and the Pydantic validator. Replace staging-west with staging-east

В ней присутствовали все заданные технические термины, окружения и полный путь. Единственным текстовым отличием от цели стала пропущенная точка в конце. От первой записи в журнале до расшифровки снова прошло около четырёх секунд.

Это не означает, что для любой ошибки стоит создавать постоянное правило. «Key reuse» — артефакт синтетического произношения, поэтому реальному пользователю такая замена нужна лишь в том случае, если ошибка повторяется в его собственных записях. Универсальный вывод здесь другой: словарь должен направлять распознавание, а последовательные правила — задавать точный результат.

Архитектурная схема исправления: от исходного результата Parakeet через словарь и правила к готовому тексту
Система исправлений работает лучше всего, когда у каждого слоя одна задача
  1. Запишите сложный исходный образец

    Возьмите один фиксированный текст с именами, путями, числами и исправлениями, важными для реальной работы. Сохраните исходную расшифровку до включения любой очистки.

  2. Добавляйте только повторяющиеся названия

    Внесите в словарь компактные имена собственные и технические токены, которые система стабильно распознаёт неверно. Запустите тот же образец ещё раз и ищите не только исправленные слова, но и новые ложные срабатывания.

  3. Сделайте точный результат детерминированным

    Используйте упорядоченные правила форматирования для произносимых разделителей, полных путей, цифр и известных многословных замен. Повторите тест и посимвольно сравните результат с целью.

  4. Подключайте LLM последней

    Необязательную модель для гибкого редактирования стоит добавлять лишь после того, как понятен детерминированный маршрут. Так сохраняется чистая отправная точка, а причины регрессий легче находить.

Голосовой ввод офлайн в Murmure: что остаётся локальным

Основной путь аудио в Murmure не покидает компьютер: приложение записывает WAV, запускает Parakeet на CPU, применяет локальные исправления и вставляет результат. По заявлению производителя, аудио удаляется сразу, расшифровка не попадает в журналы, а пять последних элементов истории хранятся в RAM и исчезают после выхода. Аккаунта и телеметрии нет. В руководстве по первым шагам показан сценарий с активным приложением и варианты вставки.

Минимальные требования к железу необычно скромны для локального распознавания речи. Murmure рекомендует не менее 2 GB свободной RAM и 1 GB на диске; GPU не требуется. Необязательная локальная LLM создаёт отдельную нагрузку. В её документации рекомендованы 4 GB, 7 GB или 8 GB VRAM для моделей возрастающего размера и отмечено, что инференс только на CPU может быть медленным.

Даже «локальное» приложение требует проверки установки под конкретную платформу. Приватная модель не отменяет разрешения операционной системы, конфликты сочетаний клавиш и особенности вставки.

В Windows есть один необычный системный риск

Murmure для Windows поддерживает Windows 10 и более новые версии и требует Visual C++ Redistributable. Глобальный перехватчик сочетаний клавиш может вызвать подозрения антивируса; кроме того, производитель описывает нерешённый случай, когда во время работы приложения перехватчик способен мешать Windows переходить в сон или гибернацию. Оба ограничения указаны на странице установки для Windows.

На управляемом ноутбуке эта проблема со сном — веская причина отказаться от Murmure, пока её не устранят или организация не согласует обходное решение. Она куда существеннее лишнего щелчка в установщике.

В macOS понадобятся три разрешения

Murmure для macOS выпускается и для Apple Silicon, и для Intel. Приложению нужны разрешения Microphone, Accessibility и Input Monitoring, после чего требуется перезапуск. Стандартное сочетание Ctrl+Space конфликтует с переключением источника ввода в macOS, а комбинации с Space или цифровыми клавишами могут оставлять лишние символы в активном приложении. Страница установки для macOS рекомендует вместо них Ctrl+Option+M, функциональную клавишу или кнопку мыши.

Для одного Mac это разовая настройка. При массовом развёртывании политика разрешений и сочетаний клавиш становится отдельной работой, которую цена $0 не отражает.

В Linux лучше всего X11, а Wayland требует больше ручной настройки

В Linux Murmure полностью поддерживает X11. В Wayland пользователь должен самостоятельно создать системные сочетания клавиш, вызывающие бинарный файл; доступен только режим toggle-to-talk, потому что такие сочетания не передают событие отпускания клавиши. Debian-пакет собран на Ubuntu 24.04 и требует GLIBC 2.38 или новее; для более старых версий Ubuntu производитель предлагает AppImage. Команды для разных пакетов и известные проблемы приведены на странице установки для Linux.

Если в Wayland принципиально нужен push-to-talk, от Murmure придётся отказаться. Если режим переключения устраивает, интеграция через CLI настраивается явно и после настройки сохраняется между перезагрузками.

Локальная и удалённая LLM в Murmure

Murmure LLM Connect — необязательный этап обработки текста, а не часть основного распознавания речи. После расшифровки и до вставки он может обратиться к локальному Ollama или OpenAI-совместимому серверу. Для каждого из четырёх сохраняемых режимов можно отдельно выбрать провайдера, модель, системный и пользовательский промпты. В комплект входят пресеты Translation, Medical, Development и Voice Dictation. Документация по LLM Connect также позволяет применить сохранённый режим к выделенному тексту.

Разница с точки зрения приватности проста:

  • Без LLM: обработка аудио и расшифровки остаётся на компьютере.
  • Локальный Ollama: Murmure передаёт текст расшифровки серверу модели на локальном компьютере или контролируемой вами конечной точке в локальной сети.
  • Удалённый провайдер: основное распознавание аудио остаётся локальным, но текст расшифровки и промпт отправляются настроенному серверу. Теперь имеют значение его правила хранения данных, биллинг, контроль доступа и юрисдикция.
Схема выбора: локальное распознавание речи с последующей локальной или удалённой обработкой LLM
Аудио может оставаться локальным, даже когда текст расшифровки пересекает внешнюю границу

При тестировании необязательной модели эти слои не смешивались. Сначала исходную расшифровку напрямую отправили в Ollama 0.34.0 с моделью qwen3.5:0.8b, отключённым режимом thinking и температурой, равной нулю. Ollama сообщила об общей продолжительности 5.005 секунды на CPU. Модель исправила полный путь к файлу, PostgreSQL, Pydantic и оба окружения staging, но оставила без изменений «key reuse» и первое «novusflow» в нижнем регистре. Для устойчивой лексики детерминированные правила дали лучший результат.

OpenAI-совместимый маршрут показал ещё один компромисс. Murmure отправил выделенную расшифровку в совместимую конечную точку стандартного Ollama, но генерация на этой небольшой модели продолжалась 32.323 секунды и завершилась HTTP 500 вместо текста для замены. Тот же запрос Murmure, направленный через loopback-мост совместимости с отключённым thinking и нулевой температурой, вернул частично исправленный текст через 4.769 секунды после запуска.

Этот мост был диагностическим инструментом, а не рекомендуемым производственным компонентом. Тест подтверждает, что удалённый протокольный маршрут действительно использовался и что настройки сервера способны изменить результат. Он не доказывает ни то, что все OpenAI-совместимые провайдеры дадут ошибку, ни то, что каждой конечной точке требуются такие параметры. Текст также не отправлялся внешнему провайдеру, поэтому внешние задержки, стоимость, хранение и конфиденциальность не проверялись. В тестовой headless-среде X11 возвращённый текст вставился в позицию курсора, а не заменил выделение, поэтому этот запуск не подтверждает успешную повседневную работу Transform UI.

Для предсказуемой технической лексики лучше правила. LLM оправдана, когда действительно требуется гибкое редактирование, перевод или перестройка текста и приемлем риск пропущенного исправления, лишней обёртки либо передачи данных за новую границу.

Локальный API полезен, но решает узкую задачу

Murmure предоставляет экспериментальную конечную точку HTTP для автоматической расшифровки файлов, пока приложение открыто. По умолчанию она слушает localhost:4800 и принимает multipart-загрузки WAV по адресу POST /api/transcribe. В документации по Local API есть примеры для curl, JavaScript и Python.

Ограничения делают её интеграцией для одной рабочей станции, а не общим сервисом распознавания: только WAV, максимум 100 MB, без потоковой передачи, запросы выполняются последовательно, доступ разрешён только с localhost или 127.0.0.1, CORS отключён. Словарь применяется автоматически, язык по-прежнему определяется автоматически.

Этого достаточно для локального скрипта, который отправляет записи встреч или голосовые заметки в тот же конвейер исправлений. Но это не API для параллельных пользователей, браузеров, удалённых сотрудников или живых субтитров. Если надстраивать такие возможности самостоятельно, модель безопасности и эксплуатации изменится.

Цена Murmure: единственный тариф — $0

На момент проверки 14 сентября 2026 года у Murmure был один вариант: бесплатное приложение с открытым исходным кодом. На странице производителя не было платного плана, аккаунта, лимита использования, срока пробного периода или отдельного коммерческого набора функций.

ТарифЦена ПОЧто включеноЗатраты за пределами цены
Бесплатно, открытый исходный код$0 за рабочее место в месяцНастольная расшифровка, словарь, правила, расширения, CLI, Local APIОборудование, электричество, время на настройку, поддержка и оплата необязательной удалённой LLM

Расчётная стоимость ПО составляет $0 за рабочее место в год и $0 за 1,000 продиктованных слов. Математически это точные цифры, но экономической картины они не дают. Даже развёртывание для десяти человек требует настроить разрешения, политику сочетаний клавиш, сопровождение словаря, проверку конечных точек и поддержку пользователей. Murmure не прячет подписку — выбор покупателя просто смещается от стоимости лицензии к самостоятельной эксплуатации.

Сравнивать срок окупаемости подписки с самим Murmure бессмысленно: подписки нет. Полезнее считать время. Если небольшой словарь и несколько правил устраняют повторяющиеся исправления, настройка может окупиться. Если каждому говорящему, проекту и окружению нужны разные правила, их сопровождение способно отнять больше времени, чем сэкономленный ввод с клавиатуры, даже при цене ПО $0.

Ограничения, которые действительно важны

У Murmure восемь ограничений, способных повлиять на решение о покупке.

1. Словарь может ухудшить расшифровку

В тесте с восемью записями несколько терминов исправились, но две фразы «staging dash» превратились в staging-east west и staging-east east. Документация предупреждает о ложных срабатываниях, и тест воспроизвёл одно из них. Похожие по звучанию записи нужно добавлять по одной и каждый раз проверять на одном и том же образце.

2. Большой словарь лишается одного этапа исправления

После 100 записей Murmure отключает этап исправления орфографии, хотя точные совпадения сохраняют регистр. Поэтому словарь плохо подходит для полного глоссария организации. Нужны правила отбора, а не привычка импортировать всё подряд.

3. Язык распознавания нельзя задать вручную

Parakeet автоматически выбирает один из 25 поддерживаемых европейских языков. В документации сказано, что принудительно указать язык сейчас нельзя. Для коротких записей, переключения между языками или аудио, похожего на другой язык, это убирает полезный способ исправить ошибку.

4. У настольной интеграции разные барьеры на разных платформах

В Wayland нет push-to-talk. macOS требует трёх разрешений и более безопасного сочетания клавиш. Windows может не переходить в сон, пока приложение работает. Это не косметические различия: от них зависит, подходит ли Murmure личной рабочей станции, заблокированному корпоративному ноутбуку или ни тому ни другому.

5. Документация расходится во мнениях о длительности записи

На странице расшифровки всё ещё указаны пятиминутный максимум и автоматическая остановка. В примечаниях к версии 1.10.1 сказано, что прежнее пятиминутное ограничение снято, а текущая страница API сообщает об отсутствии лимита длительности помимо ограничения файла в 100 MB. Более новые примечания к выпуску и документация API выглядят убедительнее, однако из-за оставленного старого ограничения пользователям приходится самостоятельно сопоставлять официальные страницы.

6. Необязательные LLM добавляют вариативность и новую границу доверия

Локальный маршрут Murmure явно рассчитан на Ollama, а в удалённом режиме поведение делегируется OpenAI-совместимой конечной точке. В тесте одна стандартная конфигурация конечной точки дала явную ошибку, а при контролируемых параметрах генерации получилось частичное исправление. Отдельно важно, что любой внешний сервер получает текст расшифровки. Удалённая LLM может быть полезна, но она не даёт бесплатного прироста точности и не входит в базовое обещание приватности.

7. Платного операционного слоя нет

Производитель не предлагает платный план, управляемую поддержку, административную консоль или соглашение об уровне обслуживания. Для бесплатного настольного приложения под лицензией AGPL-3.0 это логично. Но организации, которой нужны договорная поддержка, политика для парка устройств или обозначенный маршрут эскалации, по этой же причине стоит отказаться от Murmure.

8. API намеренно локальный и последовательный

Экспериментальный API обрабатывает WAV-запросы на localhost по одному, в порядке очереди. Потоковой передачи нет, удалённый браузер и несколько параллельных пользователей не поддерживаются. Это полезный интерфейс для интеграции, а не промышленная речевая инфраструктура.

Вердикт: Murmure стоит использовать, когда правила важнее удобства

Murmure можно рекомендовать пользователям поддерживаемых настольных ОС, которым важна приватность, регулярно встречается одна и та же лексика и не мешает предварительная настройка. Версия 1.11.3 быстро обработала воспроизводимый технический образец на CPU, а сочетание словарных записей, влияющих на декодирование, с упорядоченными правилами форматирования надёжнее необязательной малой LLM выдало нужные имена, окружения и полный путь.

Правило выбора простое: устанавливайте Murmure, если верны все три пункта.

  1. Операционная система и модель сочетаний клавиш подходят рабочей станции.
  2. Исходное аудио и текст должны оставаться локальными.
  3. Набор повторяющихся исправлений достаточно мал, чтобы его можно было настроить и поддерживать.

Откажитесь от приложения, если критично хотя бы одно из следующего: диктовка на мобильном устройстве, нулевая настройка, принудительный выбор языка, push-to-talk в Wayland, договорная поддержка, API для параллельной работы или удалённая очистка без разрешения отправлять текст расшифровки.

Самая надёжная конфигурация одновременно и самая простая: сначала локальный Parakeet, затем небольшой словарь, после него упорядоченные правила — и никакой LLM, пока для гибкого преобразования не появится ясная задача. Так ошибки остаются видимыми, а границу приватности легко объяснить.

Частые вопросы

Какое приложение с ИИ лучше всего подходит для диктовки?

Лучший вариант определяется ограничениями. Murmure подходит для локальной диктовки в разных настольных приложениях с собственными правилами, Dictare — для голосового управления терминальными агентами разработки, а встроенная диктовка Windows или Apple — для эпизодического использования с минимальной настройкой.

Какая программа для медицинской диктовки лучшая?

Выбирайте ПО, чьи клинический словарь, работа с EHR, документация по безопасности, поддержка и условия соответствия подходят организации. В Murmure есть пресеты словаря и промптов Medical, но сами по себе они не доказывают клиническую валидацию; среди специализированных решений стоит оценить Dragon Medical One.

Какая бесплатная программа для онлайн-диктовки лучшая?

Google Docs voice typing работает в браузере в актуальных версиях Chrome, Edge и Safari. Murmure тоже бесплатен, но это офлайн-приложение для настольной системы, а не сайт для диктовки.

Какое бесплатное приложение для диктовки выбрать?

Murmure — более сильный бесплатный вариант, когда важны локальная обработка и повторяемые пользовательские исправления. Windows voice typing или Apple Dictation проще, если главное — использовать уже доступные функции операционной системы.

Есть ли в Windows 11 встроенная диктовка?

Да. Поместите курсор в текстовое поле и нажмите Windows+H, чтобы запустить Windows voice typing. По данным Microsoft, функция использует онлайн-распознавание речи Azure и требует интернета; Windows voice access — отдельный локальный вариант управления на устройстве.

Как диктовать текст вместо набора на клавиатуре?

Поставьте курсор в текстовое поле и нажмите нужное сочетание клавиш. В Windows это Windows+H, для Apple Dictation — настроенное сочетание Dictation или клавиша микрофона, а Murmure использует настраиваемое глобальное сочетание и затем вставляет результат в активное приложение.

Какое приложение для диктовки лучше всего подходит для iPhone?

Murmure не выпускается для iPhone. Начните со встроенной функции Apple Dictation, которая работает везде, где можно вводить текст, и переходите к специализированному мобильному приложению, только если его словаря и сценария недостаточно.

Бесплатен ли голосовой ввод в Google Docs?

В инструкции Google голосовой ввод не указан как отдельно оплачиваемое дополнение. Он доступен в Docs в поддерживаемых браузерах, хотя администратор организации может отключить функцию.

Как лучше всего тренировать диктовку?

Возьмите фиксированный сценарий со сложными именами, путями, пунктуацией и исправлениями из реальной работы. Сравнивайте каждый результат с целевым текстом, меняйте за один раз только одну словарную запись или правило и повторите проверку с естественной речью, прежде чем доверять настройке.

Murmur offline speech to text

По такому запросу можно найти несколько не связанных между собой продуктов. Этот обзор посвящён Murmure с сайта murmure.app — бесплатному настольному приложению с локальным распознаванием Parakeet, а не Murmur из Microsoft Store или другим сервисам с похожими названиями.

Возьмите чек-лист аудита бизнес-процессов с ИИ, чтобы решить, какие части автоматизации должны оставаться локальными, а какие могут пересекать границу провайдера.

Последнее обновление
14 сент. 2026 г.
Категория
Build

Сделать этот сайт предпочтительным в Google

Добавить omidsaffari.com как предпочтительный источник в Google Поиске

Отметьте omidsaffari.com как предпочтительный источник — и Google будет поднимать его для вас в Top Stories, AI Overviews и AI Mode.

Похожие статьи
FFmpeg API RenderIO: тарифы, лимиты и реальная стоимость

FFmpeg API RenderIO: тарифы, лимиты и реальная стоимость

Разбираем тарифы FFmpeg API RenderIO: цену одной команды, переплату сверх лимита, ограничения времени и цепочек и переход на Growth или Business.14 сент. 2026 г.Build
Dictare: бесплатный голосовой ввод для программирования

Dictare: бесплатный голосовой ввод для программирования

Dictare — бесплатный локальный голосовой ввод для программирования. Отделяем цену программы от настройки речевых моделей, компьютера и тарифа ИИ-агента.13 сент. 2026 г.Build
Тестирование плагинов Claude Code: evals без самописного раннера

Тестирование плагинов Claude Code: evals без самописного раннера

Разбираем нативные eval-тесты Claude Code: как сравнить поведение с плагином и без него, оценить дельту, ограничить расходы и поставить проверку в CI.12 сент. 2026 г.Build
Голосовой ИИ-агент Cloudflare: как найти причину задержки

Голосовой ИИ-агент Cloudflare: как найти причину задержки

Разбираем turnmetrics в Cloudflare: по этапам и исходам находим причину задержки или молчания голосового ИИ-агента — от транскрибации до TTS.12 сент. 2026 г.Build
Как добавить субтитры в видео через Rendi: вшиваем SRT

Как добавить субтитры в видео через Rendi: вшиваем SRT

Разбираем, как добавить субтитры в видео через Rendi: отправить SRT и MP4 в API, настроить оформление, дождаться результата и проверить готовый файл.11 сент. 2026 г.Build
OpenAI Agents API или Agents SDK: что выбрать

OpenAI Agents API или Agents SDK: что выбрать

Сравниваем OpenAI Agents API и Agents SDK: управление состоянием, развертывание, стоимость, ограничения и сценарии, в которых стоит выбрать каждый вариант.11 сент. 2026 г.Build
Цена Rendi в 2026 году: считайте байты, а не минуты видео

Цена Rendi в 2026 году: считайте байты, а не минуты видео

Сколько стоит Rendi в 2026 году? Разбираем тарифы FFmpeg API, лимиты обработки и хранения, время команд и выбор плана под реальную нагрузку.11 сент. 2026 г.Build
Git worktree в Codex CLI: изолированные задачи без ручной рутины

Git worktree в Codex CLI: изолированные задачи без ручной рутины

Разбираем git worktree в Codex CLI 0.154.0: запуск изолированных сессий, проверка изменений, сохранение коммитов и безопасная очистка рабочих деревьев.10 сент. 2026 г.Build
Рассылка

Одно письмо, каждое воскресенье.Работающие системы, а не горячие мнения.

Еженедельно. Без спама. Отписка в любой момент.