Компания Canonical представила проект Myna — новую систему локального распознавания речи, предназначенную для голосового ввода текста в Ubuntu. Проект Myna — часть общей стратегии Canonical по развитию локального ИИ в Ubuntu. Он находится на ранней стадии и распространяется под GPLv3; в репозитории пока размещены спецификации и описание архитектуры.
В Ubuntu 26.10 планируется реализовать базовый сценарий диктовки: пользователь нажимает горячую клавишу, произносит текст, а система подставляет результат в активное приложение через симуляцию клавиатурного ввода. Во время диктовки отображается визуальный индикатор активности микрофона. Первичной платформой для тестирования выбраны GNOME + Wayland, но архитектура изначально рассчитана на адаптацию под другие рабочие столы.
Анонсированный ранее проект Myna использует локально выполняемые AI‑модели, работающие без подключения к интернету. Микрофон активируется только после явного нажатия горячей клавиши, аудиоданные обрабатываются в оперативной памяти и удаляются после завершения сеанса, а записи не передаются во внешние сервисы. Хотя архитектура не запрещает использование облачных моделей, приоритетом первого релиза является полностью локальная обработка речи.

Проект построен как модульная платформа: отдельные компоненты отвечают за распознавание речи, управление диктовкой, взаимодействие с пользователем и подстановку текста. Среда выполнения моделей будет распространяться в виде snap‑пакета. Среди рассматриваемых моделей — Whisper, Parakeet, NemoTron и Qwen3‑ASR.
Звуковой сервис работает напрямую с аудиоустройством или через PulseAudio/PipeWire, выполняет шумоподавление и нормализацию громкости. Сгенерированный моделью текст проходит постобработку — очистку, нормализацию, форматирование и расстановку знаков препинания — после чего подставляется в активное приложение через механизмы ввода, такие как Wayland input‑method или IBus.
Разработчики подчёркивают, что в Ubuntu 26.10 Myna будет сосредоточена исключительно на надёжной диктовке текста. Голосовые команды, ассистент, управление рабочим столом, перевод и автоматическое определение языка планируются только после стабилизации базового функционала. Canonical приглашает сообщество к участию в разработке и тестировании, особенно пользователей ассистивных технологий и тех, кто уже использует диктовку в Linux.







