AI И НЕЙРОСЕТИ

Canonical добавит в Ubuntu 26.10 локальный ввод речи с Myna

18 июня 2026 года Canonical раскрыла детали Myna — локального speech-to-text для Ubuntu 26.10, которое будет работать прямо на ПК.

✍️ Редакция iTech News | 19.06.2026 | ⏱ 5 мин | Источник: The Register
🎓

Canonical раскрыла детали Myna — это локальный speech-to-text, который компания собирается встроить в Ubuntu Desktop 26.10 с кодовым именем Stonking Stingray. Для русскоязычных IT-команд новость важна не из-за очередной наклейки «AI», а по более приземлённой причине: крупный Linux-вендор наконец доводит до штатного сценария офлайн-распознавание речи прямо на рабочем столе.

О планах Canonical 18 июня 2026 года сообщает The Register. По данным издания, компания опубликовала на своём форуме Discourse больше подробностей о Myna: в релизе Ubuntu 26.10 разработчики сознательно ограничатся базовым, но понятным сценарием. Пользователь нажимает горячую клавишу, диктует текст обычным голосом и получает результат в том приложении, где сейчас работает. Интерфейс тоже обещают без лишнего шаманства: система должна явно показывать, что диктовка активна и что речь действительно распознаётся, а не исчезает в неизвестном направлении.

Это не звучит как научный прорыв, и в этом как раз плюс. Canonical не пытается продавать голосовой ввод как «агентную платформу будущего», хотя сама компания в последние месяцы явно усиливает AI-повестку. Здесь задача проще и полезнее: встроить в десктоп Linux функцию, которая у конкурентов давно считается нормой. В macOS есть Voice Control, причём на машинах с Apple Silicon распознавание работает на устройстве и без сети. У Microsoft сейчас продвигается Voice Access, который постепенно вытесняет старый Windows Speech Recognition, появившийся ещё во времена Windows Vista в 2006 году. На этом фоне Linux долго оставался в позиции системы, где для таких вещей надо либо собирать что-то вручную, либо мириться с сырыми сторонними утилитами. Myna выглядит как попытка закрыть именно этот неловкий разрыв.

Для Canonical эта история ещё и репутационная. В начале июня The Register уже писал с Ubuntu Summit, что компания собирается серьёзнее заходить в AI, а одним из первых видимых результатов как раз станет speech-to-text на локально запускаемых моделях распознавания речи. Затем Canonical опубликовала дорожную карту Ubuntu Desktop 26.10 «Stonking Stingray», где курс на такие функции стал ещё заметнее. Иначе говоря, Myna не случайный сайд-проект, а часть более широкой линии: Ubuntu хочет показать, что может встроить AI-функции в настольную систему без обязательной отправки пользовательских данных в облако. Для корпоративного сектора и регулируемых отраслей это, пожалуй, важнее самого факта голосового ввода. Когда речь идёт о рабочих заметках, внутренних переписках, тикетах и документах, слово «локальный» часто ценнее слова «умный».

При этом рынок, мягко говоря, не пустой. Сам The Register напоминает, что похожие инструменты уже существуют. Когда-то одним из ранних заметных проектов был Mycroft, но его история закончилась не хеппи-эндом: несколько лет назад создатель Linux-ассистента объяснял крах проекта давлением патентного тролля. Есть Speech Note от Михала Косцеши, который можно поставить через Flathub. Есть и более технические варианты: например, в августе 2025 года The Register писал о FFmpeg 8, который умеет использовать локальную реализацию whisper.cpp для модели Whisper и тем самым делать speech-to-text на устройстве, в том числе для автоматического создания субтитров. Иными словами, технологий хватает. Не хватало другого: чтобы крупный поставщик десктопного Linux взял на себя интеграцию, UX и поддержку в стандартной поставке. Обычно именно на этом этапе энтузиазм сообщества сталкивается с реальностью реальных пользователей.

Открытый исходный код здесь тоже играет Canonical на руку. Проект Myna обещан как open source, и репозиторий на GitHub уже существует, хотя, по словам The Register, пока там немногое кроме заметок по планированию. Для разработчиков это важный сигнал. Во-первых, можно заранее понять, из каких компонентов будет собран локальный speech-to-text в Ubuntu и насколько его реально адаптировать под свои сценарии. Во-вторых, open source-подход даёт шанс на нормальную проверяемость: как именно запускаются модели, что хранится локально, как устроена интеграция с десктопом, можно ли использовать механизм в собственных продуктах, кастомных сборках или внутренних рабочих местах. Для техдиров и команд, которые живут между требованиями безопасности и давлением «сделайте уже что-нибудь с AI», это куда полезнее, чем очередной облачный API с красивым лендингом и длинным списком условий обработки данных.

В практическом смысле потенциальных сценариев довольно много. Разработчики смогут надиктовывать черновики комментариев, описания задач или заметки во время созвонов. Продакты и HR — быстрее фиксировать интервью, идеи и рабочие тексты, не вынося аудио во внешние сервисы. Для accessibility-направления Myna вряд ли станет мгновенной революцией: сам источник аккуратно даёт понять, что одной только диктовкой проблему доступности не решить. Но это заметный шаг вперёд для Linux-десктопа, который слишком часто проигрывал не по ядру, пакетам или контейнерам, а по банальным пользовательским функциям. Ирония тут в том, что одна из самых разумных ролей AI в настольной системе выглядит совсем не как магия. Просто нажал сочетание клавиш, сказал фразу, получил текст. Иногда именно такой «не вау, а работает» и не хватает всей отрасли.

Главный вопрос теперь не в том, сможет ли Canonical показать демо к октябрьскому релизу Ubuntu 26.10, а в том, сумеет ли она довести локальный speech-to-text до уровня, где функция будет полезна вне презентаций и форумных анонсов. Если Myna окажется стабильной, быстрой и достаточно точной в обычной офисной рутине, у Linux появится редкий шанс догнать конкурентов не по лозунгам, а по повседневному удобству. Детали можно сверить в публикации The Register.

Поделиться: Telegram X LinkedIn