Головна › Розпізнавання української мови

Українська мова · розпізнавання на Mac

Розпізнавання української мови на Mac: чи справді воно її розуміє

Це перше питання, яке ставлять українською, і від відповіді на нього залежить, чи має сенс решта. Коротко: так — розпізнавання української мови в Lesskeys працює, українська входить до 99 мов застосунку і визначається автоматично, а обробка відбувається просто на вашому Mac. Нижче — без прикрас: де результат добрий, де він псується і що з цим робити на двомовній нараді.

100%локально на вашому Mac — аудіо нікуди не вивантажується
Безкоштовнозавантаження; Pro — разова покупка $49.99, без підписки
99мов, визначаються автоматично
macOS 13+Apple Silicon (M1 або новіший) — обов’язково

Розпізнавання української мови: коротка відповідь

Українська — одна з 99 мов, які модель розпізнає, і вона визначається автоматично: перед диктуванням чи транскрибацією нічого перемикати не треба. Обчислення йдуть на графічному чипі вашого Mac, тож для роботи не потрібні ні інтернет, ні обліковий запис, ні пересилання файлу комусь на сервер.

Що це означає на практиці. Одна людина, мікрофон близько, звичайний темп, повні речення — і українська розшифровується добре: розділові знаки модель розставляє сама, апостроф і «ї» їй не проблема. А от прізвища, назви компаній, абревіатури й вузька термінологія — найслабше місце будь-якої системи розпізнавання, і української це стосується так само. Автоматичний текст — чернетка, яку треба вичитати. Ми не обіцяємо відсотків точності: вони залежать від мікрофона, фону й того, як говорить конкретна людина, а не від рекламного рядка.

Як визначається мова — і чому це головна деталь

Мова визначається на запис, а не на кожне слово окремо. Модель слухає початок і вирішує, якою мовою це сказано, після чого розшифровує весь фрагмент саме нею. Із цього одного факту випливає майже все, що далі.

Наслідок перший, приємний: окремі англійські терміни в українському реченні — «дедлайн», «мітинг», «пул-реквест», «фідбек» — жодної проблеми не створюють. Мова запису лишається українською, а терміни просто записуються так, як прозвучали. Це найпоширеніший робочий сценарій в українських ІТ-командах, і він працює нормально.

Наслідок другий, менш приємний: якщо на початку запису кілька секунд тиші, кашлю або нерозбірливого шуму, модель приймає рішення про мову на порожньому місці. Тому варто починати говорити після натискання клавіші, а не одночасно з ним, і не залишати довгих пауз на самому початку файлу.

Двомовні наради, суржик і перемикання посеред розмови

Це найважливіший розділ цієї сторінки, і тут потрібна відвертість, а не маркетинг. Реальність українського робочого дня часто виглядає так: половина учасників наради говорить українською, половина — російською; хтось природно змішує обидві; хтось вставляє цілі англійські фрази. Українська й російська — різні мови, і модель розпізнає їх як різні; ідеться не про «майже те саме», а про технічну задачу, у якій запис постійно перемикається між кількома мовами.

Що з цього виходить на практиці:

Жоден автоматичний інструмент — ні локальний, ні хмарний — не розв’язує це бездоганно, і чесніше сказати про це прямо, ніж дати вам витратити вечір на файл, який вийде наполовину зіпсованим.

Що зробити, щоб результат був кращим

Чому саме локальна обробка

Технічний бік: аудіофайл не залишає ваш Mac. Немає вивантаження, немає сервера, який приймає запис, немає облікового запису й немає телеметрії. Мережа потрібна лише двічі — щоб завантажити застосунок і щоб один раз завантажити модель. Далі все працює автономно, зокрема тоді, коли зв’язку або живлення просто немає; для багатьох це щоденна обставина, а не гіпотетична.

Друге, суто практичне: якщо запис розшифровується у вас на столі, питання «на чиїх серверах опинилася ця розмова» не виникає взагалі. Це твердження про архітектуру програми — і нічого більше. Ми не заявляємо відповідності Закону України «Про захист персональних даних», GDPR чи будь-яким стандартам і нічого не сертифікуємо: оцінка мети обробки та правової підстави — це до вашого юриста або до особи, відповідальної за захист персональних даних. Голос людини, а надто збережений голосовий профіль, є персональними даними.

Диктувати українською

Другий сценарій — не розшифровка файлу, а набір тексту голосом. Утримуєте ⌥Space, говорите українською, відпускаєте — текст опиняється в буфері обміну, і ви вставляєте його через ⌘V у лист, нотатку, месенджер, документ чи поле форми. Застосунок навмисно не друкує нічого сам у чужі вікна: ви бачите кожну фразу до того, як вона кудись потрапить.

Для української це часто вигідніше, ніж для англійської, з простої причини: розкладка. Диктування знімає перемикання розкладок, «і/и/ї», апострофи й тире — усе це модель ставить сама. Розділові знаки промовляти не треба. Докладніше про весь шлях від клавіші до тексту — на сторінці як перетворити голос на текст.

Чого чекати не варто

Прізвища й топоніми звучатимуть упізнавано, а писатимуться часто неправильно — «Гнатюк», «Бердичів», назва компанії чи продукту. Абревіатури на кшталт ЄДРПОУ, ТЦК, ФОП з’являються в тексті в різному вигляді. Вузька термінологія — юридична, медична, інженерна — розпізнається, але потребує перевірки. Коли двоє говорять одночасно, атрибуція до мовців збивається. І застосунок не робить нічого понад це: він не надсилає нікому підсумків, не приєднується до відеодзвінка окремим учасником і не друкує текст самостійно.

Якщо ви записуєте не лише себе

Щойно в записі звучать інші люди, спершу згода, потім техніка. Стаття 163 Кримінального кодексу карає порушення таємниці листування й телефонних розмов, тобто втручання в чужі комунікації; зворотного висновку про власні розмови ми не робимо — це юридична оцінка, яку ми не маємо права давати. Стаття 182 КК стосується незаконного збирання, зберігання, використання й поширення конфіденційної інформації про особу, тож вона актуальна й тоді, коли ви надсилаєте комусь готовий транскрипт. Цивільний кодекс додає право на приватне життя (ст. 301), таємницю телефонних розмов, використання яких потребує згоди (ст. 306), і згоду на відеозйомку (ст. 307).

Попередьте і отримайте згоду на початку розмови, зафіксуйте її в самому записі, а на роботі узгодьте практику запису з керівництвом і з відповідальною за персональні дані особою — окремого закону про запис нарад немає, це питання персональних даних і внутрішніх правил. Це інформаційний блок, а не юридична консультація, і жодних гарантій щодо доказової сили запису ми не даємо.

Вимоги, ціна й безкоштовна версія

ПунктЗначення
Українська мовавходить до 99 мов, визначається автоматично
СистемаmacOS 13 (Ventura) або новіша
ПроцесорApple Silicon (M1 або новіший) — обов’язково; Mac на Intel не підтримуються
Інтернетлише для завантаження застосунку і одноразового завантаження моделі
Вставлення текстуу буфер обміну, далі ⌘V вручну
Ціназавантаження безкоштовне; Pro — разова покупка $49.99 у застосунку, без підписки
Безкоштовна версія5 хвилин диктування на добу, 5 аудіо- і 5 відеотранскрипцій усього; запис і повторна транскрибація не обмежуються

Суму вказано в доларах, бо це ціна магазину; в App Store вона показується у валюті вашого облікового запису. Спробувати можна без покупки й без реєстрації: 5 хвилин диктування на добу та 5 аудіо- і 5 відеотранскрипцій усього — це загальний ліміт, а не денний. Сам запис не обмежується ніколи, а повторний запуск розпізнавання на вже розшифрованому файлі квоту не витрачає, тож перевірити, як воно дає раду саме з вашою вимовою й вашою двомовною нарадою, можна ще до покупки. Апаратна вимога при цьому не обговорюється: на Mac з процесором Intel застосунок не запуститься — перевірте своє залізо в меню Apple → «Про цей Mac».

Завантажити в Mac App Store

Завантаження безкоштовне. Без підписки. · Pro — разова покупка $49.99 у застосунку (в App Store ціна у валюті вашого акаунта) · macOS 13 або новіша

Часті запитання

Чи розпізнає Lesskeys українську мову?

Так. Українська входить до 99 мов, які розпізнає застосунок, і визначається автоматично — вибирати її вручну не треба. Обробка відбувається на графічному чипі вашого Mac, тож запис нікуди не вивантажується, а інтернет після завантаження моделі не потрібен.

Наскільки точно розпізнається українська?

На чистому записі однієї людини з мікрофоном близько до рота результат добрий: розділові знаки й апострофи модель ставить сама. Слабкі місця — прізвища, назви компаній, абревіатури й вузька термінологія, а також гучний фон і накладені голоси. Автоматичний текст варто вважати чернеткою і вичитувати.

Що робити з двомовною нарадою, де говорять і українською, і російською?

Мова визначається на запис, а не на кожне слово, тому тривалі перемикання між мовами псують результат. Практично найкраще розрізати такий запис на частини за мовами й обробити кожну окремо, а в налаштуваннях лишити тільки робочі дві-три мови. Повторна транскрибація вже розшифрованого файлу квоту не витрачає, тож пробувати можна вільно.

Як застосунок дає раду з суржиком?

Нестабільно, і це варто знати наперед. Оскільки модель обирає одну мову на весь запис, мовлення зі змішаними елементами двох мов може частинами піти в різні боки. Це технічне обмеження підходу, а не оцінка того, як людина говорить; на однорідному мовленні результат помітно кращий.

Чи можна диктувати українською в будь-якій програмі?

Так. Утримуєте ⌥Space, говорите, відпускаєте — текст потрапляє в буфер обміну, а вставляєте його ви самі через ⌘V у пошту, нотатки, месенджер чи документ. Застосунок нічого не друкує самостійно в чужі вікна. Диктування також знімає перемикання розкладок і ручні апострофи.

Скільки це коштує в Україні?

Завантаження безкоштовне, а Pro відкриває разова покупка в застосунку — $49.99; в App Store сума показується у валюті вашого облікового запису. Це не підписка й не оплата за хвилини. Безкоштовно доступні 5 хвилин диктування на добу та 5 аудіо- і 5 відеотранскрипцій усього, при цьому запис не обмежується, а повторна транскрибація квоту не витрачає.

Читайте також