Головна › Розпізнавання української мови
Українська мова · розпізнавання на Mac
Розпізнавання української мови на Mac: чи справді воно її розуміє
Це перше питання, яке ставлять українською, і від відповіді на нього залежить, чи має сенс решта. Коротко: так — розпізнавання української мови в Lesskeys працює, українська входить до 99 мов застосунку і визначається автоматично, а обробка відбувається просто на вашому Mac. Нижче — без прикрас: де результат добрий, де він псується і що з цим робити на двомовній нараді.
Розпізнавання української мови: коротка відповідь
Українська — одна з 99 мов, які модель розпізнає, і вона визначається автоматично: перед диктуванням чи транскрибацією нічого перемикати не треба. Обчислення йдуть на графічному чипі вашого Mac, тож для роботи не потрібні ні інтернет, ні обліковий запис, ні пересилання файлу комусь на сервер.
Що це означає на практиці. Одна людина, мікрофон близько, звичайний темп, повні речення — і українська розшифровується добре: розділові знаки модель розставляє сама, апостроф і «ї» їй не проблема. А от прізвища, назви компаній, абревіатури й вузька термінологія — найслабше місце будь-якої системи розпізнавання, і української це стосується так само. Автоматичний текст — чернетка, яку треба вичитати. Ми не обіцяємо відсотків точності: вони залежать від мікрофона, фону й того, як говорить конкретна людина, а не від рекламного рядка.
Як визначається мова — і чому це головна деталь
Мова визначається на запис, а не на кожне слово окремо. Модель слухає початок і вирішує, якою мовою це сказано, після чого розшифровує весь фрагмент саме нею. Із цього одного факту випливає майже все, що далі.
Наслідок перший, приємний: окремі англійські терміни в українському реченні — «дедлайн», «мітинг», «пул-реквест», «фідбек» — жодної проблеми не створюють. Мова запису лишається українською, а терміни просто записуються так, як прозвучали. Це найпоширеніший робочий сценарій в українських ІТ-командах, і він працює нормально.
Наслідок другий, менш приємний: якщо на початку запису кілька секунд тиші, кашлю або нерозбірливого шуму, модель приймає рішення про мову на порожньому місці. Тому варто починати говорити після натискання клавіші, а не одночасно з ним, і не залишати довгих пауз на самому початку файлу.
Двомовні наради, суржик і перемикання посеред розмови
Це найважливіший розділ цієї сторінки, і тут потрібна відвертість, а не маркетинг. Реальність українського робочого дня часто виглядає так: половина учасників наради говорить українською, половина — російською; хтось природно змішує обидві; хтось вставляє цілі англійські фрази. Українська й російська — різні мови, і модель розпізнає їх як різні; ідеться не про «майже те саме», а про технічну задачу, у якій запис постійно перемикається між кількома мовами.
Що з цього виходить на практиці:
- Поодинокі слова іншою мовою. Практично не шкодять. Мова запису визначена, вставка розшифровується як прозвучала.
- Суржик. Мовлення, у якому елементи двох мов перемішані на рівні речень і слів, дає нестабільний результат: частина фрагмента може піти в один бік, частина — в інший. Це не оцінка того, як людина говорить, — це технічне обмеження підходу «одна мова на запис».
- Тривалі перемикання. Найгірший випадок: п’ять хвилин українською, десять російською, потім знову українською. Мова визначилася один раз — і решта розшифровується не тією мовою, якою насправді сказано.
- Різні мовці — різні мови. Той самий випадок, лише перемикання відбувається щоразу, коли слово бере наступна людина.
Жоден автоматичний інструмент — ні локальний, ні хмарний — не розв’язує це бездоганно, і чесніше сказати про це прямо, ніж дати вам витратити вечір на файл, який вийде наполовину зіпсованим.
Що зробити, щоб результат був кращим
- Звузьте перелік мов до робочих двох-трьох. Якщо в налаштуваннях лишити, скажімо, українську та англійську, вибір робитиметься лише між ними, а не між дев’яносто дев’ятьма — і коротка фраза не поїде в далеку мову, якої у вашій кімнаті ніколи не звучало.
- Розріжте довгу двомовну нараду на частини. Якщо запис явно ділиться на блоки за мовами, обробляйте їх окремо: кожен блок отримає своє правильне визначення мови. Це найдієвіша порада з усього списку.
- Перезапускайте розпізнавання. Якщо результат виглядає так, наче мову визначено неправильно, запустіть розшифровку того самого запису ще раз, вказавши мову явно. Повторна транскрибація вже розшифрованого файлу не витрачає квоту, тож експериментувати можна вільно.
- Дбайте про звук. Гарнітура замість одного мікрофона посеред столу дає більше приросту точності, ніж будь-яке налаштування в програмі.
- Починайте говорити одразу. Кілька секунд тиші на початку — це кілька секунд, з яких модель робить висновок про мову.
Чому саме локальна обробка
Технічний бік: аудіофайл не залишає ваш Mac. Немає вивантаження, немає сервера, який приймає запис, немає облікового запису й немає телеметрії. Мережа потрібна лише двічі — щоб завантажити застосунок і щоб один раз завантажити модель. Далі все працює автономно, зокрема тоді, коли зв’язку або живлення просто немає; для багатьох це щоденна обставина, а не гіпотетична.
Друге, суто практичне: якщо запис розшифровується у вас на столі, питання «на чиїх серверах опинилася ця розмова» не виникає взагалі. Це твердження про архітектуру програми — і нічого більше. Ми не заявляємо відповідності Закону України «Про захист персональних даних», GDPR чи будь-яким стандартам і нічого не сертифікуємо: оцінка мети обробки та правової підстави — це до вашого юриста або до особи, відповідальної за захист персональних даних. Голос людини, а надто збережений голосовий профіль, є персональними даними.
Диктувати українською
Другий сценарій — не розшифровка файлу, а набір тексту голосом. Утримуєте ⌥Space, говорите українською, відпускаєте — текст опиняється в буфері обміну, і ви вставляєте його через ⌘V у лист, нотатку, месенджер, документ чи поле форми. Застосунок навмисно не друкує нічого сам у чужі вікна: ви бачите кожну фразу до того, як вона кудись потрапить.
Для української це часто вигідніше, ніж для англійської, з простої причини: розкладка. Диктування знімає перемикання розкладок, «і/и/ї», апострофи й тире — усе це модель ставить сама. Розділові знаки промовляти не треба. Докладніше про весь шлях від клавіші до тексту — на сторінці як перетворити голос на текст.
Чого чекати не варто
Прізвища й топоніми звучатимуть упізнавано, а писатимуться часто неправильно — «Гнатюк», «Бердичів», назва компанії чи продукту. Абревіатури на кшталт ЄДРПОУ, ТЦК, ФОП з’являються в тексті в різному вигляді. Вузька термінологія — юридична, медична, інженерна — розпізнається, але потребує перевірки. Коли двоє говорять одночасно, атрибуція до мовців збивається. І застосунок не робить нічого понад це: він не надсилає нікому підсумків, не приєднується до відеодзвінка окремим учасником і не друкує текст самостійно.
Якщо ви записуєте не лише себе
Щойно в записі звучать інші люди, спершу згода, потім техніка. Стаття 163 Кримінального кодексу карає порушення таємниці листування й телефонних розмов, тобто втручання в чужі комунікації; зворотного висновку про власні розмови ми не робимо — це юридична оцінка, яку ми не маємо права давати. Стаття 182 КК стосується незаконного збирання, зберігання, використання й поширення конфіденційної інформації про особу, тож вона актуальна й тоді, коли ви надсилаєте комусь готовий транскрипт. Цивільний кодекс додає право на приватне життя (ст. 301), таємницю телефонних розмов, використання яких потребує згоди (ст. 306), і згоду на відеозйомку (ст. 307).
Попередьте і отримайте згоду на початку розмови, зафіксуйте її в самому записі, а на роботі узгодьте практику запису з керівництвом і з відповідальною за персональні дані особою — окремого закону про запис нарад немає, це питання персональних даних і внутрішніх правил. Це інформаційний блок, а не юридична консультація, і жодних гарантій щодо доказової сили запису ми не даємо.
Вимоги, ціна й безкоштовна версія
| Пункт | Значення |
|---|---|
| Українська мова | входить до 99 мов, визначається автоматично |
| Система | macOS 13 (Ventura) або новіша |
| Процесор | Apple Silicon (M1 або новіший) — обов’язково; Mac на Intel не підтримуються |
| Інтернет | лише для завантаження застосунку і одноразового завантаження моделі |
| Вставлення тексту | у буфер обміну, далі ⌘V вручну |
| Ціна | завантаження безкоштовне; Pro — разова покупка $49.99 у застосунку, без підписки |
| Безкоштовна версія | 5 хвилин диктування на добу, 5 аудіо- і 5 відеотранскрипцій усього; запис і повторна транскрибація не обмежуються |
Суму вказано в доларах, бо це ціна магазину; в App Store вона показується у валюті вашого облікового запису. Спробувати можна без покупки й без реєстрації: 5 хвилин диктування на добу та 5 аудіо- і 5 відеотранскрипцій усього — це загальний ліміт, а не денний. Сам запис не обмежується ніколи, а повторний запуск розпізнавання на вже розшифрованому файлі квоту не витрачає, тож перевірити, як воно дає раду саме з вашою вимовою й вашою двомовною нарадою, можна ще до покупки. Апаратна вимога при цьому не обговорюється: на Mac з процесором Intel застосунок не запуститься — перевірте своє залізо в меню Apple → «Про цей Mac».
Завантаження безкоштовне. Без підписки. · Pro — разова покупка $49.99 у застосунку (в App Store ціна у валюті вашого акаунта) · macOS 13 або новіша
Часті запитання
Чи розпізнає Lesskeys українську мову?
Так. Українська входить до 99 мов, які розпізнає застосунок, і визначається автоматично — вибирати її вручну не треба. Обробка відбувається на графічному чипі вашого Mac, тож запис нікуди не вивантажується, а інтернет після завантаження моделі не потрібен.
Наскільки точно розпізнається українська?
На чистому записі однієї людини з мікрофоном близько до рота результат добрий: розділові знаки й апострофи модель ставить сама. Слабкі місця — прізвища, назви компаній, абревіатури й вузька термінологія, а також гучний фон і накладені голоси. Автоматичний текст варто вважати чернеткою і вичитувати.
Що робити з двомовною нарадою, де говорять і українською, і російською?
Мова визначається на запис, а не на кожне слово, тому тривалі перемикання між мовами псують результат. Практично найкраще розрізати такий запис на частини за мовами й обробити кожну окремо, а в налаштуваннях лишити тільки робочі дві-три мови. Повторна транскрибація вже розшифрованого файлу квоту не витрачає, тож пробувати можна вільно.
Як застосунок дає раду з суржиком?
Нестабільно, і це варто знати наперед. Оскільки модель обирає одну мову на весь запис, мовлення зі змішаними елементами двох мов може частинами піти в різні боки. Це технічне обмеження підходу, а не оцінка того, як людина говорить; на однорідному мовленні результат помітно кращий.
Чи можна диктувати українською в будь-якій програмі?
Так. Утримуєте ⌥Space, говорите, відпускаєте — текст потрапляє в буфер обміну, а вставляєте його ви самі через ⌘V у пошту, нотатки, месенджер чи документ. Застосунок нічого не друкує самостійно в чужі вікна. Диктування також знімає перемикання розкладок і ручні апострофи.
Скільки це коштує в Україні?
Завантаження безкоштовне, а Pro відкриває разова покупка в застосунку — $49.99; в App Store сума показується у валюті вашого облікового запису. Це не підписка й не оплата за хвилини. Безкоштовно доступні 5 хвилин диктування на добу та 5 аудіо- і 5 відеотранскрипцій усього, при цьому запис не обмежується, а повторна транскрибація квоту не витрачає.