Acasă › Voce în text

Ghid pas cu pas · voce în text pe Mac

Cum transformi vocea în text pe Mac

Traseul complet, fără magie: ții apăsată o scurtătură, vorbești, modelul local recunoaște ce ai spus, textul ajunge în clipboard și îl lipești tu cu ⌘V. Mai jos ai fiecare pas, ce se întâmplă tehnic la fiecare și unde apar de obicei problemele.

100%local pe Mac — audio nu se încarcă nicăieri
Gratuitde descărcat — Pro se deblochează cu o singură plată de 49,99 $
99de limbi, detectate automat
macOS 13+Apple Silicon (M1 sau mai nou), obligatoriu

Pe scurt, în cinci pași

Dacă ai două minute și nu vrei detalii, drumul de la voce în text pe Mac arată așa:

Nicăieri pe traseu nu apare o încărcare pe internet. Modelul este un fișier pe disc, descărcat o singură dată la prima configurare.

Pasul 1: scurtătura

Dictarea pornește de la o combinație globală de taste, implicit Space, pe care o poți schimba din setări. „Globală” înseamnă că funcționează indiferent de aplicația în care te afli: mail, un document, un chat, terminalul, câmpul de comentariu dintr-un browser. Nu trebuie să comuți în altă fereastră și nu trebuie să dai clic nicăieri înainte.

Ai două moduri de lucru. Ții tasta apăsată cât vorbești și o eliberezi la final — bun pentru fraze scurte, o adresă, un răspuns rapid. Sau apeși scurt o dată ca să pornești și încă o dată ca să oprești — mai comod pentru un paragraf lung, când nu vrei să ții degetul pe tastatură câteva minute.

Pasul 2: înregistrarea

Cât vorbești, sunetul este captat de la microfonul activ și ținut local. Calitatea microfonului contează mai mult decât orice setare din aplicație: microfonul intern al unui MacBook e acceptabil la 30–40 de centimetri, într-o cameră liniștită, dar se descurcă prost la distanță, în încăperi cu ecou și cu aer condiționat pornit. O pereche de căști cu microfon sau un microfon USB schimbă vizibil rezultatul.

Vorbește în ritm normal. Nu are rost să silabisești: modelele actuale se descurcă mai bine cu vorbirea firească decât cu una artificial rărită. În schimb ajută să faci o pauză scurtă între propoziții, pentru că modelul își ia de acolo indiciile pentru punctuație.

Pasul 3: modelul local

Când eliberezi tasta, înregistrarea intră în modelul de recunoaștere vocală care stă pe discul tău. Calculul se face pe unitatea grafică a Mac-ului, motiv pentru care este obligatoriu un procesor Apple Silicon (M1 sau mai nou) — memoria unificată permite modelului să ruleze fără copieri costisitoare între procesor și unitatea grafică. Pe Mac-uri cu procesor Intel aplicația nu funcționează.

Pentru fraze scurte, textul apare aproape imediat. Pentru un monolog de câteva minute, așteptarea se simte, dar rămâne în ordinul secundelor. Internetul nu intervine în niciun fel: merge în avion, în tren fără semnal, într-o cameră fără rețea.

Pasul 4: limba

Sunt acoperite 99 de limbi, iar limba este detectată automat din ce ai spus, deci nu trebuie să comuți nimic înainte de fiecare dictare. Un cuvânt englezesc într-o frază românească nu strică nimic — modelul stabilește limba pe ansamblul enunțului.

Situația care chiar cere atenție este cea tipic românească din IT și din firmele multinaționale: lucrezi în paralel în română și engleză, uneori alternând de la o propoziție la alta. Enunțurile foarte scurte, de două-trei cuvinte, pot nimeri în limba greșită, pentru că modelul are prea puțin material pe care să decidă. Soluția e simplă: restrânge în setări lista de limbi la cele în care lucrezi efectiv, de exemplu doar română și engleză. Cu lista scurtă, dictările scurte nu mai ajung în italiană sau spaniolă din cauza unui cuvânt ambiguu.

Pasul 5: clipboard și ⌘V

Textul recunoscut ajunge în clipboard, iar lipirea o faci tu, cu V. Ultimul pas este deliberat lăsat în seama ta: aplicația nu scrie singură în alte programe. Practic, vezi ce ai dictat înainte să ajungă undeva, și nu există riscul ca un text să apară într-o fereastră greșită pentru că focusul s-a mutat între timp.

Funcționează în orice câmp în care ai putea lipi text: mail, procesor de text, notițe, chat, editor de cod, formulare web. Nu depinde de aplicație, pentru că nu se integrează cu ea în niciun fel.

Celălalt drum: fișiere deja înregistrate

Dictarea este doar una dintre utilizări. Dacă ai deja o înregistrare — de pe un reportofon, din WhatsApp, dintr-un apel sau dintr-o ședință — o transformi în text pe același principiu, local, cu marcaje de timp și cu vorbitorii separați. Detaliile sunt pe pagina despre transcrierea unei înregistrări audio, iar partea cu identificarea persoanelor este explicată la cine a vorbit în înregistrare. Dacă în material apar și alte persoane, anunță-le înainte de a înregistra și notează acordul lor.

Ce merge prost și cum repari

Cerințe și preț

PunctValoare
Sistem de operaremacOS 13 (Ventura) sau mai nou
ProcesorApple Silicon (M1 sau mai nou) — obligatoriu
Mac-uri cu Intelnu sunt acceptate
Internetdoar pentru descărcarea din App Store și descărcarea unică a modelului
Prețdescărcare gratuită; versiunea completă, achiziție unică de 49,99 $ în aplicație — fără abonament
Versiunea gratuită5 minute de dictare pe zi, 5 transcrieri audio și 5 video în total; înregistrarea și re-transcrierea nu se contorizează
Contnu e nevoie de cont

Cerința de hardware nu este o recomandare: pe un Mac cu procesor Intel aplicația pur și simplu nu rulează, așa că verifică înainte de a plăti versiunea completă, din meniul Apple, la „About This Mac” („Despre acest Mac”). Suma de 49,99 $ este prețul din store în dolari; în App Store-ul din România se afișează valoarea în lei.

Poți încerca totul înainte să cumperi: în versiunea gratuită dictezi 5 minute pe zi și transcrii 5 înregistrări audio și 5 video în total. Înregistrarea propriu-zisă nu are limită, iar un material deja transcris poate fi trecut din nou prin model oricând, fără să consume din cotă.

Descarcă din Mac App Store

Descărcare gratuită. Plătești o singură dată. Fără abonament. · Pro: 49,99 $ o singură dată, achiziție în aplicație (în App Store România prețul apare în lei) · macOS 13 sau mai nou

Întrebări frecvente

Cum transform vocea în text pe Mac?

Ții apăsată scurtătura globală, implicit ⌥Space, vorbești și eliberezi tasta. Modelul local recunoaște ce ai spus, iar textul ajunge în clipboard, de unde îl lipești cu ⌘V acolo unde stă cursorul. Nu este nevoie de internet și nu se încarcă nimic pe niciun server.

Textul se scrie singur în aplicația în care lucrez?

Nu. Textul recunoscut este copiat în clipboard, iar lipirea o faci tu cu ⌘V. Aplicația nu scrie singură în alte programe, așa că vezi de fiecare dată ce ai dictat înainte ca textul să ajungă undeva.

Merge fără conexiune la internet?

Da. Modelul este un fișier pe discul tău, descărcat o singură dată la configurare, iar calculul se face pe procesorul grafic al Mac-ului. După configurare poți dicta în avion, în tren fără semnal sau cu Mac-ul deconectat de la rețea.

Cum fac dacă lucrez în română și engleză în aceeași zi?

Limba este detectată automat dintre 99, iar un cuvânt englezesc într-o frază românească nu creează probleme. Dacă dictezi des fraze foarte scurte în ambele limbi, restrânge în setări lista de limbi la română și engleză, ca enunțurile de două-trei cuvinte să nu nimerească în altă limbă.

De ce am nevoie de un Mac cu Apple Silicon?

Modelul rulează pe unitatea grafică și are nevoie de memoria unificată de pe Apple Silicon, unde procesorul și GPU-ul folosesc același spațiu. Este obligatoriu un Mac cu M1 sau mai nou și macOS 13 (Ventura); pe Mac-uri cu procesor Intel aplicația nu funcționează.

Cât costă și ce pot face gratuit?

Descărcarea este gratuită. Versiunea gratuită include 5 minute de dictare pe zi și 5 transcrieri audio plus 5 video în total, iar înregistrarea și re-transcrierea nu consumă din limită. Versiunea completă se deblochează cu o achiziție unică de 49,99 $ în aplicație, fără abonament.

Vezi și