Grai · Parcurs

Parcurs de dezvoltare

Trei antrenări, sub 1.200 de dolari în total, în ordinea în care fiecare o ieftinește pe următoarea. Plus ce e deja gata și ce lipsește.

Starea de azi

Ce e gata, 31 august 2026

Conversație realtime completă

Ascultare în flux, decizie de tură pe prozodie, întrerupere cu memorie corectă, sinteză în flux. Română și rusă.

gata

Unelte în paralel

Bifurcare, punte de umplere, rezultat anunțat separat dacă întârzie.

gata

Sesiuni permanente

Supraviețuiesc reîncărcării, deconectării și repornirii de server.

gata

Registru de agenți

Agenți ca înregistrări, clienți izolați, voce și limbă per agent.

gata

Widget de încorporat

O linie pe pagina clientului, fără dependențe.

27,6 KB

Etaloane publicate

FLEURS română și rusă, latență voce-la-voce, detecție de tură — cu metodologie și comenzi de reproducere.

gata
Ce urmează

Trei antrenări, în ordinea asta

Nu în ordinea impactului teoretic, ci în ordinea în care fiecare pas îl face pe următorul mai ieftin.

Antrenarea 1 · următoarea

Recunoașterea vorbirii în română

Singurul lucru care închide diferența de 5–9× față de concurență. Rețeta e oficială, cu rezultate publicate pe alte limbi: greaca a mers de la 35% la 24%, bulgara de la 22% la 15%. Aceeași ameliorare relativă pe română ne-ar duce de la 26,3% la aproximativ 21% pe FLEURS.

De ce prima: detectorul de tură depinde de ea. Verificarea că o tăietură cade la graniță de cuvânt se face transcriind bucata — cu recunoaștere slabă, construim setul de tură cu rigla strâmbă.

date VoxPopuli CC0, 89 h măsurate calcul ~50 h pe H100cost ~500 $
Antrenarea 2

Detector de sfârșit de tură pentru română

Cel mai ieftin din cele trei, singurul publicabil, singurul unde am fi primii. Modelul de referință are 23 de limbi și nu are româna, iar autorii au anunțat că nu mai adaugă limbi. Româna ar fi limba a douăzeci și patra.

Reperul de pornire e umilitor de jos: pe română, detectorul existent dă 4 din 8 — adică exact aruncarea cu banul. Ținta minimă e să batem aleatoriul.

date ~2.000 de mostre, produse de noi model 8 MB, 12 ms pe procesorcost sub 100 $
Antrenarea 3 · blocată pe date, nu pe bani

Voce românească proprie

Motivul pentru care voiam antrenarea asta era să ieșim de sub licența motorului de sinteză împrumutat. Cel mai mare corpus care ar fi rezolvat-o s-a dovedit necomercial — deci am ieși dintr-o licență restrictivă ca să intrăm în alta mai rea.

Precedentul există și e ieftin: un model românesc antrenat la Cluj a folosit 21 de ore și douăsprezece ore pe o singură placă. Drumul cel mai curat pornește de acolo — dar are nevoie de date pe care încă le căutăm.

blocant sursa de date calcul 500–800 $ aici putem fi ajutați →

Costul total, plătit integral

Toate trei antrenările costă sub 1.200 de dolari la preț de listă. Am acces la un program de credite pentru startupuri, dar planul nu depinde de el — un program de reduceri e o reducere, nu o precondiție.

Onest

Ce nu există încă

Lista asta e aici fiindcă un client tehnic o descoperă oricum în primele cinci minute. Mai bine de la noi.

Ne puteți grăbi

Blocantul real nu e calculul, sunt datele. Dacă aveți înregistrări în română cu drepturile clare, prima antrenare se întâmplă mai devreme.