mariuscomper.uk ROEN中文

Româna, măsurată față de limbile lumii

Care limbă e cea mai apropiată de română? Trei măsurători, trei răspunsuri

Româna a fost comparată cu limbile lumii în trei feluri, pe date deschise. Răspunsurile nu coincid, iar orice limbă poate fi pusă lângă română, după fiecare măsură în parte.

  • Cuvintemeglenoromâna, apoi italiana
  • Gramaticăitaliana, albaneza și portugheza, toate la patru din cinci
  • Suneterusa și alte limbi din nordul și estul Europei, sau două limbi mici din Columbia și Camerun, după descrierea folosită pentru sunetele românei

Hărțile apropierii

Pe hărți, un punct e o limbă, așezată acolo unde se vorbește. Cu cât punctul e mai mare și mai intens, cu atât limba e mai aproape de română după măsura respectivă. Cercul gol marchează româna. Sunetele au două hărți, câte una pentru fiecare descriere a românei.

Cuvinte

40 de cuvinte de bază, comparate sunet cu sunet, la 5.457 de limbi care au cel puțin 28 dintre ele.

Harta lumii: limbile apropiate de română după cuvinte sunt grupate în jurul Mediteranei.Harta lumii: limbile apropiate de română după cuvinte sunt grupate în jurul Mediteranei.
  1. meglenoromână0,44
  2. italiană0,60
  3. sardă logudoreză0,61
  4. aromână0,61
  5. napolitană și graiuri din sudul Italiei0,62

Pe primele 17 locuri sunt limbi romanice.

Gramatică

65 de trăsături de gramatică (unde stă articolul, câte cazuri are substantivul, în ce ordine vin cuvintele), la 243 de limbi care au cel puțin 40 dintre ele descrise.

Harta lumii: limbile apropiate de română după gramatică sunt în Europa.Harta lumii: limbile apropiate de română după gramatică sunt în Europa.
  1. italiană41 din 51
  2. albaneză45 din 56
  3. portugheză40 din 50
  4. greacă48 din 65
  5. spaniolă47 din 64

Primele trei au practic același scor: o rudă, o vecină, o rudă.

Sunete

Câte sunete are fiecare limbă în comun cu româna, la 2.085 de limbi. Lista depinde de descrierea românei.

Cu 7 vocale și 20 de consoane

Harta lumii: limbile cu inventare de sunete apropiate de al românei sunt răspândite în Africa, America și Asia de Sud-Est.Harta lumii: limbile cu inventare de sunete apropiate de al românei sunt răspândite în Africa, America și Asia de Sud-Est.
  1. damana (malayo) Columbia1–11
  2. bangolan Camerun1–22
  3. nupe Nigeria3–11
  4. creolă franceză karipúna Brazilia2–17
  5. mazanderani Iran1–56

Cu consoanele muiate din «lupi» și «pomi» numărate separat

Harta lumii: cu consoanele muiate numărate separat, limbile apropiate sunt în nordul și estul Europei.Harta lumii: cu consoanele muiate numărate separat, limbile apropiate sunt în nordul și estul Europei.
  1. rusă1–5
  2. sorabă de sus Germania3–7
  3. vepsă Rusia1–7
  4. sami skolt Finlanda și Rusia1–10
  5. lituaniană1–12

Italiana nu intră în primele 18 în nicio variantă.

Trei baze de date deschise descriu limbile lumii din trei unghiuri: cuvintele de bază, gramatica și sunetele. Fiecare a fost folosită la fel: româna, comparată pe rând cu toate limbile din bază.

Rudele, vecinii și limbile care doar au aceleași sunete sunt trei lucruri diferite. Cuvintele de bază se moștenesc din limba-mamă și se schimbă greu. Gramatica se moștenește și ea, dar se apropie, în secole de conviețuire, de a vecinilor. Sunetele unei limbi sunt puține, câteva zeci, iar două limbi pot ajunge să aibă aproape aceleași sunete fără să se fi întâlnit vreodată.

O limbă lângă română

Scrie numele unei limbi. Cele patru rigle pornesc din stânga, de la română: cu cât semnul limbii e mai la stânga, cu atât limba e mai aproape după măsura respectivă. Sub rigle sunt dovezile: cele 40 de cuvinte puse alături, trăsăturile de gramatică la care limbile coincid sau diferă, sunetele comune și cele care apar numai într-una dintre cele două limbi.

italiană

familia indo-europeană · la 986 km de România · Glottolog: Italian [ital1282]

Cuvinte locul 2 din 5.457 · între 2 și 3 în toate variantele · distanță 0,60 · cuvinte comparate: 40 din 40

românăitalianămeglenoromânăfrancezăbulgarămaghiară

Gramatică locul 1 din 243 · între 1 și 5 în toate variantele · trăsături cu aceeași valoare: 41 din 51

românăitalianăenglezămaghiarăturcă

Sunete, descrierea obișnuită locul median 128 din 2.085 (între 19 și 279, după varianta de calcul) · sunete comune cu româna: 25 din 29

românăitalianăalbanezărusăchineză mandarină

Sunete, cu consoanele muiate locul median 158 din 2.085 (între 39 și 376, după varianta de calcul)

românăitalianărusăbulgarăchineză mandarină

← aproape de românădeparte →

Cele 40 de cuvinte

lista ASJP: ITALIAN_2 · distanță 0,60 · cuvinte comparate: 40 din 40

ÎnțelesromânăitalianăDistanță
eujewio1,00
tututu0,00
noinojnoi0,33
unuunuuno0,33
doidojdue0,67
omom, persoanəuomo, ɛssere umano0,73
peștepeʃtepeʃʃe0,20
câinekəjnekane0,40
păduchepədukepidokkjo0,63
copackopak, arborealbero0,75
frunzăfrunzəfoʎʎa0,83
pielepjelepelle0,40
sângesəndʒesaŋgue0,67
osososso0,50
cornkornkorno0,20
urecheurekeorekkjo0,57
ochiokʲokkjo0,80
nasnasnazo0,50
dintedintedente0,20
limbălimbəliŋgua0,67
genunchidʒenunkʲdʒinokkjo0,75
mânămənəmano0,50
sânsənseno0,50
ficatfikatfegato0,50
a beabeabere0,50
a vedeavedeavedere0,33
a auziawzʲudire, sentire1,00
a murimurʲmorire0,83
a venivenʲvenire0,67
soaresoaresole0,40
steasteastella0,33
apăapəakkwa0,80
piatrăpjatrəsasso, pietra0,67
focfokfuoko0,40
cărarekəraresentiero0,88
muntemuntemonte, montaɲɲa0,41
noaptenoaptenotte0,33
plinplinpieno0,60
nounownuovo0,60
numenumenome0,25
Gramatica, trăsătură cu trăsătură

Valori diferite (10)

  • Articolul hotărâtromână: Articol hotărât lipit de cuvânt (afix)italiană: Articol hotărât: cuvânt aparte, diferit de demonstrativ
  • Distincții de politețe în pronumeromână: Distincții de politețe multipleitaliană: Distincție binară de politețe
  • Pronumele nehotărâteromână: Pe baza pronumelui interogativitaliană: Pe baza unui substantiv generic
  • Numărul cazurilorromână: 2 cazuriitaliană: Fără marcare morfologică a cazului
  • Poziția afixelor de cazromână: Sufixe de cazitaliană: Fără afixe de caz sau clitice adpoziționale
  • Numeralele ordinaleromână: «Întâi» special, restul derivate din cardinalitaliană: «Întâi» și «al doilea» speciale, restul derivate
  • Imperativul și hortativul (îndemnul)română: Sistem maximalitaliană: Niciunul dintre cele două sisteme
  • Ordinea subiectului și a verbuluiromână: SVitaliană: Fără ordine dominantă
  • Ordinea demonstrativului și a substantivuluiromână: Mixtitaliană: Demonstrativ – substantiv
  • Pronumele negative («nimeni», «nimic») și negația predicatuluiromână: Negația predicatului este prezentă și eaitaliană: Comportament mixt

Aceeași valoare (41)

  • Prefixare și sufixare în morfologia flexionarăSufixare puternică
  • Marcarea pluralului substantivuluiSufix de plural
  • Apariția pluralului substantivuluiToate substantivele, mereu obligatoriu
  • Articolul nehotărâtArticol nehotărât identic cu «unu»
  • Pronume de întărire și pronume reflexiveDiferite
  • Marcarea asimetrică a cazuluiAsimetrie cantitativă aditivă
  • Comitative și instrumentaleAceeași marcă
  • Poziția afixelor posesive pronominaleFără afixe posesive
  • Poziția afixelor de timp și aspectSufixe de timp și aspect
  • Imperativul morfologicPersoana a II-a singular
  • ProhibitivulImperativ special + negație normală
  • Posibilitatea situaționalăConstrucții verbale
  • Posibilitatea epistemicăConstrucții verbale
  • Suprapunerea marcării modale situaționale și epistemiceSuprapunere atât la posibilitate, cât și la necesitate
  • Ordinea subiectului, a complementului direct și a verbuluiSVO
  • Ordinea complementului direct și a verbuluiVO
  • Ordinea adpoziției și a grupului nominalPrepoziții
  • Ordinea genitivului și a substantivuluiSubstantiv – genitiv
  • Ordinea adjectivului și a substantivuluiSubstantiv – adjectiv
  • Ordinea numeralului și a substantivuluiNumeral – substantiv
  • Ordinea propoziției relative și a substantivuluiSubstantiv – propoziție relativă
  • Propoziții relative postnominaleSubstantiv-propoziție relativă (NRel) dominant
  • Ordinea adverbului de grad («foarte») și a adjectivuluiAdverb de grad – adjectiv
  • Poziția particulelor interogative în întrebările totaleFără particulă interogativă
  • Ordinea conjuncției subordonatoare și a propozițieiConjuncție la început
  • Raportul dintre ordinea complement direct–verb și ordinea adpoziție–grup nominalVO și prepoziții
  • Raportul dintre ordinea complement direct–verb și ordinea propoziție relativă–substantivVO și NRel
  • Raportul dintre ordinea complement direct–verb și ordinea adjectiv–substantivVO și NAdj
  • Morfemele negațieiParticulă negativă
  • Întrebările totaleDoar intonație interogativă
  • Ordinea morfemului negativ și a verbuluiNegV
  • Morfeme negative preverbaleNegV
  • Morfeme negative postverbaleNiciunul
  • Mijloace morfologice minore de marcare a negațieiNiciunul
  • Poziția cuvântului negativ față de subiect, complement direct și verbSNegVO
  • Poziția cuvintelor negative față de începutul și sfârșitul propoziției și față de verbImediat preverbal
  • Poziția morfemelor negative în limbile SVOSNegVO
  • Ordinea NegSVOFără NegSVO
  • Ordinea SNegVOCuvânt, fără dublă negație
  • Ordinea SVNegOFără SVNegO
  • Ordinea SVONegFără SVONeg

Grambank, aromâna față de această limbă: trăsături cu aceeași valoare, 151 din 164.

Sunetele

Sunete comune (25)

abddʒefijklmnoprsttstʃuvwzɡʃ

Doar în română (4)

həɨʒ

Doar în italiană (5)

dzɔɛɲʎ

inventare în PHOIBLE: 3, cu mărimi între 30 și 70

Fiecare loc e însoțit de un interval. Calculul se poate face în mai multe feluri la fel de îndreptățite (care listă de cuvinte pentru română, care descriere a sunetelor, câte trăsături comune se cer); intervalul arată cel mai bun și cel mai slab loc pe care limba îl ocupă în toate aceste variante. La sunete se dă și locul median, cel din mijloc când variantele sunt puse în ordine. Sunt 5.734 de limbi în total, dar numai 201 intră în clasament la toate cele trei măsuri.

Cuvintele: rudele ies primele

Programul ASJP (Automated Similarity Judgment Program) a strâns 11.540 de liste din toată lumea, fiecare cu aceleași 40 de înțelesuri, cele mai stabile dintr-o listă clasică de 100 (lista lui Swadesh): eu, tu, noi, unu, doi, apă, foc, soare, nume. Fiecare cuvânt e transcris cu un set mic de simboluri fonetice. Distanța dintre două limbi se calculează cuvânt cu cuvânt: câte sunete trebuie schimbate, adăugate sau scoase ca să ajungi de la o formă la cealaltă, raportat la lungime. Rezultatul se împarte apoi la distanța medie dintre cuvintele cu înțelesuri diferite din aceleași două liste. Zero înseamnă forme identice la toate înțelesurile comparate. În jur de 1 (scorul poate trece puțin peste), cuvintele cu același înțeles nu seamănă mai mult decât cele luate la întâmplare.

Cea mai apropiată listă e cea meglenoromână (0,44), în toate cele 72 de variante de calcul. Urmează italiana (0,60), sarda logudoreză (0,61), aromâna (0,61, dar cu numai 32 de cuvinte comune din 40) și napolitana (0,62). În calculul de bază, pe primele 17 locuri sunt limbi romanice (pe ultimul dintre ele, o creolă portugheză din India). Spaniola e pe locul 29 (0,73), franceza pe 33 (0,78).

  1. meglenoromână0,44
  2. italiană0,60
  3. sardă logudoreză0,61
  4. aromână0,61
  5. napolitană și graiuri din sudul Italiei0,62
  6. emiliană0,66
  7. sardă campidaneză0,66
  8. catalană0,67
  9. piemonteză0,67
  10. friulană0,67
  11. siciliană0,67
  12. lombardă0,67
  13. sassareză0,68
  14. galiciană0,68
  15. corsicană0,68
  16. portugheză0,68
  17. creolă portugheză din Korlai0,69
  18. latină0,69
  19. romanșă0,69
  20. liguriană0,69
  21. asturo-leoneză0,70
  22. romagnolă0,70
  23. aragoneză0,70
  24. dalmată0,70
  25. ladină0,71
  26. occitană0,71
  27. creolă portugheză din Daman și Diu0,71
  28. mirandeză0,72
  29. spaniolă0,73
  30. ladino (iudeo-spaniolă)0,76
Cele mai apropiate 30 de limbi după cuvinte. Punctul e distanța din calculul de bază; linia arată distanțele din toate cele 72 de variante.

Meglenoromâna și aromâna sunt socotite, în tradiția lingvisticii românești, dialecte istorice ale românei, alături de dacoromână și de istroromână. Cataloagele internaționale Glottolog și ISO 639-3 le trec drept limbi separate. Oricum le-ai numi, sunt rudele cele mai apropiate ale românei, iar prima limbă din afara acestui grup e italiana. ASJP nu are listă separată nici pentru istroromână, nici pentru graiul din Republica Moldova, pe care Glottolog îl trece ca dialect al românei.

În calculul de bază, latina vine abia pe locul 18 (0,69); după variantă, e între locurile 10 și 25, dar mereu după italiană și sarda logudoreză. Măsura compară formele de azi sunet cu sunet și nu spune nimic despre descendență. «Foc» și italienescul «fuoco» continuă latinescul «focus», care însemna vatră; pentru foc, lista latină din ASJP are «ignis».

Dincolo de limbile romanice, scorurile se apropie repede de 1. Bulgara e pe locul 53 (0,87), albaneza pe 245 (0,93), chineza mandarină pe 2.843 (0,99), maghiara pe 3.846 (1,00). Mai mult de jumătate dintre cele 5.457 de limbi au peste 0,99, iar numai 127 coboară sub 0,90. Aici, unde aproape toate limbile se înghesuie lângă 1, locul unei limbi spune foarte puțin. Clasamentul nu măsoară nici vocabularul împrumutat: bulgara și maghiara, din care româna a luat multe cuvinte, sunt comparate doar pe 40 de înțelesuri stabile, fără cuvintele marcate ca împrumuturi.

0,40,60,81,0meglenoromânăitalianăfrancezăbulgarădistanța față de română
Toate cele 5.457 de limbi, după distanța față de română. Aproape toate se strâng în jurul lui 1.

ASJP are liste și pentru limbi artificiale, lăsate aici în afara clasamentului. Interlingua, alcătuită din vocabularul comun al marilor limbi europene, în cea mai mare parte romanic, ar fi a doua (0,59); esperanto ar fi pe locul 29 (0,72).

Cele 40 de cuvinte, alături

ASJP notează sunetele cu 41 de simboluri, redate aici în alfabetul fonetic internațional; «ă» și «î» au același simbol (ə). Listele sunt redate așa cum sunt în ASJP, cu inconsecvențele lor de transcriere. Numărul mic de lângă fiecare cuvânt e distanța față de cuvântul românesc: 0 pentru forme identice, 1 când trebuie schimbat fiecare sunet. Lista aromână e cea numită VLACH în ASJP și are 32 de cuvinte din 40.

Înțelesromânămeglenoromânăaromânăitalianălatinăfranceză
eujewjo, jew 0,33eu, siŋuru 0,83io 1,00ego 1,00ʒə, mwa 1,00
tututu 0,00tini 0,75tu 0,00tu 0,00ti, twa 0,58
noinojnoj 0,00noi 0,33noi 0,33nos 0,33nu 0,67
unuunuun 0,33unu, una 0,17uno 0,33unus 0,25ɛ 1,00
doidojdoj 0,00dui, doua 0,58due 0,67duo 0,67de 0,67
omom, persoanəwom 0,60omu, birbatu 0,74uomo, ɛssere umano 0,73persona, homo 0,62om 0,44
peștepeʃtepeaʃti 0,33pesku 0,60peʃʃe 0,20piskis 0,83pwaso 0,80
câinekəjnekojni 0,40–kane 0,40kanis 0,80ʃjɛ 0,80
păduchepədukepidukʎu 0,43–pidokkjo 0,63pedikulus 0,67pu 0,67
copackopak, arborearbur 0,67arbor, pomu 0,70albero 0,75arbor 0,58aχbχə 0,83
frunzăfrunzəfrunzə 0,00–foʎʎa 0,83folʲũ 0,83fɛj 0,83
pielepjelekoaʒə 1,00kiali 0,80pelle 0,40kutis 1,00po 0,80
sângesəndʒesonzi 0,60sintsa 0,60saŋgue 0,67saŋgʷis 0,83so 0,80
ososwos 0,33–osso 0,50os 0,00os 0,00
cornkornkorn 0,00–korno 0,20kornu 0,20koχn 0,25
urecheurekeureakʎə 0,43uriatsli 0,71orekkjo 0,57auris 0,80oχɛj 1,00
ochiokʲwokʎu 0,80okklu 0,80okkjo 0,80okulus 0,83ɛj 1,00
nasnasnas 0,00–nazo 0,50nasus 0,40ne 0,67
dintedintedinti 0,20dinti 0,20dente 0,20dens 0,60do 0,80
limbălimbəlimbe 0,20limba 0,20liŋgua 0,67liŋgʷɛ 0,60log 0,80
genunchidʒenunkʲzinkʎu 0,83tsinuklu 0,71dʒinokkjo 0,75genu 0,50ʒənu 0,67
mânămənəmonə 0,25mina 0,50mano 0,50manus 0,60mɛ 0,75
sânsəntʃiept, sin 0,67keptu 1,00seno 0,50pektus, mama 1,00sɛ 0,67
ficatfikatdrop 1,00–fegato 0,50jekur 0,80fwa 0,60
a beabeabeaw 0,25abea, beaun 0,33bere 0,50bibere 0,67bwaχ 0,50
a vedeavedeavet 0,60vedu 0,40vedere 0,33widere 0,67vwaχ 0,80
a auziawzʲut 1,00aseultu, andu 0,80udire, sentire 1,00audire 0,83otodχə 1,00
a murimurʲmor 0,67moru 0,75morire 0,83mori 0,75muχiχ 0,60
a venivenʲvin 0,67gini, jinu 1,00venire 0,67wenire 0,83vəniχ 0,80
soaresoaresoari 0,20suari 0,40sole 0,40sol 0,60solɛj 0,60
steasteastewə 0,40stiaua 0,50stella 0,33stela 0,20etwal 0,60
apăapəapu 0,33apa 0,33akkwa 0,80akʷa 0,67o 1,00
piatrăpjatrəropə 0,83gena, osu 1,00sasso, pietra 0,67lapis 0,83pjɛχ 0,67
focfokfok 0,00foku 0,25fuoko 0,40iŋnis 1,00fe 0,67
cărarekəraredrum 0,83–sentiero 0,88vija 0,83sotje 0,83
muntemuntemunti 0,20mundi, dʒana 0,60monte, montaɲɲa 0,41mons 0,60mo, motaɲ 0,80
noaptenoaptenoapti 0,17napte, lopti 0,33notte 0,33noks 0,67nji 0,83
plinplinplin, amplin 0,17mplinu 0,33pieno 0,60plenus 0,50plɛ, χopli 0,55
nounownow 0,00nou 0,33nuovo 0,60nowus 0,40nɛf, nuvo 0,71
numenumenumi 0,25numa 0,25nome 0,25nomen 0,40no 0,75
Distanța pe toată lista0,440,610,600,690,78

Gramatica: o rudă și o vecină, cu același scor

WALS, atlasul mondial al structurilor lingvistice, descrie gramatica fiecărei limbi prin trăsături cu câteva valori posibile: unde stă articolul hotărât, câte cazuri are substantivul, în ce ordine vin subiectul, verbul și complementul. Româna are 82 de trăsături descrise; 65 țin de gramatică, restul de sunete și de vocabular. Măsura folosită aici e simplă: dintre trăsăturile descrise la ambele limbi, câte au aceeași valoare.

Italiana are aceeași valoare ca româna la 41 din 51 de trăsături, albaneza la 45 din 56, portugheza la 40 din 50: patru din cinci, la toate trei. Urmează greaca (48 din 65), spaniola (47 din 64), ucraineana (29 din 40) și bulgara (41 din 57). Franceza, limbă romanică, are 38 din 64, mai puțin decât rusa (46 din 65) sau engleza (45 din 65). La celălalt capăt, turca: 21 din 58.

Cu 50–60 de trăsături, diferențele mici nu pot despărți limbile: marjele de eroare ale primelor zece se suprapun. Ce rămâne valabil în cele nouă variante de calcul: albaneza e în primele trei în toate, italiana e în primele cinci în opt dintre ele (în a noua nu are destule trăsături comune ca să intre în clasament), iar franceza nu urcă niciodată peste locul 14.

  1. italiană41 din 51
  2. albaneză45 din 56
  3. portugheză40 din 50
  4. greacă48 din 65
  5. spaniolă47 din 64
  6. ucraineană29 din 40
  7. bulgară41 din 57
  8. rusă46 din 65
  9. arabă din Golf Golful Persic33 din 47
  10. catalană28 din 40
  11. poloneză39 din 56
  12. ebraică45 din 65
  13. engleză45 din 65
  14. woleai Micronezia28 din 41
  15. estonă34 din 50
  16. bari Sudanul de Sud29 din 44
  17. muna Indonezia27 din 41
  18. khana Nigeria26 din 40
  19. islandeză35 din 54
  20. sârbo-croată30 din 47
Primele 20 de limbi după gramatică. Punctul e proporția de trăsături cu aceeași valoare ca în română; linia e marja de eroare (interval de încredere Wilson, 95%), orientativă, fiindcă trăsăturile nu sunt independente între ele.

Comparația e mai curată pe aceleași trăsături pentru toate limbile. Sunt 36 descrise la toate cele opt limbi din tabelul de mai jos. Pe ele, albaneza coincide cu româna la 32, italiana la 30, portugheza la 29, spaniola la 28, bulgara la 24, greaca la 23, iar franceza la 21.

Pe aceleași 36 de trăsături

  1. albaneză32
  2. italiană30
  3. portugheză29
  4. spaniolă28
  5. bulgară24
  6. greacă23
  7. franceză21

Unde româna se desparte de italiană, albaneza e de partea românei. La opt trăsături româna și italiana au valori diferite, iar albaneza e descrisă și ea; la cinci dintre ele, albaneza are valoarea românei și la una singură pe a italianei. Cele cinci: articolul hotărât lipit la sfârșitul cuvântului («lupul», în albaneză «ujku»), cazurile marcate prin terminații, numeralele ordinale formate de la cele cardinale cu excepția lui «primul», felul în care se formează poruncile și îndemnurile și ordinea subiect–verb. La bulgară și la greacă nu se vede același lucru: în aceeași comparație, bulgara e de trei ori de partea românei și de șase ori de a italianei, greaca de patru și de cinci ori. Una dintre cele șase e chiar articolul hotărât: WALS îl socotește pe cel bulgăresc cuvânt aparte, deși stă tot după substantiv («вълкът», lupul).

Unde româna și italiana diferă, de partea cui e albaneza

Trăsăturăromânăitalianăalbaneză
Articolul hotărâtArticol hotărât lipit de cuvânt (afix)Articol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât lipit de cuvânt (afix)ca româna
Poziția afixelor de cazSufixe de cazFără afixe de caz sau clitice adpoziționaleSufixe de cazca româna
Numeralele ordinale«Întâi» special, restul derivate din cardinal«Întâi» și «al doilea» speciale, restul derivate«Întâi» special, restul derivate din cardinalca româna
Imperativul și hortativul (îndemnul)Sistem maximalNiciunul dintre cele două sistemeSistem maximalca româna
Ordinea subiectului și a verbuluiSVFără ordine dominantăSVca româna
Ordinea demonstrativului și a substantivuluiMixtDemonstrativ – substantivDemonstrativ – substantivca italiana
Distincții de politețe în pronumeDistincții de politețe multipleDistincție binară de politețeFără distincție de politețealtă valoare
Numărul cazurilor2 cazuriFără marcare morfologică a cazului4 cazurialtă valoare

Rezultatul nu e o probă a uniunii lingvistice balcanice, numele dat de lingviști asemănărilor de gramatică dintre română, albaneză, bulgară, macedoneană și greacă. Dintre trăsăturile ei clasice, WALS are articolul pus după substantiv; infinitivul înlocuit de conjunctiv («vreau să plec» față de «vreau a pleca»), viitorul format cu «a vrea» și complementul reluat prin pronume nu au rubrici proprii. Articolul, infinitivul și viitorul sunt arătate, cu exemple, pe pagina despre uniunea lingvistică balcanică. Nici italiana nu e departe de albaneză: cele două au aceeași valoare la 42 din 58 de trăsături descrise la amândouă.

Ce spune Grambank, care nu are româna

Cea mai mare bază de date comparativă de gramatică, după autorii ei, Grambank (2.467 de limbi și dialecte, 195 de trăsături), nu are fișă pentru română în versiunea 1.0.3. Nu are nici pentru bulgară, nici pentru spaniolă. O are pe a aromânei, cu 165 de trăsături completate, așa că testul poate fi repetat pentru ruda cea mai apropiată a românei care are date.

Așa cum sunt codate în Grambank, aromâna coincide cel mai des cu italiana și cu portugheza (151 din 164 de trăsături la fiecare), apoi cu occitana, galiciana, lombarda și corsicana. Albaneza toscă, baza albanezei literare, vine imediat după ele (142 din 160), înaintea sardei, a catalanei (142 din 164) și a francezei (136 din 165).

  1. italiană151 din 164
  2. portugheză151 din 164
  3. occitană150 din 164
  4. galiciană149 din 164
  5. lombardă148 din 164
  6. corsicană139 din 156
  7. albaneză142 din 160
  8. siciliană141 din 159
  9. romanșă139 din 158
  10. sardă campidaneză137 din 158
  11. catalană142 din 164
  12. ucraineană124 din 145
  13. macedoneană134 din 161
  14. letonă133 din 160
  15. belarusă135 din 163
  16. franceză136 din 165
  17. daneză128 din 156
  18. albaneză ghegă130 din 159
  19. greacă134 din 165
  20. islandeză129 din 159

Și aici, unde aromâna se desparte de italiană, albaneza e de partea aromânei: de nouă ori, față de patru. Macedoneana dă 9 la 3, greaca 7 la 6. Printre trăsături: articolul pus după substantiv, cazurile, apoi modul și timpul marcate prin particule invariabile. Două dintre aceste codări au fost contestate la verificare: italiana apare în Grambank fără verb auxiliar pentru timp, deși «ho visto» are unul, iar a doua privește pronumele lipit după verb în aromână. Fără ele, scorurile sunt 7 la 4 pentru albaneză, 7 la 3 pentru macedoneană și 5 la 6 pentru greacă.

Toate cele 65 de trăsături, la opt limbi

Valorile din WALS pentru română și pentru șapte limbi de comparație. Căsuțele marcate au aceeași valoare ca româna; liniuța înseamnă că trăsătura nu e descrisă pentru limba respectivă. În formulele de ordine, S e subiectul, V verbul, O complementul direct, Neg negația, iar parantezele drepte arată o negație lipită de verb. Trăsătura 45A, despre pronumele de politețe, are propria pagină: De ce spunem «dumneavoastră».

Arată tabelul
Trăsăturăromânăitalianăfrancezăspaniolăportughezăalbanezăbulgarăgreacă
26A Prefixare și sufixare în morfologia flexionarăSe adaugă la cuvinte mai ales prefixe sau sufixe?Sufixare puternicăSufixare puternicăSufixare puternicăSufixare puternicăSufixare puternicăSufixare puternicăSufixare puternicăSufixare puternică
33A Marcarea pluralului substantivuluiCum se arată că un substantiv este la plural?Sufix de pluralSufix de pluralSufix de pluralSufix de pluralSufix de pluralSufix de pluralSufix de pluralSufix de plural
34A Apariția pluralului substantivuluiCare substantive au plural și este el obligatoriu?Toate substantivele, mereu obligatoriuToate substantivele, mereu obligatoriuToate substantivele, mereu obligatoriuToate substantivele, mereu obligatoriuToate substantivele, mereu obligatoriu––Toate substantivele, mereu obligatoriu
37A Articolul hotărâtCum se exprimă articolul hotărât («lupul», în engleză «the wolf»)?Articol hotărât lipit de cuvânt (afix)Articol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât lipit de cuvânt (afix)Articol hotărât: cuvânt aparte, diferit de demonstrativArticol hotărât: cuvânt aparte, diferit de demonstrativ
38A Articolul nehotărâtCum se exprimă articolul nehotărât («un», «o»)?Articol nehotărât identic cu «unu»Articol nehotărât identic cu «unu»Articol nehotărât identic cu «unu»Articol nehotărât identic cu «unu»Articol nehotărât identic cu «unu»Articol nehotărât diferit de «unu»–Articol nehotărât identic cu «unu»
45A Distincții de politețe în pronumeSe schimbă pronumele «tu» după gradul de politețe?Distincții de politețe multipleDistincție binară de politețeDistincție binară de politețeDistincție binară de politețeDistincție binară de politețeFără distincție de politețe–Distincție binară de politețe
46A Pronumele nehotărâteCum se formează cuvinte ca «cineva» sau «ceva»?Pe baza pronumelui interogativPe baza unui substantiv genericPe baza unui substantiv genericForme specialeMixt–Pe baza pronumelui interogativPe baza pronumelui interogativ
47A Pronume de întărire și pronume reflexiveSe folosește același cuvânt pentru «însuși» și pentru reflexiv?DiferiteDiferiteDiferiteDiferiteDiferite–DiferiteDiferite
49A Numărul cazurilorCâte cazuri are substantivul?2 cazuriFără marcare morfologică a cazuluiFără marcare morfologică a cazuluiFără marcare morfologică a cazului–4 cazuriFără marcare morfologică a cazului3 cazuri
50A Marcarea asimetrică a cazuluiMarchează pronumele și substantivele cazul la fel?Asimetrie cantitativă aditivăAsimetrie cantitativă aditivăFără marcare de cazAsimetrie cantitativă aditivă–Sincretism la tipurile de grup nominal relevanteAsimetrie cantitativă aditivăSincretism la tipurile de grup nominal relevante
51A Poziția afixelor de cazUnde se așază mărcile de caz: la începutul sau la sfârșitul cuvântului?Sufixe de cazFără afixe de caz sau clitice adpoziționaleClitice prepoziționaleFără afixe de caz sau clitice adpoziționaleFără afixe de caz sau clitice adpoziționaleSufixe de cazFără afixe de caz sau clitice adpoziționaleSufixe de caz
52A Comitative și instrumentaleSe spune la fel «cu un prieten» și «cu un cuțit»?Aceeași marcăAceeași marcăAceeași marcă–Aceeași marcăAceeași marcă–Aceeași marcă
53A Numeralele ordinaleCum se formează «primul», «al doilea», «al treilea»?«Întâi» special, restul derivate din cardinal«Întâi» și «al doilea» speciale, restul derivate«Întâi» și «al doilea» speciale, restul derivate«Întâi» și «al doilea» speciale, restul derivate«Întâi» și «al doilea» speciale, restul derivate«Întâi» special, restul derivate din cardinal«Întâi» și «al doilea» speciale, restul derivate«Întâi» și «al doilea» speciale, restul derivate
54A Numeralele distributiveCum se spune «câte doi» sau «doi câte doi»?Marcate printr-un cuvânt pus înainte–Fără numerale distributiveFără numerale distributive–Marcate printr-un cuvânt pus înainteMarcate printr-un cuvânt pus înainteMarcate printr-un cuvânt pus înainte
57A Poziția afixelor posesive pronominaleSe atașează «meu», «tău» la substantiv ca afixe?Fără afixe posesiveFără afixe posesiveFără afixe posesiveFără afixe posesive–Fără afixe posesiveFără afixe posesiveFără afixe posesive
63A Coordonarea grupurilor nominaleSe spune la fel «și» și «cu»?«Și» diferit de «cu»–«Și» diferit de «cu»«Și» diferit de «cu»–«Și» diferit de «cu»«Și» diferit de «cu»«Și» diferit de «cu»
65A Aspectul perfectiv/imperfectivGramatica distinge acțiunile încheiate de cele în desfășurare?Marcare gramaticală–Marcare gramaticalăMarcare gramaticalăMarcare gramaticală–Marcare gramaticalăMarcare gramaticală
66A Timpul trecutDistinge limba trecutul apropiat de cel îndepărtat?Există trecut, fără distincții de depărtare–Există trecut, fără distincții de depărtareExistă trecut, fără distincții de depărtareExistă trecut, fără distincții de depărtare–Există trecut, fără distincții de depărtareExistă trecut, fără distincții de depărtare
67A Timpul viitorViitorul se exprimă printr-o terminație a verbului?Fără viitor flexionar–Există viitor flexionarExistă viitor flexionarFără viitor flexionar–Fără viitor flexionarFără viitor flexionar
68A PerfectulExistă un timp aparte pentru o acțiune trecută cu urmări în prezent (în engleză «I have eaten» față de «I ate»)?Fără perfect–Din construcție posesivă («a avea»)Din construcție posesivă («a avea»)Fără perfect–Alt tip de perfectDin construcție posesivă («a avea»)
69A Poziția afixelor de timp și aspectTimpul și aspectul se adaugă la începutul sau la sfârșitul verbului?Sufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspectSufixe de timp și aspect
70A Imperativul morfologicAre imperativul forme proprii la persoana a II-a: la singular, la plural sau la amândouă?Persoana a II-a singularPersoana a II-a singularPersoana a II-a singularPersoana a II-a singular și pluralPersoana a II-a singularPersoana a II-a singularPersoana a II-a singular și pluralPersoana a II-a singular și plural
71A ProhibitivulCum se formează interdicția («Nu pleca!»)?Imperativ special + negație normalăImperativ special + negație normalăImperativ normal + negație normalăImperativ special + negație normalăImperativ special + negație normalăImperativ normal + negație specialăImperativ special + negație specialăImperativ special + negație specială
72A Imperativul și hortativul (îndemnul)Imperativul se formează la fel ca «hai să…» și «să plece»?Sistem maximalNiciunul dintre cele două sistemeNiciunul dintre cele două sistemeNiciunul dintre cele două sistemeNiciunul dintre cele două sistemeSistem maximalSistem maximalSistem maximal
74A Posibilitatea situaționalăCum se exprimă «a putea» (capacitate, permisiune)?Construcții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbale–Construcții verbale
75A Posibilitatea epistemicăCum se exprimă «s-ar putea să fie așa»?Construcții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbaleConstrucții verbale–Construcții verbale
76A Suprapunerea marcării modale situaționale și epistemiceAceeași formă exprimă și capacitatea, și probabilitatea?Suprapunere atât la posibilitate, cât și la necesitateSuprapunere atât la posibilitate, cât și la necesitateSuprapunere atât la posibilitate, cât și la necesitateSuprapunere atât la posibilitate, cât și la necesitateSuprapunere atât la posibilitate, cât și la necesitateSuprapunere doar la posibilitate sau doar la necesitate–Suprapunere atât la posibilitate, cât și la necesitate
77A Distincții semantice ale evidențialitățiiGramatica arată de unde știe vorbitorul ce spune?Fără evidențiale gramaticale–Doar indirecteFără evidențiale gramaticale–Doar indirecteDirecte și indirecteFără evidențiale gramaticale
78A Marcarea evidențialitățiiPrin ce mijloc arată gramatica de unde știe vorbitorul ce spune?Fără evidențiale gramaticale–Morfem modalFără evidențiale gramaticale–Afix sau clitic verbalParte a sistemului temporalFără evidențiale gramaticale
81A Ordinea subiectului, a complementului direct și a verbuluiÎn ce ordine apar subiectul, complementul direct și verbul?SVOSVOSVOSVOSVOSVOSVOFără ordine dominantă
82A Ordinea subiectului și a verbuluiSubiectul stă înainte de verb sau după?SVFără ordine dominantăSVFără ordine dominantăSVSVFără ordine dominantăFără ordine dominantă
83A Ordinea complementului direct și a verbuluiComplementul direct stă înainte de verb sau după?VOVOVOVOVOVOVOVO
85A Ordinea adpoziției și a grupului nominalCuvinte ca «în», «pe» stau înainte de substantiv sau după?PrepozițiiPrepozițiiPrepozițiiPrepozițiiPrepozițiiPrepozițiiPrepozițiiPrepoziții
86A Ordinea genitivului și a substantivuluiPosesorul stă înainte de lucrul posedat sau după?Substantiv – genitivSubstantiv – genitivSubstantiv – genitivSubstantiv – genitivSubstantiv – genitivSubstantiv – genitivFără ordine dominantăSubstantiv – genitiv
87A Ordinea adjectivului și a substantivului«Roșu» stă înainte de «casă» sau după?Substantiv – adjectivSubstantiv – adjectivSubstantiv – adjectivSubstantiv – adjectivSubstantiv – adjectivSubstantiv – adjectivAdjectiv – substantivAdjectiv – substantiv
88A Ordinea demonstrativului și a substantivului«Acest» stă înainte de substantiv sau după?MixtDemonstrativ – substantivDemonstrativ – substantivDemonstrativ – substantivDemonstrativ – substantivDemonstrativ – substantivDemonstrativ – substantivDemonstrativ – substantiv
89A Ordinea numeralului și a substantivului«Trei» stă înainte de substantiv sau după?Numeral – substantivNumeral – substantivNumeral – substantivNumeral – substantiv–Numeral – substantivNumeral – substantivNumeral – substantiv
90A Ordinea propoziției relative și a substantivuluiPropoziția relativă («care a plecat») stă înainte de substantiv sau după?Substantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativăSubstantiv – propoziție relativă
90C Propoziții relative postnominaleCe tipuri de propoziții relative pot urma substantivului?Substantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominantSubstantiv-propoziție relativă (NRel) dominant
91A Ordinea adverbului de grad («foarte») și a adjectivului«Foarte» stă înainte de adjectiv sau după?Adverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectivAdverb de grad – adjectiv
92A Poziția particulelor interogative în întrebările totaleExistă o particulă pentru întrebările cu răspuns da/nu? Unde stă?Fără particulă interogativăFără particulă interogativăInițialăFără particulă interogativăInițialăInițialăA doua pozițieInițială
93A Poziția grupurilor interogative în întrebările parțialeÎn «Ce ai văzut?», cuvântul interogativ vine primul?Grup interogativ inițial–Grup interogativ inițialGrup interogativ inițial––Grup interogativ inițialGrup interogativ inițial
94A Ordinea conjuncției subordonatoare și a propoziției«Pentru că» stă înainte de propoziția sa sau după?Conjuncție la începutConjuncție la începutConjuncție la începutConjuncție la început–Conjuncție la începutConjuncție la începutConjuncție la început
95A Raportul dintre ordinea complement direct–verb și ordinea adpoziție–grup nominalOrdinea verb–complement merge împreună cu cea a prepozițiilor?VO și prepozițiiVO și prepozițiiVO și prepozițiiVO și prepozițiiVO și prepozițiiVO și prepozițiiVO și prepozițiiVO și prepoziții
96A Raportul dintre ordinea complement direct–verb și ordinea propoziție relativă–substantivOrdinea verb–complement merge împreună cu cea a propoziției relative?VO și NRelVO și NRelVO și NRelVO și NRelVO și NRelVO și NRelVO și NRelVO și NRel
97A Raportul dintre ordinea complement direct–verb și ordinea adjectiv–substantivOrdinea verb–complement merge împreună cu cea a adjectivului?VO și NAdjVO și NAdjVO și NAdjVO și NAdjVO și NAdjVO și NAdjVO și AdjNVO și AdjN
112A Morfemele negațieiCum se exprimă «nu»: afix, particulă sau verb?Particulă negativăParticulă negativăParticulă negativăParticulă negativăParticulă negativăParticulă negativăParticulă negativăParticulă negativă
115A Pronumele negative («nimeni», «nimic») și negația predicatuluiSe spune «nu a venit nimeni» (două negații) sau «a venit nimeni»?Negația predicatului este prezentă și eaComportament mixtComportament mixtComportament mixtComportament mixt–Negația predicatului este prezentă și eaNegația predicatului este prezentă și ea
116A Întrebările totaleCum se marchează întrebările cu răspuns da/nu?Doar intonație interogativăDoar intonație interogativăParticulă interogativăOrdine interogativă a cuvintelorParticulă interogativăParticulă interogativăParticulă interogativăParticulă interogativă
117A Posesia predicativăCum se spune «am o carte»?Cu verbul «a avea»––Cu verbul «a avea»–Cu verbul «a avea»–Cu verbul «a avea»
118A Adjectivele predicativeÎn «casa e mare», adjectivul se comportă ca un verb?Construcție nonverbală–Construcție nonverbalăConstrucție nonverbală–Construcție nonverbalăConstrucție nonverbalăConstrucție nonverbală
119A Predicația nominală și cea locativă«Este medic» și «este în casă» se construiesc la fel?Identice–IdenticeDiferite–IdenticeIdenticeIdentice
120A Copula zero la predicatul nominalSe poate omite «este» în «el este medic»?Copula nu poate lipsi–Copula nu poate lipsiCopula nu poate lipsi–Copula nu poate lipsiCopula nu poate lipsiCopula nu poate lipsi
124A Subiectul subordonatei de după «a vrea»După «a vrea», al doilea verb arată și el persoana («vreau să plec») sau rămâne la infinitiv (în franceză «je veux partir»)?Subiectul e marcat din nou (prin pronume sau prin forma verbului)–Subiectul rămâne subînțelesSubiectul rămâne subînțeles–Subiectul e marcat din nou (prin pronume sau prin forma verbului)Subiectul e marcat din nou (prin pronume sau prin forma verbului)Subiectul e marcat din nou (prin pronume sau prin forma verbului)
143A Ordinea morfemului negativ și a verbului«Nu» stă înainte de verb sau după?NegVNegVDublă negație facultativăNegVNegVNegVNegVNegV
143E Morfeme negative preverbaleCe morfeme negative apar înaintea verbului?NegVNegVNegVNegVNegVNegVNegVNegV
143F Morfeme negative postverbaleCe morfeme negative apar după verb?NiciunulNiciunulVNegNiciunulNiciunulNiciunulNiciunulNiciunul
143G Mijloace morfologice minore de marcare a negațieiNegația se marchează și prin ton sau prin modificarea verbului?NiciunulNiciunulNiciunulNiciunulNiciunulNiciunulNiciunulNiciunul
144A Poziția cuvântului negativ față de subiect, complement direct și verbUnde stă «nu» față de subiect, verb și complement direct?SNegVOSNegVODublă negație facultativăSNegVOSNegVOSNegVOSNegVOMai multe poziții
144B Poziția cuvintelor negative față de începutul și sfârșitul propoziției și față de verbCuvântul negativ stă imediat înaintea verbului sau în altă parte?Imediat preverbalImediat preverbalImediat postverbalImediat preverbalImediat preverbalImediat preverbalImediat preverbalImediat preverbal
144D Poziția morfemelor negative în limbile SVOÎn limbile SVO, unde stă «nu»?SNegVOSNegVONegație facultativăSNegVOSNegVOSNegVOSNegVOMai multe construcții
144H Ordinea NegSVOCând «nu» deschide propoziția, mai trebuie o a doua negație?Fără NegSVOFără NegSVOFără NegSVOFără NegSVOFără NegSVOFără NegSVOFără NegSVOFără NegSVO
144I Ordinea SNegVOCând «nu» stă după subiect, mai trebuie o a doua negație?Cuvânt, fără dublă negațieCuvânt, fără dublă negațieCuvânt, doar împreună cu altă negațieCuvânt, fără dublă negațieCuvânt, fără dublă negațieCuvânt, fără dublă negațieCuvânt, fără dublă negațieCuvânt, fără dublă negație
144J Ordinea SVNegOCând «nu» stă după verb, mai trebuie o a doua negație?Fără SVNegOFără SVNegOCuvânt, dublă negație facultativăFără SVNegOFără SVNegOFără SVNegOFără SVNegOFără SVNegO
144K Ordinea SVONegCând «nu» stă la sfârșit, mai trebuie o a doua negație?Fără SVONegFără SVONegFără SVONegFără SVONegFără SVONegFără SVONegFără SVONegFără SVONeg

Sunetele: două descrieri ale românei, două liste

PHOIBLE adună inventare de sunete. Un inventar e lista sunetelor unei limbi care pot deosebi două cuvinte (fonemele, uneori și variante ale lor), așa cum a stabilit-o un lingvist. Sunt 3.020 de inventare pentru 2.186 de limbi. Ce se măsoară aici e câte sunete au două inventare în comun, din câte au împreună; una dintre variantele de calcul măsoară în schimb cât de apropiate sunt sunetele unui inventar de ale celuilalt. Nu se măsoară cât de des apare fiecare sunet în vorbire, nici melodia frazei, nici cum sună limba pentru cineva care nu o știe.

Pentru română, PHOIBLE are trei inventare, iar ele nu coincid. Două urmează descrierea obișnuită: șapte vocale, 20 de consoane și semivocalele din «iarnă», «ziuă», «seară» și «soare». Al treilea, întocmit după cartea Ioanei Chitoran despre fonologia românei (2002), numără separat consoanele muiate (palatalizate) de la sfârșitul unor cuvinte ca «lupi», «pomi», «rupi»: p-ul din «lupi» e trecut ca alt sunet decât p-ul din «lup». Inventarul ajunge astfel la 51 de unități, față de 31 și 32.

Sunetele românei, în cele trei descrieri din PHOIBLE

SPA (Agard 1958, Ruhlen 1973) · 31

consoane (20) bddʒgefɡghhkclmnprsʃșttsțtʃcevzʒj

vocale (7) aeəăiɨîou

semivocale și diftongi (4) ji (iarnă)wu (ziuă)ɛ̯ɔ̯

UPSID (Agard 1958, Tătaru 1978, Ruhlen 1973) · 32

consoane (20) bddʒgefɡghhkclmnprsʃșttsțtʃcevzʒj

vocale (7) aeəăiɨîou

semivocale și diftongi (5) ji (iarnă)wu (ziuă)e̞ae̞o̞o̞a

EA (Chitoran 2002) · 51

consoane (40) bbʲçddʲdʒgedʒʲffʲɡgɡʲhhkckʲllʲmmʲnnʲppʲrrʲssʲʃșʃʲttʲtsțtsʲtʃcetʃʲvvʲzzʲʒjʒʲ

vocale (7) aeəăiɨîou

semivocale și diftongi (4) ji (iarnă)wu (ziuă)e̯äo̯ä

Cu fond plin: sunetele prezente în toate cele trei descrieri. Cu contur: cele pe care le are doar descrierea respectivă. Diftongii și semivocalele din «seară» și «soare» sunt notați diferit de la o sursă la alta și nu intră în comparație.

Cu descrierea obișnuită, cele mai apropiate inventare sunt ale unor limbi îndepărtate: damana din Columbia, bangolan din Camerun, nupe din Nigeria, o creolă franceză din Brazilia (karipúna) și mazanderani din Iran. Primele trei nu au nicio legătură cu româna; mazanderani e o limbă iraniană, deci o rudă foarte îndepărtată. Au, ca româna, un inventar de mărime mijlocie, făcut mai ales din sunete răspândite în toată lumea. Bangolan are toate cele 29 de sunete prezente în cele trei descrieri ale românei: șapte vocale, 20 de consoane și semivocalele din «iarnă» și «ziuă».

Când consoanele muiate sunt numărate separat, lista se mută în nordul și estul Europei: rusă, sorabă, vepsă, sami skolt, lituaniană, erzeană, bulgară. Toate au serii întregi de consoane muiate, ca rusa în «брать» (brat', a lua) față de «брат» (brat, frate).

Cu 7 vocale și 20 de consoane

  1. damana (malayo) Columbia2 (1–11)
  2. bangolan Camerun2 (1–22)
  3. nupe Nigeria6 (3–11)
  4. creolă franceză karipúna Brazilia9 (2–17)
  5. mazanderani Iran10 (1–56)
  6. popoluca de Sayula Mexic16 (8–32)
  7. ndamba Tanzania17 (4–37)
  8. pidgin nigerian Nigeria17 (3–54)
  9. ishkashimi Afganistan și Tadjikistan20 (8–46)
  10. kirundi Burundi21 (8–52)
  11. creolă engleză din Antigua și Barbuda Caraibe23 (5–147)
  12. dazaga Ciad și Niger29 (10–52)
  13. lunda Angola, Zambia, RD Congo29 (16–52)
  14. mwani Mozambic30 (3–90)
  15. yamba Camerun38 (17–78)

Cu consoanele muiate din «lupi» și «pomi» numărate separat

  1. rusă4 (1–5)
  2. sorabă de sus Germania5 (3–7)
  3. vepsă Rusia5 (1–7)
  4. sami skolt Finlanda și Rusia5 (1–10)
  5. lituaniană5 (1–12)
  6. votică Rusia8 (6–10)
  7. erzeană Rusia8 (4–11)
  8. sorabă de jos Germania9 (6–9)
  9. bulgară10 (1–62)
  10. sami de Ter Rusia12 (10–21)
  11. sami de sud Norvegia și Suedia14 (1–17)
  12. ruteană Carpați16 (9–27)
  13. albaneză17 (14–18)
  14. komi-ziriană Rusia23 (15–64)
  15. chinantecă de Lealao Mexic27 (10–46)

Locul median (cel din mijloc când variantele de calcul sunt puse în ordine) și, între paranteze, cel mai bun și cel mai slab loc din variantele care folosesc descrierea respectivă.

În niciuna dintre cele 72 de variante de calcul italiana nu urcă peste locul 19, iar chineza mandarină nu urcă peste locul 986, din 2.085. Albaneza are 28 dintre cele 29 de sunete comune descrierilor românei, italiana 25 (îi lipsesc «ă», «î», «h» și «j»), bulgara 24, chineza mandarină 17.

Dintre aceste 29 de sunete, cele mai rare în inventarele din PHOIBLE sunt «j» din «joc» (ʒ, prezent în 15,9% din inventare), «î» (ɨ, 16,5%) și «ă» (ə, 22,4%). Urmează «ț» (26,8%) și «v» (27,0%). Cel mai răspândit sunet care lipsește din toate cele trei descrieri ale românei e «ng» din englezescul «sing» (ŋ, în 62,8% din inventare). Printre următoarele se numără «ñ» din spaniolă (ɲ, 42,7%) și ocluziva glotală, pauza scurtă din mijlocul interjecției englezești «uh-oh» (ʔ, 37,5%).

Cât de răspândite sunt sunetele românei

  1. ʒ j16%
  2. ɨ î17%
  3. ə ă22%
  4. ts ț27%
  5. v27%
  6. dʒ ge27%
  7. z34%
  8. ʃ ș37%
  9. tʃ ce41%
  10. f44%
  11. h h56%
  12. ɡ g57%
  13. d62%
  14. b63%
  15. e70%
  16. o70%
  17. r75%
  18. s77%
  19. l81%
  20. w u (ziuă)83%
  21. p86%
  22. u88%
  23. a90%
  24. j i (iarnă)90%
  25. k c91%
  26. t92%
  27. i92%
  28. m96%
  29. n97%
  1. ŋ63%
  2. ɲ43%
  3. ɛ38%
  4. ʔ37%
  5. ɔ36%
  6. iː32%
  7. aː31%
  8. uː30%
Fiecare bară arată în ce proporție dintre cele 3.020 de inventare din PHOIBLE apare sunetul.

Cum sună româna pentru urechea unui străin e altă întrebare. Într-un joc online în care oamenii ghiceau limba dintr-o înregistrare de 20 de secunde, cu 15 milioane de răspunsuri analizate în 2017 de Hedvig Skirgård, Seán Roberts și Lars Yencken, pe harta confuziilor făcute de jucători româna stă lângă greacă, albaneză și limbile slave.

De ce nu se potrivesc cele trei răspunsuri

Fiecare măsură urmărește altceva. Lista de 40 de cuvinte e alcătuită din înțelesurile cele mai stabile, iar pe primele 17 locuri din calculul de bază sunt numai limbi romanice, rudele românei.

Gramatica se moștenește, dar se și apropie de a limbilor din jur. Româna se vorbește departe de celelalte limbi romanice: între ea și italiană stau limbi slave și maghiara, iar bulgara, albaneza și greaca îi sunt mai aproape pe hartă. Pe grafic, limbile romanice sunt aproape la ambele măsuri; albaneza, greaca și bulgara sunt aproape la gramatică și departe la cuvinte.

0,40,60,81,020%40%60%80%

← cuvinte: distanță față de română↑ gramatică: trăsături cu aceeași valoare

Fiecare punct e o limbă cu listă de cuvinte și cu cel puțin 40 de trăsături de gramatică descrise (243 de limbi). Spre stânga: cuvinte mai apropiate de ale românei. În sus: gramatică mai apropiată.

Sunetele sunt puține. O limbă are câteva zeci de foneme, iar cele mai răspândite (p, t, k, m, n, a, i, u) apar aproape peste tot. Două inventare de mărime mijlocie se pot suprapune în proporție de peste trei sferturi fără ca limbile să aibă vreo legătură, cum se întâmplă cu româna și damana.

De aceea întrebarea din titlu nu are un singur răspuns. «Cea mai apropiată» are sens numai împreună cu măsura: la cuvinte, la gramatică sau la sunete.

Cum s-a măsurat și ce alegeri s-au făcut

Identitatea limbilor

O limbă înseamnă aici o intrare de nivel «limbă» din catalogul Glottolog 5.3. Listele și inventarele culese pentru dialecte sunt trecute la limba lor. Albaneza literară se sprijină pe dialectul tosc. Lista ASJP pentru albaneza standard, atașată grupului «Albanian», și fișa WALS «Albanian» (care are codul ISO sqi, nu are cod Glottolog și pomenește atât dialectul gheg, cât și pe cel tosc) au fost puse la albaneza toscă, fiindcă PHOIBLE și Grambank au datele albanezei sub acest cod.

Cuvinte

ASJP versiunea 21: 11.540 de liste. Calculul de bază urmează regulile programului: lista de 40 de cuvinte, cel mult două sinonime pentru un înțeles, cuvintele marcate ca împrumuturi lăsate deoparte, distanța Levenshtein raportată la lungimea cuvântului și împărțită la distanța medie dintre cuvintele cu înțelesuri diferite (în engleză LDND). Pentru română sunt trei liste, care diferă între ele cu 0,12 până la 0,22; cea de bază e ROMANIAN_3. O limbă intră în clasament dacă are cel puțin 28 de cuvinte comune cu lista românească: 5.457 de limbi. Au rămas pe dinafară 405 liste fără cod Glottolog, 22 de liste ale unor limbi artificiale, patru liste atașate unor grupuri de limbi și 620 de limbi cu prea puține cuvinte.

Variantele: lista românească (3), simbolurile compuse luate ca o unitate sau desfăcute (2), împrumuturile scoase sau păstrate (2), sinonimele (primele două, toate, sau perechea cea mai apropiată: 3), lista mediană sau cea mai apropiată când o limbă are mai multe (2). În total 72. Tabelul de cuvinte arată lista mediană; când aceasta e a unui grai local, iar ASJP are și o listă cu numele simplu al limbii, e arătată aceea, cu distanța ei. Pentru chineza mandarină, care are 184 de liste, tabelul arată lista din Beijing.

Gramatică

WALS, ediția 2020.4: 65 de trăsături ale românei, după scoaterea celor 15 de fonologie și a celor două de vocabular; 28 dintre ele descriu ordinea cuvintelor. Clasamentul de bază cere cel puțin 40 de trăsături comune: 243 de limbi, din 1.900 de limbi care au măcar una. Variantele: toate trăsăturile, fără cele de ordine a cuvintelor (37), sau pe blocuri, în care trăsăturile care decurg una din alta contează o singură dată (51 de blocuri); cu pragul la 30, 40 sau 50 de trăsături comune.

În Grambank 1.0.3 s-au căutat codul Glottolog al românei și toată ramura romanică orientală: singura fișă e a aromânei. Aromâna a fost comparată cu limbile care au cel puțin 120 de trăsături comune cu ea.

Sunete

PHOIBLE 2.0.1. Înainte de comparație, notațiile au fost aduse la aceeași formă: semnele pentru dental, apical, laminal, coborât, ridicat, centralizat, avansat și retras au fost scoase; r bătut și r vibrant au fost numărați ca un singur r; semivocalele notate i̯ și u̯ au fost citite ca j și w. Tonurile, diftongii și semivocalele din «seară» și «soare» nu intră în calcul. Lungimea, nazalizarea, palatalizarea, aspirația și sonoritatea rămân diferențe. Este o simplificare făcută cu bună știință: fără ea, același t românesc ar fi trei sunete diferite în cele trei descrieri.

Variantele: măsura (suprapunerea pe notația simplificată, pe notația din PHOIBLE, sau o distanță pe cele 37 de trăsături fonetice din PHOIBLE: 3), diftongii scoși sau păstrați (2), fonemele marginale păstrate sau scoase (2), descrierea românei (3), inventarul median sau cel mai apropiat când o limbă are mai multe (2). În total 72. La comparația sunet cu sunet, un sunet românesc e socotit comun dacă îl are, ca fonem obișnuit, cel puțin un inventar al limbii alese.

Ce lipsește

Nicio măsură de aici nu spune cât de ușor se înțeleg doi vorbitori și niciuna nu ține seama de vocabularul întreg, de scriere sau de pronunția reală. Bazele de date sunt inegale: WALS are puține trăsături pentru multe limbi, iar PHOIBLE amestecă descrieri făcute după convenții diferite. De aceea fiecare rezultat e dat împreună cu numărul de cuvinte sau de trăsături pe care se sprijină.

Datele, pentru descărcare

Tabelele care cuprind date din PHOIBLE (languages.csv și sounds-romanian.csv) sunt sub licența CC BY-SA 3.0, ca PHOIBLE; celelalte, derivate din ASJP, WALS și Glottolog, sunt sub CC BY 4.0.

Surse

Bazele de date

Metodă și studii

Pe aceeași temă