# Ceai, чай, çay, 茶: cine spune la fel ca tine?

https://mariuscomper.uk/harta-cuvintelor/

Alege un cuvânt și vezi cum îl spun 107 limbi, din Islanda până în Kamciatka. Se aprind întâi cele care îl spun aproape ca tine.

Limba ta

Se încarcă harta…

Cât de aproape sună fiecare cuvânt de al tău

sună la fel ca tine · nimic în comun

Ceaiul, în limbile hărții, grupat după cuvintele care seamănă:

finlandeză *tee*, careliană de nord *čäijy*, careliană de Olonets *čuaju*, vepsă *čai*, estonă *tee*, livonă *tēj*, sami din Lule *tedja*, sami de nord *deadju*, sami din Inari *čee*, sami skolt *čee*, sami din Kildin *чайй*, mari de munte *чӓй*, mari de câmpie *чай*, mokșa *чай*, erzia *чай*, udmurtă *чай*, komi-permiacă *чай*, komi-ziriană *чай*, maghiară *tea*, hantî de nord *шай*, mansi de nord *ся̄й*, selkupă de nord *чой*, neneță de tundră *сяй*, eneță de pădure *чай*, nganasană *чаи*, bengaleză *চা*, hindi *चाय*, paștună de nord *چای*, persană *چای*, kurdă de nord *çay*, osetă *цай*, armeană *թեյ*, albaneză *çaj*, bulgară *чай*, croată *čaj*, slovenă *čáj*, slovacă *čaj*, cehă *čaj*, ucraineană *чай*, belarusă *чай*, rusă *чай*, letonă *tēja*, islandeză *te*, norvegiană *te*, suedeză *te*, daneză *te*, germană *Tee*, neerlandeză *thee*, engleză *tea*, irlandeză *tae*, galeză *te*, bretonă *te*, franceză *thé*, catalană *te*, spaniolă *té*, portugheză *chá*, italiană *tè*, română *ceai*, turcă *çay*, azeră *çay*, uzbecă *choy*, kazahă *шай*, bașchiră *сәй*, tătară *чәй*, iakută *чэй*, ciuvașă *чей*, mongolă *цай*, buriată *сай*, calmucă *цә*, evencă *чай*, manciuriană *cai*, nanai *чаи*, iukaghiră de nord *чай*, itelmenă *чай*, ciukotcă *чай*, nivhă *чай*, ainu *cha*, coreeană *차*, japoneză *茶*, groenlandeză *tii*, kannada *ಚಹ*, malayalam *ചായ*, burușaski *ćái*, georgiană *ჩაი*, bască *te*, adigheză *щай*, avară *чай*, țeză *чай*, lakă *чяй*, lezghină *чай*, dargină *чай*, cecenă *чай*, arabă *شاي*, ebraică *תה*, chineză *茶*

greacă *τσάι*, latină *thea*

poloneză *herbata*, lituaniană *arbata*

aleută *chaayu-x́*, yupik siberiană *ӄаюӄ*

tamilă *தெனீர்*, telugu *తేనీరు*

Aceeași culoare înseamnă același grup: cuvinte care seamănă cu tot grupul, iar între familii diferite de limbi asemănarea a trecut și un test de întâmplare. Pot fi moștenite, împrumutate, imitate după un sunet sau, uneori, o coincidență. Portocaliu e grupul tău. Banda de sub hartă așază fiecare limbă doar după sunet: în stânga, cuvinte aproape identice cu al tău; în dreapta, cuvinte fără nimic în comun. Atinge un punct ca să vezi cuvântul și pronunția.

Încearcă:

1 · Ceaiul

## Ceaiul a ajuns în Europa pe două drumuri

Rușii spun *чай*, turcii *çay*, perșii *چای*, iar în hindi e *चाय*. Româna a luat „ceai” din rusă, spune DEX. Dicționarul etimologic al lui Max Vasmer duce *чай* și formele turcice și mongole la chineza din nord, *čhā*.

Englezii spun *tea*, francezii *thé*, germanii *Tee*. Negustorii olandezi, principalii importatori de ceai în Europa, făceau comerț prin Xiamen, în provincia Fujian, unde se vorbește min nan și ceaiul se cheamă *te*. De la ei, cuvântul s-a răspândit în mare parte din Europa, scrie lingvistul Östen Dahl.

Portugheza e excepția: portughezii au adus ceai înaintea olandezilor, în secolul al XVI-lea, prin Macao, și spun *chá*, din cantoneză.

Harta pune toate aceste cuvinte în același grup, 95 de limbi din 20 de familii: cel mai mare grup dintre toate cele 1.016 concepte. Și are dreptate: amândouă formele vin din chineză, *cha* din mandarină și din cele mai multe limbi chineze, *te* din min nan. Ratează totuși câteva, de la greaca *τσάι* la poloneza *herbata*. Drumurile se văd și în ordinea în care se aprind limbile: pornind de la „ceai”, se aprind, în mare, întâi cuvintele de tipul *чай* și abia apoi cele de tipul *tea*.

## În toată lumea, aceleași două familii de cuvinte

Pentru World Atlas of Language Structures, Dahl a căutat cuvântul pentru ceai în 230 de limbi de pe toate continentele. 110 au o formă venită din *cha*, 84 una venită din *te*, iar 36 un cuvânt de altă origine.

Limbile din țările Europei de Est și ale Asiei care au primit ceaiul pe uscat, nu de la olandezi, tind să spună *chai*, scrie Dahl. Dicționarul academic român face aceeași împărțire, între feluri de ceai: ceaiul „rusesc” a fost adus din China pe uscat, prin Rusia; cel „englezesc”, pe mare, prin Anglia.

2 · Mama și tata

## Mama sună la fel în limbi care nu sunt rude

În 79 de limbi din 107, cuvântul pentru mamă are ca primă consoană un *m*, un *n* sau un *n* muiat, ca *ny* din maghiarul *anya*: *mamă*, *мать*, *anya*, *ana*, *amma*, *ama*. Ele vin din 16 familii de limbi.

Antropologul George Peter Murdock a numărat, în 1959, cuvintele pentru mamă și tată din sute de limbi și a găsit această tendință: silabe ca *ma* și *na* pentru mamă, *pa* și *ta* pentru tată, și în limbi fără nicio legătură între ele. Lingvistul Roman Jakobson a legat tendința de primele silabe ale copiilor, cărora adulții le-au dat un sens.

## În georgiană, *mama* înseamnă tată

Pentru tată, în 58 de limbi din 107 prima consoană e *p*, *b*, *t* sau *d*. Georgiana face exact invers: tatăl e *მამა*, iar mama e *დედა*. Harta pornește acum din georgiană.

Tendința lui Murdock rămâne o tendință: silabele copiilor seamănă peste tot, dar limbile le-au dat sensuri diferite.

3 · Cucul

## Cucul își spune singur numele

*Cuc*, *kakukk*, *guguk*, *kukkooq* în Groenlanda, *kuku* în bască. Pe hartă, 75 de limbi din 13 familii au pentru cuc un nume care seamănă cu al nostru.

Nu e doar o moștenire comună. Dicționarele etimologice numesc cuvântul onomatopeic: Vasmer pune lângă rusescul *кукушка* forme din turcă, mordvină, tătară și kazahă, limbi fără legătură cu rusa. Multe dintre aceste nume imită cântecul păsării.

4 · Martie

## Calendarul Romei a ajuns până în Kamciatka

Numele lunilor din calendarul roman sunt latinești: *Martius* era luna lui Marte. Rusa a luat numele din latină prin greaca bizantină, spune Vasmer, iar româna are „martie” din slavonă, după DEX. Pe hartă, 68 de limbi din 14 familii spun ceva asemănător, până la itelmena din Kamciatka. În alte 20 de limbi, de la bulgară și tătară la cecenă și calmucă, cuvântul se scrie exact ca în rusă: *март*.

Unele limbi și-au păstrat numele proprii: finlandezii spun *maaliskuu*, cehii *březen*, ucrainenii *березень*, belarușii *сакавік*, lituanienii *kovas*. Autorii bazei de date au inclus lunile tocmai pentru că se împrumută ușor, ca test pentru metodele care caută cuvinte împrumutate.

5 · Luna

## Un cuvânt, două lucruri

În română, „lună” e și astrul de pe cer, și luna din calendar. La fel e în alte 57 de limbi de pe hartă, din 13 familii. Sunt limbile aprinse acum.

„Limbă” e și organul din gură, și limba vorbită, ca în alte 56 de limbi. În 53 de limbi, copacul și lemnul au același nume; în 45 de limbi, mâna și brațul. Lingviștii numesc asta colexificare. Baza de date CLICS, care adună peste 3.000 de limbi, găsește luna-astru și luna-calendar împreună în 324 dintre ele.

6 · Albastrul

## Unde se termină albastrul

La culori, întrebarea devine alta: unde se oprește cuvântul. În 9 limbi de pe hartă, verdele și albastrul au același nume, după NorthEuraLex: iakuta *күөх*, oseta *цъӕх*, ainu *shiunin*, adigheza, kurda și încă câteva.

World Color Survey a arătat 330 de plăcuțe colorate unor vorbitori din 110 limbi, cam 24 în fiecare. Trage linia unde, pentru tine, verdele devine albastru.

verde · albastru

Ecranul nu redă exact plăcuțele Munsell folosite în anchetă, așa că linia ta e o aproximare. Povestea întreagă e în [Unde se termină albastrul](https://albastru.mariuscomper.uk/).

## Mai mult de jumătate din limbile anchetei au un singur cuvânt

Harta lui Paul Kay și a Luisei Maffi din WALS are 120 de limbi, din anchetă și din studii apropiate. 68 au un singur cuvânt pentru verde și albastru, 30 au cuvinte separate, iar 15 au un cuvânt care acoperă și negrul. Cele mai multe sunt limbi fără tradiție scrisă, foarte diferite de cele 107 din harta de mai sus.

7 · Curcubeul

## Curcubeul are zeci de nume

Dintre cele 218 concepte pe care le au toate cele 107 limbi, curcubeul e unul dintre cele mai împărțite: 86 de grupuri de cuvinte. Multe limbi îl descriu: germana *Regenbogen*, arcul ploii; franceza *arc-en-ciel*, arcul cerului; hindi *इंद्र-धनुष*, arcul lui Indra.

Harta pune „curcubeu” în același grup cu italianul *arcobaleno*: în amândouă apar r, c și b, în aceeași ordine. Arcobaleno e format din *arco* și *baleno*, arc și fulger. Pentru „curcubeu”, dicționarele românești nu cad de acord: DEX din 1998 dă etimologie necunoscută, ediția din 2009 doar îl apropie de latinescul *curvus*, curb. Asemănarea pare o coincidență de felul celor descrise mai jos, la metodă: între limbi înrudite, cuvintele au adesea același tipar de sunete.

Data viitoare când ceri un ceai, folosești cuvântul venit prin rusă, odată cu ceaiul adus pe uscat; englezii îl folosesc pe cel răspândit de olandezi. Când spui „lună”, vorbești și despre cer, și despre calendar, ca vorbitorii altor 57 de limbi. Iar când două cuvinte seamănă, cum seamănă „curcubeu” cu *arcobaleno*, merită întrebat dacă nu e doar o întâmplare.

[Alege alt cuvânt](https://mariuscomper.uk/harta-cuvintelor/#harta)

## Cum decide harta ce seamănă

Cuvintele vin din NorthEuraLex 0.9, o bază de date făcută la Universitatea din Tübingen: 1.016 concepte în 107 limbi, fiecare cuvânt scris și în alfabetul fonetic. Transcrierea a fost generată în mare parte automat, din ortografie, iar autorii avertizează că listele conțin erori.

Harta grupează cuvintele după sunet. Între familii diferite de limbi arată doar asemănările greu de pus pe seama întâmplării. Care dintre ele sunt și rude o stabilesc lingviștii, din istoria fiecărui cuvânt. Harta face trei pași.

### 1. Compară sunetele

Fiecare cuvânt e redus la clase de sunete, astfel încât *p* și *b* să conteze ca același sunet, iar *f* foarte aproape de ele, apoi e aliniat cu celelalte. Metoda, numită SCA, e a lingvistului Johann-Mattis List și rulează în programul LingPy.

### 2. Verifică dacă asemănarea poate fi o întâmplare

Cu 106 limbi de comparat, aproape orice cuvânt seamănă cu ceva. Am verificat: am înlocuit cuvântul unei limbi cu un alt cuvânt al aceleiași limbi, care înseamnă altceva. Doar după sunet, acest cuvânt fals și-a găsit o pereche într-o familie de limbi fără legătură cu a lui în 53 din 100 de încercări.

De aceea harta lucrează în doi pași. Întâi grupează cuvintele din aceeași familie de limbi doar după sunet: rudele au multe cuvinte comune, iar această comparație e cea pe care List și colegii săi au verificat-o pe deciziile experților.

Apoi unește grupurile din familii diferite, unde o potrivire vine mai ales din împrumut, din imitarea unui sunet, din silabele copiilor, ca la *mama*, sau din întâmplare. Pentru fiecare pereche de limbi, asemănarea e comparată cu 4.000 de perechi de cuvinte luate la întâmplare din aceleași două limbi, cu sensuri diferite; pentru acest test, sunetele sunt reduse la clase și mai simple. O singură pereche dovedește puțin: un cuvânt scurt ca „ceai” poate semăna cu altul din pură întâmplare. Aceeași potrivire, repetată în multe familii de limbi, e greu de pus pe seama întâmplării. Harta cere ca asemănarea, socotită peste toate perechile de familii implicate, să fie mai rară de 2 la 1.000; probabilitățile se combină prin metoda lui Fisher.

Cu această regulă, cuvântul fals mai găsește o pereche în altă familie în 3 din 100 de încercări. În propria familie găsește una în 23 din 100, fiindcă rudele au cuvinte cu același tipar de sunete; acolo reperul potrivit e comparația cu experții, de mai jos.

### 3. Grupează

Cuvintele intră într-un grup doar dacă seamănă, în medie, cu tot grupul, nu doar cu un membru. Culoarea de pe hartă arată grupul. Banda de sub hartă arată altceva: doar cât de aproape sună fiecare cuvânt de al tău, fără testul de întâmplare. De aceea un punct gol poate sta aproape de tine pe bandă: sună la fel, dar asemănarea poate fi o coincidență.

### Cât de des are dreptate

Pentru limbile indo-europene există un reper: IE-CoR, o bază de date în care specialiști în istoria limbilor au decis, pentru 160 de limbi, ce cuvinte au o origine comună. Am comparat grupurile hărții cu deciziile lor pe 4.129 de cuvinte din 33 de limbi prezente în ambele baze de date și 156 de concepte; încercările cu cuvântul fals au folosit aceleași concepte. Când harta pune două cuvinte în același grup, experții le consideră înrudite în 84% din cazuri. Din perechile pe care experții le leagă, harta găsește 50%.

Multe dintre perechile ratate sunt rude care nu mai seamănă: englezescul *fish* și românescul *pește*, sau *four* și *patru*, vin, după experții IE-CoR, din aceleași cuvinte indo-europene. Harta măsoară asemănarea de azi, nu istoria. Pune în același grup și cuvintele moștenite, și pe cele împrumutate, cum sunt „ceai” și *чай*.

### Cu cine seamănă româna

Numărând conceptele la care două limbi au cuvinte în același grup:

- Limba · Concepte în același grup · Din

- italiană · 419 · 1.016
- spaniolă · 369 · 1.016
- catalană · 364 · 1.016
- portugheză · 357 · 1.016
- franceză · 328 · 1.016
- latină · 303 · 1.014
- bulgară · 165 · 1.013
- albaneză · 159 · 1.016

Numărul familiilor socotește fiecare limbă izolată, cum sunt basca sau ainu, ca familie separată. Un cuvânt pentru două lucruri, la lună sau limbă, înseamnă transcriere identică în NorthEuraLex pentru ambele concepte. NorthEuraLex e una dintre sursele CLICS, deci cele două numărători nu sunt independente.

## Surse

- [Dellert și colaboratorii, „NorthEuraLex: a wide-coverage lexical database of Northern Eurasia”, Language Resources and Evaluation, 2020](https://doi.org/10.1007/s10579-019-09480-6). Datele: [northeuralex.org](http://www.northeuralex.org/), versiunea 0.9, licență CC BY-SA 4.0.

- [Johann-Mattis List, „LexStat: Automatic detection of cognates in multilingual wordlists”, 2012](https://aclanthology.org/W12-0216/), și [List, Greenhill și Gray, „The potential of automatic word comparison for historical linguistics”, PLOS ONE, 2017](https://doi.org/10.1371/journal.pone.0170046).

- [IE-CoR, Indo-European Cognate Relationships](https://iecor.clld.org/); [Anderson și colaboratorii, Scientific Data, 2025](https://doi.org/10.1038/s41597-025-05445-3).

- [Östen Dahl, „Tea”, World Atlas of Language Structures](https://wals.info/chapter/138); [Paul Kay și Luisa Maffi, „Green and Blue”](https://wals.info/chapter/134).

- [Rzymski și colaboratorii, „The Database of Cross-Linguistic Colexifications”, Scientific Data, 2020](https://doi.org/10.1038/s41597-019-0341-x).

- [George Peter Murdock, „Cross-language parallels in parental kin terms”, 1959, rezumat HRAF](https://hraf.yale.edu/ehc/documents/745).

- Max Vasmer, Dicționarul etimologic al limbii ruse, articolele [чай](https://gufo.me/dict/vasmer/чай), [кукушка](https://gufo.me/dict/vasmer/кукушка) și [март](https://gufo.me/dict/vasmer/март).

- DEX, MDA2 și Dicționarul etimologic român al lui Alexandru Ciorănescu, prin [dexonline](https://dexonline.ro/): ceai, cuc, curcubeu, martie, lună, limbă.

- [Unde se termină albastrul](https://albastru.mariuscomper.uk/): granițele din World Color Survey, recalculate din datele originale.

[mariuscomper.uk · Marius Comper](https://mariuscomper.uk/) · Prima versiune: august 2026; refăcută în septembrie 2026
