# Alege un corpus pentru texte românești

Pornește de la domeniu și de la forma textului de care ai nevoie: segmente, documente sau adnotări.

## 1. Alege segmente pentru traducere

Memoria de traducere oferă unități aliniate. Evaluează un eșantion înainte de utilizare și păstrează ediția și perechea de limbi.

[Memoria de traducere DGT-TM](https://mariuscomper.uk/cunoastere-deschisa/resurse/dgt-tm/)

## 2. Păstrează contextul documentelor

Când contează structura și paragrafele, consultă corpusul de documente. Verifică suprapunerile cu alte colecții Acquis înainte de împărțirea în seturi de antrenare și evaluare.

[DGT-Acquis — documente și paragrafe aliniate](https://mariuscomper.uk/cunoastere-deschisa/resurse/dgt-acquis/)

## 3. Alege adnotări pentru analiza limbii

Pentru sintaxă, consultă convențiile de adnotare și versiunea corpusului. Textele legislative nu reprezintă toate registrele limbii române.

[UD Romanian RRT](https://mariuscomper.uk/cunoastere-deschisa/resurse/ud-rrt/)

## Atenție

Dublurile între colecții pot denatura evaluarea unui model. Licența unei colecții nu stabilește automat drepturile pentru toate celelalte.

O selecție de corpusuri cu domeniu, versiune, limbă, condiții și o procedură de verificare a suprapunerilor.
