Empreu aquest identificador per citar o enllaçar aquest ítem:
http://hdl.handle.net/10609/149208
Títol: | El corpus paral·lel del Diari Oficial de la Generalitat de Catalunya |
Altres títols: | The parallel corpus of the Official Journal of the Catalan Government |
Autoria: | Oliver, Antoni |
Citació: | Oliver González, A. [Antoni]. (2023). El corpus paral·lel del Diari Oficial de la Generalitat de Catalunya. Linguamática, 14(2), 75-81. doi: 10.21814/lm.14.2.380 |
Resum: | En aquest article presentem el procés de compilació de la nova versió del corpus paral·lel català-castellà creat a partir dels textos del Diari Oficial de la Generalitat de Catalunya (DOGC). Es descriuen els processos de descàrrega, conversió a text, segmentació i alineació automàtica. Tots els programes que s'han desenvolupat per dur a terme aquests processos es distribueixen amb una llicència lliure i el corpus compilat es pot descarregar lliurement. A més, es descriu el procés d'entrenament i avaluació de dos motors de traducció automàtica neuronal català-castellà i castellà-català que s'ha dut a terme fent servir aquest corpus paral·el. |
Paraules clau: | corpus paral.lel traducció automàtica neuronal |
DOI: | https://doi.org/10.21814/lm.14.2.380 |
Tipus de document: | info:eu-repo/semantics/article |
Versió del document: | info:eu-repo/semantics/publishedVersion |
Data de publicació: | 31-des-2022 |
Llicència de publicació: | https://creativecommons.org/licenses/by/4.0/ |
Apareix a les col·leccions: | Articles Articles cientÍfics |
Arxius per aquest ítem:
Arxiu | Descripció | Mida | Format | |
---|---|---|---|---|
Oliver_l_corpus.pdf | 388,64 kB | Adobe PDF | Veure/Obrir |
Comparteix:
Aquest ítem està subjecte a una llicència de Creative CommonsLlicència Creative Commons