Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español

Este trabajo de fin de máster compara los sistemas de traducción automática estadística y neuronal, y evalúa las traducciones obtenidas a partir de modelos de ambos sistemas creados en plataformas de código abierto. Por un lado, se presenta un modelo creado con Moses, una estructura que permite crea...

ver descrição completa

Detalhes bibliográficos
Autor: Crosby Casali, Cristina
Formato: tesis de maestría
Fecha de publicación:2019
País:España
Recursos:Universitat Oberta de Catalunya (UOC)
Repositorio:O2, repositorio institucional de la UOC
OAI Identifier:oai:openaccess.uoc.edu:10609/97446
Acesso em linha:http://hdl.handle.net/10609/97446
Access Level:acceso abierto
Palavra-chave:traducción automática estadística
traducción automática neuronal
traducción aumentada
traducció automàtica estadística
traducció automàtica neuronal
traducció augmentada
statistical machine translation
neural machine translation
augmented translation
Machine translating -- TFM
Traducció automàtica -- TFM
Traducción automática - TFM
id ES_2679f2f18d9c46018bc9080bd87d1ef0
oai_identifier_str oai:openaccess.uoc.edu:10609/97446
network_acronym_str ES
network_name_str España
repository_id_str
dc.title.none.fl_str_mv Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
title Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
spellingShingle Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
Crosby Casali, Cristina
traducción automática estadística
traducción automática neuronal
traducción aumentada
traducció automàtica estadística
traducció automàtica neuronal
traducció augmentada
statistical machine translation
neural machine translation
augmented translation
Machine translating -- TFM
Traducció automàtica -- TFM
Traducción automática - TFM
title_short Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
title_full Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
title_fullStr Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
title_full_unstemmed Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
title_sort Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-español
dc.creator.none.fl_str_mv Crosby Casali, Cristina
author Crosby Casali, Cristina
author_facet Crosby Casali, Cristina
author_role author
dc.contributor.none.fl_str_mv Oliver, Antoni
dc.subject.none.fl_str_mv traducción automática estadística
traducción automática neuronal
traducción aumentada
traducció automàtica estadística
traducció automàtica neuronal
traducció augmentada
statistical machine translation
neural machine translation
augmented translation
Machine translating -- TFM
Traducció automàtica -- TFM
Traducción automática - TFM
topic traducción automática estadística
traducción automática neuronal
traducción aumentada
traducció automàtica estadística
traducció automàtica neuronal
traducció augmentada
statistical machine translation
neural machine translation
augmented translation
Machine translating -- TFM
Traducció automàtica -- TFM
Traducción automática - TFM
description Este trabajo de fin de máster compara los sistemas de traducción automática estadística y neuronal, y evalúa las traducciones obtenidas a partir de modelos de ambos sistemas creados en plataformas de código abierto. Por un lado, se presenta un modelo creado con Moses, una estructura que permite crear modelos de traducción automática estadística (TAE). Por otro lado, se presenta un modelo creado con Marian, un conjunto de herramientas que da soporte para la creación de modelos de traducción automática neuronal (TAN). Se utilizan los corpus bilingües en línea MultiUN, que permiten responder a la necesidad de cantidad y calidad de datos para entrenar los modelos de TAN y TAE en los pares francés-español e inglés-español. Las traducciones producidas con estos dos modelos se evalúan con métricas manuales que incluyen un proceso de posedición simple y anotación de errores. Se contrastan los resultados con traducciones generadas con un motor de traducción automática comercial y se califican con métricas automáticas. La evaluación ayuda a definir las fortalezas y debilidades de cada sistema e identificar los errores de traducción más comunes. Según el desempeño de los modelos, es posible dar una valoración que podría permitir considerarlos parte integrante de un proceso más amplio de traducción aumentada, que concibe a la traducción automática como una herramienta y, al traductor, como parte central del flujo de trabajo.
publishDate 2019
dc.date.none.fl_str_mv 2019
2019
2019
dc.type.none.fl_str_mv info:eu-repo/semantics/masterThesis
format masterThesis
dc.identifier.none.fl_str_mv http://hdl.handle.net/10609/97446
url http://hdl.handle.net/10609/97446
dc.language.none.fl_str_mv Español
language_invalid_str_mv Español
dc.rights.none.fl_str_mv CC BY-NC-ND
http://creativecommons.org/licenses/by-nc-nd/3.0/es/
info:eu-repo/semantics/openAccess
rights_invalid_str_mv CC BY-NC-ND
http://creativecommons.org/licenses/by-nc-nd/3.0/es/
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.publisher.none.fl_str_mv Universitat Oberta de Catalunya (UOC)
publisher.none.fl_str_mv Universitat Oberta de Catalunya (UOC)
dc.source.none.fl_str_mv reponame:O2, repositorio institucional de la UOC
instname:Universitat Oberta de Catalunya (UOC)
instname_str Universitat Oberta de Catalunya (UOC)
reponame_str O2, repositorio institucional de la UOC
collection O2, repositorio institucional de la UOC
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1869404824212078592
spelling Evaluación de traducciones realizadas con un modelo neuronal y uno estadístico: valoración de resultados para los pares francés-español e inglés-españolCrosby Casali, Cristinatraducción automática estadísticatraducción automática neuronaltraducción aumentadatraducció automàtica estadísticatraducció automàtica neuronaltraducció augmentadastatistical machine translationneural machine translationaugmented translationMachine translating -- TFMTraducció automàtica -- TFMTraducción automática - TFMEste trabajo de fin de máster compara los sistemas de traducción automática estadística y neuronal, y evalúa las traducciones obtenidas a partir de modelos de ambos sistemas creados en plataformas de código abierto. Por un lado, se presenta un modelo creado con Moses, una estructura que permite crear modelos de traducción automática estadística (TAE). Por otro lado, se presenta un modelo creado con Marian, un conjunto de herramientas que da soporte para la creación de modelos de traducción automática neuronal (TAN). Se utilizan los corpus bilingües en línea MultiUN, que permiten responder a la necesidad de cantidad y calidad de datos para entrenar los modelos de TAN y TAE en los pares francés-español e inglés-español. Las traducciones producidas con estos dos modelos se evalúan con métricas manuales que incluyen un proceso de posedición simple y anotación de errores. Se contrastan los resultados con traducciones generadas con un motor de traducción automática comercial y se califican con métricas automáticas. La evaluación ayuda a definir las fortalezas y debilidades de cada sistema e identificar los errores de traducción más comunes. Según el desempeño de los modelos, es posible dar una valoración que podría permitir considerarlos parte integrante de un proceso más amplio de traducción aumentada, que concibe a la traducción automática como una herramienta y, al traductor, como parte central del flujo de trabajo.This project compares statistical and neural machine translation systems, and assesses translations generated by models of both systems created on open source frameworks. The first model is created using Moses, a structure that allows the creation of statistical machine translation (SMT) models. While the second model is created using Marian, a toolkit that supports the creation of neural machine translation (NMT) models. MultiUN bilingual corpora are used, which allow to build both SMT and NMT models with quantity and quality of data for the French-Spanish and English-Spanish translations. The resulting translations are assessed using manual metrics, including a light post-editing process and error annotation. The results are benchmarked with a third translation obtained from an open-access machine translation engine. Automatic metrics are calculated with the three translations. The evaluation helps to define the strengths and weaknesses of each system, and to identify the most common translation errors. The performance of the models allows to ascertain if they could be considered an integral part of a broader process of augmented translation, which regards machine translation as a tool, while the translator is at the core of the translation workflow.Aquest treball compara els sistemes de traducció automàtica estadística i neuronal, i avalua les traduccions obtingudes a partir de models de tots dos sistemes creats en plataformes de codi obert. Per un costat, presenta un model creat amb Moses, una estructura que permet crear models de traducció estadística automàtica (TAE). Per un altre costat, es presenta un model creat amb Marian, un conjunt d'eines per a la creació de models de traducció automàtica neuronal (TAN). S'utilitzen els corpus bilingües en línia multiUN, que permeten respondre a la necessitat de quantitat i qualitat de dades per a encaixar els models de TAN i TAE. Les traduccions produïdes amb aquests dos models s'avaluaran amb manuals tècnics que inclouen un procés de plantejament senzill i una anotació d'errors. Es contrasten els resultats amb traduccions generades amb un motor de traducció automàtica comercial i qualificant amb mètriques automàtiques. L'avaluació ajuda a definir les fortaleses i les debilitats de cada sistema i identificar els errors de traducció més comunitaris. Segons el disseny dels models, és possible donar una valoració que pot permetre tenir en compte una part integrant d'un procés més ampli de traducció augmentada, que es converteix en una traducció automàtica com una eina i, al traductor, com a part central del flux de treball.Universitat Oberta de Catalunya (UOC)Oliver, Antoni201920192019info:eu-repo/semantics/masterThesisapplication/pdfhttp://hdl.handle.net/10609/97446reponame:O2, repositorio institucional de la UOCinstname:Universitat Oberta de Catalunya (UOC)EspañolCC BY-NC-NDhttp://creativecommons.org/licenses/by-nc-nd/3.0/es/info:eu-repo/semantics/openAccessoai:openaccess.uoc.edu:10609/974462026-05-28T12:42:01Z
score 15,301629