Mostrando entradas con la etiqueta MT. Mostrar todas las entradas
Mostrando entradas con la etiqueta MT. Mostrar todas las entradas

miércoles, 4 de enero de 2012

Proyecto Omega T. Traducción asistida por ordenador y otros métodos de traducción (VI)


6 .Bibliografía

-QUAH, C.K. Translation and Technology. Textbooks in translation and interpreting
-CLIMENT, Salvador; MORÉ, Joaquín; OLIVER, Antoni. Traducción y tecnología. UOC
- HUTCHINS, W. John y SOMERS, Harold, L. 1992. An Introduction to Machine Translation. London: Academic Press

- http://www.omegat.org
-http://www.opentranslation.es
- http://www.traducciónymundolibre.com

martes, 3 de enero de 2012

Proyecto Omega T. Traducción asistida por ordenador y otros métodos de traducción (V)



5. APÉNDICE: TEXTO ORIGEN

In the long fight against malaria, progress finally seems to be coming, if incrementally. The number of people who died from malaria in 2010 fell 5 percent from the previous year and has dropped 26 percent from 2000 levels, according to anew World Health Organization (WHO) report.

The decline might seem modest given the $2 billion that has been given to fight the disease in the past year. But even this small most recent dip suggests that “investment inmalaria control brings results,” Margaret Chan, director-general of the WHO, said in a statement.

The parasitic disease killed approximately 655,000 people in 2010, most of whom were children under the age of 5. The preponderance of malaria cases is still in Africa, where people are also more likely to succumb to the disease.

Although treatment via artemisinin-based combination therapies (ACTs) has greatly helped to bring the number of deaths down worldwide, Chen and others are worried by cases of artemisinin resistance reported in the past few years. With quick and cheap diagnostic tests now more widespread, the WHO recommends that no one receive malaria drugs without a test. And because the parasite can quickly develop resistance to a single drug, Chan says all monotherapies should be taken off the market.

“The estimated yearly number of malaria cases, though declining, is still 223 million,” she said. “That would be a huge and totally unacceptable number of people to be left with no effective treatment.”

Even with effective available therapies, the WHO failed to meet the goal of 50 percent decline in deaths between 2000 and 2010. And it seems to have a battle ahead if it hopes to meet the target of ending all deaths from malaria by 2015.

Proyecto Omega T. Traducción asistida por ordenador y otros métodos de traducción (III)


3. Comparación Omega T como asistente de traducción y Google Translate como traductor automático

En numerosas ocasiones hemos tratado el tema de la traducción automática y, tras numerosos intentos, la hemos descartado como  modelo de traducción adecuada. Sin embargo, ¿podría llegar a ser adecuada una traducción tras una revisión humana?, es decir, ¿qué pasaría si una traducción automática fuera asistida por el traductor?, ¿obtendría los mismos resultados que una traducción humana asistida por ordenador? En este apartado, nos disponemos a verificar la calidad que subyace de estos dos modelos de traducción: traducción asistida por ordenador (Machina-aided human translation) y traducción automática asistida (por traductor) (Human-aided machine translation). Para esta comprobación utilizaremos Omega T y Google Translation, elegido por ser el que mejores resultados nos ofreció en una de nuestras comprobaciones anteriores(http://iatpaula-f.blogspot.com/2011/11/machine-trynslations.html) y por poder modificar el texto meta en el mismo cuerpo de texto.

Una traducción automática asistida es aquella en la que el ordenador es el responsable de producir la traducción per se, pudiendo interaccionar con un revisor humano en muchos puntos a lo largo del proceso. (Slocum 1988:5).

 En otras palabras, este proceso se opone a la mera traducción automática, ya que no se basa exclusivamente en la lingüística computacional, sino que el proceso está asistido por un traductor en las llamadas etapas de «preedición» y «pos-edición».  En la etapa de preedición, el traductor se encarga de encontrar elementos que puedan crearle problemas al traductor automático, como modismos, fraseologismos, etc. Durante la fase de pos-edición el traductor revisa la traducción generada automáticamente, para amoldar el texto a unos ciertos estándares de estilo y uso apropiado de los términos. Existen por supuesto softwares de traducción automática asistida, pero ya que no contamos con ninguno de ellos, vamos a realizar la tarea de traducción mediante el traductor automático ya mencionado, preeditando y pos-editando manualmente, es decir, detectando posibles errores a priori para tenerlos en cuenta en la etapa de pos-edición del producto. Este tipo de softwares, trabajan con un número de lenguas origen muy reducidas, aquellas que cuentan con reglas gramaticales muy rígidas y un vocabulario «fácil de procesar», es decir, en el que no abundan procesos semánticos como sinonimia, polisemia, homonimia, etc. Somos conscientes de que el español no es una de estas lenguas; sin embargo, al tratarse de un  artículo que lidia con lengua de especialidad, la gramática, por las características intrínsecas a este tipo de lenguaje, es más rígida, así como los fenómenos semánticos antes citados se ven cuantiosamente reducidos.
           
            Procedemos así a la traducción de nuestro texto origen mediante el traductor automático.


3.1. Análisis de resultados.

En la etapa de preedición se ha procedido a una lectura del texto origen, detectando aquellos puntos que pudieran suponer un problema para el traductor o algo que tener en cuenta para la traducción. Así, se observaron algunos asuntos sintácticos y de estilo (uso de pasivas) y cuestiones ortotipográficas (uso de comillas americanas y emplazamiento de signos de divisas) que se han anotado y tenido en cuenta. No constan más problemas sintácticos ni semánticos como pudieran ser pequeñas metáforas, ni cuestiones de algún otro tipo.

            En la pos-edición se revisó la traducción ofrecida por el software de Google. Los pronósticos de fallo se han cumplido: las normas ortotipográficas han sido violadas y no se han producido mejoras estilíticas, respetando la sintaxis del texto original. Por otra parte, se han producido otras incorrecciones que podían llegar a esperarse, como la mala concordancia entre sujeto y verbo, o la concordancia de género incorrecta:
«Chan dice que todas las monoterapias debe ser retirado  del mercado (…)»
●«El descenso puede parecer modesta (…)»
           
            Asimismo se originan otros problemas más graves que conciernen al espectro gramatical: de una parte, las omisiones son frecuentes, originando frases agramaticales. De otra, la reordenación de los elementos resulta en una sintaxis impropia del español y que además difiere del mensaje del texto de origen. Podemos además comprobar los calcos léxicos que sufre nuestro texto meta.
«Aunque el tratamiento a través de terapias de combinación basadas en la artemisinina (TCA) ha ayudado mucho a que el número de muertes por todo el mundo, Chen y otros están preocupados por los casos de resistencia a la artesinina reportados en los últimos años.»
● « “Eso sería un gran número y totalmente inaceptable de las personas que se quedaron sin un tratamiento efectivo” (…)».

De la misma manera, encontramos que el estilo es pobre, muy pegado al texto origen y sin apenas adaptaciones.
●« el progreso por fin parece que puede venir, si de forma incremental (…)»
●« La enfermedad parasitaria mató aproximadamente a 655.000 personas en 2010 (…)».

Por otra parte, nos sorprende un error que se repite en toda la extensión del texto, y se trata de la omisión de los espacios entre palabras. A este error no encontramos una posible justificación, ya que si hay algo paralelo en los dos textos, es sin duda, el espacio que separa las palabras.
● «El número depersonas que murieron de malaria en el 2010 cayeron un 5 porciento respecto al año anterior y se ha reducido un 26 por cientode los niveles de 2000, según la Organización Mundial de la Salud de nuevo (OMS)».
         

sábado, 12 de noviembre de 2011

MT, Internet y polémica

Hoy me dispongo a escribir sobre los sistemas de memorias de traducción (MT systems), un tema cuya importancia trasciende su mero uso, y alcanza la controversia que se ha desatado su alrededor. Aclaremos primero los conceptos básicos para entender su funcionamiento y su polémica.
Una MT es una herramienta que se incluye dentro de las tecnologías de TAO cuya función es la de una base lingüística que almacena «segmentos» y sus traducciones en otra lengua con vistas a poder reutilizarlos en futuros trabajos («leveraging»), formando un «corpus paralelo» o un «bitext». El funcionamiento interno de uno de estos sistemas es bastante simple: al introducir un texto nuevo, el programa busca «segmentos» que ya se han traducido antes y muestra las coincidencias. Los llamados «segmentos» son frases en su mayoría, acotadas por signos de puntuación (lo que en ocasiones puede inducir a error), aunquela última palabra sobre dicha segmentación siempre la tiene el usuario. Las coincidencias pueden ser de varios tipos: exacta, cuando los dos extractos  son completamente idénticos en todas las cuestiones; completas si varían los «elementos variables» como números, fechas o nombres propios; casuales (fuzzy matching) en el caso de segmentos similares cuyo porcentaje de similitud puede ser elegido; coincidencias terminológicas; y coincidencias de subsegmentos, en la cuales se busca la coincidencia dentro del segmento, y no el segmento entero como tal. En el resultado de la comparación de los segmentos también puede no aparecer ninguna coincidencia. Así pues, las traducciones resultantes son traducciones análogas de otros textos anteriormente traducidos.

Estos sistemas de gestión de memorias de traducción tienen un objetivo principal, y este es facilitarle al traductor su tarea haciéndole ganar tiempo en no traducir algo ya traducido. Sin embargo, entendido el punto anterior, podemos imaginar la gran cantidad de tiempo y de traducciones que se necesita para que una memoria de traducción comience a ser útil. Por ello, una de las tendencias más seguidas es la de compartir memorias de traducción. Sin embargo, para el correcto uso interpersonal de éstas se necesita un formato unificado (de manera que no se pierda más tiempo). Este formato es el TMX (Translation Memory Exchange format; Melby, 1998). Otro objetivo primordial es mejorar la calidad de las traducciones. No obstante, no revisar ni actualizar estas bases de datos que conforman las memorias de traducción puede conllevar consecuencias muy negativas. Un texto sin revisar podría presentar cualquier tipo de problema que comete una traducción automática; el no actualizar la memoria puede suponer que sigamos utilizando términos que han caído en desuso (cosa muy normal en el campo de la traducción técnica). Vemos por tanto, que estos gestores significan mejoras de calidad en nuestra tarea, sin embargo, requieren más tiempo y esfuerzo por parte del traductor: aprender a usarlas, conformar un corpus, utilizarlo en cada traducción, actualizarlo, etc. sin tener en cuenta el esfuerzo económico, ya que en ocasiones el coste de estos programas supera los mil euros. Tienen por tanto, sus pros y sus contras.

Considero de vital importancia conocer cómo potenciar y aprovechar el uso de estos sistemas. Las coincidencias exactas pueden ser peligrosas en lo que a homonimia se refiere. Por esto, se aconseja crear distintos bloques de memorias con los distintos temas que se vayan a tratar, pudiendo así neutralizar la homonimia (la homonimia en un mismo campo conceptual es imposible o muy escasa). Ten también en cuenta que lo que estos gestores muestran son los fragmentos ya antes traducidos; serán por tanto de mayor utilidad en textos de la misma especialidad o textos con muchas repeticiones internas. Será por consiguiente muy útil en textos legales, técnicos o científicos, pero de escasa utilidad en textos creativos o expresivos (literatura, publicidad, etc). En caso de revisión, reedición, o actualización de un texto, nos aportan también una gran ventaja, ya que la mayor parte del texto ya estará traducida, será localizada y únicamente tendremos que traducir aquellos segmentos nuevos o editados. Son muy útiles también al trabajar con un mismo cliente ya que crear bloques por clientes (al igual que antes lo hacíamos por materias) nos permite adecuarnos a su estilo sin transferirlo a otros documentos.

Resulta curioso comprobar como cuanto más vemos lo útiles que pueden llegar a ser comprendemos todo el trabajo que hay detrás. Por eso, la idea de compartir estos corpora no es tan descabellada. Minako O'Hagan (autora de The coming industry of teletranslation) propuso hacer de Internet una gigantesca memoria de traducción. Y quizá esta realidad no esté tan lejos. Podríamos considerar a Wikipedia un enorme corpus, lleno de coincidencias exactas, completas, casuales, terminológicas y coincidencias de subsegmentos en cada uno de sus artículos traducidos, de hecho, ¿cuántas veces hemos accedido a ella para comprobar «cuál es el nombre exacto de esto en este otro idioma»? El único coste que tenemos que pagar es que los segmentos no están alienados y tenemos que encontrar las coincidencias de manera manual. Pero, ¿y Linguee (www.linguee.com)?


En realidad lo que Linguee nos muestra son comparaciones de segmentos traducidos en dos idiomas, marcando nuestra búsqueda (nuestro subsegmento). En este caso, aunque sí están alineados, al introducir una búsqueda homónima («renacimiento») nos presenta resultados ruidosos, ya que la base de datos no está delimitada por áreas temáticas. También podríamos incluir a IATE (http://iate.europa.eu/iatediff/SearchByQueryEdit.do) en este tipo de búsquedas, aunque en su caso, además nos permitiría la búsqueda por áreas temáticas. Estos son solo algunos de los muchos ejemplos de corpus de datos traducidos a varios idiomas en los que poder encontrar los segmentos correspondientes.

Sin embargo, el uso de estas herramientas ha dado lugar a una terrible controversia ¿debería cobrar menos el traductor por utilizar memorias de traducción? Resulta obvio que el traductor que utiliza una memoria de traducción no traduce desde el principio todas las palabras, sino que reutiliza los fragmentos anteriormente traducidos. No es por tanto un trabajo vacío, si no aprovechado. De todas formas, ¿no debería pagarse por la calidad en lugar de por las herramientas utilizadas?, ¿sería de más calidad el trabajo de un mecánico que trabajase sin una llave inglesa?, ¿debería cobrar más un arquitecto que trabajase sin planos? Las memorias de traducción son una herramienta útil de la que no se debe prescindir ni por supuesto pagar menos por utilizarla. ¿No deberíamos, a caso, cobrar más por todo el esfuerzo antes mencionado que conlleva configurar una memoria efectiva? Pero la realidad es mucho más amarga. Aunque todo depende del cliente para el que se traduzca, por lo general, los segmentos del nuevo texto que tengan una coincidencia exacta en las memorias, no se cobran. El resto de coincidencias también desgravan en mayor o menos medida sobre el cargo total de la traducción. Y esto es algo que ya está establecido. Así pues, ¿deberíamos crear nosotros, el gremio de traductores, distintas tarifas de cobro a los diferentes clientes?, ¿deberíamos establecer las tarifas  más altas a aquellos clientes nuevos en concepto de «creación de Memorias de Traducción», otra igualmente alta pero más reducida para aquellos clientes con una Memoria ya creada pero insuficiente en concepto de «desarrollo», y así ir rebajando la tarifa hasta los clientes habituales a los cuales se cobraría las tarifas ordinarias, manteniendo siempre un pago extra en concepto de «mantenimiento de Memorias»? Sin lugar a dudas, estas tarifas subsanarían el problema causado por los segmentos infracotizados.

 
Otra línea de enfrentamiento es la relativa a la posesión legítima de las memorias. Los clientes afirman que les pertenecen a ellos y que forman parte de su propiedad intelectual. Los traductores, obviamente opinan lo contrario. En este caso, mi opinión es muy clara: ya que los textos de la lengua origen han sido cedidos a los traductores para que realicen con ellos su tarea y parte de su tarea incluye constituir memorias de traducción, sería totalmente lícito el aprovechamiento de los segmentos como segmentos independientes que entre sí no conforman un texto,  y no como texto cohesionado, gozando así de derecho de usufructo. Por otra oparte, los textos en lengua meta han sido producidos por el traductor, por lo que la propiedad intelectual de estos textos traducidos también les pertenece.

*Bibliografía

-Translation memory system
-Memorias de traducción en TMX compartidas por Internet, Joseba Abaitua, Universidad   de Deusto (http://www.fti.uab.es/tradumatica/revista/)
-www.linguee.com