Переводческая память. Системы памяти переводов (Translation Memory) Малёнова Евгения Дмитриевна к.филол.н., доцент Омский государственный университет им. Ф.М. Достоевского. Программы для локализации приложений

В данной статье мы собрали программы, в том числе - бесплатные, которые позволяют переводить больше текстов за меньшее время. Надеемся, что Вы найдете здесь что-то полезное для себя.

Программы Translation memory

Translation memory (переводческая память, накопители переводов) - программы, позволяющие «не переводить одно и то же два раза». Это базы данных, которые содержат ранее переведенные единицы текста. Если в новом тексте обнаруживается единица, которая уже есть в базе, система автоматически добавляет ее в перевод. Такие программы значительно экономят время переводчика, особенно если он работает с однотипными текстами.

Trados . На момент написания статьи - одна из самых популярных программ Translation memory. Позволяет работать с документами MS Word, презентациями PowerPoint, HTML-документами и файлами других форматов. В Trados есть модуль для ведения глоссариев. Сайт: http://www.translationzone.com/trados.html

Déjà Vu . Также один из лидеров по популярности. Позволяет работать с документами практически всех популярных форматов. Есть отдельные версии программы для переводчиков-фрилансеров и для бюро переводов. Сайт: http://www.atril.com/

OmegaT . Поддерживает большое количество популярных форматов, но документы в MS Word, Excel, PowerPoint требуется конвертировать в другие форматы. Приятная особенность: программа бесплатная. Сайт: http://www.omegat.org/

MetaTexis . Позволяет работать с документами основных популярных форматов. Предлагается два варианта программы - модуль для MS Word и серверная программа. Сайт: http://www.metatexis.com/

MemoQ . Функционал схож с Традосом и Déjà Vu, стоимость программы (на момент написания статьи) ниже, чем у более популярных систем. Сайт: http://kilgray.com/

Star Transit . Предназначена для перевода и локализации. На данный момент совместима только с ОС Windows. Сайт: http://www.star-group.net/DEU/group-transit-nxt/transit.html

WordFisher . Бесплатная система Translation Memory, созданная и поддерживаемая профессиональным переводчиком. Сайт: http://www.wordfisher.com/

Across . Предлагается 4 различных версии программы, отличающихся по объему функционала. Сайт: http://www.across.net/us/translation-memory.aspx

Catnip . Бесплатная программа, «наследница» программы MT2007. Сайт: http://mt2007-cat.ru/catnip/

Электронные словари

Здесь мы представили только электронные словари для автономной работы (без доступа в интернет). Онлайн-словарей значительно больше, им будет посвящена отдельная статья. Хотя интернет проник в самые удаленные уголки планеты, полезно иметь хотя бы 1 словарь для работы в автономном режиме. Мы рассмотрели словари для профессионального использования, разговорники и словари для изучающих язык сюда не вошли.

ABBYY Lingvo . На данный момент позволяет переводить с 15 языков. Есть несколько версий программы с разным объемом словарей. Существует версия для мобильных устройств. Платная версия словаря устанавливается на компьютер и может работать без подключения к интернету, бесплатная доступна только онлайн. Программа совместима с Windows, Symbian, Mac OS X, iOS, Android. Сайт: http://www.lingvo.ru/

Мультитран . Не все знают, что существует офлайновая версия этого популярного словаря. Может устанавливаться на компьютеры (стационарные и карманные), смартфоны. Работает с Windows, Symbian и Android, а также Linux (через браузер). На данный момент позволяет переводить с / на 13 языков. Сайт: http://www.multitran.ru/c/m.exe

Promt . У данной программы есть версии для профессионального использования. Плюс Промта в том, что он позволяет работать совместно с Trados. Сайт: http://www.promt.ru/

Slovoed . Может переводить c/на 14 языков. Устанавливается на стационарные компьютеры и ноутбуки, мобильные устройства и ридеры Amazon Kindle. Работает с операционными системами iOS, Android, Windows, Symbian, BlackBerry, bada, Tizen. У словаря несколько версий, в том числе - узкоспециализированные тематические словари. Сайт: http://www.slovoed.ru/

Программы для распознавания текста

ABBYY FineReader . Распознает текст на фотографиях, сканах, PDF-документах. Последняя (на момент написания статьи) версия распознает текст на 190 языках, а для 48 из них делает проверку орфографии. Сохранить полученный текст можно практически во всех популярных форматах (Word, Excel, PowerPoint, PDF, html и др.) Сайт: http://www.abbyy.ru/finereader/

CuneiForm (OpenOCR). Программа была создана как коммерческий продукт, однако на данный момент распространяется свободно. Совместима с операционными системами Linux, Mac OS X , Windows. Сайт: http://openocr.org/

Программы для подсчета статистики

Translator"s Abacus - бесплатная программа для подсчета количества слов в документах различного типа. Сайт: http://www.globalrendering.com/

AnyCount - платная программа, обладающая большим числом настроек. Например, можно посчитать кол-во знаков с пробелами или без пробелов, кол-во слов, строк, страниц, или задать единицу подсчета самостоятельно. Сайт: http://www.anycount.com/

FineCount - программа доступна в двух версиях, платной и бесплатной, которые различаются объемом функций. Сайт: http://www.tilti.com/

Программы для локализации приложений

Программы для перевода сайтов

Другие программы для переводчиков

ApSIC Comparator - программа для сравнения файлов (исходный текст VS текст с изменениями, внесенными переводчиком). Сайт: http://www.apsic.com/en/products_comparator.html

AfterScan - программа для автоматической проверки и коррекции исходного текста. Обнаруживает и исправляет опечатки, ошибки, отсутствующие пробелы, ошибки при распознавании текста. Сайт:

10 Типичный процесс работы переводчика в действительности Не все так уж просто

Получение заказа: в любом удобном заказчику формате. Подсчет объема работ: часы, слова, символы. Не считать лишнего. Выполнение перевода: не переводить лишнее: то что уже переводили, дубликаты, цифры, даты, списки. Верстка: нужно чтобы перевод выглядел так же как оригинал(xml, html). Редактура: нет ошибок в документе, терминологическое единообразие. Отправка заказчику: сохранение документов, шифрование, обеспечение всех требований закзачика. 11 «Подводные камни»

Зачем нужны САТ системы? Зачем нужны САТ системы? 13 Объективная необходимость – переводить больше и быстрее Современные требования Эффективность и единообразие Совместимость и многоязычность Надежность, безопасность и контроль – важная информация защищена Интерфейс пользователя – легко научиться Процедура работы – удобно использовать Память переводов, терминологическая база, лексикон

14 Объективнаянеобходимость Объективная необходимость Работодатели требуют владения автоматизированными системами перевода Заказчики требуют предоставления перевода в виде базы данных Высокая конкуренция между переводчиками Требования к качеству и срокам

15 Современные требования Необходимость повышения качества переводов: Обеспечение единообразия терминологии Обеспечение единообразного перевода одних и тех же предложений Необходимость повышения эффективности (снижение трудозатрат, сокращение сроков): Автоматизация рутинных операций Исключение полного повторного перевода документации, в которую внесены изменения и дополнения Исключение повторного перевода одних и тех же слов и предложений

17 CONFIDENTIALITY AGREEMENT August,2004 Re: Confidentiality Agreement Ladies and Gentlemen: You have requested Confidential Information from Company1 Corporation ("Company1") concerning Company1 that is either confidential, proprietary, or publicly unavailable in connection with your consideration of a possible business combination ("Transaction") between you and Company1 involving TLLC. As a condition, and in consideration, of furnishing to you "Confidential Information" (as defined below), Andrew requires that you treat the Confidential Information so furnished confidentially as set forth in this letter agreement (the "Confidentiality Agreement"). 1. Confidential Information As used in this Confidentiality Agreement, the term "Confidential Information" means all information concerning Company1 and its subsidiaries or affiliates that is furnished or made available to you by Company1 or any agent or representative of Company1 or that is obtained or derived by you from any of the foregoing persons as part of your consideration of the Transaction. Исходный текст:

21 Основные функции САТ - систем Анализ Предварительный глобальный перевод по ТМ Автоматический поиск переводов сходных предложений Пополнение памяти переводов Сведение – создание TM по готовым переводам Пополнение и ведение терминологической базы данных Текстовый редактор

SDL TRADOS Последняя версия продукта – SDL Trados Studio 2011 (Freelance/Professional/Passolo) Работает с любыми языковыми комбинациями, поддерживаемыми Microsoft Word Системные требования – 2Гб оперативной памяти (для более устойчивой работы), процессор – Pentium IV (минимум) Поддерживает различные форматы файлов (Microsoft Office, Adobe, Java, InDesign)

Why Immigration Courts Need Interpreters

Each year, the Executive Office for Immigration Review publishes a Statistics Yearbook on immigration court matters. This past year’s report highlighted several trends in immigration, including an increase in the number of immigration cases when compared to previous years. In addition to an increase of immigration cases, the report also showed an increased need for translation services in the courtroom.

An Unbalanced System & An Unbalanced Workload

U.S. Immigration Courts are estimating a rise in court cases due to current changes in immigration policies.

In fact, last year’s trends displayed a 14 percent increase in court matters compared with 2015.

Further data confirmed an unbalanced system and an unbalanced workload. This was evident in the fact that 25 percent of all cases brought to the attention of the immigration court system were only accounted by five city immigration courts (there are 58 nationwide).

The cities most affected by immigration-related court cases include:

Los Angeles, CA

New York City, NY

San Francisco, CA

Arlington, VA

Miami, FL

Language Trends

According to the Executive Office for Immigration, the top five languages represented in 2016 include:

Spanish – 75.73% of all initial case completions

English – 10.21% of all initial case completions

Mandarin Chinese – 3.80% of all initial case completions

Punjabi – 0.81% of all initial case completions

Arabic – 0.60% of all initial case completions

While Spanish is the most requested language for court interpreters, Administrative Deputy Clerk for the Racine County of Courts Office, Sam Christensen, says a few other language requests have been showing up, including Arabic, American Sign Language, Gujarati, Burmese, Hindi, Portuguese, Tagalog, Russian, Korean, Serbian, and Vietnamese.

“That’s just for the last couple of months,” Christensen added. “Whether you’re innocent or guilty, you have the right to understand the court process.”

Interpreting the Results

These statistics confirm that native Spanish language speakers were responsible for the majority of court cases in the system last year (76 percent). Which, in turn, has resulted in an increased demand for Spanish court interpreters.

According to The Journal Times , more than 1,747 hours were logged in Racine County courts by Spanish-speaking court interpreters.

According to the Bureau of Labor Statistics , the employment of interpreters and translators is projected to grow 29 percent from 2014 to 2024. This increase will assist in meeting the demand in immigration courts. In order for proceedings in this court to be fair and accurate, all parties involved must understand what’s going on. That is best achieved when information can be conveyed in the appropriate language.

The article was written by Sirena Rubinoff.

Sirena"s bio: Sirena Rubinoff is the Content Manager at Morningside Translations. She earned her B.A. and Master’s Degree from the Medill School of Journalism at Northwestern. After completing her graduate degree, Sirena won an international fellowship as a Rotary Cultural Ambassador to Jerusalem. Sirena covers topics related to software and website localization, global business solutions, and the translation industry as a whole.

Говоря об автоматизированном переводе, обычно подразумевают программы, осуществляющие перевод на основе технологии машинного перевода (Machine Translation). Однако существует и другая технология - Translation Memory, которая хотя и не столь широко известна российским пользователям, но, тем не менее, имеет ряд преимуществ.

Бурное развитие технического прогресса привело к увеличению числа технических устройств, машин и другой сложной техники, без которых жизнь современного человека практически немыслима. Например, объем документации для европейского самолета Airbus исчисляется десятками тысяч страниц. Как показывают данные исследования, проведенного в конце 2004 года ассоциацией LISA (LISA 2004 Translation Memory Survey), 42% опрошенных переводят около 1 млн. слов в год, у 24% компаний - участников опроса ежегодный объем переводов составляет 1-5 млн., 12% переводят от 5 до 10 млн., объем переводов остальных компаний - от 10 до 500 и более миллионов слов в год. В частности, большинство производителей сегодня не ограничиваются своим локальным рынком и активно осваивают региональные рынки. При этом локализация продукции, в том числе перевод описания продукта на местный язык, является одним из обязательных условий для выхода на новый рынок.

В то же время, хотя производители регулярно выпускают новые версии своих продуктов - автомобилей, экскаваторов, компьютеров и мобильных телефонов, программного обеспечения, - далеко не все из них принципиально отличаются от предыдущих моделей. Подчас новая модель телефона представляет собой слегка измененную (или рестайлинговую) предыдущую модель. Новые версии продаются лучше, поэтому производителям приходится регулярно обновлять свои продукты. В результате документация по каждому из таких продуктов зачастую на 70-90% совпадает с той, что была у предыдущей версии.

Два фактора - большой объем требующих перевода документов и их высокая повторяемость - послужили стимулом к созданию технологии Translation Memory (сокращенно именуется TM, общепринятый русский перевод этого термина отсутствует). Суть технологии TM можно образно передать одной фразой: «Не переводить один и тот же текст дважды». Иначе говоря, Translation Memory используется для повторного использования ранее сделанных переводов. Это позволяет серьезно сократить время на подготовку перевода, особенно при работе с текстами, имеющими высокую степень повторяемости.

Технологию Translation Memory часто путают с машинным переводом (Machine Translation), которая, безусловно, тоже полезна и интересна, но ее описание не является целью настоящей статьи. Использование технологии ТМ повышает скорость перевода за счет уменьшения объема механической работы. Однако важно отметить, что TM не выполняет перевод за переводчика, а является мощным инструментом для сокращения затрат при переводе повторяющихся текстов.

Технология ТМ работает по принципу накопления результатов перевода: в процессе перевода в базе ТМ сохраняются исходный текст и его перевод. Для облегчения обработки информации и сравнения различных документов система Translation Memory разбивает весь текст на отдельные кусочки, которые называются сегментами. Такими сегментами чаще всего являются предложения, но могут быть приняты и другие правила сегментации. При загрузке нового текста система TM осуществляет сегментирование и сравнивает сегменты исходного текста с уже имеющимися в подключенной базе переводов. Если системе удается найти полностью или частично совпадающий сегмент, то его перевод отображается с указанием совпадения в процентах. Сегменты, которые отличаются от сохраненного текста, выделяются подсветкой. Таким образом, переводчику остается только перевести новые сегменты и отредактировать частично совпадающие.

Как правило, задается порог совпадений на уровне не ниже 75%, так как если установить меньший процент совпадений, то увеличатся затраты на редактирование текста. Каждое изменение или новый перевод сохраняются в ТМ, так что нет необходимости переводить одно и то же дважды!

Важно также постоянно пополнять базу Translation Memory, сохраняя в базе (или в базах, если перевод выполняется по различным тематикам) пары сегментов «исходный текст - правильный перевод». Это позволит значительно сократить время, необходимое для перевода сходных текстов. Помимо снижения трудоемкости перевода система TМ позволяет выдержать единство терминологии и стиля во всей документации.

Использование технологии ТМ обеспечивает переводчику следующие преимущества:

повышение производительности труда. Подстановка даже на 80% совпадающих сегментов из базы переводов может сократить время работы над переводом на 50-60%. Как показывает практика, гораздо эффективнее править уже готовый перевод, чем переводить заново - «с нуля»;
единство терминологии и стиля при наличии базы переводов по тематике переводимого документа. Это особенно важно при переводе узкоспециальной документации;
организация работы коллектива переводчиков с гарантированным качеством перевода благодаря доступу к общей базе Translation Memory.

Отдельно отметим, что в западных странах, где технология Translation Memory давно уже стала де-факто обязательным инструментом переводчика, средства, потраченные на создание базы переводов, рассматриваются не как затраты, а, скорее, как инвестиции в стабильную и качественную работу, что увеличивает не только прибыль, но и стоимость самой компании.

Рынок систем Тranslation Мemory

Бесспорным лидером на рынке систем Translation Memory являются программы SDL-TRADOS. Летом 2005 года произошло объединение двух крупнейших разработчиков систем ТМ - компаний SDL и TRADOS (программные продукты под торговой маркой TRADOS хорошо известны многим пользователям), и теперь они выпускают совместный продукт, который является законодателем стандартов в области Translation Memory.

Новая система SDL-TRADOS имеет расширенные (настраиваемые пользователем) функциональные возможности нечеткого соответствия (поиск по совпадениям в базе переводов), а также инструментарий для проверки качества переводимых документов. Программа осуществляет проверку орфографии и защищает содержимое блоков памяти с помощью технологии шифрования.

Система поддерживает такие форматы, как Word DOC и RTF, online help RTF, PowerPoint, FrameMaker, FrameMaker +SGML, FrameBuilder, Interleaf, QuickSilver, Ventura, QuarkXPress, PageMaker, SGML/HTML/XML, включая HTML Help, RC (Windows Resource), Bookmaster (DCF) и Troff. Помимо системы SDL-TRADOS, на IT-рынке имеются и другие системы ТМ. Особенно широко представлены французские производители.

Система французской компании Atril (www.atril.com) называется. Ее разработчики сначала организовали собственное бюро перевода технической документации, после чего возникла идея создания специализированного ПО на основе технологии Translation Memory.

Это самостоятельное приложение с систематизированным меню. Система может создавать базы ТМ, а также базы данных терминологии и подключать словари. Процесс перевода осуществляется в специальной оболочке Project, куда при ее создании прикрепляется файл, который необходимо перевести, и подключаются дополнительные настройки: база ТМ, словари и др. Текст переводится в специальной таблице, где напротив каждой графы его оригинала нужно заполнить вариант перевода. К преимуществам также относится дополнительная функция для перевода файлов различных форматов, которая позволяет сохранить исходное форматирование файла.

Память переводов или Translation memory

Па́мять переводо́в (ПП, англ. translation memory, TM иногда называемая «Накопитель переводов») - база данных, содержащая набор ранее переведенных текстов. Одна запись в такой базе данных соответствует «единице перевода» (англ. translation unit), за которую обычно принимается одно предложение (реже - часть сложносочинённого предложения, либо абзац). Если очередное предложение исходного текста в точности совпадает с предложением, хранящимся в базе (точное соответствие, англ. exact match), оно может быть автоматически подставлено в перевод. Новое предложение может также слегка отличаться от хранящегося в базе (неточное соответствие, англ. fuzzy match). Такое предложение может быть также подставлено в перевод, но переводчик будет должен внести необходимые изменения.

Помимо ускорения процесса перевода повторяющихся фрагментов и изменений, внесенных в уже переведенные тексты (например, новых версий программных продуктов или изменений в законодательстве), системы Translation Memory также обеспечивают единообразие перевода терминологии в одинаковых фрагментах, что особенно важно при техническом переводе. С другой стороны, если переводчик регулярно подставляет в свой перевод точные соответствия, извлеченные из баз переводов, без контроля их использования в новом контексте, качество переведенного текста может ухудшиться.

В каждой конкретной системе Translation Memory данные хранятся в своем собственном формате (текстовый формат в Wordfast, база данных Access в Deja Vu), но существует международный стандарт TMX (англ. Translation Memory eXchange format), который основан на XML и который могут порождать практически все системы ПП. Благодаря этому результаты работы переводчиков можно обменивать между приложениями, то есть переводчик работающий с OmegaT может использовать память переводов, созданную в ТРАДОСе (Trados) и наоборот.

Большинство систем Translation Memory как минимум поддерживают создание и использование словарей пользователя, создание новых баз данных на основе параллельных текстов (англ. alignment), а также полуавтоматическое извлечение терминологии из оригинальных и параллельных текстов.

Список программных систем Translation memory (памяти переводов)

В соответствии с недавними обзорами использования систем памяти переводов (translation memory) к наиболее популярным системам относятся.