Платформа CAT для переводов: память и терминология
У нас бюро переводов, и нам нужна платформа CAT, которая соберёт всю работу лингвистов в одном окне и уберёт бесконечное перепечатывание. Сегодня специалисты вручную повторяют формулировки, которые уже встречались в прошлых заказах, сверяют термины по десятку файлов и на каждом новом проекте фактически начинают заново. Хотим веб-сервис, в котором переводчик загружает документ, получает его разбитым на понятные отрезки и работает над ними напротив исходного текста, а система сама накапливает и возвращает ранее сделанные переводы. Интерфейс должен быть спокойным и быстрым: сотрудники сидят в нём целыми сменами, и любая задержка бьёт по срокам.
Главная часть заказа — накопительная база переводов. Как только отрезок утверждён, он попадает в хранилище и позже подсказывается при похожем тексте, с указанием доли совпадения для полных и приблизительных вариантов, чтобы исполнитель сразу понимал объём повторного использования. К этому нужны терминологические словари: сервис выделяет согласованные термины в оригинале и вставляет утверждённый эквивалент горячей клавишей, так что одно и то же наименование не переведут в проекте по-разному. Автоматический контроль качества должен в фоне ловить потерянные цифры, пропущенные фрагменты, расхождения в терминах, лишние пробелы и повреждённую разметку до передачи заказчику.
Важны и загрузка с выгрузкой. Платформа обязана открывать распространённые офисные и локализационные форматы, беречь вёрстку и встроенные метки и отдавать документ, совпадающий с исходником во всём, кроме языка. Ждём предложение по архитектуре, объяснение, как вы удержите скорость на больших базах, и разбивку на этапы. Плюсом будет опыт в локализации и работе с многоязычным контентом.
— Накопительная база с полными и приблизительными совпадениями
— Терминологические словари и вставка термина клавишей
— Автоматическая разбивка текста и правка напротив оригинала
— Настраиваемый контроль качества перед сдачей
— Загрузка и выгрузка с сохранением вёрстки и меток
Главная часть заказа — накопительная база переводов. Как только отрезок утверждён, он попадает в хранилище и позже подсказывается при похожем тексте, с указанием доли совпадения для полных и приблизительных вариантов, чтобы исполнитель сразу понимал объём повторного использования. К этому нужны терминологические словари: сервис выделяет согласованные термины в оригинале и вставляет утверждённый эквивалент горячей клавишей, так что одно и то же наименование не переведут в проекте по-разному. Автоматический контроль качества должен в фоне ловить потерянные цифры, пропущенные фрагменты, расхождения в терминах, лишние пробелы и повреждённую разметку до передачи заказчику.
Важны и загрузка с выгрузкой. Платформа обязана открывать распространённые офисные и локализационные форматы, беречь вёрстку и встроенные метки и отдавать документ, совпадающий с исходником во всём, кроме языка. Ждём предложение по архитектуре, объяснение, как вы удержите скорость на больших базах, и разбивку на этапы. Плюсом будет опыт в локализации и работе с многоязычным контентом.
— Накопительная база с полными и приблизительными совпадениями
— Терминологические словари и вставка термина клавишей
— Автоматическая разбивка текста и правка напротив оригинала
— Настраиваемый контроль качества перед сдачей
— Загрузка и выгрузка с сохранением вёрстки и меток