Наука и технологии33

Как это работает: машинный перевод иноязычных текстов

7 января 1954 года в штаб-квартире корпорации IBM в Нью-Йорке состоялся так называемый «Джорджтаунский эксперимент», в ходе которого был успешно продемонстрирован полностью автоматический перевод нескольких десятков предложений с русского языка на английский.

Перевод был примитивным: на основе словаря из 250 слов и 6 правил. Поэтому система могла перевести только несколько самых примитивных фраз. Но целью было привлечь внимания к машинному переводу и продемонстрировать его перспективность.

Теперь, благодаря интернету, каждое незнакомое слово или фразу можно за несколько секунд перевести на родной язык, и этот перевод получится довольно точный. Что же изменилось с тех пор? Какой сейчас принцип работы автоматических переводчиков и какое будущее у живых переводчиков-профессионалов?

Современные онлайн-переводчики (самый известный из которых — Google Translate) используют статистический машинный перевод, в процессе которого компьютерная программа анализирует огромный массив текстов, переведенных людьми, использует словари и грамматику в цифровом формате. Звучит сложно? Давайте разбираться.

Огромный массив текстов состоит из большого количества языковых пар — текстов, которые имеют две точные языковые версии (переведенные человеком). В качестве таких текстов обычно используются официальные документы мультиязычных стран, где перевод документации обязателен на все государственные языки. Такие переводы всегда совершенны, так как государственные документы решают судьбу отдельных людей и страны в целом. Очень полезными оказались и многоязычные документы, выпускаемые ООН.

Анализируя пары текстов, система «учится», усваивая с каждым разом все больше новых правил. Таким образом строится модель языка.

Каждая система автоматического перевода имеет модель перевода — «словарь», в котором для всех слов и фраз на одном языке перечислены возможные переводы на другой язык с указанием вероятности этих переводов. Модели перевода для каждой пары языков содержат миллионы пар слов и словосочетаний.

Если вы переводите с английского языка, например, на белорусский, будут задействованы две языковые пары: белорусский-русский и русский-английский. То есть сначала текст переводится с английского на русский, а потом — с русского на белорусский.

Такой путь наиболее рационален, так как документов, которые бы имели безукоризненные английскую и белорусскую версии — немного, и прямой перевод с английского на белорусский получался бы очень некачественным по причине недостаточной «обученности» системы.

Непосредственно переводом занимается декодер — алгоритм, который проводит анализ текста и для каждого слова подбирает все варианты перевода, упорядочивая в порядке убывания вероятности. Затем все полученные варианты декодер оценивает с помощью модели языка на частотность употребления и выбирает предложение с лучшим сочетанием вероятности и частотности.

К сожалению, в настоящее время нет сервиса автоматического перевода, который бы мог перевести текст с такой же точностью, как и человек-переводчик. Но уже сейчас некоторые компании внедряют в машинный перевод нейронные сети, которые значительно улучшают его качество.

Поэтому можно предположить, что с течением времени специалисты-переводчики будут нужны только для создания сложных художественных переводов, что значительно сократит численность людей, занятых в этой сфере. Но вряд ли это близкая перспектива. А как считаете вы?

Читайте также:

Следующая революция в информатике — нейронные сети

Комментарии3

Сейчас читают

33-летний Даниил Гаркавый, который неожиданно покинул Офис Тихановской, рассказал о своей онкологии и семи операциях2

33-летний Даниил Гаркавый, который неожиданно покинул Офис Тихановской, рассказал о своей онкологии и семи операциях

Все новости →
Все новости

«Не кажы ты мне слоў, што не грэюць цяплом», Александр Чернухо4

«Жестокость под видом благотворительности». В Австралии из вертолета расстреляли до 700 коал2

В минском кафе работает робот-официант ВИДЕО

Белоруса в Нидерландах осудили на 12 лет тюрьмы за убийство

Песков назвал условие, при выполнении которого война мгновенно завершилась бы1

Бывшую жену политзаключенного, которая поет песни Анны Селук, отметили на «Песне года»4

Экспертка поделилась лайфхаком, как получить шенген быстрее и на более длительный срок2

«Мы не теряем надежды, хотя и не наивны». Радослав Сикорский о перспективах свободной Беларуси1

Трамп раскритиковал Зеленского за заявление, что Украина никогда не признает Крым российским23

больш чытаных навін
больш лайканых навін

33-летний Даниил Гаркавый, который неожиданно покинул Офис Тихановской, рассказал о своей онкологии и семи операциях2

33-летний Даниил Гаркавый, который неожиданно покинул Офис Тихановской, рассказал о своей онкологии и семи операциях

Главное
Все новости →

Заўвага:

 

 

 

 

Закрыць Паведаміць