Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование» » Ваш Выбор Инноваций

Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование»

Образование 25-10-2019, 18:20 Calhoun 140 0

В Казани презентовали русско-татарский машинный переводчик «Татсофт»


Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование»
Фото: Ринат Назметдинов


Казанские специалисты разработали русско-татарский машинный переводчик Tatsoft. С помощью сайта любой пользователь сможет переводить с языка Пушкина на язык Тукая и обратно. Презентация проекта состоялась сегодня в Казани. Что предлагает система, насколько она лучше «Яндекса» и чем заинтересовались в Уфе — в репортаже корреспондента «Реального времени».


Опередили время

Сегодня в Казани состоялась презентация русско-татарского машинного переводчика «Татсофт». Мероприятие прошло на площадке молодежного центра «Сэлэт». Сервис, работающий на основе нейросетевых технологий, представляет собой онлайн-переводчик с русского языка на татарский и с татарского на русский.

Чтобы перевести необходимую фразу с русского на татарский и наоборот, достаточно набрать ее в специальном поле на сайте translate.tatar и кликнуть «перевести». Кроме этого, система предлагает озвучивание результатов перевода на татарском и русском языках, двуязычный интерфейс и возможности оценки качества работы. Программа самообучающаяся.

Если пользователю перевод покажется некорректным, он может поставить «дизлайк». Это предложение или словосочетание попадет в специальную базу, которую рассмотрят специалисты, чтоб в последующем предложить правильный вариант перевода.

Проект разработан коллективом Института прикладной семиотики Академии наук Республики Татарстан (ИПС АН РТ). Как рассказал корреспонденту «Реального времени» директор ИПС АН РТ Джавдет Сулейманов, технологию разрабатывали пять человек. К работе привлекались филологи-лингвисты, переводчики, программисты.

В совокупности над сервисом трудились порядка 60 человек. И над этим проектом специалисты работали 30 лет.

— Более акцентированно мы начали работать над ним с начала 2014 года в рамках государственной программы, — отметил заместитель директора института Ринат Гильмуллин в беседе с нашим корреспондентом. — По нашим обязательствам мы должны были показать свой продукт в следующем году. Но мы опередили время.

Пять лет назад татарстанские айтишники начали сотрудничество с компаниями ABBYY и «Яндекс». В 2018 году ИПС АН РТ разработал первую версию переводчика. В основе подхода была выбрана архитектура encoder-decoder-attention. В 2019 году система была обновлена: построены модели на базе архитектуры Transformer, использовались алгоритмы внедрения языковых моделей в нейросеть. Впервые для русско-татарской пары были проведены эксперименты по использованию параллельных данных для других языков с целью переноса знаний (transfer learning).

Неосвоенный «птичий язык»

В качестве основных обучающих данных используется созданный параллельный корпус объемом 983,3 тыс. пар русско-татарских предложений, включающий тексты новостей, художественную литературу, нормативно-правовые акты. В планах — набрать 10 млн пар предложений.

Как сообщил Сулейманов, всего на создание базы переводчика ушло порядка 40 млн рублей.

По его словам, сайт смогли запустить благодаря АО «СМП-Нефтегаз», которое предоставило им мощный сервер стоимостью 18 млн рублей.

Во время презентации старший научный сотрудник ИПС АН РТ Айдар Хусаинов подчеркнул, что переводчик пригодится 5 млн носителям татарского языка, тем, кто желает освоить «туган тел», журналистам, переводчикам, школьникам и студентам. Кроме того, в Татарстане татарский наряду с русским является государственным, поэтому документы, надписи дублируются на двух языках.

Более того, он предложил присутствующим сказать какую-нибудь фразу на русском или татарском и опробовать переводчик в деле. Собравшиеся предлагали как простые предложения, так и довольно сложные. В целом сервис достойно справился. Даже смог неплохо перевести пушкинские строки из стихотворения «К***»: «Я помню чудное мгновенье…».

Заминка произошла при переводе на русский названия лакомства «кош теле». Система упорно предлагала варианты «птичий язык» и «язык птиц». Хотя те, кто пробовал это блюдо, понимают, что речь идет о сладком хворосте.

— Разным названиям, именам собственным, фразеологизмам программе еще предстоит учиться, — выкрутился Хусаинов.

Заинтересовались в Башкирии

Подобный сервис (русско-татарский переводчик) есть и у компании «Яндекс». Но Сулейманов и Гильмуллин уверены, что их разработка лучше всех аналогов. Поэтому продукт заинтересовал и другие регионы. Например, в Башкортостане (АН РБ и УФИЦ РАН) теперь тоже хотят взять на вооружение ноу-хау казанцев.

— Башкиры хотят вместе с нами создать свой переводчик — русско-башкирский, — говорит Сулейманов. — Этот проект мы готовы предложить всем народам Российской Федерации, поскольку мы знаем, как это делать. Наши технологии могут работать в любых парах.

В частности, уфимский создатель Машинного фонда башкирского языка Зиннур Сиразетдинов, заведующий лабораторией лингвистики и информационных технологий УФИЦ РАН, хочет работать с казанскими коллегами. Также к татарстанцам обращались ученые из республик Средней Азии.


Тимур Рахматуллин, фото Рината Назметдинова

В Казани презентовали русско-татарский машинный переводчик «Татсофт» Фото: Ринат Назметдинов Казанские специалисты разработали русско-татарский машинный переводчик Tatsoft. С помощью сайта любой пользователь сможет переводить с языка Пушкина на язык Тукая и обратно. Презентация проекта состоялась сегодня в Казани. Что предлагает система, насколько она лучше «Яндекса» и чем заинтересовались в Уфе — в репортаже корреспондента «Реального времени». Опередили время Сегодня в Казани состоялась презентация русско-татарского машинного переводчика «Татсофт». Мероприятие прошло на площадке молодежного центра «Сэлэт». Сервис, работающий на основе нейросетевых технологий, представляет собой онлайн-переводчик с русского языка на татарский и с татарского на русский. Чтобы перевести необходимую фразу с русского на татарский и наоборот, достаточно набрать ее в специальном поле на сайте translate.tatar и кликнуть «перевести». Кроме этого, система предлагает озвучивание результатов перевода на татарском и русском языках, двуязычный интерфейс и возможности оценки качества работы. Программа самообучающаяся. Если пользователю перевод покажется некорректным, он может поставить «дизлайк». Это предложение или словосочетание попадет в специальную базу, которую рассмотрят специалисты, чтоб в последующем предложить правильный вариант перевода. Проект разработан коллективом Института прикладной семиотики Академии наук Республики Татарстан (ИПС АН РТ). Как рассказал корреспонденту «Реального времени» директор ИПС АН РТ Джавдет Сулейманов, технологию разрабатывали пять человек. К работе привлекались филологи-лингвисты, переводчики, программисты. В совокупности над сервисом трудились порядка 60 человек. И над этим проектом специалисты работали 30 лет. — Более акцентированно мы начали работать над ним с начала 2014 года в рамках государственной программы, — отметил заместитель директора института Ринат Гильмуллин в беседе с нашим корреспондентом. — По нашим обязательствам мы должны были показать свой продукт в следующем году. Но мы опередили время. Пять лет назад татарстанские айтишники начали сотрудничество с компаниями ABBYY и «Яндекс». В 2018 году ИПС АН РТ разработал первую версию переводчика. В основе подхода была выбрана архитектура encoder-decoder-attention. В 2019 году система была обновлена: построены модели на базе архитектуры Transformer, использовались алгоритмы внедрения языковых моделей в нейросеть. Впервые для русско-татарской пары были проведены эксперименты по использованию параллельных данных для других языков с целью переноса знаний (transfer learning). Неосвоенный «птичий язык» В качестве основных обучающих данных используется созданный параллельный корпус объемом 983,3 тыс. пар русско-татарских предложений, включающий тексты новостей, художественную литературу, нормативно-правовые акты. В планах — набрать 10 млн пар предложений. Как сообщил Сулейманов, всего на создание базы переводчика ушло порядка 40 млн рублей. По его словам, сайт смогли запустить благодаря АО «СМП-Нефтегаз», которое предоставило им мощный сервер стоимостью 18 млн рублей. Во время презентации старший научный сотрудник ИПС АН РТ Айдар Хусаинов подчеркнул, что переводчик пригодится 5 млн носителям татарского языка, тем, кто желает освоить «туган тел», журналистам, переводчикам, школьникам и студентам. Кроме того, в Татарстане татарский наряду с русским является государственным, поэтому документы, надписи дублируются на двух языках. Более того, он предложил присутствующим сказать какую-нибудь фразу на русском или татарском и опробовать переводчик в деле. Собравшиеся предлагали как простые предложения, так и довольно сложные. В целом сервис достойно справился. Даже смог неплохо перевести пушкинские строки из стихотворения «К***»: «Я помню чудное мгновенье…». Заминка произошла при переводе на русский названия лакомства «кош теле». Система упорно предлагала варианты «птичий язык» и «язык птиц». Хотя те, кто пробовал это блюдо, понимают, что речь идет о сладком хворосте. — Разным названиям, именам собственным, фразеологизмам программе еще предстоит учиться, — выкрутился Хусаинов. Заинтересовались в Башкирии Подобный сервис (русско-татарский переводчик) есть и у компании «Яндекс». Но Сулейманов и Гильмуллин уверены, что их разработка лучше всех аналогов. Поэтому продукт заинтересовал и другие регионы. Например, в Башкортостане (АН РБ и УФИЦ РАН) теперь тоже хотят взять на вооружение ноу-хау казанцев. — Башкиры хотят вместе с нами создать свой переводчик — русско-башкирский, — говорит Сулейманов. — Этот проект мы готовы предложить всем народам Российской Федерации, поскольку мы знаем, как это делать. Наши технологии могут работать в любых парах. В частности, уфимский создатель Машинного фонда башкирского языка Зиннур Сиразетдинов, заведующий лабораторией лингвистики и информационных технологий УФИЦ РАН, хочет работать с казанскими коллегами. Также к татарстанцам обращались ученые из республик Средней Азии. Тимур Рахматуллин, фото Рината Назметдинова
Цитирование статьи, картинки - фото скриншот - Rambler News Service.
Иллюстрация к статье - Яндекс. Картинки.
Есть вопросы. Напишите нам.
Общие правила  поведения на сайте.
Похожие новости
Эва Милконская: «Мне хотелось зацепиться за какой-то просвет в этой грязной весне» - «Культура»

Резонансный фотохудожник — о беспутье в Куюках и социальной роли искусства Фото: Эва Милконская Неожиданно...

Подробнее 0
Безнадежные кредиты и вывод залогов: криминальная энциклопедия Роберта Мусина - «Происшествия»

Обвинитель по делу о многомиллиардных хищениях в «Татфондбанке» начал оглашать письменные доказательства...

Подробнее 0
В Азербайджане произошли два землетрясения магнитудами более 3 - «Происшествия»

adventtr / istockphoto.com Москва, 2 ноября - АиФ-Москва. В Азербайджане произошли два землетрясения...

Подробнее 0
Загородный дом оформить в собственность совсем не просто - «Недвижимость»

Дачная амнистия заканчивается 1 марта 2015 г., а около трети обитателей загородных домиков ещё не оформили...

Подробнее 0

Оставить комментарий
Ваш Выбор Инноваций

«Синие воротнички» могут заработать до 120 тысяч рублей в месяц — правда, вахтовым методом. «Домашние»...

Подробнее 17-июл-2018

Математика рассказывает, насколько велико антропогенное влияние на изменение температуры в Антарктиде. И...

Подробнее 08-окт-2017

Советы практического психолога о том, как мягко перевести ребенка с летних каникул на школьные рельсы Фото:...

Подробнее 22-авг-2021

Фото: bboldino-school.ucoz.ru Две трети россиян (67%) положительно оценили предложение поднимать флаг и...

Подробнее 07-мая-2022

Сегодня Владимир Путин провел совещание по эпидемиологической ситуации и о подготовке к осенне-зимнему...

Подробнее 29-июл-2020

Эксперты обсудили вопросы частного образования в «Бизнес-клубе» — на программе «Реального времени» и «Эхо...

Подробнее 19-авг-2017

Чем запомнились татарстанцам уходящие 7 дней Фото: eltransteh.ru Наиболее резонансными темами для обсуждения...

Подробнее 25-авг-2018

Фото: realnoevremya.ru Чаще, чем разговоры о необходимости самого высшего образования, звучат только...

Подробнее 16-янв-2022

Яндекс.Метрика