Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование» » Ваш Выбор Инноваций

Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование»

Образование 25-10-2019, 18:20 Calhoun 143 0

В Казани презентовали русско-татарский машинный переводчик «Татсофт»


Опережая время: татарский онлайн-переводчик заинтересовал башкир - «Образование»
Фото: Ринат Назметдинов


Казанские специалисты разработали русско-татарский машинный переводчик Tatsoft. С помощью сайта любой пользователь сможет переводить с языка Пушкина на язык Тукая и обратно. Презентация проекта состоялась сегодня в Казани. Что предлагает система, насколько она лучше «Яндекса» и чем заинтересовались в Уфе — в репортаже корреспондента «Реального времени».


Опередили время

Сегодня в Казани состоялась презентация русско-татарского машинного переводчика «Татсофт». Мероприятие прошло на площадке молодежного центра «Сэлэт». Сервис, работающий на основе нейросетевых технологий, представляет собой онлайн-переводчик с русского языка на татарский и с татарского на русский.

Чтобы перевести необходимую фразу с русского на татарский и наоборот, достаточно набрать ее в специальном поле на сайте translate.tatar и кликнуть «перевести». Кроме этого, система предлагает озвучивание результатов перевода на татарском и русском языках, двуязычный интерфейс и возможности оценки качества работы. Программа самообучающаяся.

Если пользователю перевод покажется некорректным, он может поставить «дизлайк». Это предложение или словосочетание попадет в специальную базу, которую рассмотрят специалисты, чтоб в последующем предложить правильный вариант перевода.

Проект разработан коллективом Института прикладной семиотики Академии наук Республики Татарстан (ИПС АН РТ). Как рассказал корреспонденту «Реального времени» директор ИПС АН РТ Джавдет Сулейманов, технологию разрабатывали пять человек. К работе привлекались филологи-лингвисты, переводчики, программисты.

В совокупности над сервисом трудились порядка 60 человек. И над этим проектом специалисты работали 30 лет.

— Более акцентированно мы начали работать над ним с начала 2014 года в рамках государственной программы, — отметил заместитель директора института Ринат Гильмуллин в беседе с нашим корреспондентом. — По нашим обязательствам мы должны были показать свой продукт в следующем году. Но мы опередили время.

Пять лет назад татарстанские айтишники начали сотрудничество с компаниями ABBYY и «Яндекс». В 2018 году ИПС АН РТ разработал первую версию переводчика. В основе подхода была выбрана архитектура encoder-decoder-attention. В 2019 году система была обновлена: построены модели на базе архитектуры Transformer, использовались алгоритмы внедрения языковых моделей в нейросеть. Впервые для русско-татарской пары были проведены эксперименты по использованию параллельных данных для других языков с целью переноса знаний (transfer learning).

Неосвоенный «птичий язык»

В качестве основных обучающих данных используется созданный параллельный корпус объемом 983,3 тыс. пар русско-татарских предложений, включающий тексты новостей, художественную литературу, нормативно-правовые акты. В планах — набрать 10 млн пар предложений.

Как сообщил Сулейманов, всего на создание базы переводчика ушло порядка 40 млн рублей.

По его словам, сайт смогли запустить благодаря АО «СМП-Нефтегаз», которое предоставило им мощный сервер стоимостью 18 млн рублей.

Во время презентации старший научный сотрудник ИПС АН РТ Айдар Хусаинов подчеркнул, что переводчик пригодится 5 млн носителям татарского языка, тем, кто желает освоить «туган тел», журналистам, переводчикам, школьникам и студентам. Кроме того, в Татарстане татарский наряду с русским является государственным, поэтому документы, надписи дублируются на двух языках.

Более того, он предложил присутствующим сказать какую-нибудь фразу на русском или татарском и опробовать переводчик в деле. Собравшиеся предлагали как простые предложения, так и довольно сложные. В целом сервис достойно справился. Даже смог неплохо перевести пушкинские строки из стихотворения «К***»: «Я помню чудное мгновенье…».

Заминка произошла при переводе на русский названия лакомства «кош теле». Система упорно предлагала варианты «птичий язык» и «язык птиц». Хотя те, кто пробовал это блюдо, понимают, что речь идет о сладком хворосте.

— Разным названиям, именам собственным, фразеологизмам программе еще предстоит учиться, — выкрутился Хусаинов.

Заинтересовались в Башкирии

Подобный сервис (русско-татарский переводчик) есть и у компании «Яндекс». Но Сулейманов и Гильмуллин уверены, что их разработка лучше всех аналогов. Поэтому продукт заинтересовал и другие регионы. Например, в Башкортостане (АН РБ и УФИЦ РАН) теперь тоже хотят взять на вооружение ноу-хау казанцев.

— Башкиры хотят вместе с нами создать свой переводчик — русско-башкирский, — говорит Сулейманов. — Этот проект мы готовы предложить всем народам Российской Федерации, поскольку мы знаем, как это делать. Наши технологии могут работать в любых парах.

В частности, уфимский создатель Машинного фонда башкирского языка Зиннур Сиразетдинов, заведующий лабораторией лингвистики и информационных технологий УФИЦ РАН, хочет работать с казанскими коллегами. Также к татарстанцам обращались ученые из республик Средней Азии.


Тимур Рахматуллин, фото Рината Назметдинова

В Казани презентовали русско-татарский машинный переводчик «Татсофт» Фото: Ринат Назметдинов Казанские специалисты разработали русско-татарский машинный переводчик Tatsoft. С помощью сайта любой пользователь сможет переводить с языка Пушкина на язык Тукая и обратно. Презентация проекта состоялась сегодня в Казани. Что предлагает система, насколько она лучше «Яндекса» и чем заинтересовались в Уфе — в репортаже корреспондента «Реального времени». Опередили время Сегодня в Казани состоялась презентация русско-татарского машинного переводчика «Татсофт». Мероприятие прошло на площадке молодежного центра «Сэлэт». Сервис, работающий на основе нейросетевых технологий, представляет собой онлайн-переводчик с русского языка на татарский и с татарского на русский. Чтобы перевести необходимую фразу с русского на татарский и наоборот, достаточно набрать ее в специальном поле на сайте translate.tatar и кликнуть «перевести». Кроме этого, система предлагает озвучивание результатов перевода на татарском и русском языках, двуязычный интерфейс и возможности оценки качества работы. Программа самообучающаяся. Если пользователю перевод покажется некорректным, он может поставить «дизлайк». Это предложение или словосочетание попадет в специальную базу, которую рассмотрят специалисты, чтоб в последующем предложить правильный вариант перевода. Проект разработан коллективом Института прикладной семиотики Академии наук Республики Татарстан (ИПС АН РТ). Как рассказал корреспонденту «Реального времени» директор ИПС АН РТ Джавдет Сулейманов, технологию разрабатывали пять человек. К работе привлекались филологи-лингвисты, переводчики, программисты. В совокупности над сервисом трудились порядка 60 человек. И над этим проектом специалисты работали 30 лет. — Более акцентированно мы начали работать над ним с начала 2014 года в рамках государственной программы, — отметил заместитель директора института Ринат Гильмуллин в беседе с нашим корреспондентом. — По нашим обязательствам мы должны были показать свой продукт в следующем году. Но мы опередили время. Пять лет назад татарстанские айтишники начали сотрудничество с компаниями ABBYY и «Яндекс». В 2018 году ИПС АН РТ разработал первую версию переводчика. В основе подхода была выбрана архитектура encoder-decoder-attention. В 2019 году система была обновлена: построены модели на базе архитектуры Transformer, использовались алгоритмы внедрения языковых моделей в нейросеть. Впервые для русско-татарской пары были проведены эксперименты по использованию параллельных данных для других языков с целью переноса знаний (transfer learning). Неосвоенный «птичий язык» В качестве основных обучающих данных используется созданный параллельный корпус объемом 983,3 тыс. пар русско-татарских предложений, включающий тексты новостей, художественную литературу, нормативно-правовые акты. В планах — набрать 10 млн пар предложений. Как сообщил Сулейманов, всего на создание базы переводчика ушло порядка 40 млн рублей. По его словам, сайт смогли запустить благодаря АО «СМП-Нефтегаз», которое предоставило им мощный сервер стоимостью 18 млн рублей. Во время презентации старший научный сотрудник ИПС АН РТ Айдар Хусаинов подчеркнул, что переводчик пригодится 5 млн носителям татарского языка, тем, кто желает освоить «туган тел», журналистам, переводчикам, школьникам и студентам. Кроме того, в Татарстане татарский наряду с русским является государственным, поэтому документы, надписи дублируются на двух языках. Более того, он предложил присутствующим сказать какую-нибудь фразу на русском или татарском и опробовать переводчик в деле. Собравшиеся предлагали как простые предложения, так и довольно сложные. В целом сервис достойно справился. Даже смог неплохо перевести пушкинские строки из стихотворения «К***»: «Я помню чудное мгновенье…». Заминка произошла при переводе на русский названия лакомства «кош теле». Система упорно предлагала варианты «птичий язык» и «язык птиц». Хотя те, кто пробовал это блюдо, понимают, что речь идет о сладком хворосте. — Разным названиям, именам собственным, фразеологизмам программе еще предстоит учиться, — выкрутился Хусаинов. Заинтересовались в Башкирии Подобный сервис (русско-татарский переводчик) есть и у компании «Яндекс». Но Сулейманов и Гильмуллин уверены, что их разработка лучше всех аналогов. Поэтому продукт заинтересовал и другие регионы. Например, в Башкортостане (АН РБ и УФИЦ РАН) теперь тоже хотят взять на вооружение ноу-хау казанцев. — Башкиры хотят вместе с нами создать свой переводчик — русско-башкирский, — говорит Сулейманов. — Этот проект мы готовы предложить всем народам Российской Федерации, поскольку мы знаем, как это делать. Наши технологии могут работать в любых парах. В частности, уфимский создатель Машинного фонда башкирского языка Зиннур Сиразетдинов, заведующий лабораторией лингвистики и информационных технологий УФИЦ РАН, хочет работать с казанскими коллегами. Также к татарстанцам обращались ученые из республик Средней Азии. Тимур Рахматуллин, фото Рината Назметдинова
Цитирование статьи, картинки - фото скриншот - Rambler News Service.
Иллюстрация к статье - Яндекс. Картинки.
Есть вопросы. Напишите нам.
Общие правила  поведения на сайте.
Похожие новости
Посланники ЦУР «Татнефти»: как сделать мир лучше - «Образование»

Волонтеры корпоративной программы возобновили очные встречи со школьниками Сколько литров воды уходит...

Подробнее 0
События недели: норовирус в Крыму, пародийный предвыборный ролик и древнее захоронение в Аксубаевском районе - «История»

Чем запомнились татарстанцам уходящие 7 дней Фото: irida-tur.ru Неделя началась с подведения итогов работы...

Подробнее 0
И ещё пара слов о поборе с недвижимости - «Недвижимость»

Ненасытность власти уже не удивляет, а оскорбляет. То, что страна в заднице, уже давно не секрет, а...

Подробнее 0
Как челнинский бизнесмен оказался в эпицентре банкротно-канализационного скандала в Ульяновске - «Инфраструктура»

Фото: Скриншот видео Как стало известно «Реальному времени», в Ульяновске развернулась коммунально-судебная...

Подробнее 0

Оставить комментарий
Ваш Выбор Инноваций

Чего жду от 2018-го: создатель и директор школы СОлНЦе о нечестности школьных олимпиад, санкциях и мечтах о...

Подробнее 08-янв-2018

Мэрия Казани строит спортплощадку для новой школы не у стен учебного заведения, а «зачистив» ближайшую рощу...

Подробнее 14-авг-2018

Фото: Илья Репин 29 и 30 июня в Казани проходят пробные ЕГЭ, на которых организаторы будут оценивать...

Подробнее 29-июн-2020

Топ-10 главных событий 2018 года в Башкортостане Фото: glavarb.ru «Реальное время», запустив год назад...

Подробнее 04-янв-2019

Как Госсовет возмутился языковому конфликту в Татарстане, но решил не обсуждать этот вопрос Фото: Олег...

Подробнее 26-окт-2017

В Йошкар-Оле на круглом столе по марийскому языку выступила идеолог языковой политики России Фото: Марк...

Подробнее 01-фев-2018

Компания реализует в детских садах Альметьевского района проект «Высокое качество образовательной среды»...

Подробнее 25-янв-2021

Сегодня на вокзале «Казань-1» прошла акция «День транспортной безопасности». Школьникам рассказали о...

Подробнее 16-фев-2018

Яндекс.Метрика