Мета обучава изкуствен интелект да говори над 1000 езика, използвайки Библията!

Последна актуализация: 24/05/2023
Мета обучава изкуствен интелект да говори повече от 1000 езика, използвайки Библията!

Meta обяви, че използва Библията, за да подобри възможностите за разпознаване и генериране на реч на своите модели с изкуствен интелект (ИИ) на повече от хиляда езика. Това иновативно начинание има за цел не само да разработи авангардни технологии, но и да запази застрашените езици.

Амбициозният проект на Meta включва публичното предоставяне на новите лингвистични модели чрез платформата за хостинг на код GitHub. Това позволява на програмистите на различни езици да разработват иновативни и гъвкави гласови приложения.

Мета използва „Новия завет“ от Библията, за да обучи изкуствен интелект

Мета използва „Новия завет“ от Библията, за да обучи изкуствен интелект

За тази задача Meta е подготвила своите модели, използвайки два набора от данни: единият, състоящ се от аудио записи на Новия завет на 1,107 езика , и другият, който включва немаркирани записи на Новия завет на 3,809 езика.

„Имаме много добри набори от данни за английски и някои други езици, но нямаме такива за езици, говорени от, да речем, 1000 души.“ – Майкъл Аули, изследовател в Meta

В момента изследователите на Meta твърдят, че техните модели могат да комуникират на повече от 1,000 езика и да разпознават повече от 4,000 , което е значително постижение, като се има предвид, че в света има около 7,000 езика.

В сравнение с модели на конкурентни компании, като например Whisper на OpenAI, версията на Meta показа наполовина по-малък процент на грешки , въпреки че покрива 11 пъти повече езици.

Огромно предизвикателство, което би революционизирало разговорния изкуствен интелект

Библията, една от най-превежданите книги в историята, е преведена на повече от 700 езика , според Обединеното библейско общество. Новият завет, в частност, е преведен на повече от 1,500 езика. Този широк набор от преводи е стимулирал продължаващия превод на малцинствени и застрашени езици.

Преводът на Библията обаче не е лесна работа. Всеки език има свои собствени характеристики, с различни начини за изразяване на идеи и понятия. Това означава, че в много случаи преводачите трябва да положат херкулесовски усилия, за да намерят правилните думи и фрази, които точно предават оригиналните послания и значения на библейските текстове, което усложнява използването им като перфектен източник за обучение на изкуствен интелект.

Въпреки подобренията в разбирането и генерирането на език, моделите на Мета не са без недостатъци . Изследователите признават, че техните модели могат неправилно да транскрибират някои думи или фрази и че техните модели за разпознаване на реч са генерирали повече пристрастни думи от други модели, макар и само с 0.7% повече.

Крис Емезуе, изследовател в Masakhane, организация, посветена на обработката на естествен език за африкански езици, каза пред MIT, че използването на религиозни текстове за обучение на модели може да бъде проблематично. Според него „Библията има много пристрастия и изкривявания“.

🔥ПРИСЪЕДИНЕТЕ СЕ🔥 КЪМ НОВАТА IP@P ОБЩНОСТ! РЕГИСТРИРАЙТЕ СЕ ТУК!

Теми

Автор: Марио Хосе

Със степен по журналистика, специализирана в разследваща журналистика, търся истината във всичко. В момента съм фокусирана изцяло върху технологиите, компютрите и интернет.

Последни новини