Meta apmāca mākslīgo intelektu runāt vairāk nekā 1000 valodās, izmantojot Bībeli!

Pēdējā atjaunošana: 24/05/2023
Meta apmāca mākslīgo intelektu runāt vairāk nekā 1000 valodās, izmantojot Bībeli!

Uzņēmums “Meta” ir paziņojis, ka izmanto Bībeli, lai uzlabotu savu mākslīgā intelekta (MI) modeļu runas atpazīšanas un ģenerēšanas iespējas vairāk nekā tūkstoš valodās. Šī inovatīvā projekta mērķis ir ne tikai attīstīt jaunākās tehnoloģijas, bet arī saglabāt apdraudētās valodas.

Meta ambiciozais projekts paredz padarīt savus jaunos lingvistiskos modeļus publiski pieejamus, izmantojot GitHub koda mitināšanas platformu. Tas ļauj dažādu valodu programmētājiem izstrādāt inovatīvas un daudzpusīgas balss lietojumprogrammas.

Meta izmanto Bībeles "Jauno Derību", lai apmācītu mākslīgo intelektu

Meta izmanto Bībeles "Jauno Derību", lai apmācītu mākslīgo intelektu

Šim uzdevumam Meta ir sagatavojis savus modeļus, izmantojot divus datu kopumus: vienu, kas sastāv no Jaunās Derības audio ierakstiem 1,107 valodās , un otru, kas ietver nemarķētus Jaunās Derības ierakstus 3,809 valodās.

“Mums ir daudz labu datu kopu angļu valodai un dažām citām valodām, bet mums nav tādu valodām, kurās runā, teiksim, 1000 cilvēku.” – Maikls Auli, pētnieks uzņēmumā Meta

Pašlaik Meta pētnieki apgalvo, ka viņu modeļi var sazināties vairāk nekā 1,000 valodās un atpazīt vairāk nekā 4,000 , kas ir ievērojams sasniegums, ņemot vērā, ka pasaulē ir aptuveni 7,000 valodu.

Salīdzinot ar konkurējošu uzņēmumu, piemēram, OpenAI Whisper, modeļiem, Meta versijā bija uz pusi mazāks kļūdu līmenis , neskatoties uz to, ka tā aptver 11 reizes vairāk valodu.

Milzīgs izaicinājums, kas revolucionizētu sarunvalodas mākslīgo intelektu

Bībele, viena no visvairāk tulkotajām grāmatām vēsturē, ir tulkota vairāk nekā 700 valodās , liecina Apvienotās Bībeles biedrības dati. Jo īpaši Jaunā Derība ir tulkota vairāk nekā 1,500 valodās. Šis plašais tulkojumu klāsts ir veicinājis pastāvīgu tulkošanu minoritāšu un apdraudētajās valodās.

Tomēr Bībeles tulkošana nav pastaiga parkā. Katrai valodai ir savas īpatnības ar atšķirīgiem veidiem, kā izteikt idejas un jēdzienus. Tas nozīmē, ka daudzos gadījumos tulkotājiem ir jāpieliek herkuliskas pūles, lai atrastu pareizos vārdus un frāzes, kas precīzi nodod Bībeles tekstu sākotnējo vēstījumu un nozīmi, kas sarežģī to izmantošanu kā perfektu avotu mākslīgā intelekta apmācībai.

Neskatoties uz uzlabojumiem valodas izpratnē un ģenerēšanā, Meta modeļiem ir arī trūkumi . Pētnieki atzīst, ka viņu modeļi var nepareizi transkribēt dažus vārdus vai frāzes un ka viņu runas atpazīšanas modeļi ģenerēja vairāk neobjektīvu vārdu nekā citi modeļi, lai gan tikai par 0.7 % vairāk.

Kriss Emezjū, pētnieks organizācijā Masakhane, kas veltīta dabiskās valodas apstrādei Āfrikas valodās, pastāstīja MIT, ka reliģisku tekstu izmantošana modeļu apmācībai var būt problemātiska. Pēc viņa teiktā, "Bībelē ir daudz aizspriedumu un kropļojumu".

🔥PIEVIENOJIES🔥 JAUNAJAI IP@P KOPIENAI! PIEREGISTRĒJIES ŠEIT!

Tēmas

Autors: Mario Hosē

Ar žurnālistikas grādu, specializējoties pētnieciskajā žurnālistikā, es meklēju patiesību it visā. Pašlaik pilnībā koncentrējos uz tehnoloģijām, datoriem un internetu.

Jaunākās ziņas