Prema saopštenju, u koaliciji učestvuje ukupno 60 partnera - vodeće AI kompanije, korporacije, filantropske organizacije i drugi akteri koji već rade na proširenju broja jezika dostupnih u AI tehnologijama. Cilj inicijative je da tokom narednih pet godina, boljom koordinacijom postojećih napora, obuhvati više od tri milijarde ljudi, prenosi Asošiejted pres.

Izvršni direktor Gejtsove fondacije Mark Suzman izjavio je za AP da ovaj posao mora da se nastavi punom brzinom, uprkos tome što pojedine najveće AI kompanije pozivaju na usporavanje razvoja naprednih modela. Dodao je da vlade treba da regulišu uticaj AI tehnologije na sajber-bezbednost i razvoj dece, dok se istovremeno njena humanitarna primena širi na siromašne zajednice koje su trenutno "isključene" iz te tehnologije.

Suzman je naglasio da bi izgradnja reprezentativnih jezičkih baza podataka bila neophodna čak i kada razvoj AI ne bi dalje napredovao, mada je istakao da to ne očekuje niti to zagovara.

Detalji upravljanja koalicijom, uključujući nadzor nad obavezama potpisnika, prema njegovim rečima, još uvek se usaglašavaju.

Saradnja je najavljena nedelju dana nakon objavljivanja godišnjeg izveštaja, u kojem je fondacija najavila ulaganje od milijardu dolara u AI projekte usmerene na unapređenje zdravstvenih ishoda, obrazovnih alata i poljoprivrednih praksi malih poljoprivrednika širom sveta.

U izveštaju se upozorava da nereprezentativni jezički podaci mogu dovesti do pogrešnog prevoda, poput slučaja trudnice iz Malavija čija bi izjava da joj je pukao vodenjak mogla biti pogrešno prevedena na engleski jezik.

Izvršna direktorka Mozilla Data Collective, E. M. Luis-Džong , čija je kompanija podružnica Mozilla.org, ocenila je da je "prvobitni greh" AI tehnologije to što su mnogi alati trenirani na jezičkim podacima prikupljenim sa interneta, koji ne predstavlja reprezentativan uzorak ljudske komunikacije.

Google, kao jedan od članova koalicije, već finansira projekat prikupljanja govornih zapisa u Indiji, poznat kao Project Vaani, u okviru kog je do sada sakupljeno više od 150.000 sati audio zapisa iz svih indijskih okruga. Potpredsednik kompanije Džejms Manjika naveo je da projekat pokazuje potrebu za prikupljanjem podataka o dijalektima unutar pojedinačnih jezika.

Iz Anthropica, čiji je izvršni direktor ranije pozivao na saradnju u okviru industrije radi usporavanja razvoja AI modela, saopšteno je da kompanija već sarađuje sa fondacijom na ubrzanju razvoja vakcina i proširenju baze podataka o lokalnim poljoprivrednim kulturama. 

Elizabet Keli, koja u Anthropicu rukovodi odeljenjem za korisnu primenu tehnologije, priznala je da proizvodi kompanije zaostaju u pogledu podrške mnogim afričkim jezicima.