Isang koalisyon ng 60 organisasyon ang nagpahayag noong Setyembre 21 na nais nitong magamit ng mga taong nagsasalita ng mga wikang hindi gaanong napaglilingkuran ng mga kasalukuyang sistema ng AI ang mga kasangkapang iyon sa sarili nilang wika at boses. Tinataya ng Gates Foundation na 3.4 bilyon ang populasyong ito at nagtakda ito ng limang taon para sa pagsisikap na ito. Kabilang sa mga lumagda ang Google, Anthropic at OpenAI Foundation, kasama ang mga lokal na organisasyon sa pananaliksik at mga organisasyong pangkomunidad. Anunsiyo ng koalisyon.
Ang agarang pagbabago ay isang kasunduang pag-ugnayin ang mga gawain para sa akses sa pamamagitan ng wika. Inilalarawan ng bilang ang ambisyon, hindi ang mga taong naabot na. Magiging mahalaga ang pagkakaibang iyon kapag dumating ang mga unang ulat ng pag-unlad: magkaibang tagumpay ang isang isinaling interface at isang serbisyong nakauunawa sa aktuwal na tanong ng isang tao.
Ano ang kailangang buuin ng koalisyon
Iminumungkahi ng mga lumagda ang pinagsasaluhang datos sa wika, mga pagtatasa ng pag-unlad, at mga modelo at application na magagamit ng ibang tagabuo. Bahagi ng ipinahayag na pamamaraan ang pagkapribado, pahintulot at kontrol ng komunidad sa datos. Ayon sa anunsiyo, bubuuin pa sa darating na taon ang detalyadong pamamahala at mga larangan ng gawain ng koalisyon. Ang mga ipinahayag na pangako.
Naglahad ang independiyenteng pag-uulat ng isang pambihirang tuwirang pag-amin tungkol sa panimulang kalagayan. Sinabi ni Elizabeth Kelly ng Anthropic sa Associated Press na hindi mahusay ang pagganap ng mga produkto nito sa maraming wikang Aprikano. Iniulat din ng AP na susubaybayan ng isang sekretaryat ang mga pangako ng mga kalahok. Kapaki-pakinabang na bantayan ang mga ito habang lumilipat ang koalisyon mula sa paglagda tungo sa pagtupad. Pag-uulat ng AP.
Sa aming pagtatasa, ang praktikal na pagsubok ay dapat na isang natapos na gawain. Kaya bang magtanong ng isang tao sa karaniwan niyang paraan ng pagsasalita, unawain ang sagot at itama ang maling pagkaunawa? Kahit kahanga-hanga ang marka sa nakasulat na pagsasalin, may bahagi pa rin ng pagsubok na iyon na hindi masasagot. Sa isang kapaki-pakinabang na pampublikong ulat, hiwalay na susuriin ang pagkilala sa pananalita at ang katumpakan at pakinabang ng sagot na ibibigay sa huli.
Ang gawaing isinasagawa na sa labas ng mga laboratoryo ng mga modelo
Ipinapakita ng Project Vaani kung ano ang kailangan sa pangangalap ng angkop na datos. Pinamamahalaan ito ng Indian Institute of Science at ARTPARK sa pagpopondo ng Google, at layunin nitong mangalap ng mahigit 150,000 oras ng pananalita mula sa mga distrito sa buong India. Kasalukuyang nakatala sa pampublikong dashboard nito ang humigit-kumulang 31,278 oras at 105 wika. Hindi dapat mapagkamalan na magkapareho ang planong kabuuan at ang naitalang kabuuan. Project Vaani.
Ayon sa proyekto, nilalayon ng koleksiyon nito na katawanin ang mga pagkakaiba, kabilang ang edad, kasarian, edukasyon at lokasyon sa lungsod o kanayunan. Naghaharap ito sa mga developer ng mas mahirap na tanong kaysa sa kung may nakalistang wika sa menu ng kanilang produkto: kaninong pananalita sa loob ng wikang iyon ang natutuhan nitong kilalanin?
Isa pang bahagi ng problema ang pagmamay-ari ng mga recording. Sa isang update noong Mayo, inilarawan ng Mozilla ang isang tampok sa Mozilla Data Collective para sa paghiling ng akses na nagbibigay-daan sa mga nag-a-upload na aprubahan kung sino ang makatatanggap ng kanilang mga dataset. Pinahihintulutan din ng platform nito ang mga tagapagbigay na tukuyin kung paano maaaring gamitin ang kanilang materyal. Kabilang sa mga lumagda sa koalisyon ang Mozilla Data Collective. Update sa platform ng Mozilla, mga tuntunin sa akses sa dataset.
Para sa isang komunidad na nag-aambag ng mga recording, ang akses ay isang kongkretong pagpapasya. Maaaring itanong ng isang proyekto kung sino ang makatatanggap ng mga ito, kung pinahihintulutan ang komersiyal na paggamit at kung paano haharapin ang isang reklamo. Dapat malinawan ang mga tanong na iyon bago magsimula ang pangangalap. Hindi pamalit ang pagtawag sa isang dataset na bukas sa pagpapaliwanag ng lisensiya nito sa mga taong may boses na nakapaloob dito.

Ano ang magbabago para sa mga pampublikong serbisyo at negosyo
Para sa mga organisasyong nagsusuri ng mga serbisyo ng AI, nagbibigay ito ng dahilan upang magsagawa muna ng lokal na pagsubok bago magpalawak. Inirerekomenda naming magsimula sa isang karaniwang gawain na may makitid na saklaw at kumuha ng mga bihasang tagapagsalita mula sa mga nilalayong gumamit upang tasahin ang mga sagot. Itala ang mga pagkabigo nang kasing-ingat ng mga tagumpay. Isama ang mga lokal na termino at karaniwang paraan ng pagpapalit-palit ng wika ng mga tao, sa halip na subukan lamang ang mga pinakinis na pangungusap na isinulat para sa isang demonstrasyon.
Kailangan din ng isang serbisyo ang malinaw na paraan upang makaalis sa isang hindi matagumpay na awtomatikong pag-uusap. Dapat makausap ang isang tao o makagamit ng ibang daluyan ang sinumang hindi makakuha ng tumpak na sagot. Dapat tasahin ang magiging pag-unlad ng koalisyon kasabay ng mga alternatibong kaayusang iyon, lalo na kung nakaaapekto ang maling pagkaunawa sa akses sa isang mahalagang serbisyo.
Dumating ang pagsisikap na ito matapos ipahayag ng Gates Foundation noong Setyembre 14 ang mga planong gumastos ng hindi bababa sa $1 bilyon sa loob ng dalawang taon para sa makatarungang akses sa AI. Mas malawak na pangako sa pagpopondo iyon; hindi sinasabi sa anunsiyo tungkol sa wika na nakalaan sa koalisyong ito ang buong halaga. Ang hiwalay na anunsiyo sa pagpopondo.
Tiyak ang susunod na ebidensiyang dapat hanapin: mga tinukoy na wika, mga inilathalang pagsusuri na may mga lokal na kalahok, mga dataset na magagamit at mga serbisyong gumagana. Ipapakita ng mga iyon kung ginagawa ng kasunduan na kapaki-pakinabang ang AI para sa mga taong kakaunti pa lamang ang dahilan upang umasa rito hanggang ngayon.



