一個由60個組織組成的聯盟於9月21日宣布,希望讓使用當今AI系統支援不足語言的人,能以自己的語言和聲音使用這些工具。蓋茲基金會估計這一群體約有34億人,並為這項行動設定五年期限。Google、Anthropic和OpenAI Foundation均為簽署方,其他簽署方還包括在地研究機構和社群組織。 聯盟公告。
眼前的變化是,各方同意協調語言近用工作。這個數字描述的是目標規模,而非已經觸及的人數。首批進度報告出爐時,這項區別將十分重要:翻譯介面與能理解使用者實際問題的服務,是兩項不同的成果。
聯盟需要建置什麼
簽署方提出共享語言資料、評估進度,並開發可供其他建置者使用的模型和應用程式。隱私、同意以及社群對資料的控制權,也是所述做法的一部分。公告表示,聯盟的詳細治理機制和工作項目將在未來一年內制定。 所作承諾。
獨立報導以異常直接的方式承認了起點所面臨的問題。Anthropic的Elizabeth Kelly告訴美聯社,該公司的產品在許多非洲語言上的表現不佳。美聯社也報導,將由一個秘書處追蹤參與方的承諾。隨著聯盟從簽署協議走向實際交付,這些都是值得關注的事項。 美聯社的報導。
我們的評估是,實際檢驗標準應是能否完成一項任務。一個人能否用日常說話方式提問、理解回答並修正誤解?即使書面翻譯得分亮眼,也仍會有一部分檢驗沒有得到解答。一份有用的公開報告應將語音辨識與最終回答的準確性和實用性分開呈現。
模型實驗室之外已在進行的工作
Project Vaani顯示了蒐集相關資料涉及哪些工作。該專案由印度科學研究所和ARTPARK營運,並獲Google資助,目標是在印度各地區蒐集超過15萬小時的語音。其公開資訊儀表板目前列出約31,278小時和105種語言。計畫總量不應與已錄製的總量混為一談。 Project Vaani。
該專案表示,其資料蒐集旨在反映年齡、性別、教育程度以及都市或鄉村所在地等差異。這向開發者提出一個比「產品選單中是否列有某種語言」更嚴格的問題:在使用這種語言的人群中,產品學會辨識的是誰的說話方式?
錄音的所有權是另一個問題。Mozilla在5月的一次更新中介紹了Mozilla Data Collective的一項存取申請功能,上傳者可藉此核准誰能取得其資料集。該平台也允許提供者明確指定其材料可如何使用。Mozilla Data Collective也是該聯盟的簽署方之一。 Mozilla平台更新,資料集存取條款。
對提供錄音的社群而言,是否允許存取是一項具體決定。專案可以詢問誰將收到這些錄音、是否允許商業使用,以及申訴將如何處理。這些問題應在蒐集開始前確定。把資料集稱為開放資料,並不能取代向其中聲音的主人說明其授權條款。

公共服務和企業將出現哪些變化
對評估AI服務的組織而言,這提供了在擴大應用前先進行在地測試的理由。我們建議從範圍有限的例行任務著手,並從目標使用者中招募能流利使用相關語言的人來評估回答。記錄失敗時應和記錄成功一樣仔細。測試應納入在地用語,以及人們在不同語言間切換的常見方式,而非只測試為展示精心撰寫的句子。
服務還需要提供明確途徑,讓使用者能退出未能奏效的自動對話。無法獲得準確回答的人應能聯絡真人服務,或使用其他管道。聯盟最終取得的進展也應與這些備援安排一併評估,尤其是在誤解會影響基本服務近用的情況下。
在這項行動之前,蓋茲基金會於9月14日宣布,計畫在兩年內投入至少10億美元,用於促進公平近用AI。這是一項範圍更廣的資助承諾;有關語言的公告並未表示全部款項都屬於這個聯盟。 另一項資助公告。
接下來應尋找的證據非常具體:明確列出的語言、有在地參與者參加的公開評估、可用的資料集,以及實際運作的服務。這些證據將顯示,這項協議是否正讓那些迄今幾乎沒有理由依賴AI的人也能從中受益。



