一个由60家组织组成的联盟于9月21日宣布,希望让使用当今人工智能系统支持不足的语言的人,能够以自己的语言和声音使用这些工具。盖茨基金会估计这一群体约有34亿人,并为这项行动设定了五年期限。谷歌、Anthropic和OpenAI Foundation均为签署方,其他签署方还包括本地研究机构和社区组织。 联盟公告。

眼下的变化是,各方同意协调推进语言可及性工作。这个数字描述的是目标规模,而不是已经覆盖的人数。首批进展报告发布时,这一区别将十分重要:翻译界面与能够理解用户实际问题的服务,是两项不同的成果。

联盟需要建设什么

签署方提出共享语言数据、评估进展,并开发可供其他建设者使用的模型和应用程序。隐私、同意以及社区对数据的控制权,也是所述方法的一部分。公告称,联盟的详细治理机制和工作方向将在未来一年内制定。 所作承诺。

独立报道以不同寻常的直率方式承认了起点所面临的问题。Anthropic的Elizabeth Kelly告诉美联社,该公司的产品在许多非洲语言上的表现不佳。美联社还报道称,将由一个秘书处跟踪参与方的承诺。随着联盟从签署协议转向实际交付,这些都是值得关注的事项。 美联社的报道。

我们的判断是,实际检验标准应当是能否完成一项任务。一个人能否用日常说话方式提问、理解回答并纠正误解?即使书面翻译得分亮眼,也仍会有一部分检验没有得到回答。一份有用的公开报告应当把语音识别与最终回答的准确性和实用性区分开来。

模型实验室之外已经开展的工作

Project Vaani展示了收集相关数据涉及哪些工作。该项目由印度科学研究所和ARTPARK运营,并获得谷歌资助,目标是在印度各地区收集超过15万小时的语音。其公共信息面板目前列出约31,278小时和105种语言。计划总量不应与已经录制的总量混为一谈。 Project Vaani。

该项目表示,其数据收集旨在反映年龄、性别、教育程度以及城市或农村所在地等差异。这给开发者提出了一个比“产品菜单中是否列有某种语言”更严格的问题:在使用这种语言的人群中,产品学会识别的是谁的说话方式?

录音的所有权是另一个问题。Mozilla在5月的一次更新中介绍了Mozilla Data Collective的一项访问申请功能,上传者可以借此批准谁能获得其数据集。该平台还允许提供方明确其材料可如何使用。Mozilla Data Collective也是该联盟的签署方之一。 Mozilla平台更新,数据集访问条款。

对于提供录音的社区而言,是否允许访问是一项具体决定。项目可以询问谁将收到这些录音、是否允许商业使用,以及投诉将如何处理。这些问题应在收集开始之前确定。把数据集称为开放数据,并不能替代向其中声音的主人解释其许可条款。

Conceptual sequence: a speaker gives consent to recording, waveform data are collected, one reviewer examines a tablet on a stand, and a person uses a phone service.
From permission to data, local evaluation and a usable service: a conceptual workflow, not the coalition's implemented system. AI-generated illustration · BIG CHANGE.

公共服务和企业将发生什么变化

对于评估人工智能服务的组织而言,这提供了一个在扩大应用前先进行本地测试的理由。我们的建议是,从范围有限的常规任务入手,并从目标用户群体中招募能流利使用相关语言的人来评估回答。记录失败时应当像记录成功一样仔细。测试应包含本地用语以及人们在不同语言之间切换的常见方式,而不应只测试为演示精心编写的句子。

服务还需要提供一条明确途径,让用户能够退出未能奏效的自动对话。无法获得准确回答的人应当能够联系人工服务,或使用其他渠道。联盟最终取得的进展也应结合这些备用安排来评估,尤其是在误解会影响基本服务使用机会的情况下。

在这项行动之前,盖茨基金会于9月14日宣布,计划在两年内投入至少10亿美元,用于促进公平使用人工智能。这是一项范围更广的资助承诺;有关语言的公告并未表示全部资金都属于这个联盟。 另一项资助公告。

接下来应寻找的证据非常具体:明确列出的语言、有本地参与者参加的公开评估、可用的数据集,以及实际运行的服务。这些证据将表明,这项协议是否正在让那些迄今几乎没有理由依赖人工智能的人也能从中受益。