非洲的人工智能热潮如何让1亿残障公民掉队
要点速览
- •超过1亿非洲人患有残障,然而这片大陆的手语、语音口音和街道布局在全球人工智能模型中基本缺失,而这些模型正日益塑造日常生活。
- •一项由AI4D委托开展、覆盖加纳、肯尼亚和卢旺达并涉及585余名参与者的2025年范围综述研究发现,残障人士在人工智能训练数据集中代表性不足,而现有残障数据零散且缺乏梳理。
- •HAIDI由加纳KNUST的负责任人工智能实验室托管,将作为包容性人工智能的泛非枢纽;ADDN则作为协调与发现网络,连接数据使用者与数据集持有者,而非集中存储数据。
- •HAIDI第一年的优先事项包括覆盖全非的残障数据集清查与梳理,以及开发三个聚焦非洲的数据集,涵盖手语、心理与性和生殖健康以及包容性就业。
- •与发布同步,该联盟宣布了一项为期18个月的支持计划,面向三家为残障人士构建人工智能解决方案的初创企业,提供最高500万肯尼亚先令(38,600美元)的资助以及技术支持和测试机会。

超过1亿非洲人患有残障,然而这片大陆的手语、语音口音和街道布局在全球人工智能模型中几乎完全缺失,而这些模型正日益塑造着日常生活。一个新的泛非联盟——人工智能与残障包容中心(HAIDI)和非洲残障数据网络(ADDN)——正致力于构建所需的数据基础设施,以填补研究人员所称的人工智能“残障数据荒漠”。TechCabal的John Adoyi对这一举措进行了报道。
当尼日利亚东南部埃努古的中学教师Francis Elendu外出时,他会带上手机和导盲杖。“我的导盲杖是我出行最好的工具,”他说。“我用手机上的一些应用,比如Envision AI和Seeing AI,来查看道路上导盲杖无法探测到的电线杆和高处的物体。”
然而,这项技术并不总能理解他周围的环境。导航应用在尼日利亚的街道上可能失灵,因为当地环境与这些应用所针对的场景大相径庭。
“我不知道他们开发这些应用时,是否考虑过美国和欧洲以外的地方,因为这些应用有时会把看到的东西识别得完全不同,”Elendu说。
他的经历反映的问题远不止一个用户的困扰。根据世界卫生组织(WHO)2022年《残障人士健康公平全球报告》,在构成世卫组织非洲区域的47个国家中,超过八分之一的人患有严重残障。
一项由“人工智能促进发展”(AI4D)委托开展、考察加纳、肯尼亚和卢旺达并涵盖585余名参与者的2025年范围综述研究发现,残障人士在用于训练人工智能系统的数据集中代表性不足,而现有的残障数据仍然零散且缺乏系统梳理。
这种代表性不足并非抽象问题:它体现在残障非洲人已经依赖的工具中——从误读当地街道的导航应用,到无法识别当地口音的实时字幕。
为弥补这一差距,研究人员和残障倡导者推出了HAIDI和ADDN这两项举措,旨在为整个非洲的包容性人工智能夯实数据基础。该计划得到国际发展研究中心(IDRC)、英国外交联邦与发展办公室(FCDO)和AI4D项目的支持,并在内罗毕全球数据节上发布,合作伙伴包括加纳夸梅·恩克鲁玛科技大学(KNUST)的负责任人工智能实验室(RAIL)、Next Step Foundation、残障辅助技术信托(AT4D)以及马塞诺大学应用人工智能中心(MCAAI)。
“每一个人工智能系统都始于数据,”Next Step Foundation人工智能主管Christopher Harrison说。“关键问题在于,这些数据是否反映了最终将受到该技术影响的人群的多样性。当残障人士在数据集中缺席时,他们的经历、需求和视角就有可能在由此构建的系统中被忽视。缩小这一差距不仅仅是一项技术挑战;它对构建更公平的数字未来至关重要。”
HAIDI背后的组织并非专注于开发人工智能应用,而是聚焦于包容性人工智能所需的数据基础设施。
打好基础
尽管HAIDI和ADDN同时发布,但它们扮演着不同却互补的角色。
HAIDI由KNUST的RAIL托管,是残障社群、研究人员、创新者、政策制定者和机构的泛非枢纽,共同推进包容性人工智能。其工作重点包括加强以残障为中心的数据系统、支持包容性人工智能创新、推进研究以及促进符合伦理的人工智能治理。
ADDN是在这一生态系统中运作的举措之一。它并非作为中央数据存储库运作,而是被设计为一个协调与发现网络,帮助研究人员、初创企业、政策制定者和机构找到与残障相关的数据集,并与管理这些数据集的组织建立联系。
“ADDN旨在让残障相关数据集更易发现、更易浏览,而不是把所有数据存储在一个地方,”该联盟告诉TechCabal。“对于初创企业和创新者来说,开发包容性人工智能解决方案的最大障碍之一,仅仅是不了解已存在哪些数据集以及由谁管理。”
例如,一位构建人工智能手语翻译工具的研究人员可以利用ADDN查证相关数据集是否已经存在,确定管理该数据集的机构,并根据该机构自身的治理和知情同意框架直接申请访问权限。ADDN不是将敏感残障数据的所有权转移到一个中央平台,而是在需要数据的人和已经持有数据的人之间架起桥梁,减少重复劳动,促进跨国界和跨机构的协作。
该枢纽本身将托管基准测试、治理框架和培训材料等开放资源,这些资源不像原始残障数据那样具有敏感性。
梳理非洲的残障数据
该举措的首要目标之一是回答一个基本问题:非洲已存在哪些残障数据?联盟承认自己尚不清楚。
AI4D委托的范围综述研究记录了非洲手语和本地语言数据集的明显缺口。例如,肯尼亚手语数据与美国手语相比极其有限,而涉及言语障碍的基尼亚卢旺达语语音数据在全球数据集中几乎不存在。
“正是那项研究揭示了残障数据荒漠,”该联盟表示。“它告诉我们差距存在及其原因,但它并不是对现有每个数据集的完整清查。所以不,我们还没有一个确切的数字,而弥合这一差距正是HAIDI研究议程下一步要做的事。”
下一步将从一项覆盖全非的数据清查与梳理工作开始,这是HAIDI第一年的优先事项之一。研究人员将识别手语、语音和健康等领域的残障相关数据集,记录其存储位置,并确定在语言、残障类型、地理区域和数据形态等方面存在哪些最大缺口。
然而,找到现有数据集只是问题的一部分。该联盟表示,不一致的标注格式也会使残障数据集难以合并或用于机器学习。
在开展数据梳理的同时,HAIDI将开发三个聚焦非洲的数据集,以弥补部分已确定的缺口。第一个聚焦手语,第二个聚焦心理健康以及性与生殖健康,第三个聚焦包容性就业。
该联盟表示,健康数据集最初将涉及18岁及以上的参与者,目标年龄段为18至30岁。最终可能纳入13至17岁的人群,但前提是先解决家长同意的安排问题。数据集将与领域专家和残障社群共同开发,并尽可能对个人数据进行匿名化处理。
将信任融入数据
创建新的残障数据集只是挑战的一部分。说服人们贡献自己的数据——尤其是涉及深度个人隐私的信息——需要在隐私、知情同意和治理方面提供强有力的保障。
该联盟表示,任何涉及残障人士的活动都将接受伦理审查,并获得相关机构审查委员会和国家监管机构的批准。参与者将提供知情同意,个人信息将尽可能匿名化,数据将被安全存储。
然而,匿名化并不一定能消除隐私风险。人工智能治理与数据保护专家Fola Adeleke表示,去标识化并不总能防止人们被重新识别,这取决于所收集数据的类型和规模。
“这取决于数据的规模和你收集的数据类型,”Adeleke说。“有些元数据可能无法完全匿名化。”
参与者也将有权撤回自己的数据。如果有人撤回,其数据将从已发布的数据集中删除,但联盟承认,已被下载并用于构建人工智能模型的数据很难删除。在Adeleke看来,这使得知情同意尤为重要。
“一旦数据被用于训练人工智能,在不重新训练模型的情况下撤回这些数据在技术上可能很,甚至不可能,”他说。“因此,在数据被使用之前,知情同意至关重要。”
这些治理措施体现了支撑该举措的更广泛原则:残障人士不应仅仅是数据的来源,而应作为积极的参与者,塑造数据的收集和使用方式。
代表性仍是该举措面临的最大挑战之一
HAIDI和ADDN表示,他们正与多个国家的手语创新者、残障组织和研究机构合作,以提升数据集的代表性。该举措还计划收集按性别分列的数据,并提高残障妇女和女童的参与度——由于社会污名和照护责任,她们往往被排除在研究之外。
协作模式已初具雏形。该联盟表示,已通过其泛非手语网络研讨会系列,与80多位开发手语技术的创始人建立联系,构建了一个覆盖不同非洲手语的研究人员和创新者早期网络,而不是将无障碍挑战视为特定国家的问题。
对于居住在拉各斯、有听力障碍的残障倡导者Abdulazeez Hamdallah来说,对更好的本地数据的需求在他已经使用的工具中显而易见。他依靠研究公司OpenAI开发的人工智能聊天机器人ChatGPT撰写报告和消息、整理思路并准备培训材料,同时使用会议应用Google Meet和Microsoft Teams获取实时字幕,并使用Otter.ai进行会议转录。
然而,这些工具并不总能使沟通变得更容易。Hamdallah表示,这些工具对手语的支持较差,并且在应对口音、语速过快和背景噪音时可能遇到困难。
“我曾在一些会议和场合中听不懂别人在说什么,因为实时字幕由于说话人的口音而无法正确生成字幕,”他说。“所以,有时会非常令人沮丧。”
该联盟计划中的手语数据集正是为了解决这一缺口。Hamdallah补充说,其经历被收集的人们也应参与决定数据的收集和管理方式。
“我认为这是一项非常好的重要举措,尤其是如果残障人士能够直接参与数据的收集和管理,”他说。
对于非洲残障与包容中心执行主任Yinka Olaito而言,HAIDI和ADDN等举措的推出正当其时。
“在人工智能正在成为我们所做一切的一部分的非洲,这个时机恰到好处,”Olaito说。“重要的是,我们要通过残障包容的视角来思考人工智能,否则我们将继续面临围绕语音及其他残障领域的歧视,把人们排除在本应惠及他们的技术之外。”
Olaito将这些举措描述为“一个好的起点”,并表示需要做更多工作,以确保非洲的人工智能生态系统不会复制现有的排斥模式,同时希望此次发布能引发关于残障数据在塑造这片大陆人工智能未来中所起作用的更广泛讨论。
“我们仍在应对数字无障碍、资金和基础设施方面的挑战,但这更加凸显了确保我们以包容所有人的方式利用人工智能的重要性,”他说。
从数据到应用
该联盟还希望这些数据能够转化为产品。在HAIDI和ADDN发布的同时,联盟宣布了一项为期18个月的支持计划,面向三家为残障人士构建人工智能解决方案的初创企业。
入选的初创企业将获得最高500万肯尼亚先令(38,600美元)的资助、技术和产品支持、与残障社群共同测试产品的机会,以及对接资金和合作伙伴网络的机会。该计划向从事教育、就业、心理健康、照护和辅助技术等领域的初创企业开放。
未来一年,该联盟计划建立HAIDI的治理结构、完成残障数据清查、开发三个旗舰数据集,并评估残障包容性在非洲各国人工智能战略中的体现情况。
这些交付成果——治理结构、数据清查、三个旗舰数据集以及对各国人工智能战略的评估——将是衡量残障数据荒漠是否开始被填补的首批具体标志。
该举措最终成效,将取决于研究人员、政府和开发者能否利用这些数据构建更好地反映残障人士生活的人工智能系统。
“HAIDI和ADDN展示了协作在推动包容性创新方面的力量,”残障辅助技术信托(AT4D)创始人兼首席执行官Bernard Chiira说。“通过汇聚残障社群、研究人员、技术合作伙伴和政策制定者,我们正在创建构建惠及所有人的人工智能系统所需的数据和伙伴关系。这是确保残障人士不仅在人工智能的未来中得到体现、而且参与塑造这一未来的重要一步。”