一年之后:主权AI与选择权之争
内容提要
Cloudflare在生日周宣布将欧洲开源大模型EuroLLM和Apertus引入Workers AI。EuroLLM支持35种语言,包括全部24种欧盟官方语言;Apertus由瑞士公共机构开发,训练覆盖1500多种语言。Cloudflare还推出面向政府网络安全机构和关键基础设施运营商的实操研讨会,帮助构建不依赖单一模型的AI防御体系,首场10月在新加坡举行。
延伸解读
欧洲开源模型的双重价值
EuroLLM和Apertus均由欧洲公共机构开发,前者覆盖全部24种欧盟官方语言,后者训练数据涵盖1500多种语言且40%为非英语。它们不仅服务于语言多样性,更强调训练过程符合欧盟AI法案和GDPR,如尊重数据退出、去除个人数据。这为需要合规且多语言支持的开发者提供了替代选择,尤其适合公共服务场景。
从国家模型到实际应用
过去一年,亚太地区的学生、创业者和公务员基于Workers AI上的国家模型开发了实用工具。例如印度的Form Mitra用22种语言语音引导填表,新加坡的MedBridge帮助护士用14种语言沟通,日本的Anshin Concierge一键连接公共服务。这些案例表明,开源模型能快速转化为解决本地化问题的应用,降低技术门槛。
不依赖单一模型的AI防御
Cloudflare的安全团队构建了一个编排层,可协调多个AI模型并行寻找漏洞、验证发现并优先处理威胁。该框架开源,支持任何模型,因此即使失去对某一提供商的访问,防御也不会中断。这回应了政府对模型访问受限的担忧,并已转化为面向政府机构和关键基础设施运营商的实操研讨会,首场10月在新加坡举行。
Q&A
Cloudflare 在生日周宣布了哪些欧洲开源大模型?
Cloudflare 宣布将欧洲开源大模型 EuroLLM 和 Apertus 引入 Workers AI。EuroLLM 支持 35 种语言,包括全部 24 种欧盟官方语言;Apertus 由瑞士公共机构开发,训练覆盖 1500 多种语言。
EuroLLM 和 Apertus 分别有什么特点?
EuroLLM 支持 35 种语言,包括所有 24 种欧盟官方语言,由欧洲多所大学和研究机构联合开发,在欧盟多语言基准测试和机器翻译上表现优于同类模型。Apertus 是瑞士首个大规模完全开源多语言模型,训练数据超过 15 万亿 token,覆盖 1500 多种语言,40% 训练数据非英语,架构、权重、数据和方法全部公开,设计时考虑了欧盟 AI 法案和 GDPR。
Cloudflare 为政府机构推出了什么新项目?
Cloudflare 推出面向政府网络安全机构和关键基础设施运营商的实操研讨会,帮助构建不依赖单一模型的 AI 防御体系。参与者可以构建自己的 AI 安全工具链和分层防御,模块可即插即用,首场研讨会于 10 月在新加坡国际网络周举行。
过去一年,亚太地区基于这些开源模型有哪些实际应用案例?
有三个典型案例:印度的 Form Mitra 帮助低识字率或视障公民用 22 种印度语言填写政府表格;新加坡的 MedBridge 帮助护士用 14 种语言(包括福建话和粤语)与老年患者沟通;日本的 Anshin Concierge 让老年人用自然语言描述问题,一键连接到东京都政府的正确支持部门。
Cloudflare 如何构建不依赖单一模型的 AI 防御体系?
Cloudflare 的安全团队构建了一个编排层(harness),协调多个 AI 模型并行工作,以寻找漏洞、验证发现并优先处理威胁。该工具链可与任何模型(闭源或开源)配合使用,并已开源,任何组织都可以用自己选择的模型运行。此外,还发布了分层架构,防止攻击者利用前沿模型发现漏洞。
Cloudflare 对 AI 主权和选择权的核心观点是什么?
Cloudflare 认为 AI 主权不是零和游戏,选择权才是实现 AI 主权和安全的路径。他们主张通过开源标准防止供应商锁定,提供免费起步的服务,并在全球 125 多个国家的 335 个城市部署网络(其中 230 多个城市有用于 AI 推理的 GPU),以确保任何国家都不必依赖单一公司获取 AI 能力。