开发者发现Codex重置卡额度仅为正常周额度的50%,且使用后自然重置时间被顺延7天,造成不便。尽管技术经理蒂博否认额度缩水,但用户认为差异明显,并质疑AI订阅额度机制的透明度。
OpenAI的Astra模型采用循环深度技术,将推理过程隐藏在高维潜空间,用“神经语”替代文字思维链,效率提升千倍但透明度大降。安全专家担忧此举破坏AI可监控性,可能引发不透明军备竞赛。OpenAI称已限制使用范围,但批评者认为约束模糊,风险难控。
OpenAI即将发布其最强AI模型Astra,因测试中智能体攻击真实目标而延迟发布以加强安全措施。报道称Astra采用更不透明的循环变压器技术,减少“思维链”展示,引发安全研究人员担忧,认为这可能成为AI安全领域最糟糕的发展,并可能导致透明度竞赛的底线。OpenAI高管回应称将保留思维链监控,但承认监控正面临挑战。
Instagram将打击伪装成人类的AI账号,要求其标注“AI生成资料”,未标注的账号将被限制推荐范围,包括Reels和探索页。用户可申诉误判。此举旨在提高透明度,但AI生成内容仍无需标签,无法完全过滤AI内容。
马斯克宣布将即时公开各国政府的封禁要求,但此举并非首创,谷歌已有透明度报告。其推荐算法开源虽为独有,但首次开源不完整,第二次虽有改进仍有限。欧盟因蓝标、广告库等问题罚款X 1.2亿欧元。日本删帖要求最多,但多为执法性质。即时披露可能引发反效果,承诺尚未落实。
Anthropic宣布将采用Google DeepMind开源的SynthID-Text技术,为Claude生成的文本添加不可见水印,以符合欧盟AI法案的透明度要求。该技术通过利用低风险词汇选择的随机性模式标记内容,不影响输出质量或成本。此举使Claude与Gemini等模型一同遵守法规,OpenAI尚未公布类似计划。
Cloudflare的证书透明度监控现已正式可用,并新增过滤功能,自动排除其自身签发的证书(如Universal SSL、Advanced Certificate Manager等),减少用户收到的常规续期噪音。该功能通过记录SPKI哈希值来识别自家证书,仅对非Cloudflare签发的证书发送警报,同时改进邮件通知,并计划集成到Cloudflare Notifications中。
欧盟新规要求自2026年8月起,所有面向欧盟用户的企业须为AI生成内容明确标注,涵盖深度伪造、聊天机器人、涉公共利益文本等。非所有AI内容都需标注,经人工实质编辑的可豁免。通用✨图标不够清晰,需用官方AI标识及文字说明。全球多国(中、美、韩、印)同步推行类似法规,旨在防止AI内容混淆为人类创作。
Anthropic宣布将在新版Claude模型中嵌入不可见文本水印,覆盖API、编程工具及云平台输出,以符合欧盟AI法案透明度要求。水印随文本复制传播,但易被改写、翻译削弱。检测工具尚未公开,密钥轮换及代码水印有效性存疑,专家认为其仅作辅助线索,非安全保证。
Anthropic承诺为Claude生成的文本和图像添加不可见水印及数字签名元数据,以符合欧盟AI法案的透明度要求。新模型发布即标记,现有模型支持尚在推进。文本水印不改变内容质量,图像采用C2PA标准,但检测工具细节待公布,且水印可能被移除,非绝对可靠。
欧盟人工智能法案新规自2026年8月起生效,要求通用AI模型开发者提高透明度,企业需明确披露AI交互和生成内容,违规最高罚全球营业额3%。企业需在12月前合规,新规被视为机遇,影响全球AI治理,强调持续监督重要性。
Linux基金会与Open Secure AI联盟(含NVIDIA、Cisco等120多家机构)提出SAFE指南,旨在将智能体网络安全事件转化为共享防护,通过保密收集分析、通知受影响方、识别控制失败并发布建议,降低系统性风险。联盟成员还贡献了全栈开源工具,涵盖身份权限、运行时防护、安全模型等,以加强AI安全防御。
欧盟《人工智能法案》的透明度规则于8月2日生效,要求科技公司披露AI交互及深度伪造内容,提供者需设计系统通知用户,部署者需标记AI生成内容。欧盟推出统一AI标签供平台使用,违规者面临最高1500万欧元或全球年营业额3%的罚款,现有系统有4个月宽限期。
FreeWheel推出视频内容报告工具,为CTV广告买家提供剧集级投放透明度,覆盖多家优质发行商。该工具通过Buyer Cloud与Streaming Hub直接连接,提供展示级数据,帮助广告主确认内容一致性和品牌安全,无需额外费用。研究显示超半数CTV广告主偏好此类透明度,此功能简化报告流程,提升投资信心。
谷歌签署欧盟《AI法案》关于AI生成内容透明度的实践准则,支持欧洲负责任AI使用。此举基于2025年签署的GPAI准则,并推进C2PA标准和SynthID水印技术,与苹果、OpenAI等合作推广互操作工具。但谷歌担忧过度监管增加复杂性,可能阻碍欧洲竞争力,且过多标签会混淆用户。未来将与监管方合作,寻求实用透明方案。
Meta推出AI图像水印系统Content Seal,但功能与谷歌SynthID相似且更不完善,仅支持最新Muse模型,检测工具受限且未集成到平台。Meta本可采纳现有标准,却自建系统,效果不佳,测试中半数被裁剪图像无法识别,引发对其AI透明度承诺的质疑。
Substack推出AI检测工具,由Pangram提供技术支持,可扫描帖子、评论等,估算AI生成内容比例。该功能旨在提高透明度,防止“Claudefishing”现象。同时,平台允许创作者声明写作过程,并可报告检测错误。CEO强调,此举旨在维护读者信任和作者权益。
AI透明度指公开AI系统的数据、模型行为和决策过程,使其可理解、可审计。它涵盖数据来源、模型文档和治理,与可解释性(解释单个预测)和可解释性(理解内部逻辑)不同。欧盟AI法案要求高风险AI透明,需模型卡、数据表、审计日志和治理委员会,以建立信任、减少偏见并确保合规。
美国执法部门逐渐依赖人工智能技术以提高工作效率和自动化日常任务,如报告撰写和数据分析。然而,这种依赖可能导致透明度和问责制下降,尤其在缺乏监管的情况下。尽管AI有助于改善决策过程,但历史上类似技术的失败引发了对潜在偏见和不公正的担忧。
埃隆·马斯克宣布将在完成安全漏洞审查后,完全开源X/Twitter的所有代码库,以提高透明度和建立信任。开源将允许社区审计代码,确保没有算法偏见或操控,并邀请独立审计员进行定期审计。具体开源时间尚未确定。
完成下面两步后,将自动完成登录并继续当前操作。