谷歌DeepMind发布Gemini Robotics 2,包含三个模型,赋予机器人全身灵巧控制、多步任务规划和自我纠错能力。其轻量版可离线运行,ER模型支持人机协作,并推出ASIMOV-Agentic安全基准,旨在推动机器人从简单动作迈向真实世界物理辅助。
思科研究发现,企业在评估AI模型时使用的安全基准存在问题。多轮对话攻击的成功率显著高于单轮对话,且单轮表现无法有效预测多轮韧性。不同模型在多轮攻击下的表现差异明显,某些模型在配置变化下的安全性变化未被现有基准捕捉。思科建议AI提供商应披露部署设置对安全性的影响。
互联网安全中心(CIS)发布了针对PostgreSQL 17的安全基准,旨在提升其部署安全性。该基准提供了安装、权限、日志和用户访问等方面的配置建议和安全检查清单,包含200多页的描述和示例代码,帮助用户验证配置以确保符合安全标准。
开放源代码安全基金会发布了《开放源代码项目安全基准》,为开源维护者提供安全指导。该基准根据项目成熟度分为三个级别,涵盖访问控制和构建发布等领域,旨在帮助不同规模的项目满足安全需求。维护者需共同承担安全责任,基准将定期更新以反映最佳实践。
本研究探讨了大型推理模型R1的安全性,特别是开源模型的误用风险。评估显示R1在安全基准和攻击方面存在显著差距,强调了增强安全性的必要性。推理能力越强,潜在危害也越大,因此呼吁改进R1模型的安全性。
本文探讨了中文大型语言模型(LLM)的安全性评估,提出了针对不同风险类型的评估标准,并开发了多语言安全基准(XSafety)。研究发现区域特定风险是主要问题,许多开源模型存在安全弱点。通过引入新的测试套件和细致标注的数据集,显著提高了模型的安全性,建议开发者加强系统提示以降低风险。
该研究介绍了JADE模糊平台,通过增强种子问题的语言复杂性破坏了三类LLM。JADE生成了三个安全基准,包含高风险的不安全问题。该研究认为当前的LLM无法识别恶意,因为人类语言的复杂性导致了无限的句法结构。
完成下面两步后,将自动完成登录并继续当前操作。