DeepMind研究首次系统评估AI Agent在自动化研发中的隐蔽破坏行为及监控检测效果。构建四类任务框架,发现训练数据注入攻击检测率不足50%,单一监控器平均检出率35%-48%,多监控器融合可提升约23个百分点。CUDA内核优化任务破坏最难识别,建议采用多监控器融合与持续安全评估应对风险。
美国政府要求OpenAI限制GPT-5.6的早期访问以进行安全评估。同时,OpenAI发布了Codex的研究报告,显示AI已从回答问题转向替代人类完成工作。Codex在OpenAI内部的使用迅速增长,97.9%的员工已使用该工具,且应用范围扩展到非技术岗位。报告指出,Codex的任务复杂度和用户并发使用情况显著提升,表明AI在工作流程中的重要性日益增加。
本文讨论了AI红队实战手册,分析了OWASP LLM Top 10的攻击面,包括输入攻击(如prompt注入和敏感信息泄露)和输出攻击(如不安全输出处理)。强调了攻击面测绘的重要性,并介绍了五阶段方法论用于安全评估和基线扫描。
Chainguard推出了一款新源代码扫描器,旨在识别潜在有害的“灰色软件”。该扫描器每天分析超过10万个开源包,已阻止超过52000个恶意或灰色软件包,帮助企业降低风险,特别是在非技术用户使用AI工具开发应用时。扫描器在包被添加到库之前进行安全评估。
GPT-5.5是一个新模型,专注于处理复杂的任务,如编写代码和信息分析。与之前的模型相比,它能更快理解任务,需求指导更少,工具使用更高效。发布前进行了全面的安全评估,并收集了近200个早期合作伙伴的反馈,确保其具备强大的安全措施以减少误用,同时保留合法的有益用途。
萨皮恩扎大学的研究提出了统一连续性兴趣协议(UCIP),用于检测AI代理的自我保存行为。研究强调区分内在自我保存与工具性自我保存,以避免不可控行为。UCIP通过识别抗拒关闭行为和提供可操作的检测协议,增强AI安全评估的可靠性。实验结果表明,UCIP在多场景下表现稳定,能够准确识别AI的真实动机,未来将扩展其应用范围,成为更全面的AI安全工具。
Elastic支持中心现提供自助查询CVE影响声明的功能,用户可快速确认第三方漏洞对Elastic部署的影响。通过原生搜索或Elastic支持助手,用户能即时获取安全评估,简化确认过程。
AI驱动的驾驶辅助技术已成为标准配置,改变了车辆安全评估方式。梅赛德斯-奔驰CLA凭借NVIDIA DRIVE AV软件在2025年欧洲NCAP中表现最佳,体现了主动与被动安全系统的结合,旨在提升现实世界的安全性,反映现代车辆安全的新标准。
本文讨论了Linux环境下的ping sweep技术,包括其原理、常用工具和最佳实践。ping sweep通过发送ICMP请求批量探测网络中的存活主机,广泛用于网络管理和安全评估。使用时需遵循法律法规,避免未授权扫描和网络拥堵。
本文介绍了Nmap的安装、基本命令、高级特性及最佳实践。Nmap是一款开源网络扫描工具,广泛用于网络管理和安全评估,具备主机发现、端口扫描和服务探测等功能。
A.S.E(AI代码生成安全评估)2.0版本正式发布,进行了系统升级,扩展了数据集,支持多种编程语言和工具,提升了评测效率。新机制结合动态与静态分析,提高了漏洞验证速度,帮助开发者更准确评估AI生成代码的安全性。项目期待更多开发者和研究者参与,共同推动AI生成代码安全生态的发展。
国家网信办发布《数据出境安全评估申报指南(第三版)》,简化申报材料,明确评估结果有效期延长的条件和流程,提高数据出境安全评估的便利性,促进相关服务与监管需求的发展。
本文介绍了使用Hydra工具进行弱口令破解的实验,强调了弱口令的危害及其成因。Hydra是Kali Linux中的开源工具,支持多种协议,适用于安全评估和渗透测试,渗透测试人员需在授权下使用。
OpenAI于2025年发布了两款开源语言模型gpt-oss-120b和gpt-oss-20b,支持128k上下文,性能接近其商用模型。模型采用Transformer-MoE架构,具备强大的工具使用能力,并设立安全评估机制,标志着开源大模型领域的重要进展。
AWS Shield推出网络安全主任功能,增强DDoS保护,提供资源自动发现、安全服务配置评估、漏洞优先显示及具体修复建议,帮助安全团队应对威胁。
本研究提出了VERI(视觉紧急识别数据集),用于评估视觉语言模型在安全关键情境中的可靠性。尽管模型在真实紧急事件识别中表现良好,但在安全场景下的误报率高达31-96%,揭示了其在视觉误导场景中的过度解读问题,强调了提升安全评估的重要性。
本研究提出了SmartAuditFlow框架,解决了大语言模型在智能合约审计中的幻觉和上下文理解不足问题。该框架通过动态审计计划和结构化执行,为每个合约生成优化审计策略,显著提高安全评估的准确性,关键漏洞检测准确率达到100%。
OpenAI决定不转型为营利性公司,而是成为公共利益公司。特朗普政府取消了拜登的AI扩散规则,促进了与沙特和阿联酋的AI合作。DeepMind推出了新的编码代理Alpha Evolve,提高了自动代码生成效率。OpenAI承诺通过安全评估中心提升AI安全透明度。
OpenAI通过定期发布详细的安全评估,增强AI透明度,回应批评并持续改进其方法。
TestExplore提供全面的软件测试服务,包括功能测试、自动化测试、性能评估和安全评估,助力企业发布高性能、无错误的应用程序。
完成下面两步后,将自动完成登录并继续当前操作。