论文复现是科学基石,但机器学习领域面临可复现性危机。Inherent Labs团队训练了270亿参数的AI智能体Faraday,利用Codex GPT-5.5作为工具,在73%的分布内任务和60%的AI for Science任务上超越Claude和GPT-5.5。Faraday通过自动生成任务空间和稳定GRPO后训练,展现出更强的科学严谨性,能指导更大模型工作,提升复现能力。
本文介绍四个Rust项目:fcmaes-rust提供并行黑箱优化算法及22个教程;Apache Fory 1.5.0支持外部类型序列化,JSON性能大幅提升;BorrowSanitizer优化垃圾回收后平均提速1.90倍,发现跨语言别名错误;job-control实现支持作业控制的Unix shell。
本文档介绍SQLite内核系列实验的复现方法,涵盖环境要求(Linux/WSL2、SQLite 3.45+)及多个脚本实验,如页头解析、查询计划、回滚日志、WAL检查点、锁冲突、事务模式、覆盖索引、跨库操作、完整性检查和备份。强调以官方文档和源码为准,实验需记录版本、命令和输出,性能数据引用既有测试。
泛微e-cology OA系统存在远程代码执行漏洞,攻击者可利用BeanShell组件未授权访问接口执行任意命令。该漏洞于2019年9月19日被公开,安全补丁已发布,建议用户及时更新防护。
泛微e-cology OA系统存在远程代码执行漏洞,攻击者可通过未授权接口执行任意命令。已发布安全补丁,建议用户及时更新系统以防范风险。
本目录为 [RocksDB 内核系列](../index.html) 提供可复现实验脚本。
Nginx存在解析漏洞和文件名逻辑漏洞(CVE-2013-4547),攻击者可通过特殊URI绕过文件上传限制,执行恶意代码。漏洞源于Nginx与PHP-FPM的交互缺陷及特殊字符处理不当。防御措施包括修改PHP配置、升级Nginx版本和加强文件上传检测。
拓竹的CyberBrick套件允许用户轻松拼装可遥控的3D打印小车。OpenCyberBrick项目通过使用廉价组件复现CyberBrick,降低成本并扩展功能,支持手机遥控。
本文介绍了结合数独与Dancing Links算法的逆向题。程序通过大整数生成数独初盘,利用DLX算法求解终盘,并对用户输入的十六进制字符进行多次变换,最终与数独解逐位比较,匹配计数达到79时输出成功信息。整个过程在Windows环境下稳定复现,展示了数独求解经典算法与加密题目的结合。
本文介绍了利用RANSAC算法从基于LFSR的流密码中恢复128位初始状态。通过分析非线性项的噪声影响,构建LPN模型,成功恢复密钥并验证,准确率达到93.854%,实现100%复现。
Erlang/OTP在高并发场景中广泛使用,但其标准组件存在CVE-2025-32433漏洞,攻击者可绕过认证执行任意命令,影响嵌入式设备和测试环境。该漏洞源于ssh_channel.erl模块未有效校验通道请求,可能导致系统命令执行和数据窃取等严重后果。
Log4j2是Apache开发的开源日志框架,旨在克服Log4j 1.x的性能和功能限制。它支持动态变量替换,但存在JNDI注入漏洞,攻击者可利用该漏洞执行恶意代码。防御措施包括禁用lookup查询、拦截特定请求和升级组件。
Redis HyperLogLog(HLL)存在整数溢出漏洞,影响多个版本。攻击者可利用该漏洞实现远程代码执行或导致服务崩溃。修复版本通过新增校验机制来防止溢出。
文章讨论了访问验证的代码,涵盖应用标识、用户信息和请求参数等内容。
Sakana AI的AI Scientist-v2通过了ICLR会议的同行评审,成为首篇由AI撰写的科研论文。OpenAI推出PaperBench基准测试,评估AI在复现机器学习研究中的能力。研究表明,AI在复现论文方面表现良好,但长期任务执行能力仍需改进。
中国人民大学与九章云极团队在大模型推理技术上取得新进展,复现类R1模型并开源实现。新模型STILL-3-Tool-32B在AIME 2024测试中准确率达到81.70%,超越DeepSeek-R1,推动AI推理能力提升。
中国人民大学与北京智源研究院联合开发的类R1推理模型STILL-3-Tool-32B在AIME 2024基准测试中取得81.70%准确率,超越DeepSeek-R1。研究表明外部工具能增强模型推理能力,并成功应用于Alaya NeW系统,推动AI技术发展。
Manus引发智能体复现潮,多个开源项目如OpenManus和OWL迅速推出复现代码,OWL在GAIA基准测试中表现优异。Manus通过邀请码吸引海外用户,用户反馈积极,付费意愿强。GAIA基准测试成为智能体产品的重要竞争领域,分为三个难度级别,Manus在Level 3上表现突出。
Visual Studio的VSStandardCollectorService150服务在NT AUTHORITY\SYSTEM上下文中运行,存在权限提升漏洞。通过分析服务配置和文件操作,可以利用特定工具进行渗透测试,触发服务并执行任意文件的DACL重置。
复旦大学研究团队高效复现了R1-zero的自发反思能力,使用200多行简洁代码,降低资源消耗,支持低算力环境下训练。项目已开源,训练中出现“顿悟时刻”,计划进一步优化。
完成下面两步后,将自动完成登录并继续当前操作。