《数学话语》是一本新创的同行评审在线数学期刊,专注于发布高质量数学研究讲座视频,旨在促进数学交流文化,强调沟通在研究中的重要性。现正征集纯数学领域约一小时的研究或研讨会讲座视频投稿,详情见官网。编辑团队由多位知名数学家组成。
神经外科医生金山木利用ChatGPT的GPT-5.6-Sol模型,在16小时内证明了困扰数学界22年的Crouzeix猜想。该证明获多位顶尖数学家确认,但尚未正式同行评审。此事凸显AI在数学领域的突破能力,并挑战了传统专业训练体系的有效性假设。
IBM与芝加哥大学等机构发布三篇论文,展示量子计算机在特定任务上超越经典模拟,同时通过错误检测、误差缓解和跨平台验证确保结果可信。实验使用IBM Heron处理器,涉及70量子比特电路、Floquet模型模拟和Loschmidt回声测量,但未排除所有经典算法,结果待同行评审。
美国管理和预算办公室提议对联邦拨款规则进行重大修改,这可能削弱同行评审的作用,增加行政负担,并限制科学家应对新机遇的能力。这些变化将影响基础研究的灵活性,阻碍意外发现和合作,进而影响科学竞争力。
arXiv 正在加强对 AI 生成论文的监管,违规者将被禁发新论文一年,并需经过同行评审。此措施旨在维护学术可信度,作者需对 AI 生成内容的准确性负责。
arXiv 新规规定,提交包含 AI 生成内容的论文作者将被封禁一年,且未来需经过同行评审才能再提交。这一政策旨在确保学术诚信,作者需对稿件中的错误负责,影响深远,尤其在物理和数学领域。
ArXiv将禁止上传包含AI生成内容的研究论文,若发现未检查生成结果的证据,作者将被禁用一年。未来提交需先在有声望的同行评审期刊接受,此政策旨在减少AI生成的低质量论文。
AI生成的学术论文数量激增,给同行评审系统带来压力。许多论文质量低劣且重复,难以筛选。这导致了学术出版危机,影响了研究的真实性和有效性。
GPTZero团队扫描了300篇ICLR 2026投稿论文,发现50篇存在幻觉引用,漏检率高。部分论文评分达到8/10,几乎肯定会发表。幻觉引用类型多样,同行评审系统面临崩溃,AI生成论文问题严重,学术诚信受到威胁。
arXiv宣布将对计算机领域的综述和立场论文实施新审核政策,要求这些文章在提交前必须经过期刊或会议的同行评审,以应对AI生成内容的激增和质量下降问题,旨在提高文章质量,确保学术标准。
DeepSeek首次登上《Nature》封面,创始人梁文锋表示“中国AI不可能永远跟随”。R1模型的训练成本约为200万人民币,成为首个经过同行评审的大型语言模型,具有深远影响。该模型数据来源多样,安全性评估中等,展现出透明性与开源精神。
本研究提出Re^2数据集,旨在解决同行评审数据集的多样性不足和质量低下的问题。该数据集包含大量初始提交、评审评论和反驳内容,支持静态评审和动态交互,帮助作者完善手稿,减轻审核压力。
本研究提出将人工智能会议的单向评审改为双向反馈循环,以提升审稿质量和责任感。通过建立奖励机制,鼓励审稿人进行高质量审稿,促进可持续的同行评审体系发展。
LazyReview是一个新数据集,旨在揭示科学同行评审中的“懒惰思维”问题。研究发现,评审者因工作量大而使用表面启发式,导致评审质量下降。该数据集包含500个专家标注和1276个银标注的评审片段,旨在帮助开发自动化工具识别这些问题。研究还测试了大型语言模型在检测懒惰思维方面的能力,结果表明改进的标注指南显著提升了模型的检测效果。
Sakana AI 发布的 AI Scientist-v2 版本能够生成高质量的学术论文,并成功通过顶级会议的同行评审。该系统在创意生成和实验管理方面具有显著创新,提升了自主性和灵活性,展示了人工智能在科学研究中的潜力。
本研究提出了一种新颖的水印嵌入技术,用于识别学术期刊和会议中依赖大型语言模型生成的评审评论。该方法在评估中展现出高灵敏度和抗干扰性,有助于提升同行评审的质量。
去年,Sakana AI推出的AI Scientist-v2成功通过ICLR研讨会的同行评审,成为首篇完全由AI生成的科研论文。该系统能够自主提出假设、设计实验并撰写论文,展现了AI在科学研究中的潜力。团队认为,未来AI可能生成与人类水平相当的学术论文。
alphaXiv是一个新兴的学术评论平台,允许用户直接在arXiv论文上评论,促进学术讨论。用户可以选择AI模型进行问答,评论内容包括技术澄清和理论讨论。虽然alphaXiv未取代传统同行评审,但为社交媒体与正式评审之间提供了一个讨论空间,推动论文的动态更新与反馈。
本研究提出了一种数据驱动框架,以提高科学同行评审的准确性和效率,解决传统评审系统的不足。研究表明,开放同行评审是科学出版的可扩展且公平的替代方案。
在分布式知识系统中,真理通过网络中的互动验证而非依赖权威。知识声明在多节点网络中接受审查,各节点提供独特视角,形成强大的验证框架。持续的同行评审创造了一个动态环境,使知识不断被测试。信任通过参与建立,形成奖励真实专业知识的优胜劣汰系统。这种方法在复杂领域尤为重要,适应不确定性和复杂性,成为建立可靠知识的关键。
完成下面两步后,将自动完成登录并继续当前操作。