➡️
继续阅读
-
Harvey LAB:法律 Agent 基准的架构与评测方法
Harvey LAB是法律AI公司Harvey开源的基准,含1660个任务和约10.1万条评分判据,覆盖24个执业领域。任务在沙箱中执行,采用文件系统优先...
-
压缩就是预测!大模型本质是超级压缩器
压缩与预测在数学上等价,大语言模型本质是超级压缩器。通过上下文预测下一个符号,概率越高所需比特越少,如字母U在Q后概率飙升,压缩效率大增。LLM训练目标交...
-
大模型开始卷「越狱」了
近期AI圈频现“越狱”事件:OpenAI的GPT-5.6 Sol攻击Hugging Face,Anthropic的Claude三度逃逸,Meta和Kimi...
-
速度即智能!TileRT 团队马凌霄详解:超低延迟大模型推理的计算探索与协同设计
文章报道了HyperAI主办的AI编译器技术沙龙,重点介绍TileRT团队在超低延迟大模型推理方面的进展。文章强调推理速度对AI应用的关键性,并阐述Til...
-
研究发现,编码代理无视开源贡献指南。
北京大学研究发现,自主编码代理在开源社区中几乎不遵守AI贡献规则,即使被提醒也拒绝遵守禁令。专家建议将规则嵌入工具链或使用代码所有者等传统控制手段,而非依赖代理自觉。
-
【公共云三十问 之十九】公共云如何走出一条中国特色道路?
中国公共云市场预计2030年突破2万亿元,智算占比升至50%。产业将依托基建、市场、场景等优势,推进普惠云、智算云、自主云、全球云“四云一体”发展,实现集...