➡️
继续阅读
-
从AI代码到可信软件:工程约束的实践
文章探讨了“工程约束”如何通过仓库强制执行标准,确保AI生成代码的质量与问责。它强调权限、质量门、证据和可观测性,并描述了从辅助到自主的成熟度阶段。核心是...
-
把Agent放进真实尺度香港,上交大/新加坡国立大学/美团等提出UrbanGround,测试多模态模型城市探索能力
该文章介绍了一项关于多模态大语言模型(MLLM)在城市导航中能力的研究。研究团队构建了基于香港真实地理数据的URBANGROUND交互环境,评测了GPT-...
-
Kimi K3 模型结构(0):一张图看懂 Kimi K3
Kimi K3是2.78T参数、104.2B激活的93层MoE模型,支持1M上下文及图像视频输入。其结构创新分三方面:序列用KDA与Gated MLA混合...
-
Minmax H3中英提示词效果差异测试 - 蝈蝈俊
对于MiniMax H3,使用中文和英文提示词时,能看到都在说,英文提示词通常能带来更好的生成效果。但是我实际测试下来,感觉差别不大。 我的测试是基于北京...
-
OpenAI承认德国维基‘事件’
OpenAI says it needs to overhaul how and when it reports instances of AI mode...
-
自动驾驶出租车进入反派时代
It's Bullitt meets Christine meets Waymo. A new short film imagines a San...