➡️
继续阅读
-
深度求索发布DeepSeek-V4-Pro-0813 该模型从预览版正式进入GA阶段
深度求索发布DeepSeek-V4-Pro-0813版,从预览版正式进入GA阶段,模型ID不变,API定价暂未调整。该模型支持1M上下文窗口,提供Resp...
-
人类认知极限在哪里?客观宇宙藏在语言裂缝里
人类认知受限于大脑、感知、语言和理论模型,预测不等于理解。语言塑造思维但非唯一视角,范式转换可能遮蔽观察。物理学家坚持客观现实存在,认知科学家强调视角多样...
-
SpaceXAI推出Grok 4.6系列模型 专注于长时程任务和处理交互式可视化工作
SpaceXAI发布Grok 4.6模型,专注长时程任务和可视化交互,经补充训练提升软件工程、编程等能力,并增强自我测试。基准测试表现持平或略逊于竞品。定...
-
微信宣布推出WeLM模型 参数规模为617B 目前已经内置到微信原生AI助手小微中
微信团队推出自研AI模型WeLM系列,包括80B和617B版本,后者采用混合专家架构,仍在开发中。该系列已内置到微信AI助手小微,支持对话、搜索及调用微信...
-
利用Docker和ModelPack推进AI模型互操作性
ModelPack项目旨在解决AI模型管理工具与格式耦合的问题,通过制定开放标准并利用OCI工件来标准化模型打包和分发。项目与Docker合作,使Dock...
-
让对话与执行真正并行:Qwen-Audio-Agent 架构解析
Qwen-Audio-Agent是开源实时语音运行时,旨在解决语音助理对话中断问题。其架构分为实时前台和后台Agent两层,前台仅暴露八个工具,支持全双工...