➡️
继续阅读
-
LightNav-0——激发VLM空间智能实现跨本体通用:基于单目RGB与统一token接口,结合时间感知历史压缩、两阶段课程与GRPO在线强化
LightNav-0是一种基于Qwen3-VL-4B构建的紧凑通用具身导航模型,无需任务特定预测头。它通过双通道指向接口(可供性点与物体点)表达空间意图,...
-
流式JSON为什么总报错?理解结构化输出就能接稳AI接口
流式JSON报错源于逐块解析,正确做法是按事件仅收集文本增量,拼接后在流结束再解析校验。文章以Gemini结构化流式输出为例,给出Pydantic模式与代...
-
推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking
谷歌发布Gemini 3.8 Live与3.8 Live Extended Thinking两款实时语音模型。前者主打快速流畅对话,支持97种语言切换、实...
-
使用 Gemini 3.8 Live 和 3.5 Transcribe 构建实时语音应用
谷歌发布Gemini实时语音模型,包括3.8 Live和3.8 Live Extended Thinking,支持异步函数调用、视觉上下文、多语言及后台深...
-
推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking
谷歌发布Gemini 3.8 Live与3.8 Live Extended Thinking两款语音模型。前者主打规模化与低成本,支持近实时视觉输入、97...
-
快数学/慢数学
数学家本·安蒂厄提出“快数学与慢数学”之分,主张用大语言模型推进高维几何等宏大研究,但须以人类理解为核心。他反对以论文数量衡量数学进步,并建议社区规范:可...