TypeSafe推出判断模型Jev,专用于分类判断而非文本生成,可核查事实、校验引用、重排搜索结果、归类笔记、诊断智能体失败原因。其响应仅0.35至0.52秒,比Gemini 3.5 Flash快三到八倍,准确率多数持平或略逊。Jev让智能体实时自检成为可能,但准确率约79%,复杂长轨迹表现仍待验证。
完成下面两步后,将自动完成登录并继续当前操作。