GLM-5.3-Flash是Z.AI推出的低成本模型,价格约为旗舰版GLM-5.3的1/16。测试显示两者在编码、逻辑和提取任务中均得满分,准确性无差异,但Flash在困难任务中消耗更多token和时间,其成本优势依赖当前定价,可能变化。建议Flash适合简单任务,复杂任务需权衡时间与成本。
本周AI领域密集发布三款前沿模型:Grok 4.6、Qwen 3.8-Max和DeepSeek V4-Pro,均主打成本优势而非能力提升。开源权重模型压低价格,使价值转向模型路由层。Nvidia推出开源路由器NeWo Switchyard,优化任务分配。专家指出,更便宜的模型不会减少AI预算,反而因杰文斯悖论增加使用量。企业约70%任务用本地小模型,20%用中端API,10%用前沿模型。
DeepSeek-V4-Flash正式版发布一周内登顶全球大模型调用量榜首,周调用量达7.1万亿Token,中国模型包揽前五。其Agent能力大幅提升,价格极低,单任务成本仅3美分,吸引海外开发者迁移,推理成本降60%-85%。分析认为,中国AI以性能与价格优势改写全球市场规则,冲击美国头部模型。
英国一家公司使用开源AI模型GLM 5.2进行记账,仅花费2.73美元和68分钟,处理59笔交易,准确率达到99.9%。尽管在某些税务细节上出现错误,但AI的效率和成本优势显著,可能对人类会计师构成威胁。未来会计工作可能需要人类监督AI处理异常情况。
完成下面两步后,将自动完成登录并继续当前操作。