➡️
继续阅读
-
DeepSeek最强悍的,从来不是训练模型,而是Infra - 蝈蝈俊
DeepSeek的核心优势在于其基础设施(Infra)能力,而非仅算法创新。其母公司幻方量化自2019年起投入巨资自建超算平台,积累了深厚工程经验。Dee...
-
一张图最多384个Token:DeepSeek多模态模型背后的“极限压缩”艺术 - 蝈蝈俊
DeepSeek推出多模态模型DeepSeek-V4-Flash-Vision-Exp,图片最多占384个Token,通过三级压缩技术大幅降低成本。模型侧...
-
神秘模型Ox Alpha免费无限量:DeepSeek新视觉模型?智谱、小米?
2026年8月21日,DeepSeek下架免费模型并上线视觉模型API,同日OpenRouter出现匿名模型Ox Alpha,免费且支持多模态。网友测试发...
-
DeepSeek V4 Flash视觉模型上线,600张图一锅端!
DeepSeek发布V4-Flash-Vision-Exp多模态模型,视觉能力免费,定价与纯文本版一致,单图最高384 token,价格远低于GPT-4o...
-
Pi Agent + DeepSeek 深度优化
文章介绍了使用两台懒猫AI算力舱本地部署DeepSeek模型的优化过程。通过调整上下文长度至328K、开启思考模式及工具调用功能,提升了模型性能,实现每秒...
-
Claude Opus 5在ARC-AGI-3基准上得分30%。借助英伟达AVO系统,其得分达到100%。
英伟达发布AVO智能体系统,将Claude Opus 5在ARC-AGI-3基准上的得分从30.2%提升至100%。该系统通过持久记忆和程序化监督,支持长...