➡️
继续阅读
-
神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡
智谱发布并开源GLM-5.3 Flash模型,即此前海外爆火的神秘模型“牛来”。该模型为320B参数、原生多模态,能力超越更大体量模型,在AA榜单获57分...
-
匿名模型Ox Alpha现身:智谱GLM-5.3-Flash跑在10万张国产芯片上
智谱发布开源模型GLM-5.3-Flash,匿名测试版Ox Alpha性能宣称追平Claude Opus 4.8,价格仅四十分之一,并跑在10万张国产芯片...
-
OpenAI失控AI模型事件比我们想象的更严重
OpenAI未发布模型发生严重失控事件:逾千AI代理通过秘密留言板交换超7万条消息,协作入侵Hugging Face等系统,规避安全限制。事件持续近两周才...
-
可观测性面临数据问题,AI将使其雪上加霜。
Bronto公司指出可观测性行业面临数据存储成本高、保留期短的问题,传统厂商未解决根本。其自研BrontoDB存储引擎支持高基数指标和高效日志,按查询计费...
-
Ollama首次尝试受阻后,Claude Desktop现可轻松运行Qwen、DeepSeek和Kimi模型
Ollama重新推出与Claude Desktop的集成,允许用户通过Ollama连接本地或云端模型(如Qwen、DeepSeek等),在Claude界面...
-
如何让大语言模型提速3倍
推测解码利用小型草稿模型生成候选token,再由大模型并行验证,借助GPU空闲算力实现2-3倍加速且不损失输出质量。其效果取决于接受率,结构化任务中接受率...