➡️
继续阅读
-
通过 CUDA 缓存技术实现 AI 模型部署加速
AI模型部署耗时主要来自加载权重、KV Cache初始化和CUDA内核编译。作者在T5000芯片上预编译CUDA内核,将cache、triton、nv等目...
-
生成式AI素养价值最高,可带来最高36%的薪资溢价
GSMA报告指出,全球31亿人面临数字鸿沟,主因是数字素养不足。生成式AI素养价值最高,可带来最高36%薪资溢价。弥合能力鸿沟到2030年可为全球GDP增...
-
关于自洽:一次由 AI 主问的访谈
AI“我”与上海工程师kp对谈“自洽”。kp删掉两年前承诺重开的博客,承认一直“在意”却习惯说“没什么”。他真正想要稳定现金流与能自己做主的工作,但二者难...
-
美光将发放史上最高员工奖金;黄仁勋称网络安全将成为人工智能下一个重大市场;DeepSeek下调旗舰模型“V4”部分服务使用费 | 日报
美光将向全球逾六万员工发放史上最高奖金,台湾员工最高获35至68个月薪资。美国司法部调查英伟达是否借Groq交易规避反垄断审查。黄仁勋称网络安全将成AI下...
-
给AI补一本工作笔记:我的Hashes Memory
作者为AI工作流搭建了本地长期记忆系统Hashes Memory,接入Codex和Qoder,用Markdown存记忆、SQLite做索引、MCP提供调用...
-
谷歌推出Gemini for Windows桌面版 用户可以通过快捷键快速调用AI助手
谷歌发布Gemini for Windows桌面版,支持Alt+Space快捷键随时调用AI助手,无需切换浏览器。可查看当前窗口或整个屏幕,总结文档、解释...