有传言称谷歌正在研发名为Frozen v2的芯片 将AI模型部分蚀刻到芯片上提高吞吐量

有传言称谷歌正在研发名为Frozen v2的芯片 将AI模型部分蚀刻到芯片上提高吞吐量

💡 原文中文,约1400字,阅读约需4分钟。
📝

内容提要

#人工智能 谷歌也尝试将模型权重直接蚀刻到硅晶片中,谷歌正在研发的 Frozen v2 芯片 token 吞吐量是谷歌现有 TPU 单元的 6~10 倍。模型权重直接蚀刻到硅晶片中可以减少芯片执行的步骤数和每次查询的数据量,但代价是芯片完成蚀刻后无法再升级模型。谷歌的做法是将模型部分决策蚀刻到晶体管中固定,Gemini 发布新版本后也能继续用。查看全文:https://ourl.co/114010

🏷️

标签

➡️

继续阅读