#人工智能 谷歌也尝试将模型权重直接蚀刻到硅晶片中,谷歌正在研发的 Frozen v2 芯片 token 吞吐量是谷歌现有 TPU 单元的 6~10 倍。

模型权重直接蚀刻到硅晶片中可以减少芯片执行的步骤数和每次查询的数据量,但代价是芯片完成蚀刻后无法再升级模型。

谷歌的做法是将模型部分决策蚀刻到晶体管中固定,Gemini 发布新版本后也能继续用。

查看全文:https://ourl.co/114010?t

😁订阅 🤔解封 🥰推特 🎉CN2VPS
来自频道: @landiansub
Loading comments...