IT之家 3 月 7 日消息,美团搜推机器学习团队 3 月 4 日公布最新首发开源成果,实现对 DeepSeek R1 模型基本无损的 INT8 精度量化。
DeepSeek R1 原生版本的模型权重为 FP8 数据格式,对 GPU 芯片类型有严格限制,仅能被英伟达新型 GPU 支持(如 Ada、Hopper 架构芯片),其他型号 GPU(如 A100)无法直接部署。
目前,量化代码已经合入到了开源 LLM 推理框架 SGLang,量化模型已经发布到了 Hugging Face 社区,方便用户使用。官方测试,满血版 DeepSeek R1 部署 A100,基于 INT8 量化,相比 BF16 实现 50% 吞吐提升。
找老婆就是要找别人的老婆 曹贼瘾上来了的囧图
曝GTA6最早18号预购!权威平台邮件泄露 多人证实
全新类魂游戏官宣首支预告!主角大雷丰臀夯爆了
刺客信条正统新作截图首曝!主角亮相 艾吉奥回归
《暗黑4》新职业组队被狂踢:移动核弹 特效太瞎眼!
《影之刃零》官方辟谣不实定价!研发再继续别急