联想宣布旗下首款AMD AI服务器单机部署满血版DeepSeek大模型,可实现极限吞吐量6708 token/s
创始人
2025-03-17 14:17:19

  Hehson科技讯 3月17日下午消息,联想宣布旗下首款AMD AI大模型训练服务器联想问天WA7785a G3在单机部署671B(满血版) DeepSeek大模型时,可实现极限吞吐量6708token/s,将单台服务器运行大模型的性能推向了新高。

  依托联想万全异构智算平台,联想通过访存优化、显存优化、PCIe 5.0全互联架构创新以及精选SGLang框架中性能最优算子等诸多创新方式,对大模型从预训练、后训练到推理的全流程进行持续优化,在单台部署DeepSeek 671B大模型的联想问天WA7785a G3上实测最高吞吐量达6708 token/s。

  在模拟问题对话场景(上下文序列长度128/1K)时,最高可支持并发数158,TPOT 93毫秒, TTFT 2.01秒;而在模拟代码生成(上下文序列长度512/4K )时,并发数可达140,TPOT 100毫秒, TTFT 5.53秒。这一成绩意味着单台联想问天WA7785a G3可以支撑1500人规模企业的正常使用,是继联想问天WA7780 G3服务器单机部署满血版DeepSeek 大模型总吞吐量突破2500 token/s之后,单机部署该大模型推理性能的又一次突破。

  联想方面称,此次突破是联想中国基础设施业务群、联想研究院ICI实验室和AMD联合设计、协同调优、共同实现的。此结果也并非最终结果, 联想与AMD 还在持续尝试深度调优新方法,实现更高调优突破。

相关内容

热门资讯

伤感句子我形同陌路相遇也是恩泽... 一句话一段情一生心疼,总有一些句子,会滴墨成伤:  1.打从某天起好像跟你没那麼好了见面少了电话也少...
关于友谊的伤感句子 关于友谊的...  关于友谊的伤感句子一:  1.孤独是美丽的,置身于孤单之中,你会把全身心放松,感到从来没有过的清新...
有哲理的伤感句子 有哲理的伤感... 有哲理的伤感句子一:  1.一个人只有一个心脏,却有两个心房。一个住着快乐;一个住着悲伤。不要笑得太...
关于青春的伤感句子 关于青春的...  关于青春的伤感句子一:  1.刺骨的寒风从季节深处吹来,以冰冷姿势划过我黯淡的眼眸。  2.季节的...
有关爱情的伤感句子 有关爱情的... 有关爱情的伤感句子一:  (一)喜欢一个人上路,没有方向,没有归宿,只想找一个适合自己的地方停留  ...