“AI界的拼多多”DeepSeek发布新模型
创始人
2024-12-27 16:15:38

12月26日晚间,杭州深度求索人工智能基础技术研究有限公司(以下简称“深度求索”)宣布,全新系列模型DeepSeek-V3首个版本上线并同步开源。

深度求索表示,DeepSeek-V3在知识类任务(MMLU, MMLU-Pro, GPQA, SimpleQA)上的水平相比前代 DeepSeek-V2.5显著提升,接近当前表现最好的模型Anthropic公司于10月发布的Claude-3.5-Sonnet-1022。在美国数学竞赛(AIME 2024, MATH)和全国高中数学联赛(CNMO 2024)上,DeepSeek-V3大幅超过了其他所有开源闭源模型。另外,在生成速度上,DeepSeek-V3的生成吐字速度从20TPS(Transactions Per Second每秒完成的事务数量)大幅提高至60TPS,相比V2.5模型实现了3倍的提升,能够带来更加流畅的使用体验。

DeepSeek-V3和其他模型的比较。图片来源:Deep Seek微信公众号

Meta AI研究科学家田渊栋对DeepSeek-V3各个方向上的进展都表示赞赏,称“这是一项了不起的工作”。

据官方技术论文披露,DeepSeek-V3模型的总训练成本为557.6万美元,而GPT-4o等模型的训练成本约为1亿美元。深度求索表示,“这是一个全新的开始。”。

公开信息显示,深度求索成立于2023年7月17日,由知名量化资管巨头幻方量化创立,幻方量化创始人梁文峰在量化投资和高性能计算领域具有深厚的背景和丰富的经验。成立半年后,发布了第一代大模型DeepSeek Coder;2024年5月发布了其第二代开源Mixture-of-Experts(MoE)模型——DeepSeek-V2。DeepSeek V2模型因在中文综合能力评测中的出色表现,且以极低的推理成本引发行业关注,被称为“AI界的拼多多”。DeepSeek-V3模型API服务定价为每百万输入tokens为0.5元(缓存命中)/2元(缓存未命中),每百万输出tokens价格为8元,并享有45天的优惠价格体验期。

相关内容

热门资讯

金山往来鼓楼台江 有了快捷通道   新开放5条匝道,金山大道主线高架缓堵效应进一步释放  金山往来鼓楼台江 有了快捷通道  金山大桥...
华宝标普中国A股红利机会ETF... 数据显示,7月2日,华宝标普中国A股红利机会ETF(562060)遭净赎回463.65万元,位居当日...
中荣股份涨2.03%,成交额3... 7月3日,中荣股份盘中上涨2.03%,截至09:45,报16.59元/股,成交316.59万元,换手...
黄金股板块活跃 西部黄金涨停   07月03日消息,截止09:45,黄金股板块活跃,西部黄金、四川黄金、赤峰黄金、招金黄金涨停,山...
“闽江潮涌映初心 榕城薪火续华... 1日晚,“闽江潮涌映初心 榕城薪火续华章”文艺汇演在沈葆桢故居举行。活动由福州市委宣传部指导、福州市...