“AI界的拼多多”DeepSeek发布新模型
创始人
2024-12-27 16:15:38

12月26日晚间,杭州深度求索人工智能基础技术研究有限公司(以下简称“深度求索”)宣布,全新系列模型DeepSeek-V3首个版本上线并同步开源。

深度求索表示,DeepSeek-V3在知识类任务(MMLU, MMLU-Pro, GPQA, SimpleQA)上的水平相比前代 DeepSeek-V2.5显著提升,接近当前表现最好的模型Anthropic公司于10月发布的Claude-3.5-Sonnet-1022。在美国数学竞赛(AIME 2024, MATH)和全国高中数学联赛(CNMO 2024)上,DeepSeek-V3大幅超过了其他所有开源闭源模型。另外,在生成速度上,DeepSeek-V3的生成吐字速度从20TPS(Transactions Per Second每秒完成的事务数量)大幅提高至60TPS,相比V2.5模型实现了3倍的提升,能够带来更加流畅的使用体验。

DeepSeek-V3和其他模型的比较。图片来源:Deep Seek微信公众号

Meta AI研究科学家田渊栋对DeepSeek-V3各个方向上的进展都表示赞赏,称“这是一项了不起的工作”。

据官方技术论文披露,DeepSeek-V3模型的总训练成本为557.6万美元,而GPT-4o等模型的训练成本约为1亿美元。深度求索表示,“这是一个全新的开始。”。

公开信息显示,深度求索成立于2023年7月17日,由知名量化资管巨头幻方量化创立,幻方量化创始人梁文峰在量化投资和高性能计算领域具有深厚的背景和丰富的经验。成立半年后,发布了第一代大模型DeepSeek Coder;2024年5月发布了其第二代开源Mixture-of-Experts(MoE)模型——DeepSeek-V2。DeepSeek V2模型因在中文综合能力评测中的出色表现,且以极低的推理成本引发行业关注,被称为“AI界的拼多多”。DeepSeek-V3模型API服务定价为每百万输入tokens为0.5元(缓存命中)/2元(缓存未命中),每百万输出tokens价格为8元,并享有45天的优惠价格体验期。

相关内容

热门资讯

国防部:日本侵略过所有周边国家 3月26日下午,国防部举行例行记者会,国防部新闻局副局长、国防部新闻发言人蒋斌大校答记者问。记者:据...
港榕两地学子 同上一堂AI课 香港学子开心走过百福门,观看“福州中轴线文化”项目化学习成果展台。一附小张彬老师借助数字人AI执教整...
公司经理助理岗位职责 质安部经...   1、在公司经理领导下负责办公室的全面工作,努力作好公司经理的参谋助手,起到承上启下的作用,认真做...
物业经理岗位职责 物业经理岗位...   篇一:物业经理岗位职责   1 落实总经理安排的各项工作;   2 负责本部门整体运作;   3...
市场总监岗位职责 市场总监岗位...   篇一:市场总监岗位职责   协助总经理制订总体市场发展战略以及市场发展目标   拓展公司的市场策...