IBM watsonx.ai上线DeepSeek-R1蒸馏模型
创始人
2025-02-11 19:23:49

(全球TMT2025年2月11日讯)IBM日前宣布,DeepSeek-R1的Llama 3.1 8B和Llama 3.3 70b蒸馏版本现已在IBM的企业级AI开发平台watsonx.ai上提供。DeepSeek-R1是中国AI初创公司DeepSeek的推理大语言模型(LLM),被认为是世界上最强大的开源模型之一,通过在基础模型DeepSeek-V3上直接使用强化学习(RL)开发,并使用知识蒸馏技术微调多个Llama和Qwen模型。

IBM 通过“按需部署目录”在watsonx.ai中提供两种Llama蒸馏变体,允许用户部署专用实例进行安全推理。用户还可以使用自定义基础模型导入功能导入DeepSeek-R1模型的其他变体,如Qwen蒸馏模型。DeepSeek-R1以其卓越的推理能力支持广泛应用,包括规划、编码和数学问题解决等。开发人员可在watsonx.ai中使用DeepSeek-R1等已部署的模型和解决方案功能构建AI解决方案。

相关内容

热门资讯

好医声 | 春寒料峭警惕“心脏... 眼下正是福州一年中 气温最“任性”的时段 冷暖气流激烈交锋 不仅带来频繁降水 更让气温像“坐...
央视关注福州:科技创新与产业创... 福建落实“四个更大”重要要求⑥︱福州:科技创新与产业创新深度融合闯出新路 央视网消息(记者 黄钰姣...
当风波触及能源心脏:避险时刻,... (本文作者薛洪言为星图金融研究院常务副院长) 近日,中东战火升级,原油价格飙升,黄金本该是避险资金的...
省老年医院推出“动感透析”新模...   省老年医院推出“动感透析”新模式  让治疗更轻松,还能缓解并发症  血液透析在不少人的印象里,意...