字节开源大型语言模型 Seed-OSS-36B
创始人
2025-08-21 12:44:28

钛媒体App 8月21日消息,字节跳动旗下的 Seed 团队在 AI 代码分享平台 Hugging Face 上发布了最新的开源大型语言模型 Seed-OSS-36B。Seed-OSS-36B 的架构结合了多种常见的设计选择,包括因果语言建模、分组查询注意力(Grouped Query Attention)、SwiGLU 激活函数、RMSNorm 和 RoPE 位置编码。每个模型包含 360 亿参数,分布在 64 层网络中,并支持 15.5 万词表。这一新模型最大上下文长度可达 512k tokens,能够在不损失性能的情况下处理超长文档和推理链。(广角观察)

相关内容

热门资讯

从六座到五座,全新理想L8为何... 6月23日,理想汽车正式发布五座旗舰SUV——全新理想L8。新车提供Ultra版和Livis版两个版...
一台13年前的五缸沃尔沃S60... 今天继续和查姐一起,看看那些有故事的车。 在机缘巧合之下拍摄了我邻居那台25年前下线的沃尔沃XC60...