钛媒体App 8月3日,MiniMax正式开源新一代通用视频模型MiniMax H3。据介绍,该模型能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。(广角观察)
上一篇:英特尔:为开源多模态视频模型MiniMax H3提供Day 0支持
下一篇:自变量机器人发布HOST框架并开源