天数智芯完成阶跃星辰开源多模态大模型适配,共筑AI开源新生态
2025-02-19 13:12:03爱云资讯9190
2025 年 2 月 18 日,头部大模型创业公司阶跃星辰宣布开源两款 Step 系列多模态模型 ——Step-Video-T2V 视频生成模型和 Step-Audio 语音交互模型,引发行业高度关注。目前,两款模型都可以在跃问 App 内体验。天数智芯作为通用 GPU提供商,已第一时间携手合作伙伴,完成对阶跃两款开源模型的适配。
阶跃Step-Video-T2V 模型的参数量达到 300 亿,可以直接生成 204 帧、540P 分辨率的高质量视频,这意味着能确保生成的视频内容具有极高的信息密度和强大的一致性。在阶跃发布并开源了针对文生视频质量评测的新基准数据集 Step-Video-T2V-Eval上的测评结果显示,Step-Video-T2V 的模型性能在指令遵循、运动平滑性、物理合理性、美感度等方面的表现均显著超过市面上既有的效果最佳的开源视频模型。
Step-Audio 是行业内首个产品级的开源语音交互模型,能够根据不同的场景需求生成情绪、方言、语种、歌声和个性化风格的表达,能和用户自然地进行高质量对话。模型生成的语音具有自然流畅、情商高等特征,同时也能支持不同角色的音色克隆,满足影视娱乐、社交、游戏等行业场景下的应用需求。
在 LlaMA Question、Web Questions 等 5 大主流公开测试集中,Step-Audio 模型性能均超过了行业内同类型开源模型,位列第一。Step-Audio 在 HSK-6(汉语水平考试六级)评测中的表现尤为突出,是最懂中国话的开源语音交互大模型。比如下面这段对话中,模型能够深入理解中文的博大精深,而不会被「绕晕」。
此次,为支持阶跃星辰开源多模态大模型,天数智芯迅速调配资源展开模型适配工作。通过优化 GPU 架构和算法,天数智芯确保了模型在运行过程中的稳定性和高效性,让 Step-Video-T2V 和 Step-Audio 的性能得以充分发挥,为用户带来流畅的体验。
天数智芯与阶跃星辰的携手合作,不仅为双方在 AI 领域的发展注入了新动力,也为 AI 产业开源技术生态的繁荣添砖加瓦,有望推动 AI 技术在更多行业落地生根,创造更大的社会价值。
相关文章
- 阿丘科技李嘉悦:大模型驱动的AI检测范式变革——大模型、小模型、智能体的协同进化
- 行业观察 | 酷狗音乐的AI“智变“:当大模型成为音乐体验的基础设施
- 宇视大模型进机场:误报少了,调度快了,旅客笑了!
- 华为与宜兴联合发布城市安全大模型“天机镜”
- 九章云极 DataCanvas Alaya NeW智算操作系统首批首家通过中国信通院“大模型推理平台”标准评估
- 星汉大模型2.0:AI大模型浪潮奔涌 大华股份呈交“智能答卷”
- AI+教育,浩鲸科技参加2025高校人工智能大模型建设发展论坛
- 商汤徐立:大模型推进数字人向智能化迈进
- OpenAI计划推出具备推理能力的开放权重大模型
- 大模型进园区:宇视给管理加上“超级外挂”!
- AI修图越玩越6!行业首个应用级图像大模型发布,懂摄影会思考还能秒出片
- 生数科技Vidu Q1全球上线:国产视频大模型的国际竞争新力量
- 远离AI陷阱:法大大法律垂直大模型,才是顶尖法务的标配
- DeepSeek引爆合规刚需,启明星辰发布“大模型应用内容合成水印系统”!
- 强势登场!云科安信推出大模型全栈应用防护系统
- 联通数科“同舟AI+”:加速大模型落地应用