阶跃星辰再开源推出SOTA级端到端语音大模型_财经评论(cjpl)股吧

股吧首页 > 财经评论吧 > 正文

最近访问：

财经评论吧

返回财经评论吧>>

- 重要股东股权质押数据全览

东方财富资讯君

发表于 2025-09-02 00:42:22 股吧网页版

阶跃星辰再开源推出SOTA级端到端语音大模型

来源：上海证券报·中国证券网作者：孙小程

　　上证报中国证券网讯（记者孙小程）近日，阶跃星辰正式发布最强开源端到端语音大模型Step-Audio 2 mini，该模型在多个国际基准测试集上取得SOTA（State-of-The-Art，即当前最佳水平）成绩。

　　在技术层面，Step-Audio 2 mini采用真正的端到端多模态架构，并将语音理解、音频推理与生成统一建模，不仅时延更低、输出更快，还能更加精准地理解副语言信息、非人声信号等语音要素，显著提升了语音人机交互的效率和智能上限。

　　根据测评，这款模型在音频理解、语音识别、跨语种翻译、情感与副语言解析等任务中表现突出，综合性能超越Qwen-Omni 、Kimi-Audio在内的所有开源端到端语音模型，并在大部分任务上超越GPT-4o-audio。

　　在此之前，吉利发布了搭载阶跃星辰端到端语音大模型的吉利银河M9，这是行业内端到端语音大模型首次实现量产上车。

　　阶跃星辰相关负责人介绍，自去年发布国内首个千亿参数端到端语音大模型Step-1o Audio以来，公司持续迭代模型性能，并跟吉利、鲸鱼机器人、TCL、Cyan青心意创等头部终端厂商达成深度合作，让语音大模型在生活场景中为消费者提供更加智能、便捷的互动体验。

　　今年以来，阶跃星辰已经开源8款性能领先的多模态模型，覆盖语音、视频生成、图像编辑、3D、多模态推理等多个类别。

（文章来源：上海证券报·中国证券网） [点击查看原文]

郑重声明：用户在财富号/股吧/博客等社区发表的所有信息（包括但不限于文字、视频、音频、数据及图表）仅代表个人观点，与本网站立场无关，不对您构成任何投资建议，据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容，远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息，谨防上当受骗！

评论该主题

帖子不见了！怎么办？

作者：您目前是匿名发表登录 | 5秒注册作者：，欢迎留言退出发表新主题

温馨提示： 1.根据《证券法》规定，禁止编造、传播虚假信息或者误导性信息，扰乱证券市场；2.用户在本社区发表的所有资料、言论等仅代表个人观点，与本网站立场无关，不对您构成任何投资建议。用户应基于自己的独立判断，自行决定证券投资并承担相应风险。《东方财富社区管理规定》