快讯 23:46Anthropic 拟登陆纳斯达克,连续两季盈利目标估值 2 万亿美元23:06英伟达联手 Perplexity:本地智能体 Portable Computer 登陆 Windows RTX PC23:05X与SpaceXAI撤回对苹果反垄断诉讼,继续追责OpenAI 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期二 · 09-15 15:45 约 1 分钟读完

阶跃星辰推出 StepAudio 3 系列语音模型,多款登顶 Artificial Analysis 榜单

摘要

阶跃星辰发布 StepAudio 3 系列五款语音大模型,覆盖实时交互、语音识别、合成、生成与音乐创作,均已上线开放平台。其中 Realtime 模型在 Artificial Analysis 对话动态榜单以 98.9% 综合得分位列全球第一。

9 月 15 日,阶跃星辰正式推出 StepAudio 3 系列语音大模型,包含 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music 五款产品。目前该系列模型已全部上线阶跃星辰开放平台,面向开发者与企业客户提供服务。

据官方介绍,StepAudio 3 系列分别针对真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解以及音乐创作等核心场景设计。其中,StepAudio 3 Realtime 主打原生全双工实时对话能力,在 Artificial Analysis Conversational Dynamics 榜单中以 98.9% 的综合得分排名全球第一。

阶跃星辰方面表示,当前 Realtime 语音产品普遍已支持全双工、打断和低延迟交互,但真正的体验差异在于模型能否在持续对话中边听边理解、判断接话时机,并同步完成推理与任务执行。StepAudio 3 Realtime 正是围绕这一目标进行能力提升,使模型不仅能听懂和回答,还能像真实交流中的人一样参与对话。

多款模型在 Artificial Analysis 榜单中位列全球第一,表明阶跃星辰在语音大模型领域的技术积累已进入全球第一梯队。随着五款模型同步上线开放平台,AI 语音交互、音频生成及音乐创作等方向的开发者将获得新的模型选择。

阶跃星辰语音大模型StepAudio 3Artificial Analysis
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
4
完整版提示词