阶跃星辰推出StepAudio 3系列语音大模型,五款模型登陆开放平台
摘要
阶跃星辰发布StepAudio 3系列语音大模型,包含Realtime、ASR、TTS、Gen和Music五款模型,已在阶跃星辰开放平台上线。该系列多款模型在Artificial Analysis榜单中位列全球第一。
阶跃星辰近日正式推出StepAudio 3系列语音大模型,该系列由五款模型组成,分别为Realtime、ASR、TTS、Gen和Music。目前,这五款模型均已在其开放平台上线,面向开发者与企业用户提供语音相关能力。
从模型构成来看,StepAudio 3系列覆盖了实时交互、语音识别、语音合成、生成以及音乐等多个细分方向。其中,Realtime模型面向实时语音场景,ASR负责语音转文本,TTS则处理文本转语音,Gen和Music分别对应生成与音乐相关任务。
值得注意的是,该系列中的多款模型在Artificial Analysis榜单上取得了全球第一的成绩。Artificial Analysis是业内广泛关注的模型评测榜单之一,其排名通常反映模型在特定任务上的综合表现。
此次发布意味着阶跃星辰在语音大模型领域的布局进一步细化,从识别、合成到生成与音乐,形成了较为完整的产品矩阵。对于开发者而言,五款模型同步上线开放平台,也提供了更直接的技术接入路径。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗