快讯 23:58无问芯穹与华环电子签署战略合作,共同探索国产异构算力AI基础设施新方向23:48日本游戏业AI渗透率飙升至85.8%,超六成开发者每日使用23:28特斯拉Optimus在华启动量产审厂,供应链企业回应不一 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

论文 今天 · 星期六 · 09-19 19:12 约 1 分钟读完

SpaceXAI推Grok语音转文本2.0,错误率减半价格不变

摘要

SpaceXAI发布Grok Voice Transcribe 2.0,错误率较1.0降低约一半,定价维持每小时0.10美元批量、0.20美元流式不变。该模型在Artificial Analysis全部32款流式模型中准确率居首,并在四个内部数据集评测中全面超越前代。

SpaceXAI于当地时间9月18日推出语音转文本模型Grok Voice Transcribe 2.0,核心升级在于错误率较上一代降低约一半,而定价保持完全不变。该模型构建于Grok Voice底层的音频基础模型之上,延续了后者在实际业务中的规模化部署路径。

据官方披露,Grok Voice目前每天承接数万通客服电话,转录数百万小时的视频旁白,并驱动实体硬件中的语音智能体,其中包括特斯拉车辆搭载的Grok助手。这一业务体量为新模型的迭代提供了真实场景的验证基础。

在第三方基准Artificial Analysis榜单中,Grok Voice Transcribe 2.0在全部32款流式模型里准确率排名第一。除公开基准外,SpaceXAI还基于线上业务采样的四个内部数据集系统评测词错误率,覆盖客服电话音频、与Grok的日常英语对话、电话号码与邮箱地址等口述信息、以及多语种简短语音指令。四个数据集上,2.0版本均全面超越1.0。

定价方面,Grok Voice Transcribe 2.0与1.0完全一致:批量转录每小时音频0.10美元,实时流式转录每小时0.20美元。对已接入该服务的开发者与企业而言,此次升级意味着在成本不变的前提下获得显著的准确率提升。

SpaceXAIGrok Voice Transcribe语音转文本模型发布
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
41
企业落地案例
5
完整版提示词