OpenAI 将 GPT-Live-1 语音模型开放至 API,开发者可构建实时对话智能体
摘要
OpenAI 宣布 GPT-Live-1 正式登陆 API,该模型即 1-800-ChatGPT 背后的语音能力。开发者可将其接入应用,获得边说边听的自然对话语音智能体,并搭配自选模型与 harness 使用。
OpenAI 今日宣布,旗下语音模型 GPT-Live-1 正式开放至 API。该模型正是驱动 1-800-ChatGPT 电话服务的底层语音能力,此前仅通过官方渠道提供,如今开发者可直接调用。
根据官方说明,GPT-Live-1 支持边说边听的自然对话模式,开发者将其接入应用后,可构建具备实时语音交互能力的智能体。与传统的轮次式语音接口不同,该模型在对话流畅度与响应节奏上更接近真人交流。
在集成方式上,GPT-Live-1 允许开发者搭配自选的模型与 harness 使用,意味着语音层与推理层可以解耦,开发者能够根据具体场景灵活组合技术栈,而不必绑定单一模型方案。
此次开放标志着 OpenAI 将电话服务中验证过的语音能力向开发者生态释放。对于需要语音智能体的应用场景而言,API 化意味着更低的接入门槛和更高的定制自由度,实时语音交互的产品化进程有望进一步提速。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗