OpenAI发布语音模型GPT-realtime

首页 > 国际 > 正文

来源：科技日报 2025-09-01 10:25:42

　　8月28日，美国人工智能公司OpenAI发布了其所谓“最先进的语音到语音模型”GPT-realtime，以及配套的Realtime API（实时应用程序接口）。

　　据OpenAI公司介绍，该模型在理解复杂指令、精准调用工具以及生成自然、富有表现力的语音方面表现突出，并在客户服务、教育、个人助理等多种场景中具备广泛应用潜力。

　　与传统语音模型不同，GPT-realtime新增了Marin与Cedar两种极具特色的语音，同时对原有8种语音进行了全面升级。模型不仅能生成自然流畅的语音，还能够敏锐捕捉笑声等非语言信号，在句子中间自如切换语言，并可根据场景需求灵活调整语气，使语音交互更贴近真实人类沟通。

　　通过Realtime API，开发者可实现实时语音输入输出，不必再经过繁琐的多模型转换流程。在实际应用中，这套技术可用于客户服务系统，让虚拟助手即时解答问题，提高效率和体验。它还可应用于教育领域，实现语音对话和口语练习。而在个人助理、办公或智能家居场景中，用户能通过语音快速完成安排或查询信息。结合图像或文本输入，开发者还能打造更智能的虚拟助手或机器人系统。

　　OpenAI表示，GPT-realtime和Realtime API已于8月28日起面向所有付费开发者开放。

责任编辑：辛文

相关新闻

超级碗全国城乡足球联赛惠州赛区即将开赛体育赋能乡村振兴

更多>> 最新文章

汾阳清香润“北国” 匠心臻酿醉“春城”

　　汾清天下全国行第三十一站走进吉林长春。　　金秋八月，北国春... ...[详细]
· 汾阳清香润“北国” 匠心臻酿醉“春城”
· 叁芯科技集团隆重盛典 | 共襄盛举，筑梦未来
· 浙江长兴：推进土地综合整治助力美丽乡村建设
· 2025服贸会九月启幕五大特色亮点纷呈
· 琴澳跨境救护车服务启动

更多>> 热门文章

更多>> 视界