OpenAI发布两款实时语音模型,p95延迟降低25%

7月7日,OpenAI宣布在其API中上线gpt-realtime-2.1和gpt-realtime-2.1-mini两款新模型,专为低延迟语音智能体与多模态交互优化。官方称通过缓存机制改进,p95延迟至少下降25%。前者强化字母数字识别、噪声处理与中断响应;后者支持实时音文输入、工具调用及5档可配推理强度(默认low)。文本、音频、图片输入/输出按Token计费,mini版成本显著降低。模型即日起面向开发者开放调用。

上一篇:

下一篇:

发表回复

登录后才能评论