OpenAI 和阿里巴巴今日联合发布了全新的语音 AI 模型
OpenAI 推出了两款新模型:GPT-Live-Transcribe 和 GPT-Transcribe。前者专为低延迟的实时语音转文字任务设计,后者则针对已完成的音频文件和异步批量处理进行了优化。两款模型现在均可利用录音的自由形式上下文信息(如关键词、特定领域术语的名称及预期语言)来提升准确率。其中,GPT-Live-Transcribe 还能自动将此前转录的内容作为上下文参考。
GPT-Live 正式上线!ChatGPT 新版语音碾压旧高级语音模式
OpenAI 今日官宣 ChatGPT 语音功能迎来重大更新,由新一代语音模型 GPT‑Live 驱动。2024 年上线的高级语音模式曾让大众初次体验流畅语音对话,而本次更新代表 ChatGPT 语音交互迈出全新关键一步。
OpenAI 连发三款实时音频模型,打造下一代语音智能体
OpenAI 刚刚通过 API 面向开发者发布了三款全新的实时音频模型:GPT-Realtime-2、GPT-Realtime-Translate 和 GPT-Realtime-Whisper。这一系列更新旨在为应用开发者和智能体构建者提供更自然的语音交互、实时翻译以及低延迟的语音转文字能力。
办公软件,就选简鹿
简便、快捷、高效