OpenAI WebRTC 語音會話更新:整合文件上下文並支援 GPT-Realtime-2
Simon Willison 更新其 OpenAI WebRTC Audio Session 工具,加入文件上下文功能,直接提升與 OpenAI API 互動的實戰能力。
Simon Willison 於 2024 年 12 月首次建構了一個基於 OpenAI WebRTC API 的工具,旨在試驗其即時語音模型。近期,OpenAI 推出了全新的 GPT-Realtime-2 模型,該模型被宣傳為「首個具備 GPT-5 級推理能力的語音模型」,知識截止日期為 2024 年 9 月 30 日。由於該模型尚未整合至 ChatGPT iPhone 應用程式,作者決定重新檢視其舊有的實驗平台。現在,使用者不僅可以選擇更強大的 GPT-Realtime-2 模型,還能 • 貼入大量文件情境,以便在瀏覽器中針對特定資訊進行語音對話。 • 這項更新旨在提供一個平台,讓使用者能夠以對話形式探索任何有價值的資訊。
作者開發此工具的目的是為了在官方應用程式之外,提供一個更靈活的方式來體驗 OpenAI 最新的語音互動技術。
來源:Simon Willison
閱讀原文 ↗