Code & Chain · Signal Desk

OpenAI 推出 GPT-Live 雙向語音模型,同步聆聽說話打破人機互動界限

原始來源cryptobriefing.com補充:tech.yahoo.com

摘要

OpenAI 正式發布 GPT-Live-1,一款支援雙向語音互動的模型,可用於 ChatGPT 中同時聆聽與說話,並能處理插話、保持跨輪次上下文。模型整合即時網路搜尋與記憶功能,免費版用戶可使用 Lite 版本,付費訂戶則享有完整功能。GPT-Live-1 基於五月推出的 GPT-Realtime-2,具備 128k token 上下文長度,定價為每百萬輸入 token 32 美元、輸出 token 64 美元。此次更新為即時語音 AI 應用樹立新標竿,可能帶動去中心化語音代理的運算需求,影響相關基礎設施代幣。

重點整理

  • 語音應用開發者現在能以較低成本導入雙向對話 AI,企業客服與會議助理等場景可望大幅提升效率。
  • 相較於多數語音助手僅支援單向輪流問答,GPT-Live 首次在 ChatGPT 中實現真正同步雙向語音,超越傳統語音助理的互動模式。
  • 開發者可將即時語音互動整合至客服、教育、自駕等應用場景,提升使用者體驗。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。