07:06IT之家(博客/媒体)OpenAI 推出 GPT-Live-Transcribe 和 GPT-Transcribe 两种转录模型,已开放 API 调用。GPT-Live-Transcribe 专为低延迟实时转录设计,费用每分钟 0.017 美元;GPT-Transcribe 用于异步转录,费用每分钟 0.0045 美元。在 Context Aware ASR 基准上,GPT-Transcribe 语义准确率从无上下文的 41.6% 提升至有上下文的 45.2%。在 Common Voice 22 种语言上,GPT-Transcribe 转录错误率为 19.27%,低于 Whisper(whisper-1)的 40.37%。在真实世界音频九种语言上,其转录错误率 8.98%,Whisper 为 15.21%。AI模型OpenAIGPT-Live-TranscribeGPT-Transcribe10 个信源在谈事件专题推荐理由:OpenAI 出了两款转录模型,GPT-Live-Transcribe 实时转录延迟低,GPT-Transcribe 批量处理更便宜,错误率比 Whisper 低一半多。原文稍后读已读值得跟进有用关注 OpenAI
02:26官方一手@OpenAIDevs@OpenAIDevs精选OpenAI 在 API 中推出两个新转录模型:GPT-Live-Transcribe 专为低延迟实时转录设计,GPT-Transcribe 优化了已完成音频文件的异步转录和批量处理。这两个模型能更好理解上下文,在口音、多种语言、短句、数字、专业术语以及嘈杂背景下的语音识别准确率更高。AI产品GPT-Live-TranscribeGPT-TranscribeOpenAI10 个信源在谈事件专题推荐理由:OpenAI 出了两个新转录模型,一个实时低延迟,一个异步批量处理,对口音和噪音场景更准。做语音识别应用的话可以试试。原文稍后读已读值得跟进有用关注 GPT-Live-Transcribe