OpenAI: GPT Transcribe API
GPT Transcribe 是一个语音转文本模型,适用于已完成的音频文件、流式文件转录以及通过 WebSocket 进行的实时会话中的已提交回合。它支持非结构化上下文、关键词提示和多语言提示,以改进领域术语、多语言音频和语码转换的转录。
- 上下文窗口: 16,000 tokens
- 最大输出: 2,000 tokens
- 输入模态: audio, text
- 输出模态: text
- 工具调用: 支持
- 文件输入: 支持
- 发布日期: 2026-07-28
- 知识截止: 2024-05-31
常见问题
GPT Transcribe 的上下文窗口有多大?
GPT Transcribe 支持最高 16,000 token 的上下文窗口。
GPT Transcribe 支持函数调用(Function Calling)吗?
支持。GPT Transcribe 支持工具调用 / 函数调用。
GPT Transcribe 的知识截止日期是?
GPT Transcribe 的知识截止日期为 2024-05-31。