GPT Audio
厂商:OpenAI
The gpt-audio model is OpenAI's first generally available audio model. The new snapshot features an upgraded decoder for more natural sounding voices and maintains better voice consistency. Audio is priced...
关键参数
- 上下文长度:128K
- 最大输出:16.4K
- Tokenizer:GPT
- 发布时间:2026-01-19
Token 定价
- 输入价格:$2.50 / 100 万 tokens
- 输出价格:$10.00 / 100 万 tokens
- 综合单价:$4.38 / 100 万 tokens
输入输出模态
文本、音频
典型用例
- 深度推理与复杂分析:数学证明、逻辑推理、多步骤规划,适合科研与金融分析场景。(≈ $0.080/次)
- 语音交互:文字转语音(TTS),支持多种音色与语速调节,适合播客、有声书、IVR 系统。
- 智能客服与对话:FAQ 自动应答、多轮对话、情绪识别,适合电商、金融、政务等场景。(≈ $0.020/次)
- 内容安全审核:自动检测违规内容、仇恨言论、色情暴力,支持自定义规则库与打分阈值。
什么时候选这个模型
基于公开定价与能力字段派生的选型信号(非实测benchmark),最终选型请结合官方文档与你的评测。
- 支持音频:语音转写、语音 Agent、会议纪要分析。
相关问题
- GPT Audio 的 Token 定价是多少? 该模型的输入价为 $2.50 / 100 万 tokens,输出价为 $10.00 / 100 万 tokens,综合单价约 $4.38 / 100 万 tokens。具体价格以 OpenAI 官方页面为准。
- GPT Audio 支持多大的上下文窗口? 上下文窗口为 128K,最大输出约 16.4K,适合处理长文档、多轮对话与复杂推理任务。
- GPT Audio 适合哪些使用场景? 基于其能力与定价,GPT Audio 最适合:深度推理与复杂分析、语音交互、智能客服与对话。可在详情页「典型用例」区查看更详细的场景说明与成本估算。
- GPT Audio 支持哪些输入输出模态? 支持 文本、音频 模态。
- GPT Audio 是免费模型吗? GPT Audio 按 Token 计费,不属于免费模型。
- GPT Audio 由哪家厂商提供? GPT Audio 由 OpenAI 提供。
同厂商其他模型
查看完整信息:GPT Audio