gpt-4o-transcribe client.audio.transcriptions.create fails on all supported audio types (“This model does not support the format you provided.”)
メンテナーはふだん 1 日以内に返信
評価
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 初心者へのやさしさ
- 25/100
- issue の種類
- バグ
- 明瞭さ
- 説明が足りない
- 活発さ
- 停滞
- 技術スタック
- python
- 領域
- api, audio-video-rtc
調査の方向性
まず、issue にある WAV、MP3、M4A、BytesIO の例を使い、client.audio.transcriptions.create 経由で報告された呼び出しを再現します。文字起こしリクエストの経路を調査し、whisper-1 と動作を比較します。完了の条件は、サポート対象の音声入力が gpt-4o-transcribe で失敗しなくなること、またはライブラリと API の境界が明確に特定されることです。
索引モデルが issue の本文から書いたものです。
説明
Confirm this is an issue with the Python library and not an underlying OpenAI API
- This is an issue with the Python library
Describe the bug
When calling client.audio.transcriptions.create(model="gpt-4o-transcribe", file=...) I consistently receive:
openai.BadRequestError: Error code: 400 - {'error': {'message': 'This model does not support the format you provided.', 'type': 'invalid_request_error', 'param': 'messages', 'code': 'unsupported_format'}}
regardless of supplying the file as:
- wav (PCM‑16, 16 kHz, mono)
- mp3
- m4a (AAC)
- an in‑memory BytesIO buffer with .name set to the proper extension
The same code works fine with the whisper-1 model, but gpt-4o-transcribe/mini always rejects the input, even though I have verified via ffprobe/sox that my files are valid PCM‑16 WAV, standard MP3, or AAC.
To Reproduce
from openai import OpenAI
from dotenv import load_dotenv
from io import BytesIO
import os
load_dotenv()
client = OpenAI()
# 1) Try WAV on disk
with open("audio.wav", "rb") as f:
resp = client.audio.transcriptions.create(
model="gpt-4o-transcribe",
file=f
)
print(resp)
# 2) Try MP3 on disk
with open("audio.mp3", "rb") as f:
resp = client.audio.transcriptions.create(
model="gpt-4o-transcribe",
file=f
)
print(resp)
# 3) Try M4A on disk
with open("audio.m4a", "rb") as f:
resp = client.audio.transcriptions.create(
model="gpt-4o-transcribe",
file=f
)
print(resp)
# 4) Try BytesIO wrapper
data = open("audio.wav", "rb").read()
buffer = BytesIO(data)
buffer.name = "audio.wav"
buffer.seek(0)
resp = client.audio.transcriptions.create(
model="gpt-4o-transcribe",
file=buffer
)
print(resp)
Code snippets
from openai import OpenAI
from dotenv import load_dotenv
load_dotenv()
client = OpenAI()
audio_file = open("temp/audio.wav", "rb")
transcription = client.audio.transcriptions.create(
model="gpt-4o-transcribe", file=audio_file
)
print(transcription.text)
OS
Windows 11
Python version
3.13
Library version
openai==1.97.0
- 主要言語
- Python
- スター
- 31.8k
- フォーク
- 7.3k
- 平均マージ
- 1日 3時間
- マージ済み PR(30日)
- 131
環境構築
このプロジェクトの開発コンテナを、あなたの GitHub アカウントでブラウザ上に起動します。
- Dockerfile・Docker Compose ファイルなし
- プルリクエストのテンプレートあり
- コントリビューションガイドを読む
はじめの一歩
- issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
- 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
- リポジトリをフォークし、ブランチを切って変更します。
- issue 番号を参照したプルリクエストを送ります。
openai/openai-python のほかの issue
-
難易度 2/5 1〜3時間 初心者へのやさしさ 72/100
openai/openai-python#4022 · コメント 19 件 ·
メンテナーはふだん 1 日以内に返信
-
fix(auth): SubjectTokenProviderError drops response and duplicates error message in workload identity providers対応中かも @mohmedmm が 9 日前に担当しました。 オープン
難易度 2/5 1〜3時間 初心者へのやさしさ 86/100
openai/openai-python#4017 · コメント 3 件 ·
メンテナーはふだん 1 日以内に返信
-
Querystring drops explicit empty-string scalar values対応中かも @sylvesterkaczmarek が 31 日前に担当しました。 オープンsdk-breaking-change v4
難易度 2/5 1〜3時間 初心者へのやさしさ 86/100
openai/openai-python#3837 ·
メンテナーはふだん 1 日以内に返信
-
Define + export `ServiceTiers` string literal対応中かも @SparshGarg999 が 58 日前に担当しました。 オープン
難易度 2/5 1〜3時間 初心者へのやさしさ 68/100
openai/openai-python#3556 · コメント 3 件 ·
メンテナーはふだん 1 日以内に返信
-
Empty OPENAI_BASE_URL prevents fallback to default API endpoint対応中かも @Sehastrajit-S が 24 日前に担当しました。 オープンbug
難易度 2/5 1〜3時間 初心者へのやさしさ 68/100
openai/openai-python#2927 · コメント 6 件 ·
メンテナーはふだん 1 日以内に返信
openai/openai-python の issue をすべて見る
似ている issue
-
難易度 1/5 1時間未満 初心者へのやさしさ 60/100
521xueweihan/HelloGitHub#3924 ·
-
難易度 2/5 1〜3時間 初心者へのやさしさ 67/100
wilbowes/EchoMuse#869 · コメント 1 件 ·
メンテナーはふだん 1 日以内に返信
-
難易度 1/5 1時間未満 初心者へのやさしさ 85/100
-
namespace operations
難易度 1/5 1時間未満 初心者へのやさしさ 72/100
EclipseFdn/open-vsx.org#14043 ·
メンテナーはふだん 1 日以内に返信
-
test: TestServeUntilStale races the server's close against the client's sendall (BrokenPipeError under load)対応中かも @evoludigit が今日担当しました。 オープン
難易度 1/5 1時間未満 初心者へのやさしさ 89/100
メンテナーはふだん 1 日以内に返信