OpenAI、GPT-6 Sol/Lunaの画像認識を劣化させていた不具合を修正
OpenAIGPT-6画像認識API開発者向け
OpenAIはAPIチェンジログで、GPT-6 SolとGPT-6 Lunaの画像入力に影響していたエンコーディングの不具合を修正したと公表した。画像を含むタスク、とくにコンピュータ操作系のワークフローで精度が改善する。画像入力に依存する実装は評価をやり直すよう案内されている。
何が発表されたか
- 9月25日付のOpenAI APIチェンジログで、GPT-6 Sol/GPT-6 Lunaの画像エンコーディング不具合の修正を告知
- 不具合により、両モデルの視覚的な理解が劣化していた
- 画像入力を伴うタスク、とくにコンピュータ操作(computer use)のワークフローで性能が改善する
- 画像に依存する実装では、評価(eval)の再実行を推奨している
開発者への影響
- 両モデルは9月22日リリース。直後の数日に画像入力のベンチマークを取っていた場合、その数値は当てにならないので取り直す必要がある
- 「画像を読ませても精度が出ないのでモデルを変えた」という判断をこの数日で下した人は、前提が変わったので再評価の価値がある
- 制作実務では、デザインカンプのスクリーンショットからコードや文言を起こす用途、帳票・レシートの読み取り、EC商品画像からの属性抽出などが対象。プロンプトを変えていないのに出力が変わりうるため、検収基準を持っている案件は再確認したい
補足
このチェンジログは日付ごとのエントリ形式で、個別エントリの固有URLは提供されていない。
