「o4」の検索結果: ユーザー 5件・記事 9件
リード OpenAIは2026年9月13日、推論特化モデル「o4」のAPIおよびChatGPT向け提供を同時開始した。数学(AIME 2026: 94.7%)、科学難問(GPQA Diamond: 89.2%)、実環境バグ修正(SWE-bench Verified: 63.8%)の3指標でPhD相当とされるラインを初めて同時突破。「性能がいつか専門家を超える」という命題が、「どの業務から実装するか...
リード OpenAIは2026年7月4日(米国時間)、推論特化モデル「o4」をAPIおよびChatGPT Plusで正式公開した。コーディングベンチマーク「SWE-bench Verified」の正解率はo3比18.5ポイント増の92.3%、数学オリンピック予選相当の「AIME 2026」では30問中30問正解を記録。「推論AIが人間の専門家水準を超える」がベンチマーク上の話でなく、実作業で問われ...
リード OpenAIが2026年8月10日、推論特化モデル「o4-mini」を正式公開した。前世代o3-miniと比較して入力1Mトークンあたりのコストを約65%削減しながら、AMC/AIME 2025数学競技で正答率89.4%を達成。「安いと精度が落ちる」というトレードオフが崩れつつあり、API経由でビジネス展開するスタートアップの設計判断に即座に影響する。 何が起きているのか OpenAIは日...