AI注目記事のキュレーターページ

← 一覧へ戻る

重要度 高2026-07-09 19:46:38

新しいGPT-5.6ファミリー:ルナ、テラ、ソルの登場

サマリー

OpenAIが新たに発表したGPT-5.6ファミリーは、ルナ、テラ、ソルの3つのモデルから成り、長期的なエージェントパフォーマンスでClaude Fable 5を上回る結果を示しています。新しいAPI機能も追加され、効率的な知性の利用が期待されます。価格はモデルによって異なり、コストパフォーマンスが向上しています。

本文

OpenAIの最新のフラッグシップモデルが本日一般公開され、サイズはルナ、テラ、ソルの3種類(小から大へ)があります。新しいモデルの価格は、入力/出力トークン1Mあたり、ルナが1ドル/6ドル、テラが2.50ドル/15ドル、ソルが5ドル/30ドルです。比較として、Claude Opusシリーズは5ドル/25ドル、Claude Fable 5は10ドル/50ドルですが、同じタスクに対する推論トークンの数がモデルによって大きく異なるため、トークンあたりの価格だけでは十分な情報を得られません。

すべてのモデルは2026年2月16日までの知識を持ち、1百万トークンのコンテキストウィンドウと最大128,000トークンの出力をサポートしています。

OpenAIの最大のベンチマーク主張は、長期的なエージェントパフォーマンスに関するもので、あるベンチマークではすべてのモデルがClaude Fable 5を上回っています。GPT-5.6は、55の分野にわたる長期的なプロフェッショナルワークフローの評価で、Solモデルが新たな高得点53.6を記録し、Claude Fable 5(適応推論)を13.1ポイント上回りました。中程度の推論でも、Fable 5を11.4ポイント上回り、推定コストの約4分の1で実現しています。この効率性は、知性をより豊かで手頃にするために不可欠な小型モデルにも及び、GPT-5.6テラとルナはFable 5を約16分の1のコストで上回っています。

興味深いことに、Fable 5がGPT-5.6ファミリーを圧倒したとされる自己報告ベンチマークSWE-Bench Proでは、Fable 5が80%を獲得したのに対し、GPT-5.6 Solは64.6%でした。これがOpenAIが昨日、特にSWE-Bench Proの問題を指摘する記事を公開した理由かもしれません。これらの結果を踏まえ、SWE-bench Proのタスクの約30%が壊れていると推定し、モデル開発者に結果を慎重に確認するようアドバイスしています。

私はGPT-5.6 Solに早期アクセスを持っていますが、非常に優秀であるものの、これまでのところAnthropicのモデルで行っている複雑なコーディングタスクにおいてFableよりも優れているとは感じていません。GPT-5.6の使用に関するモデルガイダンスには興味深い詳細が含まれており、プログラム的ツール呼び出しやマルチエージェント機能などの新しいAPI機能が追加されています。

Contact us

ご質問・ご相談等ございましたらお気軽にご相談ください。

  • フォームでのご相談
    フォームでのご相談

    ホームページ制作、運用・更新における
    ご相談はお気軽にご連絡ください。

    お問い合わせ・ご相談
  • お電話でのお問い合わせ
    お電話でのお問い合わせ

    お電話でのご相談も随時受け付けております。
    見積依頼などもお気軽にご連絡ください。

    052-700-8712 平日 10:00~19:00