OpenAI、「GPT-6 Sol」「Luna」公開 Astra並の性能でコストはGPT-5.6の半額
OpenAIは22日(米国時間)、最上位モデル「GPT‑6 Astra」と同じGPT-6シリーズで、高い知能とコスト効率を両立した新モデル「GPT‑6 Sol」、「GPT‑6 Luna」を提供開始した。GPT-6 Astraを最上位モデルとし、Sol、Lunaの3つのモデルを用途やコストに応じて選択可能となる。
ChatGPT Work/Codexにおいて、Plus(月3,000円~)、Pro(同16,800円~)、Business、Enterprise、Eduのすべてのユーザーに提供する。FreeとGo(月1,400円)ユーザーは、デスクトップアプリでGPT‑6 Lunaを利用できる。なお、現時点ではChatでは利用できない。OpenAI APIでは、gpt-6-solおよびgpt-6-lunaとして提供開始している。
なお、GPT-5.6シリーズでは上からSol、Terra、Lunaの3つのモデル展開だったが、GPT-6シリーズではAstraが最上位となり、Sol、Lunaの3モデルとなり、Terraが無くなっている。
GPT‑6 SolとLunaはGPT‑6 Astraと同様の手法で学習され、専門業務、事実正確性、コーディング、コンピュータ利用、アラインメントにおけるAstraのパフォーマンスやその技術を、より高速で手頃な価格のモデルにも反映させている。
GPT-6モデルは、各モデル階層における高い能力と、大規模かつ効率的に提供するインフラを組み合わせることでコスト競争力を強化。キャッシュと推論の改良により、そのコスト削減分を、GPT-5.6の価格と比較してSolおよびLunaのAPI価格を50%引き下げた。
100万トークンあたりの価格はGPT-6 Solが入力2ドル(GPT-5.6 Solは4ドル)、出力10ドル(同20ドル)で50%安価となった。GPT-6 Lunaは入力0.2ドル(GPT-5.6 Lunaは0.4ドル)、出力は0.5ドル(同1.2ドル)でこちらも50%削減されている。
GPT‑6 Astraは、引き続きOpenAIの最上位モデルで、最高の結果を求める場合はAstraを活用する。GPT‑6 SolとLunaは、複雑な作業を遂行するために最も有用な機能において、皆様がすでに使い慣れたモデルに知能の向上とコスト効率をもたらす。
GPT‑6 Solは、困難な業務タスクを処理できるだけでなく、使用制限が少なく、コストの削減により、反復作業を実現可能とする。同価格帯の競合モデルと比較して、より高い性能や優れた結果を提供できるという。
アプリ横断的なビジネスワークフローをテストする「AutomationBench」において、GPT‑6 Solは「xhigh」エフォート設定で、Claude Opus 5の「max」エフォート設定を上回る性能を発揮。タスクあたりのコストはOpus 5の9%に留まるという。また、「high」エフォート設定では、GPT‑6 Lunaは前世代モデルより5.4パーセントポイント向上し、タスクあたりのコストは58%低減する、
AutomationBenchにおけるGPT‑6 Sol (xhigh)のスコアは33.2%で、GPT‑6 Astra(low)の 30.3%、Claude Opus 5(max)の26.9%を上回りながら、コスト効率は3.9倍、11.1倍高いとする。
コンピュータ上で行なわれる専門業務のベンチマーク「Agents’ Last Exam V1」においては、最大エフォートモードのGPT‑6 Solのスコアは56.4%。Claude Opus 5の最高スコアを越えながら、タスクあたりのコストは60%低くなった。GPT‑6 Lunaも大幅に改善しており、高いエフォートレベルでは、コストが約100分の1でGPT‑5.6 Solと同等の性能を発揮できるという。
また、GPT‑6 Solは前世代モデルに比べて誤りを約半分に減らし、はるかに低いコストでAstraレベルの信頼性に近づいているという。
コーディングでは、より長期間かつ要求の厳しいタスクに対応。「FrontierCode」において、GPT‑6 SolはGPT‑5.6 Solに比べて大幅な性能向上を示し、はるかに低いコストでClaude Fable 5.1 xhighと同等の性能を発揮した。
「DeepSWE v1.1」において、GPT‑6 Solは最大のエフォートで68.8%のスコアを記録。Claude Fable 5の「xhigh」モードの最高スコアである69.9%から1.1パーセントポイント差で、タスクあたりのコストは約80%低い。Luna(max)は66.6%で、Opus 5とFable 5のmediumエフォートに匹敵しながら、タスクあたりのコストは、Opus 5より93%、Fable 5より96%低くなった。
コンピュータ利用(Computer Use)においては、GPT‑6 Astraが依然として最高のモデルとなるが、GPT‑6 SolとLunaもコスト効率に優れたパフォーマンスを提供。ベンチマーク「OSWorld 2.0 offline」では、GPT‑6 Solは「xhigh」のエフォートレベルで60.5%となり、Opus 5の「medium」(60.3%)と同等のスコアを達成しながら、タスクあたりのコストは約80%低くなる。また、GPT‑6 Luna(max)は、GPT‑5.6 Sol(medium)の10分の1のコストで、スコアを上回っている。
また、応答(コラボレーションスタイル)についても改善し、内容の本質を損なうことなく、より明快で、専門用語が少なく、不自然な表現や価値の低い詳細を削減。全体として回答がわずかに短くなる。そのほか、エージェントや長文会話におけるキャッシュ機能を改善している。
アラインメント(人間の意図や価値観との整合性)も継続的に改善。Astraで導入されたアラインメント技術に基づき、コーディング作業に関する誤解を招く主張の発生率が低下している。
なお、22日にはAnthropicも主力モデルとなる「Claude Opus 5.5」を提供開始。Fable 5.1並みの性能をOpus 5より40%安価にするなど、上位モデルに迫る性能をより安価に提供する手段を強化しており、さらに安価なSonnet 5.5/Haiku 5.5も近日公開予定としている。
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.









