GPT-6.1 SolとCodexクラウド化が開発に与える影響
この記事では、2026年9月29日(米国時間)にOpenAIが開いた開発者向けイベント「DevDay 2026」の発表のうち、システム開発に関わるものを整理します。あわせて、新規事業やシステム開発を進める会社にとって何が変わりうるのかを、事実と私たちの見方を分けてお伝えします。
DevDay 2026で発表されたこと
OpenAIは、継続的な役割を担えるエージェントと、人とAIが協力する新しい働き方を発表しました。発表は20以上にのぼります。この記事では、開発に関わる3つに絞ります。なお、以下は2026年9月30日時点で公開されている情報にもとづきます。
GPT-6.1 Sol:性能と価格のバランスを見直したモデル
OpenAIはGPT-6.1 Solについて、エージェント型のコーディング、コンピュータ操作、専門的な業務で、最上位モデルGPT-6 Astraに近い性能を、Astraの標準トークン価格の5分の1で提供すると説明しています。トークンとは、AIが文章を処理するときの単位で、API(他のソフトからAIを呼び出す窓口)の利用料はこの量で決まります。
提供条件は次のとおりです。
- ChatGPT WorkとCodexで、Plus、Pro、Business、Enterprise、Eduの利用者に提供されます。
- Chatでは未提供です。開発者はAPIから「gpt-6.1-sol」として使えます。
- 2026年9月時点のAPI標準価格は、入力100万トークンあたり2ドル、出力100万トークンあたり10ドルです。
精度面では、OpenAIによると、難しい質問に対して事実の誤りを含む回答の割合が、低い推論設定でGPT-6 Solの11.4%から7.7%に下がったとのことです。これはOpenAI自身が示した評価結果です。
Codexのクラウド化と、レビュー・セキュリティ機能
Codexは、OpenAIのソフトウェア開発向けAIエージェントです。今回の発表では、パソコン上、スマートフォンからのリモート操作、任意の端末からのクラウド実行のどれでも動かせるようになりました。主な内容は次のとおりです。
- 再利用できるクラウド開発環境があり、チームで承認済みの設定と権限を共有できます。
- 刷新されたCodex CLIは音声での操作と、複数タスクを割り振って追跡する/agentsビューに対応します。
- ChatGPTデスクトップアプリのコードレビューは、クラウド上で変更内容の最初のチェックを自動で行い、結果をGitHubのプルリクエストやGitLabのマージリクエストに共有できます。
- Codex Security Cloudは、リポジトリのセキュリティ上の弱点を調べ、修正案を自動で用意します。
Agents APIのコンピュータ操作と、Decisions API
Agents APIはコンピュータ操作に対応し、ソフトウェアを操作してタスクをこなすエージェントを作れるようになりました。Codexのマルチエージェント機能やツール検索なども、自社のアプリに組み込めます。
Decisions APIは、あらかじめ決めた質問と有限の回答候補に対して、AIに答えを選ばせるものです。コンテンツの分類、リクエストの振り分け、エージェントの次の行動の選択に使えます。
確認しておきたい注意点
事実として、次の点には注意が必要です。
- Decisions APIは2026年9月29日に限定プレビューが始まり、広く公開されるのは「数日以内」とされています。一方、別の媒体は、正式な公開は数週間後になる見込みと伝えています。時期は流動的なので、利用を考えるなら公式の案内を確認してください。
- 速度を上げる有料プラン「Ultrafast」は高価とも報じられています。常用するかは、用途ごとの費用で判断するのが現実的です。
- OpenAIは最新のフラッグシップモデル「GPT-6.1 Astra」について、セキュリティ上の懸念から公開しないと発表しました。今回の「Sol」はそれとは別の、価格を抑えたモデルです。
- 性能の数字は、主にOpenAIが公表した評価です。他社モデルとの比較は、見るベンチマークで結果が分かれます。The New Stackは、DeepSWEではGPT-6.1 Solが上回り、AutomationBenchではSonnet 5.5が上回ったと伝えています。前日に取り上げたモデルの話はClaude Sonnet 5.5の発表と新規事業への影響にまとめています。モデルごとの違いは開発向け生成AI比較|Claude・ChatGPT・Geminiもご覧ください。
編集部の見方:新規事業・システム開発で何が変わるか
ここからは、私たちJustFit編集部の見方です。発表された事実を踏まえた推測を含みます。
1. 試作にかかる手間が下がる方向に進む
モデルの価格が下がり、Codexのようなコーディングエージェントがクラウドで動くようになると、試作を何度も回すハードルは下がると考えられます。特に新規事業では、最初の案が正解とは限りません。作って確かめ、直して、また確かめる回数を増やしやすくなります。動く試作で検証する考え方は、新規事業のアイデア検証方法|動くシステムで確かめる手順で整理しています。
2. 「何を作るか」を決める側の重みが増す
AIが実装やレビューの最初の一次チェックを担える範囲は広がっています。そのぶん、何を作るのか、誰のどの課題を解くのか、どこまでを自社で作り込むのかといった判断の価値は、相対的に大きくなります。これは人が担う部分です。要件の整理は要件定義とは?新規事業で抜け漏れとズレを防ぐ進め方が参考になります。
3. 自動で進むほど、確認の設計が重要になる
エージェントが自動でコードを書き、ソフトを操作し、修正案まで用意するようになると、確認すべき場所は変わります。コードレビューの自動化やセキュリティスキャンは助けになりますが、最終的に品質を判断するのは人です。この点はAI開発でも品質には人の確認が必要な理由で詳しく書いています。
4. モデルの入れ替わりが速い前提で選ぶ
GPT-6 Solの公開からわずか1週間でGPT-6.1 Solが登場しました。特定のモデルや機能に依存した作りにすると、見直しの負担が大きくなります。モデルを差し替えやすい構成にしておくことが、発注や設計の段階で効いてきます。
読み手の会社が今できること
新しいツールをすぐ導入するかどうかよりも、自社の進め方を点検する機会にするのが現実的です。
- 作りたいものの「判断基準」を言葉にする。 何が動けば事業として見込みがあると言えるのか、先に決めておきます。
- 小さく作って確かめる範囲を決める。 最初に確かめたい機能を1つか2つに絞ると、AIを使った試作の効果を測りやすくなります。進め方はMVP開発・プロトタイプ開発の進め方|新規事業の判断法をご覧ください。
- AIに任せる範囲と、人が確認する範囲を分ける。 役割分担の考え方はAI駆動開発とは|AIと人の役割分担と発注側の要点にまとめています。
- データの扱いを確認する。 OpenAIは企業が自社データの保護に自信を持ってAIを使えるようにする「OpenAI Private Intelligence」を発表しています。ただし詳細は今後の確認が必要です。社内ルールと合わせて検討してください。
- 外部の開発会社に頼む場合は、実物で認識を合わせられるか確かめる。 言葉だけの仕様では、AIを使っても認識のズレは残ります。システム開発の認識のズレを防ぐ、実物を見ながらのすり合わせやシステム開発の外注ガイド|依頼の流れと失敗の防ぎ方も参考になります。
まとめ
- OpenAIはDevDay 2026で、GPT-6.1 Sol、Codexのクラウド環境、Agents APIのコンピュータ操作、Decisions APIなどを発表しました。
- 事実として、GPT-6.1 Solは上位モデルに近い性能を低い価格で提供するとされています。Decisions APIは限定プレビュー段階で、公開時期の報道は分かれています。
- 私たちの見方では、試作を繰り返すコストが下がる一方、「何を作るか」の判断と「品質の確認」の重みは増します。
- 今できるのは、判断基準の言語化、小さな検証範囲の設定、AIと人の役割分担の整理です。
JustFitは、構想をもとに約1ヶ月で実際に動くプロトタイプを先に開発し、実物を見てから契約を判断できる受託開発サービスです。新規事業のアイデアをシステムとして形にしたい場合は、JustFitのサービス紹介もあわせてご覧ください。
参考にした情報
- DevDay 2026 Recap(OpenAI)
- Introducing GPT-6.1 Sol(OpenAI)
- OpenAI gives Codex reusable cloud environments that work across devices(TechCrunch)
- OpenAI expands Codex and its API at DevDay with security scans, a Decisions API, and Ultrafast(The Decoder)
- OpenAI’s new GPT-6.1 Sol undercuts its own Astra flagship(The New Stack)
- The 5 biggest announcements from OpenAI’s blockbuster AI conference(Axios)