2026年7月AIモデル報告書:Kimi、DeepSeek、Qwen、Gemini、GPT、Claude
2026年7月24日に検証済みのモデルトラッカーで、リリース、プレビュー、延期、アクセス変更、そして現在開発者が直面する実践的な判断について網羅しています。

2026年7月には十分な量のモデル関連ニュースが発表され、静的な「最高のLLM」リストが出版される前に陳腐化してしまいました。有用な形式はステータスレポートです:現在利用できるもの、プレビュー版のままのもの、延期されているもの、緊急な移行作業、そしてまだ将来の約束に依存しているもの。
この最新のAIモデルに関する2026年7月のレポートは、7月24日時点で検証済みです。製品の状態には各プロバイダーの公式文書を参照し、キャパシティや遅延に関する状況には定められた報告手法を使用しています。ベンダーが提示するベンチマークの主張を独立した事実として位置づけることは避けています。
1分後のステータス
2026年7月24日時点での2026年7月モデルの市場状況:混雑しており、高性能で、複数のリリースステージに分かれています。 GPT-5.6とClaude Fable 5は利用可能です。Kimi K3は提供が開始されていますが、モデルの重みは7月27日にリリース予定です。DeepSeek V4はオープンウェイトのプレビュー版です。Qwen3.8-Maxは選定製品向けプレビュー版です。Gemini 3.6 Flashと3.5 Flash-Liteは利用可能ですが、3.5 Proはパートナー向けテスト中です。
その表現の使い分けは重要です。「発表された」「プレビュー版」「特定の製品を通じて利用可能」「一般提供開始」「オープンウェイト」は、それぞれ異なるアクセスレベルを指します。あるモデルがあるサブスクリプション製品で使用可能な状態である一方で、その重み、技術レポート、公開API、またはエンタープライズ向けサービスレベルのコミットメントはまだ提供されていない場合があります。これらのステージを互いに置き換え可能なものとして扱うことで、有用なモデルガイドが誤情報に変わってしまうのです。
トラッカー
| モデル | 7月24日時点のステータス | 実用上の注意点 | |---|---|---| | GPT-5.6 ソル、テラ、ルナ | 一般提供開始済み | OpenAIの各製品およびAPIで利用可能であり、機能とコストに応じた階層プランが用意されています | | クロード・フェイブル5 | 利用可能 | 野心的なコーディングや長期的な知識作業に適した環境 | | Kimi K3 | サービス提供可能 | 7月27日に全重量データと詳細な技術情報を発表予定 | | DeepSeek V4 Pro / Flash | プレビュー版;APIとウェイトが利用可能 | 廃止予定の従来のエイリアスの代わりに明示的なモデル名を使用する | | クウェン3.8マックス | 選定された一部製品でプレビュー提供 | 完全版の公開技術資料およびリリースパッケージは依然として限定的に提供されています | | Gemini 3.6 フラッシュ | 利用可能 | コーディング、ナレッジ、マルチモーダル、エージェントタスク向けのGoogleの現行主力モデル | | Gemini 3.5 Flash-Lite | 利用可能 | 高スループットで低コストなGeminiルート | | ジェミニ3.5プロ | パートナー向けテスト | Googleの7月21日の投稿に一般提供開始日は記載されていません |
3つの運用ストーリー
最初に、処理能力は競争優位性です。Kimiの一時的なサブスクリプション停止は、ローンチに成功した後でさえ、需要が推論処理の供給を上回る可能性があることを示しました。次に、ライフサイクル管理は製品品質です。DeepSeekがdeepseek-chatとdeepseek-reasonerを廃止したことで、開発者は明示的なV4ルートを使用することを余儀なくされます。最後に、自制心が重要です。Googleは人工的なGA(一般提供開始)日付を宣言する代わりに、3.5 Proをテスト段階に留めたまま新しいFlashモデルをリリースしました。
これらのストーリーは、なぜ購入者がすべての社内カタログにフォールバック、モデルアダプタ、回帰テストスイート、およびリリースステータスフィールドを必要とするのかを説明しています。
今月テストすべき項目
長時間のコーディング作業、視覚的なフィードバック、または大規模な知的タスクが主要な用途である場合にKimi K3をテストしてください。DeepSeek V4 FlashとProをそれぞれ別のルートとしてテストし、一方のモデルがすべてのトラフィックを処理すべきだと仮定しないでください。プレビューが実際に提供されている製品内でQwen3.8-Maxを評価してください。スケーラブルなエージェントワークフローについては、Gemini 3.6 Flashと3.5 Flash-Liteを比較してください。最も困難なタスク向けのフロンティアベイクオフにはGPT-5.6 SolとClaude Fable 5を含めておいてください。
2026年7月モデルの市場を評価するための実践的な方法
リーダーボードで始めないでください。自身の業務から抽出したタスクパケットから始めてください:代表的な入力10件、期待される結果、制限時間、および許容できない失敗の短いリスト。コーディングエージェント向けの場合は、バグ修正、小さな機能追加、テスト修正、およびリポジトリナビゲーションタスクを含めてください。研究業務向けの場合は、回答が時間とともに変化する質問を含め、かつリンクされた情報源の使用を義務付けてください。ドキュメント作業向けの場合は、不整列なテーブル、スキャン済みページ、および矛盾する指示を含めてください。
すべての候補モデルに対して、同一のコンテキスト、ツール、権限、成功基準で実行してください。タスクの完了状況、人間による修正時間、レイテンシ、トークン使用量、ツール呼び出しの失敗回数を記録してください。最後の2つは見落とされやすいですが、実際の請求額を左右することがよくあります。一度のスムーズなパスで完了するモデルは、ループしたり、不要にファイルを書き換えたり、繰り返しプロンプトが必要な低価格モデルよりも安価に済む場合があります。
重要な業務には人間のレビュアーを関与させたままにしておきましょう。モデルは妥当に見えるが不正確な説明を生成したり、検証済みと過大に主張したり、業務ルールに違反する技術的に正当な変更を加えたりする可能性があります。最も安全な本番環境の設計では、エージェントに必要な権限のみを付与し、アクションをログに記録し、不可逆的なステップの前に承認を必須とし、ロールバックを容易にします。
最後に、モデルまたはハーネスに意味のある更新を行った後、テストを再実行してください。エージェントのパフォーマンスはシステム全体の属性——モデル、プロンプト、ツール定義、コンテキスト管理、ランタイム、承認ポリシー——であり、単なるモデル名ではありません。他社の環境で得られた結果は証拠にはなりますが、あなたの環境での保証にはなりません。
ほとんどのチームが下すべき購買決定
単一のトップモデルではなく、ポートフォリオを選びましょう。 失敗のコストが高い、またはタスクが異常に困難な一部の業務には、性能の高い最先端モデルを使用しましょう。 定型的な分類、情報抽出、翻訳、初稿作成の業務は、より高速なモデルに割り当てましょう。 サービス停止、容量制限、利用規約の変更、突然の価格変更に備えて、少なくとも1つの代替プロバイダーまたは自前ホスティングのオプションを保持しておきましょう。
大規模な契約に署名する前には、100万トークンあたりのコストではなく、受け入れ済みタスク1件あたりのコストを計算してください。再試行、ツール呼び出し、キャッシュされた入力、人間によるレビュー、エンジニアリング作業時間、低速なレスポンスに伴うコストを含めてください。次に、データ保持、地域での処理、アクセス制御、監査ログ、レート制限、モデル非推奨化の条件を確認してください。これらの運用面の詳細はローンチ当日の見出しを獲得することはめったにありませんが、AIワークフローが実稼働環境での運用を継続できるかどうかを左右します。
特定の業務段階では、特化型製品は単一の汎用モデルよりも優れた性能を発揮できます。汎用モデルはコンセプトの調査、ブリーフの構成、計画の確認などを行うことができますが、クリエイティブ、コーディング、法律、アナリティクスの分野に特化した製品は実行業務を担当します。最適なワークフローは多くの場合、明確な境界線を持つツールを組み合わせるものであり、すべてのステップを単一のチャットボットで処理することを強制しません。これはまた、置き換えを容易にします:チームはプロセス全体を再設計することなく、特定の段階をアップグレードできます。
エルサーAIが自然に適合する場所
Creative teams can pair general models with specialist products. A model may turn research into a structured visual brief, while Elser AI can create anime imagery, original characters, videos, and storyboards. This modular approach keeps each tool focused on what it is built to do.
私たちがエビデンスとハイプをどのように分離したか
この記事では、ファーストパーティのリリースノート、モデルページ、APIドキュメント、および定評のある報道機関からの出典の明らかな報道を優先しています。ベンダーのベンチマーク主張は、テストハーネス、推論設定、比較条件によってスコアに大きな影響を与える可能性があるため、ベンダー主張として特定されます。匿名のスクリーンショット、アリーナのニックネーム、ソーシャルメディアのカウントダウン、または販売業者のモデルメニューを、公開リリースの証拠とは見なしません。
締切日は2026年7月24日です。製品へのアクセスは国、プラン、アカウント、ロールアウトコホートによって異なる場合があり、新しいモデル名がなくても価格は変更される可能性があります。デプロイを実施する前に、プロバイダー独自のコンソールで現在のモデル識別子、レートカード、および利用可能性を確認してください。後日、技術レポートまたは重量が約束されている場合、この記事ではその約束を将来の計画として説明しており、リリースが完了したものとしては記載していません。
よくある質問
広く入手可能な最新のフラッグシップは何ですか?
GPT-5.6とClaude Fable 5は現在入手可能なフラグシップモデルです。「最新製品」はすべてのワークロードに最適なものと混同してはなりません。
今日のKimi K3はオープンウェイト級ですか?
ムーンショットのサービスは既に稼働中ですが、本レポートの締切日から3日後の7月27日にフルウェイトリリースが予定されています。
DeepSeek V4は単なる噂なのでしょうか?
いいえ。同モデルのAPIとウェイトは利用可能ですが、DeepSeekはこれをプレビューと明確に表示しています。
Qwen3.8は使用可能ですか?
Qwen3.8-Max-Previewは、一部のアリババのサブスクリプションおよびコーディング商品で報道されています。 より広範なリリースの詳細は未だ不明なままです。
Gemini 3.5 Pro はどうなったのですか?
グーグルはパートナーとのテストを実施していると述べています。同社は、幅広いPro版の提供を発表することなく、3.6 Flashと3.5 Flash-Liteをリリースしました。
結論
7月の市場では正確性が重視される。Kimiはリリースされたものの、完全なウェイトの適用を待っている。DeepSeekはアクセス可能だがプレビュー版である。Qwenはセレクト商品のプレビュー版である。GeminiのPro版はテスト中で、新しいFlash製品は既に出荷されている。GPT-5.6とClaude Fable 5は利用可能な最先端の選択肢となっている。これらのラベルを使用し、実際の業務をテストし、次回の変更に備えてアーキテクチャを準備しておいてください。
出典と検証
- OpenAI: GPT-5.6 リリース
- アントロピック:クロード・フェイブル5
- Moonshot AI: Kimi K3 テクニカルブログ
- AP:Kimi、需要が定員を上回ったため新規契約を一時停止
- DeepSeek:V4プレビューリリース
- サウス・チャイナ・モーニング・ポスト:アリババ、Qwen3.8-Max-Previewをプレビュー公開
- Google: ジェミニ 3.6 フラッシュ、3.5 フラッシュライト、および 3.5 フラッシュ サイバー
- ロイター:Gemini 3.5 Proの発売延期
編集上の注: この記事は2026年7月24日に調査され、最終確認されました。プロバイダーへのアクセス、価格、プレビューステータスは変更される場合があります。本番環境での決定を行う前に、リンクされたファーストパーティのドキュメントを確認してください。






































