GPT-6 Astra Web Search vs File Search:どちらの検索ツールを使うべきか?
GPT-6 Astraのウェブ検索とファイル検索を、鮮度、権威性、プライバシー、引用、レイテンシ、理想的なユースケースで比較し、両方を使用するパターンも紹介します。

Web searchとfile searchはどちらもGPT-6 Astraに学習済み知識を超えた情報を提供しますが、解決する検索課題は異なります。Web searchは現在の公開情報を探索します。File searchは、あなたが準備し管理するベクターストアから情報を取得します。どちらを選ぶかは、どちらのツールが「優れているか」というよりも、情報源の所有者、更新頻度、回答に示すべき根拠によって決まります。
一言で言うと、その決断は
ウェブ検索は現在の公開情報に、ファイル検索は管理された内部または厳選された知識に使用し、タスクが外部の世界と組織のルールを調整する必要がある場合は両方を使用してください。
| 要件 | Web検索 | ファイル検索 | | 現在の公開ニュースまたはドキュメント | 強い適合 | アップロードした場合のみ | | プライバシーポリシーまたは顧客ファイル | 誤ったツール | 強力な適合 | | コーパスレベルのアクセス制御 | ドメイン制御、ドキュメントACLではない | ベクトルストアアーキテクチャがスコープを制御 | | ソース引用 | Web引用とソース一覧 | ファイル注釈とオプションの結果詳細 | | 決定論的ソースセット | ライブウェブに制限される | コーパスとフィルターが制御されている場合に高い | | メンテナンス | 検索は最新の状態を保つ | ファイルの取り込み、更新、削除が可能 |
GPT-6 Astra によるウェブ検索の仕組み
Responses API に、ホステッド web_search ツールを追加します。モデルは検索が有用なタイミングを判断し、最新の情報源を回答に取り入れることができます。
const response = await client.responses.create({
model: "gpt-6-astra",
tools: [{
type: "ウェブ検索",
filters: {
allowed_domains: ["developers.openai.com", "platform.openai.com"]
}
}],
include: ["web_search_call.action.sources"],
input: "Responses APIストリーミングに関する現在の公式ガイダンスを要約してください。"
});
ドメインフィルタリングはガバナンスの補助手段です。現在のResponses APIドキュメントでは、許可ドメイン100件とブロックドメイン100件まで設定できます。ドメインエントリにはプロトコルは含まれません。許可リストは、コンプライアンス、医療、法律、技術調査において有用です。これらの分野では、広範なウェブ検索結果よりも、厳選された一次情報源の集合の方が価値が高いためです。
上記の include フィールドは、検索アクションによって参照されたURLの完全なリストを返します。このリストは、最終テキスト用に選択された少数の引用よりも大きくなる可能性があります。監査可能性が重要な場合はソースメタデータを保存しますが、引用が生成された段落のすべての節を証明するとは想定しないでください。UIでは、ソースと主張の関係を明確にする必要があります。
ウェブ検索が勝つとき
リリースノート、市場の変化、公開規制、イベントスケジュール、製品の在庫状況など、鮮度が重要な事実に使用します。また、ユーザーが明示的に開けるソースを要求した場合にも役立ちます。
ウェブ検索はプライベートイントラネットにアクセスする方法ではありません。また、すべての情報源が信頼できることを保証するものでもありません。可能な場合はドメインを制限し、一次情報源を求め、重要な主張を検証してください。
ファイル検索の仕組み
ファイル検索は、ベクターストアを基盤とするホスト型Responses APIツールです。まずベクターストアを作成し、ファイルをアップロードして添付することで、OpenAIがコンテンツを処理できるようにします。その後、リクエストで1つ以上のベクターストアIDを指定します。
const response = await client.responses.create({ model: "gpt-6-astra", tools: [{ type: "ファイル検索", vector_store_ids: ["vs_company_handbook"], max_num_results: 8, filters: { type: "eq", key: "部署", value: "サポート" } }], include: ["file_search_call.results"], input: 「エンタープライズインシデントのエスカレーションポリシーは何ですか?」 });
メタデータフィルターは、地域、部門、ドキュメントバージョン、発行年などの関連サブセット内に検索を制限します。`max_num_results`は、精度、レイテンシ、コンテキストのトレードオフです。少なすぎると重要な証拠を省略する可能性があり、多すぎるとノイズが増える可能性があります。実際の質問とラベル付けされた期待されるソースを使用して評価してください。
### ファイル検索が勝つとき
ポリシー、契約書、研究ライブラリ、製品マニュアル、承認済みブランドガイドライン、顧客提供文書、その他の限定された知識に使用します。クリエイティブチームは、スクリプト、キャラクターバイブル、制作ノートを保存し、[Elser AI](https://www.elser.ai/) のような製品で検索を使用して下流の作業を基盤付けることができます。重要なのは出所です。回答は承認されたプロジェクトコーパスから導き出されるべきであり、ランダムな公開ページからではありません。
ファイル検索は自動的に回答を正しくするわけではありません。ファイルの欠落、古いアップロード、弱いチャンクマッチ、または過度に広範なクエリによって、不完全な回答が生成される可能性があります。検索品質と回答品質は別々に評価する必要があります。
## ポリシーを考慮した最新の回答には両方を使用する
多くのビジネス上の質問には、2つの証拠層があります。「このプロモーションをドイツで開始できるか?」という質問には、現在の公的規制と会社の現在の承認ポリシーの両方が必要になるかもしれません。両方のツールを設定し、各ソースクラスを明確にラベル付けし、モデルに対して、都合ではなく権限によって競合を解決するよう指示してください。
堅牢なシーケンスは以下の通りです:
1. 該当する内部ポリシーとバージョンを取得する。
2. 主要な公的情報源を現在検索する。
3. 相違点や欠落した日付を特定する。
4. 引用付きの適切な回答を作成する;
5. 解決策を発明するのではなく、エスカレーションする。
証拠を匿名の要約にまとめないでください。ユーザーは、どの発言が企業文書からのもので、どの発言が公開ウェブからのものかを知るべきです。
## 選択する前に考慮すべき5つのデザイン上の質問
### 回答はどの程度新しいものでなければなりませんか?
「今日」が重要な場合は、ウェブ検索を行うか、ベクターストアを継続的に更新してください。モデルの知識だけでは適切な情報源とはなりません。
### 誰がソースを見ることができますか?
ファイル検索では、認可境界に一致するベクターストアの境界を作成します。広く取得してからモデルに後で編集を依頼することは決してしないでください。アクセス制御は取得の前に行うべきです。
### 正確性を管理するのは誰か?
内部コンプライアンスチームはファイルコーパスを承認できます。誰もウェブ全体を管理しているわけではありません。逆に、内部スナップショットは古くなる可能性がある一方で、規制当局のウェブサイトは変更されます。
### UIはどのような証拠を提示すべきか?
ウェブ検索では、引用と、必要に応じて参照した完全なソースリストを保持してください。ファイル検索では、開発時や監査時に含まれる結果を要求してください。未承認のユーザーに対して、取得した機密テキストをそのまま表示しないでください。
### 障害モードとは何ですか?
「強い証拠がない」という場合に、拒否、明確化の質問、より広範な検索、または人間へのエスカレーションのいずれを生成すべきかを判断する。黙って推測することは最悪のデフォルトである。
## 本番環境を反映した検索評価
回答可能、回答不能、曖昧、および権限に敏感なクエリを含むテストセットを構築します。検索と生成を別々にスコアリングします。
- 正しいソースが上位の結果に入りましたか?
- 最新の正式版が優先されましたか?
- 回答は、主張を実際に裏付ける情報源を引用していましたか?
- フィルターはクロステナントやクロスリージョンの漏洩を防ぎましたか?
- モデルは証拠が不十分であることを認めましたか?
レイテンシーとツール呼び出しの頻度も測定します。`max_num_results`を減らすとリクエストは高速化できますが、再現性を損なう可能性があります。ドメインの許可リストを狭くすると信頼性は向上しますが、主要な情報源が移動した場合に機能しなくなります。検索設定には回帰テストが必要です。
## FAQ
### ファイル検索は私のラップトップ上のファイルに直接アクセスできますか?
いいえ、ファイルはAPIワークフローを通じてベクターストアにアップロードし、関連付ける必要があります。
### Web検索を信頼できるサイトに制限することはできますか?
はい。Responses APIのドメインフィルターは、文書化された制限内でドメインを許可またはブロックできます。このフィルターは、ソースガバナンスの一層として扱ってください。
### 代わりにプロンプトにドキュメントを貼り付けるべきですか?
1つの短いドキュメントであれば、それが最も簡単かもしれません。再利用可能または成長するコーパスの場合、通常はファイル検索の方が検索とメンテナンスに優れています。ご自身のワークロードで両方をテストしてください。
### モデルは1つの応答で両方のツールを使用できますか?
はい、両方が提供され、タスクがそれらを必要とする場合に限ります。ソースの権威と競合処理に関する明示的な指示を提供してください。
## 結論
Web検索は「今、公に真実とされていることは何か?」に答え、ファイル検索は「この管理されたコーパスは何を述べているか?」に答える。信頼性の高いGPT-6 Astraシステムはその区別を維持し、検索前に認可を適用し、適切な証拠を提示し、ソース選択を散文の品質とは別に評価する。ユーザーの質問が真に両方の世界にまたがる場合にのみ、ツールを組み合わせる。






























































































