GPT-6 Astra Ricerca Web vs Ricerca File: Quale Strumento di Recupero Dovresti Usare?
Confronta la ricerca web e la ricerca file di GPT-6 Astra per freschezza, autorevolezza, privacy, citazioni, latenza e casi d'uso ideali, con schemi per utilizzarle entrambe.

Sia la ricerca sul web che la ricerca nei file forniscono a GPT-6 Astra informazioni oltre le sue conoscenze addestrate, ma risolvono problemi di recupero diversi. La ricerca sul web esplora le informazioni pubbliche correnti. La ricerca nei file recupera dati da archivi vettoriali che prepari e controlli. Scegliere tra di loro non riguarda quale strumento sia "migliore", ma piuttosto chi possiede la fonte, quanto velocemente cambia e quali prove deve mostrare la risposta.
La decisione in una frase
Usa la ricerca web per fatti pubblici attuali; usa la ricerca file per conoscenze interne o curate sotto controllo; usa entrambe quando un'attività deve riconciliare il mondo esterno con le regole della tua organizzazione.
| Requisito | Ricerca web | Ricerca file | | Notizie pubbliche o documentazione attuale | Ottima corrispondenza | Solo se lo hai caricato | | Politiche sulla privacy o file dei clienti | Strumento sbagliato | Ottima corrispondenza | | Controllo accesso a livello di corpus | Controlli di dominio, non ACL di documenti | L'architettura del tuo vettore-store controlla l'ambito | | Citazioni delle fonti | Citazioni web e elenco delle fonti | Annotazioni dei file e dettagli facoltativi del risultato | | Set di origine deterministico | Limitato dal web live | Alto quando il corpus e i filtri sono controllati | | Manutenzione | La ricerca rimane aggiornata | Ingerisci, aggiorni ed elimini file |
Come funziona la ricerca web con GPT-6 Astra
Nell'API Responses, aggiungi lo strumento web_search ospitato. Il modello può decidere quando la ricerca è utile e incorporare fonti aggiornate nella sua risposta.
const response = await client.responses.create({ model: "gpt-6-astra", tools: [{ type: "web_search", filtri: { allowed_domains: ["developers.openai.com", "platform.openai.com"] } }], include: ["web_search_call.action.sources"], input: "Riassumi le linee guida ufficiali attuali per lo streaming dell'API Responses." });
Il filtro dei domini è un ausilio alla governance. L'attuale documentazione delle API Responses consente fino a 100 domini consentiti e 100 bloccati; le voci dei domini omettono il protocollo. Una lista di consentiti è utile per la conformità normativa, la ricerca medica, legale o tecnica, dove un risultato web ampio è meno prezioso di un insieme ristretto di fonti primarie.
Il campo `include` sopra restituisce l'elenco completo degli URL consultati dall'azione di ricerca. Tale elenco può essere più ampio del set ridotto di citazioni selezionate per il testo finale. Conserva i metadati delle fonti quando l'auditabilità è importante, ma non dare per scontato che una citazione dimostri ogni affermazione in un paragrafo generato. La tua interfaccia utente dovrebbe rendere chiare le relazioni tra fonti e affermazioni.
### Quando la ricerca web vince
Sceglilo per note di rilascio, cambiamenti di mercato, regolamenti pubblici, programmi di eventi, disponibilità di prodotti e altri fatti di cui la freschezza è importante. È utile anche quando l'utente richiede esplicitamente fonti che può aprire.
La ricerca web non è un modo per accedere a una intranet privata. Inoltre, non garantisce che ogni fonte sia autorevole. Limita i domini quando possibile, chiedi fonti primarie e verifica le affermazioni consequenziali.
## Come funziona la ricerca dei file
La ricerca file è uno strumento dell'API Responses ospitato, basato su archivi vettoriali. Per prima cosa crei un archivio vettoriale, carichi i file e li alleghi in modo che OpenAI possa elaborare il contenuto. Una richiesta fornisce quindi uno o più ID di archivi vettoriali.
```ts
const response = await client.responses.create({ model: "gpt-6-astra", strumenti: [{ type: "file_search", vector_store_ids: ["vs_company_handbook"], max_num_results: 8, filtri: { type: "eq", key: "dipartimento", value: "supporto" } }], include: ["file_search_call.results"], input: "Qual è la nostra politica di escalation per gli incidenti aziendali?" });
I filtri dei metadati mantengono il recupero all'interno di un sottoinsieme pertinente, come regione, dipartimento, versione del documento o anno di pubblicazione. `max_num_results` è un compromesso tra precisione, latenza e contesto: un numero troppo basso può omettere prove essenziali; uno troppo alto può aggiungere rumore. Valutalo utilizzando domande reali e fonti attese etichettate.
### Quando la ricerca file vince
Usalo per policy, contratti, biblioteche di ricerca, manuali di prodotto, linee guida del marchio approvate, documenti forniti dai clienti e altre conoscenze delimitate. Un team creativo potrebbe archiviare copioni, bibbie dei personaggi e note di produzione, quindi utilizzare il recupero per fondare il lavoro a valle in un prodotto come [Elser AI](https://www.elser.ai/). Il punto importante è la provenienza: la risposta dovrebbe derivare dal corpus di progetto approvato, non da una pagina pubblica casuale.
La ricerca dei file non rende automaticamente corretta una risposta. Un file mancante, un caricamento obsoleto, una corrispondenza debole dei frammenti o una query eccessivamente ampia possono comunque produrre una risposta incompleta. La qualità del recupero e la qualità della risposta richiedono una valutazione separata.
## Utilizza entrambi per risposte attuali consapevoli delle policy
Molte domande aziendali hanno due livelli di evidenza. "Possiamo lanciare questa promozione in Germania?" potrebbe richiedere la normativa pubblica attuale e l'attuale politica di approvazione dell'azienda. Configura entrambi gli strumenti, etichetta chiaramente ogni classe di fonte e istruisci il modello a risolvere i conflitti in base all'autorità piuttosto che alla convenienza.
Una sequenza robusta è:
1. recuperare la politica interna applicabile e la versione;
2. cercare le attuali fonti pubbliche primarie;
3. identificare disaccordi o date mancanti;
4. produrre una risposta qualificata con citazioni;
5. escalation piuttosto che inventare una risoluzione.
Non unire le prove in un unico riepilogo anonimo. Gli utenti dovrebbero sapere quale dichiarazione proviene da un documento aziendale e quale dal web pubblico.
## Cinque domande di design prima di scegliere
### Quanto fresca deve essere la risposta?
Se "oggi" è importante, cerca sul web o aggiorna continuamente il tuo archivio vettoriale. La sola conoscenza del modello non è la fonte giusta.
### Chi può vedere il codice sorgente?
Per la ricerca nei file, crea confini di vector-store che corrispondano ai confini di autorizzazione. Non recuperare mai in modo ampio e chiedere al modello di oscurare in seguito. Il controllo degli accessi appartiene prima del recupero.
### Chi controlla la correttezza?
Un team di conformità interno può approvare un corpus di file. Nessuno controlla l'intero web. Al contrario, uno snapshot interno può diventare obsoleto mentre il sito web di un regolatore cambia.
### Quali prove deve esporre l'interfaccia utente?
Per la ricerca web, conserva le citazioni e, dove necessario, l'elenco completo delle fonti consultate. Per la ricerca nei file, richiedi i risultati inclusi durante lo sviluppo e gli audit. Evita di mostrare testo riservato recuperato in forma grezza a utenti non autorizzati.
### Qual è la modalità di guasto?
Decidi se "nessuna prova forte" debba produrre un rifiuto, una domanda di chiarimento, una ricerca più ampia o un'escalation a una persona. L'ipotesi silenziosa è la peggiore impostazione predefinita.
## Valutazione del recupero che riflette la produzione
Costruisci un set di test con query a cui si può rispondere, a cui non si può rispondere, ambigue e sensibili ai permessi. Valuta il recupero separatamente dalla generazione:
- Il sorgente corretto è entrato nei primi risultati?
- È stata preferita l'ultima versione autorevole?
- La risposta ha citato la fonte che supporta effettivamente l'affermazione?
- I filtri hanno impedito perdite tra tenant o tra regioni?
- Il modello ha ammesso quando le prove erano insufficienti?
Misura anche la latenza e la frequenza delle chiamate agli strumenti. Ridurre `max_num_results` può velocizzare una richiesta ma danneggiare il richiamo. Una lista di domini consentiti ristretta può migliorare la fiducia ma fallire quando una fonte primaria si sposta. Le impostazioni di recupero necessitano di test di regressione.
## FAQ
### La ricerca file può accedere direttamente ai file sul mio laptop?
No. I file devono essere caricati e associati a un archivio vettoriale tramite il flusso di lavoro dell'API.
### È possibile limitare la ricerca web a siti affidabili?
Sì. I filtri di dominio dell'API Responses possono consentire o bloccare domini entro i limiti documentati. Considera il filtro come un livello di governance delle fonti.
### Dovrei invece incollare i documenti nel prompt?
Per un documento breve, potrebbe essere la soluzione più semplice. Per un corpus riutilizzabile o in crescita, la ricerca su file offre solitamente un recupero e una manutenzione migliori. Testa entrambi per il tuo carico di lavoro.
### Il modello può utilizzare entrambi gli strumenti in una singola risposta?
Sì, quando entrambi sono forniti e il compito lo giustifica. Fornisci istruzioni esplicite sull'autorità della fonte e sulla gestione dei conflitti.
## Conclusione
Le risposte della ricerca web dicono "cosa è pubblicamente vero ora?" Le risposte della ricerca file dicono "cosa dice questo corpus controllato?" I sistemi affidabili GPT-6 Astra preservano questa distinzione, applicano l'autorizzazione prima del recupero, espongono le prove appropriate e valutano la selezione delle fonti separatamente dalla qualità della prosa. Combina gli strumenti solo quando la domanda dell'utente abbraccia genuinamente entrambi i mondi.





























































































