"pricing":
Si paga per dataset. Si verifica prima di pagare.
I piani a pagamento sono per dataset, mensili, senza vincoli di lungo periodo. L'accesso agli esempi apre a breve — nel frattempo ci scriva: le mostriamo la catena di provenienza su una release reale.
demo
0 USD
accesso agli esempi a breve
Il campione di valutazione non è ancora aperto. Nel frattempo ci scriva: le mostriamo una release reale.
- Campione di valutazione, a breve
- Catena di provenienza completa su ogni record
- Merkle root su ogni hash di chunk
- Lo stesso JSONL dei piani a pagamento
starter
99 USD/mese
per dataset / mese
Un corpus di produzione, aggiornato ogni settimana.
- Aggiornamenti settimanali delle release
- JSONL + manifest con Merkle root
- Campi di provenienza per ogni record
- Supporto via email
pro
299 USD/mese
per dataset / mese
Release giornaliere con ID stabili — nuovi embedding solo per ciò che cambia.
- Aggiornamenti giornalieri delle release
- ID di record e chunk stabili tra le release
- Licenza RAG/embedding con indennizzo
- Supporto prioritario
enterprise
Su misura
accordo su misura
Tutti i dataset, le sue nicchie, la nostra pipeline.
- Tutti i dataset che pubblichiamo
- Condizioni di freschezza e supporto nel contratto
- Nicchie e connettori su misura
- Supporto dedicato
ogni piano include
Catena di provenienza completa per ogni record
Merkle root su ogni hash di chunk
JSONL + SHA-256 per ogni file
Verificabile con codice proprio
Le servono tutte le nicchie, o una che non abbiamo?
Enterprise copre tutti i dataset che pubblichiamo, nicchie e connettori su misura, supporto dedicato e condizioni di freschezza concordate nel contratto. La fatturazione passa da un contratto, non da un checkout.
"faq":
Le domande che i clienti fanno davvero
È lecito usare questi dati per embedding e retrieval?
Sì — è esattamente il punto. Ogni dataset viene fornito con una licenza esplicita che consente uso RAG, embedding e retrieval. Le licenze Pro ed Enterprise includono l'indennizzo. Nessuna zona grigia di scraping: raccogliamo da fonti primarie, rispettiamo robots.txt e le esclusioni, e filtriamo i dati personali da ogni record prima di calcolarne l'hash.
Come si verifica la provenienza?
Ogni record porta con sé URL di origine, momento del prelievo e SHA-256 della risposta grezza. Ogni release include un manifest con uno SHA-256 per ogni file e un Merkle root sugli hash dei chunk in ordine. Ricalcoli gli hash dei file, ricostruisca la radice da chunks.jsonl, confronti — poche righe di codice suo, nessuna riga nostra. Abbiamo fatto esattamente questo su una release con lo storico completo, usando un'implementazione separata, e le radici corrispondevano.
Con quale frequenza vengono aggiornati i dataset?
La frequenza dipende dal dataset e dal piano: Starter pubblica release settimanali, Pro giornaliere. Ogni release è versionata e, poiché gli ID di record e chunk restano stabili tra le release, può confrontarne da sé due qualsiasi e vedere esattamente cosa è cambiato.
Quali formati fornite?
JSONL per i record e i chunk pronti per il retrieval, più un manifest.json per ogni release con lo SHA-256 e la dimensione in byte di ciascun file, il numero di record e di chunk, le metriche di qualità e il Merkle root sugli hash dei chunk in ordine.
Si può provare prima di pagare?
Oggi non con un dataset di esempio — l'accesso agli esempi è chiuso mentre il corpus cresce, e aprirà a breve. Nel frattempo ci dica quale corpus sta valutando: le mostriamo una release reale — il manifest, lo SHA-256 di ogni file e il Merkle root — e lei ricalcola la radice con il suo codice prima di pagare qualsiasi cosa.
Realizzate nicchie su misura?
Con il piano Enterprise realizziamo nicchie e connettori su misura a partire dal suo elenco di fonti, con condizioni di freschezza concordate nel contratto. Ci dica dal modulo di contatto cosa manca al suo livello di retrieval.