# robots.txt · https://www.ravindradellabina.com # Aggiornato il 6 ottobre 2026. # # In breve # - Motori di ricerca, motori di ricerca IA e assistenti IA possono leggere il sito # e citarlo con un link (ricerca, risposte in tempo reale, richieste degli utenti). # - Non è consentito usare i contenuti per addestrare o perfezionare (fine-tuning) # modelli di intelligenza artificiale. È una riserva espressa ai sensi dell'art. 4, # par. 3, della Direttiva (UE) 2019/790 e dell'art. 70-quater della legge 633/1941. # - Dettagli: https://www.ravindradellabina.com/intelligenza-artificiale # - Sintesi del sito per i modelli linguistici: https://www.ravindradellabina.com/llms.txt # # Le regole Disallow valgono solo per i crawler che le rispettano: la riserva sui # diritti vale comunque, anche per chi non legge questo file. # # Content Signals (Cloudflare, licenza CC0). Il testo ufficiale, in inglese, è qui sotto. # Traduzione: accedendo al sito accetti questi segnali sui contenuti. # search=yes puoi usarli per creare un indice di ricerca e mostrare risultati # (link e brevi estratti); # ai-input=yes puoi usarli come input per modelli di IA che rispondono in tempo reale # (RAG, grounding, risposte generate con fonte); # ai-train=no non puoi usarli per addestrare o perfezionare modelli di IA. # # As a condition of accessing this website, you agree to # abide by the following content signals: # # (a) If a content-signal = yes, you may collect content # for the corresponding use. # (b) If a content-signal = no, you may not collect content # for the corresponding use. # (c) If the website operator does not include a content # signal for a corresponding use, the website operator # neither grants nor restricts permission via content signal # with respect to the corresponding use. # # The content signals and their meanings are: # # search: building a search index and providing search # results (e.g., returning hyperlinks and short excerpts # from your website's contents). Search does not include # providing AI-generated search summaries. # ai-input: inputting content into one or more AI models # (e.g., retrieval augmented generation, grounding, or other # real-time taking of content for generative AI search # answers). # ai-train: training or fine-tuning AI models. # # ANY RESTRICTIONS EXPRESSED VIA CONTENT-SIGNALS ARE EXPRESS # RESERVATIONS OF RIGHTS UNDER ARTICLE 4 OF THE EUROPEAN # UNION DIRECTIVE 2019/790 ON COPYRIGHT AND RELATED RIGHTS # IN THE DIGITAL SINGLE MARKET. # # Nota: un crawler segue solo il gruppo più specifico che lo nomina, per questo la riga # Content-Signal è ripetuta in ogni gruppo. La pagina /epk non è bloccata di proposito: # i motori devono poterla leggere per vedere il suo "noindex". # 1. Tutti gli altri crawler (Googlebot, Bingbot, Applebot, DuckDuckBot, anteprime dei # social come Twitterbot e facebookexternalhit, ecc.): accesso libero. User-agent: * Content-Signal: search=yes, ai-input=yes, ai-train=no Allow: / # 2. Motori di ricerca IA e assistenti IA: possono leggere e citare il sito con un link. # Servono alla ricerca e alle risposte con la fonte. La riga Content-Signal ricorda # anche a loro che l'addestramento non è consentito. # OpenAI: indice di ricerca di ChatGPT User-agent: OAI-SearchBot # OpenAI: pagine aperte da ChatGPT su richiesta di un utente User-agent: ChatGPT-User # Anthropic: indice di ricerca di Claude User-agent: Claude-SearchBot # Anthropic: pagine aperte da Claude su richiesta di un utente User-agent: Claude-User # Perplexity: indice di ricerca User-agent: PerplexityBot # Perplexity: pagine aperte su richiesta di un utente User-agent: Perplexity-User # Amazon: ricerca in Alexa e nei servizi Amazon User-agent: Amzn-SearchBot # Amazon: risposte di Alexa su richiesta di un utente User-agent: Amzn-User # Mistral AI: indice di ricerca di Mistral User-agent: MistralAI-Index # Mistral AI: pagine aperte su richiesta di un utente User-agent: MistralAI-User # DuckDuckGo: risposte con fonte di DuckAssist User-agent: DuckAssistBot # Meta: ricerca di Meta AI User-agent: Meta-WebIndexer # Meta: pagine aperte su richiesta di un utente User-agent: Meta-ExternalFetcher Content-Signal: search=yes, ai-input=yes, ai-train=no Allow: / # 3. Crawler usati per l'addestramento di modelli di IA: accesso negato. # OpenAI: addestramento dei modelli GPT User-agent: GPTBot # Anthropic: addestramento dei modelli Claude User-agent: ClaudeBot # Anthropic: vecchio token, non più usato, tenuto per sicurezza User-agent: anthropic-ai # Google: addestramento di Gemini. Attenzione: blocca anche il grounding nell'app Gemini # e in Vertex AI; non tocca Google Search, il suo ranking né le risposte IA di Search. User-agent: Google-Extended # Apple: addestramento dei modelli Apple Intelligence (Applebot resta libero per Siri e Spotlight) User-agent: Applebot-Extended # Meta: addestramento dei modelli di IA di Meta User-agent: Meta-ExternalAgent # Amazon: può usare i contenuti per addestrare i modelli di Amazon User-agent: Amazonbot # Mistral AI: dataset di addestramento User-agent: MistralAI-Training # Cohere: dati di addestramento (token preso da elenchi indipendenti) User-agent: cohere-training-data-crawler # Common Crawl: archivio pubblico del web, usato per creare dataset di addestramento User-agent: CCBot # Allen Institute for AI: addestramento di modelli linguistici aperti User-agent: AI2Bot # ByteDance: addestramento di modelli (token preso da elenchi indipendenti; # segnalato come poco rispettoso del robots.txt) User-agent: Bytespider # Webz.io: archivio del web venduto anche per addestrare IA (token preso da elenchi indipendenti) User-agent: Webzio-Extended Content-Signal: search=yes, ai-input=yes, ai-train=no Disallow: / Sitemap: https://www.ravindradellabina.com/sitemap.xml