Ingestione Server Logs / API
Se il tuo sito non gira dietro Cloudflare o Akamai — ad esempio perché il tuo nginx è l’edge — puoi inviare le visite dei crawler IA direttamente a Finseo. Funziona qualsiasi sistema in grado di inviare un POST HTTP: una pipeline di tracking server-side, un access log nginx filtrato con un cron, o uno script personalizzato. La connessione si trova in Bot Analytics → Sync → Server Logs / API → Connect. La finestra di dialogo crea il tuo token di ingestione legato al progetto (fslg_…) e mostra l’endpoint, un esempio NDJSON e modelli nginx e cron pronti da copiare.
I crawler IA come GPTBot, ClaudeBot e PerplexityBot non eseguono JavaScript — uno snippet lato client non può vederli. Bot Traffic lavora esclusivamente con dati lato server: i dati devono quindi provenire dai tuoi log edge o server.
Endpoint
Formato delle righe di log
I nomi dei campi sono intenzionalmente identici al feed Cloudflare: un unico formato di export funziona per tutte le integrazioni push di Finseo.
Risposta
received— righe nel batchbotVisits— righe identificate come richieste di crawler IA/ricerca verificatisaved— righe scritte dopo la deduplicazione
I retry sono sicuri: Finseo deduplica lato server su bot + timestamp + IP + percorso. Un batch inviato due volte non produce mai conteggi doppi. Puoi anche inviare log non filtrati — le righe non-crawler vengono scartate e mai memorizzate — ma il pre-filtraggio mantiene i payload leggeri.
Opzione A: push dal tuo tracking server-side
Se hai già un log centrale delle richieste (tracking server-side, pipeline di log), filtralo sugli User-Agent dei crawler e invia il batch ogni ora o ogni giorno:Opzione B: access log nginx filtrato + cron
La registrazione completa non è necessaria. Un secondo log filtrato contenente solo i crawler IA conta tipicamente poche migliaia di righe al giorno — nessun servizio di aggregazione richiesto:Limiti
- Max
16 MBper request body (64 MBdecompresso), max20.000righe per push - Rate limit per IP e per token — invia batch, non richieste singole
- Vengono memorizzate solo le richieste di crawler IA e di ricerca verificati; tutto il resto viene scartato
Testare senza modifiche ai server
Vuoi vedere numeri reali prima di configurare qualsiasi cosa? Bot Analytics → Upload Server Logs accetta log di testo grezzi nginx, Apache e Cloudflare fino a 1 GB — esporta un giorno di log e caricali manualmente.Disconnessione
Clicca Manage → Disconnect sulla scheda Server Logs / API. Il token di ingestione viene invalidato immediatamente — i push successivi vengono rifiutati con403. Ricordati di rimuovere anche il tuo cron job.
Risoluzione dei problemi
La risposta mostra botVisits: 0 anche se ho inviato righe di crawler
La risposta mostra botVisits: 0 anche se ho inviato righe di crawler
Finseo verifica l’identità dei crawler tramite gli intervalli IP pubblicati dai provider. Se invii l’IP del tuo load balancer invece dell’IP client reale (prima voce di
X-Forwarded-For), la verifica fallisce e le righe vengono scartate. Controlla anche che ClientRequestUserAgent contenga la stringa UA originale completa.Errori 401 o 403
Errori 401 o 403
401 significa che manca l’header Authorization: Bearer; 403 che il token non è valido o è stato revocato tramite Disconnect. Copia il token attuale dalla finestra di dialogo di connessione.Lo stato rimane su 'Awaiting first push'
Lo stato rimane su 'Awaiting first push'
Lo stato cambia al primo POST riuscito — controlla la risposta JSON nell’output del tuo cron. Un
413 significa che il batch ha superato i limiti di dimensione; suddividilo.saved è inferiore a botVisits
saved è inferiore a botVisits
È la deduplicazione al lavoro: le righe con lo stesso bot, timestamp, IP e percorso — ad esempio da un batch reinviato — vengono memorizzate una sola volta.