Vai al contenuto

Per gli editori

Il crawler di C Wire

Acquistiamo solo pagine che abbiamo letto. Se il nostro crawler non può raggiungere le Sue pagine non possiamo leggerle, quindi bloccarlo rimuove il Suo inventario dalle nostre pianificazioni invece di proteggerlo.

01Cosa vede il crawler

CWireBotlegge la paginamappa ogni unità pubblicitariaregistra nel Placement Graph

02User agent

User agent

CWireBot
La richiesta dice chi è e cosa accetta. La verifica sta nel log, non nella promessa.

03Frequenza di scansione

Una richiesta al secondo per host come impostazione predefinita, meno su richiesta. Rispettiamo Retry-After e rallentiamo a ogni 429 o 5xx.

Al massimo una richiesta al secondo. Una pagina occupata riceve un'ora più tranquilla.

04Cosa fa il crawler

Legge e vettorializza il testo degli articoli per stabilire di cosa parla il contenuto e registra dove si trovano le unità pubblicitarie nel layout. Non raccoglie dati personali e non segue moduli né aree riservate.

Content Graph

Che cosa dice ogni pagina o video dopo che lo abbiamo letto e vettorializzato.

Placement Graph

Che cosa ha prodotto ogni placement sottoposto ad audit, registrato unità per unità.

Entrambi alimentano ogni decisione.

05Istruzioni di autorizzazione

Nulla cambia, se non questo: le nostre richieste non vengono più rifiutate, e la pagina inizia a essere letta.

Security · WAF · Custom rules. Create a rule with the Skip action.

(http.user_agent contains "CWireBot")
→ Action: Skip
→ Skip: All remaining custom rules, Bot Fight Mode, Rate limiting

Domande

Il funzionamento del crawler

Perché C Wire deve eseguire la scansione del mio sito?

Perché C Wire acquista solo pagine che ha letto. Se il crawler non può raggiungere le Sue pagine, non possono essere lette, quindi bloccarlo rimuove il Suo inventario da ogni pianificazione invece di proteggerlo.

Cosa legge e registra il crawler?

Il testo dell'articolo, per comprendere l'argomento del contenuto, e la posizione delle unità pubblicitarie nel layout. Non raccoglie mai dati personali e non segue mai moduli o aree ad accesso riservato.

Quanto carico genera?

Una richiesta al secondo per host per impostazione predefinita, riducibile su richiesta. Rispetta Retry-After e riduce la frequenza a fronte di qualsiasi risposta 429 o 5xx.

Come posso inserirlo nella allowlist?

Tramite lo user agent e gli intervalli IP pubblicati, per intervallo anziché per singolo indirizzo. Le istruzioni specifiche per Cloudflare, Akamai, Fastly, AWS WAF e robots.txt sono su questa pagina, senza moduli di accesso.

06Richiedete la scansione del vostro sito

Inviateci il dominio e confermiamo la finestra di scansione. Nessuna istruzione qui sopra è dietro un modulo.

Passo successivo

Parliamo di integrazione.

Un tag, nessuna riscrittura e una revisione di come i nostri formati stanno nel vostro layout. Oppure iniziate autorizzando il crawler.