III · Estrazione

Domain scraper. Ogni indirizzo che un sito pubblica.

contact@, info@, careers@ e ogni indirizzo incontrato strada facendo, riportato in chiaro, deduplicato e restituito con la pagina in cui è stato trovato.

~35% dei siti espone un indirizzo di ruolo · 2.5 domini/s in blocco

mozartemail.com / scrape-domaindemo in tempo reale: fare clic per prendere i comandi

1 · Compilare 2 · Eseguire

ogni indirizzo pubblicato su un sito, con la sua pagina di origine

Inizia gratis con 50 crediti

Senza carta di credito · 50 crediti gratuiti

Il problema

L’indirizzo è sul sito. Il lavoro è tirarlo fuori.

Altrove

I siti scrivono gli indirizzi come contact [at] domain [dot] com, li assemblano in JavaScript, o li seppelliscono nelle note legali. Una passata di regex sulla homepage si lascia sfuggire gran parte di ciò che è davvero pubblicato.

Con Mozart

Mozart percorre le pagine dove gli indirizzi vivono davvero, inverte i trucchi di offuscamento, e restituisce ogni indirizzo con la sua pagina di origine, indirizzi di ruolo separati da quelli nominativi.

Il meccanismo

Come viene letto un sito.

1

Scansione

Homepage, contatti, chi siamo e note legali: la scansione segue le pagine dove gli indirizzi pubblicati stanno davvero.

2

In chiaro

Le scritture at-dot, le entità HTML e gli indirizzi assemblati via script vengono riportati in testo semplice.

3

Classificazione

Gli indirizzi vengono deduplicati, divisi tra quelli di ruolo e quelli nominativi, e restituiti ciascuno con la pagina da cui proviene.

A confronto

Una scansione contro una regex.

AltroveCon Mozart
Una passata di regex sulla homepageuna scansione delle pagine dove gli indirizzi vivono
Indirizzi offuscati persiscritture at-dot e trucchi via script invertiti
Un elenco di stringhe e nient’altroogni indirizzo con la sua pagina di origine, di ruolo o nominativo
Prezzo per indirizzo trovato1 credito per sito scansionato, qualunque sia il numero di indirizzi pubblicati

Si paga la scansione, quindi anche «nessun indirizzo pubblicato» viene addebitato, mentre una scansione mai partita è gratis.

Misurato, non promesso

2.5

domini al secondo in blocco

Un file da 5 000 domini richiede da 30 a 35 minuti, senza sorveglianza. Circa un terzo dei siti pubblica almeno un indirizzo di ruolo.

Inizia gratis con 50 creditiCome lo dimostriamo →

Senza carta di credito · 50 crediti gratuiti

Singolo · in blocco · API

Un sito, un file di settore, o l’API.

Singolo

Basta puntare il widget qui sopra su un dominio per leggere in tempo reale ciò che pubblica.

In blocco

5 000 domini per file, che girano mentre nessuno guarda.

API

POST /api/scrape-domain restituisce separatamente gli indirizzi di ruolo e quelli nominativi, con i conteggi e il numero di pagine percorse.

POST /api/scrape-domain
{"domain": "leipzig-cantata.com"}
200 OK
{
"ok": true, "billable": true, "charged": 1,
"role_emails": ["contact@leipzig-cantata.com"],
"other_emails": ["johann.bach@leipzig-cantata.com"],
"n_role": 1, "pages": 3
}

Esplora l’API →

Dove si inserisce

Per le caselle che vivono sui siti.

Team SDRRaggiungere le piccole imprese il cui unico indirizzo è contact@, direttamente dai loro siti.
AgenzieSetacciare un file di settore da 5 000 domini in mezz’ora e avviare la campagna con le caselle pubblicate.
RevOpsRiempire la colonna dei contatti generici che il CRM non ha mai avuto, con la pagina di origine allegata.

Da comporre con

Domain finderDomain scraperEmail verifier

Trovare il dominio, raccogliere ciò che pubblica, verificare prima di inviare.

Domande, risposte complete

Addebito, pagine e concatenazioni.

Perché questo strumento si paga anche quando non torna nessun indirizzo?

Perché la risposta è la scansione. «Questo sito non pubblica nulla» chiude la riga con la stessa certezza di tre indirizzi, e la scansione è comunque avvenuta. È l’unico strumento del catalogo addebitato per il lavoro e non per il risultato, e preferiamo dirlo invece di nasconderlo in fondo alle condizioni. Una scansione che non è potuta partire è gratis.

Quali pagine vengono percorse?+

Quelle dove vivono gli indirizzi pubblicati: homepage, contatti, chi siamo, team e note legali. Ogni indirizzo restituito porta con sé la pagina in cui è stato trovato.

Qual è la differenza tra indirizzi di ruolo e nominativi?+

Gli indirizzi di ruolo appartengono a una funzione: contact@, info@, sales@. Quelli nominativi portano il nome di una persona. Tornano entrambi, già separati, così si possono instradare in modo diverso.

Si possono scansionare i siti usciti da una raccolta su Maps?+

È la catena naturale: raccogliere le schede con il Google Maps scraper, tenere la colonna del sito, e passarla a questo strumento come file in blocco.

Ogni indirizzo pubblicato.
Con la sua pagina di origine.

Un credito per sito, e la risposta è la scansione.

Inizia gratis con 50 crediti

Senza carta di credito · 50 crediti gratuiti