III · Extraer

Domain scraper. Todas las direcciones que publica una web.

contact@, info@, careers@ y todas las direcciones que aparecen por el camino, desofuscadas, deduplicadas y devueltas con la página en la que se encontró cada una.

~35 % de las webs exponen una dirección genérica · 2,5 dominios/s por lotes

mozartemail.com / scrape-domaindemo en directo: haz clic y toma el control

1 · Rellenar 2 · Ejecutar

todas las direcciones publicadas en una web, cada una con su página de origen

Empezar gratis con 50 créditos verificados

Sin tarjeta de crédito · 50 créditos gratis

El problema

La dirección está en la web. Extraerla es el trabajo.

En otras partes

Las webs escriben las direcciones como contact [at] domain [dot] com, las montan con JavaScript o las entierran en un aviso legal. Una pasada de regex por la página de inicio se pierde la mayor parte de lo que en realidad está publicado.

En Mozart

Mozart rastrea las páginas donde viven las direcciones, revierte los trucos de ofuscación y devuelve cada dirección con su página de origen, con las genéricas separadas de las que llevan nombre.

El mecanismo

Cómo se lee una web.

1

Rastreo

Página de inicio, contacto, «quiénes somos» y aviso legal: el rastreador va donde de verdad están las direcciones publicadas.

2

Desofuscación

Las grafías con at y dot, las entidades HTML y las direcciones montadas por script se revierten a texto plano.

3

Clasificación

Las direcciones se deduplican, se separan las genéricas de las que llevan nombre, y cada una vuelve con la página de la que salió.

Cara a cara

Un rastreo contra una regex.

En otras partesEn Mozart
Una pasada de regex por la página de inicioun rastreo de las páginas donde viven las direcciones
Direcciones ofuscadas que se pierdengrafías con at y dot, trucos de script: todo revertido
Una lista de cadenas y nada máscada dirección con su página de origen, genérica o con nombre
Precio por dirección encontrada1 crédito por sitio escaneado, publique las que publique

Se paga el escaneo, así que «no publica nada» también se factura, y un escaneo que nunca llegó a empezar es gratis.

Medido, no prometido

2,5

dominios por segundo en modo por lotes

Un archivo de 5 000 dominios se termina en 30 o 35 minutos, sin supervisión. Alrededor de un tercio de las webs publican al menos una dirección genérica.

Empezar gratis con 50 créditos verificadosCómo se demuestra →

Sin tarjeta de crédito · 50 créditos gratis

Individual · por lotes · API

Un sitio, un archivo sectorial o la API.

Individual

Apunta el widget de arriba a cualquier dominio y lee lo que publica, en directo.

Por lotes

5 000 dominios por archivo. Se ejecuta sin que nadie lo vigile.

API

POST /api/scrape-domain devuelve por separado las direcciones genéricas y las que llevan nombre, con sus recuentos y el número de páginas rastreadas.

POST /api/scrape-domain
{"domain": "leipzig-cantata.com"}
200 OK
{
"ok": true, "billable": true, "charged": 1,
"role_emails": ["contact@leipzig-cantata.com"],
"other_emails": ["johann.bach@leipzig-cantata.com"],
"n_role": 1, "pages": 3
}

Explorar la API →

Dónde encaja

Para los buzones que viven en las webs.

Equipos SDRLlega a los negocios pequeños cuya única dirección es contact@, directamente desde su propia web.
AgenciasBarre un archivo sectorial de 5 000 dominios en media hora y arranca la campaña con buzones publicados.
RevOpsRellena la columna de contacto genérico que tu CRM nunca tuvo, con la página de origen adjunta.

Componer con

Domain finderDomain scraperEmail verifier

Busca el dominio, recolecta lo que publica, verifica antes de enviar.

Preguntas con respuesta completa

Facturación, páginas y encadenamientos.

¿Por qué se factura esta herramienta aunque no vuelva ninguna dirección?

Porque la respuesta es el escaneo. «Este sitio no publica nada» cierra la fila igual de bien que tres direcciones, y el rastreo se ha hecho en ambos casos. Es la única herramienta del catálogo que se factura por el trabajo y no por la captura, y preferimos decirlo a esconderlo en la letra pequeña. Un escaneo que no ha podido empezar es gratis.

¿Qué páginas se rastrean?+

Aquellas donde viven las direcciones publicadas: página de inicio, contacto, «quiénes somos», equipo y aviso legal. Cada dirección devuelta lleva consigo la página en la que se encontró.

¿Qué diferencia hay entre una dirección genérica y una con nombre?+

Las direcciones genéricas pertenecen a una función: contact@, info@, sales@. Las otras llevan el nombre de una persona. Vuelven las dos, ya separadas, para que puedas darles un tratamiento distinto.

¿Puedo escanear las webs que ha devuelto una recolección de Maps?+

Es el encadenamiento natural: recolecta fichas con el Google Maps scraper, conserva la columna de web y pásasela a esta herramienta como archivo por lotes.

Todas las direcciones publicadas.
Con su página de origen.

Un crédito por sitio, y el escaneo es la respuesta.

Empezar gratis con 50 créditos verificados

Sin tarjeta de crédito · 50 créditos gratis