Tools Rúbica
← Todas las herramientas

Herramienta libre · Contenido

Extractor de contenido principal

Pegá una URL y te devolvemos solo el contenido principal: sin menú, pie, barra lateral ni publicidad. Como texto limpio o en Markdown.

Funciona con páginas públicas en HTML. Si una página carga el texto con JavaScript, puede salir incompleta.

Cómo funciona

Tres pasos, cero fórmulas

  1. 01

    Pegá la URL

    De una nota, un artículo del blog de tu competencia o una página de producto.

  2. 02

    Leemos la página

    La consultamos desde nuestro servidor y separamos el contenido principal del resto con el mismo motor del modo lectura de Firefox.

  3. 03

    Llevate el texto

    Copialo o descargalo como texto plano o en Markdown, con sus títulos y listas.

Preguntas frecuentes

¿Para qué sirve?

Para analizar el contenido de una página sin distracciones: contar palabras, revisar la estructura de un competidor, pasarlo a un documento o usarlo como base para un brief.

¿Por qué algunas páginas salen vacías o incompletas?

Porque cargan el texto con JavaScript después de abrirse, o lo protegen detrás de un inicio de sesión. Leemos el HTML que entrega el servidor, como lo hace un buscador sin ejecutar scripts.

¿Hay un límite?

Hasta 30 páginas por hora por persona, y páginas de hasta 3 MB. No consultamos direcciones internas ni privadas.

¿Guardan el contenido?

No. Leemos la página en el momento y te devolvemos el resultado. Solo registramos un dato cifrado de tu conexión para aplicar el límite por hora.