Hola a todos!
Estoy intentando extraer todas las librerías de una web para un proyecto personal, pero no sé por dónde empezar. He probado con algunas herramientas como DevTools y scripts en Python, pero no logro obtener todo lo que necesito.
¿Alguien sabe cómo extraer todas las librerías de una web de manera eficiente? Me refiero a JS, CSS, fuentes, etc.
También, si conocen alguna herramienta o extensión que haga esto automáticamente, sería genial. No quiero perder horas revisando el código manualmente, jaja.
Gracias de antemano por la ayuda!
¡Hola! Para extraer todas las librerías de una web, te recomiendo usar Web Scraper o HTTrack. Son herramientas que te permiten descargar todo el contenido de un sitio, incluyendo JS, CSS y fuentes.
Si prefieres algo más específico, prueba con Wappalyzer. Es una extensión de navegador que identifica las tecnologías usadas en una web, incluyendo librerías. ¡Es super útil y ahorra tiempo!
Yo usé BuiltWith para un proyecto similar. Es una herramienta online que te da un informe detallado de todas las librerías y tecnologías que usa un sitio.
También puedes combinar eso con un script en Python usando BeautifulSoup para extraer los enlaces de los recursos. No es automático, pero te da más control.
¡Hola! Si buscas algo rápido, prueba con PageXray. Es una herramienta que analiza una web y te lista todos los recursos, incluyendo librerías JS y CSS.
Además, si usas Chrome, puedes inspeccionar la red en DevTools y exportar los datos en formato HAR. Luego, con un script, puedes filtrar lo que necesitas.
Para extraer todas las librerías de una web, yo uso Screaming Frog SEO Spider. Aunque está más enfocado en SEO, te permite extraer todos los recursos de una página, incluyendo JS, CSS y fuentes.
Es pago, pero tiene una versión gratuita que te deja analizar hasta 500 URLs. ¡Vale la pena probarla!
¡Hola! Una opción sencilla es usar Sitebulb. Es una herramienta que te permite analizar una web y extraer todas las librerías y recursos que usa.
Además, te da un informe detallado con todo lo que necesitas saber. No es gratis, pero si buscas algo profesional, es una buena opción.
Si quieres algo más técnico, puedes usar Puppeteer con Node.js. Te permite automatizar la extracción de recursos de una web, incluyendo librerías JS y CSS.
Es un poco más complicado, pero te da mucha flexibilidad. ¡Y es gratis!
¡Hola! Para extraer todas las librerías de una web, prueba con Octoparse. Es una herramienta de scraping que te permite extraer datos de sitios web de manera automática.
Aunque está más enfocado en datos, puedes configurarlo para que extraiga los recursos que necesitas. ¡Y tiene una versión gratuita!
¡Muchas gracias a todos por las sugerencias! Probé Wappalyzer y Screaming Frog, y funcionaron bastante bien. Aunque todavía tengo problemas para extraer algunas fuentes y librerías dinámicas.
¿Alguien sabe cómo manejar eso? También, ¿alguien ha usado Puppeteer? Me interesa probarlo, pero no sé si es complicado de configurar. ¡Gracias de nuevo!
Yo uso Netpeak Spider para esto. Es una herramienta que te permite analizar una web y extraer todos los recursos, incluyendo librerías JS, CSS y fuentes.
Además, te da un informe detallado con todo lo que necesitas. ¡Es super útil y fácil de usar!