
Loading comments…
Récompense
Infos du projet
Mots-clés du produit
SCRAPR est une API d'extraction de données web qui capture du JSON structuré directement à partir des requêtes réseau internes d'un site web — sans utiliser de navigateur ni de sélecteurs DOM fragiles. En rejouant les appels HTTP/XHR exacts qu'un site effectue pour charger ses propres données, SCRAPR fournit un résultat propre et prêt pour l'IA en moins de 200 millisecondes. Actuellement en phase MVP précoce, plus de 835 ingénieurs sont sur la liste d'attente.
SCRAPR intercepte et rejoue les mêmes appels HTTP/XHR qu'un site web utilise pour alimenter sa propre interface. Cela élimine le temps de démarrage du navigateur et les délais de rendu, atteignant des vitesses d'extraction moyennes de 89 ms — 10 à 100 fois plus rapide que les solutions basées sur Puppeteer.
Les types, les clés et la structure des données sont déduits automatiquement de chaque réponse API. Les chaînes, les tableaux et les nombres arrivent correctement typés dans le JSON de sortie, prêts à être utilisés directement dans des contextes LLM, des magasins de vecteurs ou la mémoire d'agent.
Parce que SCRAPR cible les API de données internes plutôt que les éléments DOM, les pipelines d'extraction ne se cassent pas lorsqu'un site repense son CSS. Les points de terminaison de données sous-jacents changent beaucoup moins souvent, réduisant la maintenance continue à presque zéro.
Plus de 437 nœuds actifs dans plus de 190 pays offrent une couverture mondiale avec un taux de réussite de 99,9 %. Le service prend en charge l'extraction par lots, les notifications webhook et le traitement asynchrone des tâches pour les opérations de données à grande échelle.
"La couche d'extraction qui ne casse pas."
SCRAPR repense le scraping web en traitant chaque site web comme sa propre API. Au lieu de simuler un utilisateur naviguant sur une page, il capture les données structurées que le site s'envoie déjà à lui-même. Cette approche donne des résultats plus rapides et plus fiables et élimine le cycle constant de mise à jour des sélecteurs qui tourmente les scrapers traditionnels. Le résultat est un JSON propre — pas d'analyse HTML, pas de nettoyage regex, juste des données typées prêtes pour les pipelines IA.
Vous construisez des agents IA, des systèmes RAG ou des pipelines de données qui dépendent de contenu web frais et structuré. Si vous avez été frustré par les navigateurs sans tête lents, les sélecteurs CSS fragiles ou la charge de maintenance des outils de scraping traditionnels, SCRAPR offre une approche fondamentalement différente. Il est particulièrement pertinent pour les équipes qui ont besoin d'extraire des données à grande échelle — les points de terminaison par lots et le support webhook sont déjà en alpha, et l'API REST est stable en version 1.
D'autres outils que vous pourriez envisager
Créateur
meowbyte
Loading comments…