
Loading comments…
성과
프로젝트 정보
제품 키워드
SCRAPR는 브라우저를 렌더링하거나 취약한 DOM 선택자를 사용하지 않고, 웹사이트의 내부 네트워크 요청에서 직접 구조화된 JSON을 캡처하는 웹 데이터 추출 API입니다. 사이트가 자체 데이터를 로드하기 위해 수행하는 정확한 HTTP/XHR 호출을 재생함으로써, SCRAPR는 200밀리초 이내에 깨끗하고 AI에 바로 사용 가능한 출력을 제공합니다. 현재 초기 MVP 단계로, 835명 이상의 엔지니어가 대기자 명단에 있습니다.
SCRAPR는 웹사이트가 자체 인터페이스를 채우는 데 사용하는 동일한 HTTP/XHR 호출을 가로채서 재생합니다. 이는 브라우저 시작 시간과 렌더링 지연을 제거하여 평균 89ms의 추출 속도를 달성합니다. 이는 Puppeteer 기반 솔루션보다 10~100배 빠릅니다.
각 API 응답에서 유형, 키 및 데이터 구조가 자동으로 추론됩니다. 문자열, 배열 및 숫자는 출력 JSON에 올바르게 입력된 상태로 도착하여 LLM 컨텍스트, 벡터 저장소 또는 에이전트 메모리에서 직접 사용할 수 있습니다.
SCRAPR는 DOM 요소가 아닌 내부 데이터 API를 대상으로 하기 때문에, 사이트가 CSS를 재설계해도 추출 파이프라인이 중단되지 않습니다. 기본 데이터 엔드포인트는 훨씬 덜 자주 변경되므로 지속적인 유지보수가 거의 필요하지 않습니다.
190개 이상의 국가에 걸쳐 437개 이상의 활성 노드가 99.9%의 성공률로 전 세계적인 커버리지를 제공합니다. 이 서비스는 대규모 데이터 작업을 위한 배치 추출, 웹훅 알림 및 비동기 작업 처리를 지원합니다.
"중단되지 않는 추출 계층."
SCRAPR는 각 웹사이트를 자체 API로 취급하여 웹 스크래핑을 재정의합니다. 사용자가 페이지를 탐색하는 것을 시뮬레이션하는 대신, 사이트가 이미 자체적으로 전송하는 구조화된 데이터를 캡처합니다. 이 접근 방식은 더 빠르고 안정적인 결과를 제공하며, 기존 스크래퍼를 괴롭히는 지속적인 선택자 업데이트 주기를 제거합니다. 출력은 깨끗한 JSON입니다. HTML 구문 분석, 정규식 정리 없이 AI 파이프라인에 바로 사용할 수 있는 입력된 데이터만 제공됩니다.
신선하고 구조화된 웹 콘텐츠에 의존하는 AI 에이전트, RAG 시스템 또는 데이터 파이프라인을 구축 중인 경우입니다. 느린 헤드리스 브라우저, 취약한 CSS 선택자 또는 기존 스크래핑 도구의 유지보수 부담에 지쳐왔다면, SCRAPR는 근본적으로 다른 접근 방식을 제공합니다. 특히 대규모로 데이터를 추출해야 하는 팀에게 적합합니다. 배치 엔드포인트와 웹훅 지원은 이미 알파 단계이며, REST API는 v1에서 안정적으로 운영됩니다.
제작자
meowbyte
Loading comments…