아마존이 스크랩하기 가장 어려운 웹사이트인 이유
무뚝뚝하게 말하자. Amazon scraping 2026년에는 인터넷에서 가장 정교한 안티봇 시스템 중 하나에 맞서 싸우고 있습니다. Amazon은 여러 계층의 방어를 사용합니다. 단 몇 번의 자동화된 페이지 로드 후에 나타나는 CAPTCHA 문제, 제한에서 완전한 차단으로 확대되는 IP 기반 속도 제한, 사람이 아닌 탐색 패턴을 감지한 후 액세스를 중단시키는 세션 무효화, 법적 조치 등 Amazon은 2025년에 무단 콘텐츠 스크래핑으로 Perplexity AI를 고소했으며, 데이터 수집 관행에 대한 여러 집단 소송이 계속해서 법적 환경을 형성하고 있습니다. Amazon은 제품 데이터를 보호하기 위한 재정적 인센티브와 이를 위한 엔지니어링 리소스를 모두 갖고 있습니다.
이는 Amazon scraping이 불가능하다는 의미는 아닙니다. 이는 실제 한계를 이해하고, 적절한 규모에 적합한 도구를 사용하고, 다른 플랫폼에서 작동하는 일부 접근 방식이 여기서는 작동하지 않는다는 점을 받아들여야 함을 의미합니다.
연구 규모(사람의 탐색 속도로 수십에서 수백 개의 제품 페이지)에서는 세션 관리를 통한 스크래핑이 작동합니다. 상업적 규모(여러 카테고리에 걸쳐 수천 개의 제품, 자동화됨)에서 Amazon은 귀하를 감지하고 차단합니다. 심각한 Amazon 데이터 요구 사항이 있는 경우 공식 API 또는 유료 데이터 서비스를 사용하십시오.
Amazon 제품 데이터를 얻는 세 가지 합법적인 방법
| 방법 | 최고의 대상 | 규모 | 위험 수준 |
|---|---|---|---|
| Amazon Creators API | 제품 제목, 가격, 이미지, 리뷰, 가용성에 대한 공식 액세스입니다. 제휴 계정 + 지난 30일 동안 적격 판매 10회가 필요합니다. | 1TPS에서 시작됩니다. 제휴 수익에 따라 최대 10TPS까지 확장됩니다. | ✅ Safe & compliant |
| Keepa API | Price history, 판매 순위 추세, 제품 메타데이터. Keepa은 이미 수년간의 Amazon 데이터를 수집했습니다. 스크랩할 필요가 없습니다. | Data plans from €19/mo. API access from €49/mo. | ✅ Safe (third-party data) |
| AI Scraper (Research Scale) | Manual research: 경쟁사 가격 확인, 자신의 목록 모니터링, 소규모 제품 조사. | 10-50 products/session. Human speed only. | ⚠️ Use at research scale only |
실제로 어떤 Amazon 데이터를 얻을 수 있나요?
| 데이터 포인트 | API | AI 스크레이퍼 | 메모 |
|---|---|---|---|
| Product title, price, image | ✅ | ✅ (페이지에 표시) | Basic listing data은 항상 표시됩니다. |
| BSR, category rank | ✅ | ✅ (페이지에 표시) | 베스트셀러 순위는 제품 정보 섹션에 있습니다. |
| Reviews (text + rating) | ✅ (한정) | ⚠️ (인기 리뷰만 해당) | Full 검토 스크래핑은 보안 문자를 빠르게 트리거합니다. |
| Price history | ❌ | ❌ | Use Keepa — 긁지 마세요. |
| Inventory / stock level | ❌ | ⚠️ (한정) | "In Stock" only — 수량 데이터가 없습니다. |
EasyClaw으로 Amazon 제품 데이터를 긁는 방법
For research-scale use only: 자신의 목록 모니터링, 소수의 경쟁사 가격 확인, 소규모 제품 조사. 이 이상의 작업에는 Amazon API 또는 Keepa을 사용하세요.
Step 1: Amazon에 로그인(주의)
브라우저를 열고 Amazon 계정에 로그인하세요. 하지만 기본 구매 또는 판매 계정이 아닌 보조 계정을 사용하세요. Amazon은 로그인한 사용자와 로그아웃한 사용자에게 서로 다른 가격, 배송 옵션 및 가용성을 표시합니다. 그러나 Amazon이 귀하의 계정에서 자동화된 활동을 표시하는 경우 구매 내역, Prime 혜택 또는 판매자 권한을 포함하여 해당 계정을 제한할 수 있습니다. 이 목적을 위해 전용 조사 전용 Amazon 계정을 생성하거나 로그인을 건너뛰고 로그아웃 가격이 표시된다는 점을 수락하세요.
Step 2: Scrapling 활성화
EasyClaw 열기 → Skills → "Scrapling Web Data Extraction" → Add.
Step 3: 인간의 속도로 긁어내기
⚠️ Critical: 지시사항에 항상 "페이지 간 X초 대기"를 포함시키십시오. 인간의 탐색 속도(요청 간 3~8초)는 Amazon의 탐지를 피하는 데 가장 중요한 요소입니다. Scrapling은 이러한 지연을 존중합니다. 건너뛰면 몇 분 안에 IP 차단 위험이 있습니다.
너: 이 Amazon 검색 결과 페이지[URL]로 이동하여 처음 20개 결과에 대해서만 제품 이름, 가격, 평점 및 리뷰 수를 추출하세요. 요청 사이에 기다리십시오. CSV로 저장합니다.
Step 4: 한계를 받아들이세요
- 세션당 20-50개의 제품이 현실적입니다. Not 500. Not 5,000.
- cron 일정에 따라 Amazon scraping을 자동화하지 마십시오. 감지됩니다.
- CAPTCHA를 받으면 중지하세요. 다시 시도하기 전에 몇 분이 아니라 몇 시간을 기다리십시오.
- 상업적 규모의 모든 것에는 Amazon API 또는 Keepa를 사용하십시오.
더 나은 방법: 스크래핑 대신 공식 API 사용
대부분의 Amazon 데이터 요구 사항에 대해 스크래핑은 잘못된 도구입니다. 언제 무엇을 사용해야 하는지는 다음과 같습니다.
Amazon 제작자 API(PA-API 대체)
공식 Amazon 제품 데이터 API입니다. API 액세스를 활성화하려면 Amazon Associates 계정이 필요하며 지난 30일 동안 최소 10회의 적격 판매가 필요합니다. 제품 제목, 가격, 이미지, 리뷰, 재고 여부 등을 모두 깔끔한 JSON으로 제공합니다. 초당 요청 1개부터 시작하여 제휴 수익을 기준으로 최대 10TPS까지 확장됩니다. Note: 이전 PA-API v5는 2026년 5월에 종료됩니다. 신규 사용자는affiliate-program.amazon.com에서 Creators API에 등록해야 합니다.
Keepa API
Keepa은 이미 수년간의 Amazon 가격 내역 및 판매 순위 데이터를 수집했습니다. 스크랩할 필요가 없습니다. 데이터 구독은 월 €19부터 시작됩니다. 프로그래밍 방식 API 액세스는 분당 20개의 토큰에 대해 월 €49부터 시작하며 데이터 볼륨에 따라 확장됩니다. 한 번의 API 호출로 몇 주간의 스크래핑이 대체됩니다.
Scrapling(연구 규모 전용)
가끔 직접 조사하는 경우 — 자신의 목록 확인, 몇 가지 경쟁업체 가격 확인, 소규모 제품 조사. 인간의 탐색 속도로 세션당 20-50개의 제품. 자동화 또는 예약을 위한 Not. Amazon은 패턴을 감지합니다. 동일한 IP에서 반복적으로 사용하면 차단됩니다.
자주 묻는 질문
결론
Amazon scraping은 자신의 목록 확인, 소수의 경쟁업체 가격 모니터링, 가벼운 제품 조사 등 연구 규모에서 가능하지만 상업적 규모의 데이터 추출에는 전혀 적합하지 않습니다. 플랫폼의 봇 방지 방어력이 너무 강력하고 IP 차단이나 법적 문제의 위험이 너무 높습니다.
가장 현명한 접근 방식: Amazon Creators API (공식, 판매가 10개 이상인 Associates 계정 필요) 제품 데이터에 대한 정보입니다. 사용 Keepa (유료, 신뢰성, 스크래핑 필요 없음) 가격 내역. 사용 Scrapling 가끔 수동 조사에만 사용되며 일정에 따라 수행되지는 않습니다. API를 언제 스크랩해야 할지, 언제 API를 사용해야 할지 파악하세요. Amazon 계정 상태가 이에 따라 달라집니다.