Amazon がスクレイピングするのが最も難しい Web サイトである理由
率直に言ってみましょう。 アマゾンスクレイピング 2026年、インターネット上で最も精査されたアンチボットシステムの1つと戦っています。 Amazonは複数の防御層を使用しています。また、データ収集の慣行を巡って複数の集団が法的な状況を形成し続けています。 Amazon には、製品データを保護するための報酬的インセンティブと、それを行うためのエンジニアリング リソースの両方があります。
これは、Amazon スクレイピングが不可能であるという意味ではありません。つまり、実際の制限を正しく理解し、適切な適切なツールを使用し、他のプラットフォームで機能するいくつかのアプローチがここでは機能しないことを受け入れる必要があります。
研究規模 (人間の閲覧速度で数十から数百前半の製品ページ) では、セッション管理を使用したスクレイピングが機能します。商業規模(複数のカテゴリ全体何千もの製品、自動化)では、Amazon があなたを検出してブロックします。 Amazon データが本格的に必要な場合は、公式 API または有料データ サービスを使用してください。
Amazonの商品データを取得する3つの合法的な方法
| 方法 | 最適な用途 | 規模 | リスクレベル |
|---|---|---|---|
| Amazonクリエイター API | 製品タイトル、価格、画像、レビュー、在庫状況への公式アクセス。アソシエイト アカウント + 過去 30 日間の対象となる売上が 10 件必要です。 | 1TPSから進みます。アフィリエイト獲得は最大10 TPSまで拡張できます。 | ✅ 安全かつ準拠 |
| Keepa API | 価格履歴、売上ランキング推移、商品メタデータ。 Keepa はもう何年もの Amazon データを収集しています。スクレイピングは必要ありません。 | データプランは月額 19 ユーロから。 API へのアクセスは月額 49 ユーロからです。 | ✅ 安全 (サードパーティデータ) |
| AIスクレイパー(研究規模) | 手動調査: 競合他社価格のチェック、自社の出品の監視、小規模な製品調査。 | 1セッションあたり10~50製品。人間のスピードのみ。 | ⚠️ 研究規模でのみ使用してください |
実際にどのようなAmazonデータを取得できますか?
| データポイント | API | AIスクレーパー | 注意事項 |
|---|---|---|---|
| 商品タイトル、価格、画像 | ✅ | ✅ (ページに表示されます) | 基本的な出品データは常に表示されます。 |
| BSR、カテゴリーランク | ✅ | ✅ (ページに表示されます) | 売れ筋ランキングは製品情報セクションにあります。 |
| レビュー (テキスト + 評価) | ✅ (限定) | ⚠️ (上位レビューのみ) | フルレビュー スクレイピングにより、キャプチャが迅速にトリガーされます。 |
| 価格履歴 | ❌ | ❌ | これには Keepa を使用してください — スクレイピングしないでください。 |
| 在庫/在庫レベル | ❌ | ⚠️(限定) | 「在庫あり」のみ — 数量データなし。 |
EasyClawを使ってAmazonの商品データをスクレイピングする方法
研究規模でのみ使用する場合: 自社の出品を監視したり、少数の流通の価格をチェックしたり、小規模な製品調査を行ったりします。これを上回る場合は、Amazon API または Keepa を使用してください。
ステップ 1: Amazon へのログイン (注意)
ブラウザ開いてAmazonアカウントにログインしますが、 プライマリの売買アカウントではなく、セカンダリ アカウントを使用してください。 Amazon では、ログインユーザーとログアウトユーザーに対して、価格が異なり、配送オプション、在庫状況が表示されます。ただし、Amazon がアカウントの自動アクティビティにフラグを立てた場合、購入履歴、プライム、特典販売者の特権など、アカウントが制限される可能性があります。この目的のために、リサーチ専用の Amazon アカウントをするか、ログインをスキップして、ログアウトした価格が表示されることを受け入れます。
ステップ 2: Scraplingを有効にする
EasyClawを開く→ スキル → "Web データの抽出をScraplingする" → 追加.
ステップ3:人間のスピードでスクレイピング
⚠️ クリティカル: 指示には必ず「ページ間でX秒待つ」を含めてください。人間の閲覧速度(リクエスト中の3~8秒)が、Amazonの検出を回避するための最も重要な要素です。Scraplingはこの遅延を考慮します。これをスキップすると、数分以内にIPがブロックされる危険があります。
あなた: このAmazon 検索結果ページ [URL] にアクセスし、最初の 20 件の結果のみの製品名、価格、評価、レビュー数を抽出します。リクエスト間で保留します。CSV に保存します。
ステップ 4: 制限を受け入れる
- セッションごとに 20 ~ 50 製品が現実的です。500 ではありません。5,000 ではありません。
- Amazon スクレイピングを cron スケジュールで自動化しないでください。検出されてしまいます。
- CAPTCHAを了承した場合は停止してください。再試行する前に、数分ではなく数時間待ってください。
- 商業規模のものについては、Amazon API または Keepa を使用してください。
より良い方法: スクレイピングの代わりに公式 API を使用する
ほとんどの Amazon データのニーズにとって、スクレイピングはいつでも間違ったツールです。何を使用するかは次の正しいです。
Amazon Creators API (PA-API の置き換え)
Amazon の公式商品データ API。 API アクセスを有効にするために、Amazon アソシエイト アカウントと、過去 30 日間に少なくとも 10 件の対象となる売上が必要です。製品のタイトル、価格、画像、レビュー、在庫状況をすべてクリーンな JSON で提供します。 1 リクエスト/秒から開始され、アフィリエイト 売上に基づいて最大 10 TPS までスケールします。 注記: 古い PA-API v5 は 2026 年 5 月に終了します。新規ユーザーは、affiliate-program.amazon.com でクリエイター API にサインアップする必要があります。
Keepa API
Keepa はもう何年にもわたる Amazon の価格履歴と売上ランキングのデータを収集しています。スクレイピングは必要ありません。データ サブスクリプションは月額 19 ユーロから進みます。プログラムによる API アクセスは、20 時間/分で暫定 49 ユーロから、データ量に応じてスケールアップします。 1 回の API 取得で数週間のスクレイピングが置き換えられます。
Scrapling(研究規模のみ)
時折手作業で調査する場合 - 自社の出品商品のチェック、いくつかの競合他社の価格のスポットチェック、小規模な製品調査など。人間の閲覧速度でセッションごとに 20 ~ 50 の製品。 自動化またはスケジュール用のではありません。 Amazon はパターンを検出します。同じ IP からの繰り返し使用はブロックをトリガーします。
よくある質問
結論
Amazon スクレイピングは、自社の商品リストをチェックしたり、少数の競合の価格を監視したり、簡単な製品調査を行ったりするなど、研究規模では可能ですが、商業規模のデータ抽出にはまったく適していません。プラットフォームのボット対策が強力すぎるため、IP ブロックや法の問題のリスクが高すぎます。
最も賢いアプローチ: Amazonクリエイター API (公式、10 以上の販売を持つアソシエイツ アカウントが必要) 製品データ用。使用 キーパ (有料、信頼性が高く、スクレイピングは必要ありません) 価格履歴。使用 Scrapling 手動での調査は時折行うだけで、予定通りに行うことはありません。 API をいつスクレイピングするか、いつ API を使用するかを理解してください。