/p/…/A-<id> の形のものです。成功した実行は、提供元自身が公開している例のアドレスを送り、ok で返ってきました。17列のうち5列に値があります。query、name、images、image、url です。名前は完全で正確な商品タイトル、画像は本物の Target の画像のアドレスでした。つまりサービスはページに到達して読んでいます。問題は、ページが何を渡すかだけです。
price、parsed_price、currency はすべて空で、brand、sku、rating、reviews、availability、description も同様です。提供元のサービス注記によれば、価格は Target の別建ての RedSky API からしか来ず、その API は保護されていてデータセンターのアドレスをはねつけます。当社のエクスポートはその注記が予告するとおりのものです。だからこそ、これを異常ではなく既知の限界として示します。
同じ商品ページのアドレスを取得すると、およそ 685 KB の HTML が返り、その中には商品名、商品 ID が45回、Target の画像配信元への参照が千件近くあります。そして構造化データの塊はまったくありません。文書全体で唯一のドル額は、メタ説明文にある送料無料のしきい値です。マークアップにはさらに、提供元の注記が名指しするその API への事前接続の指定があります。名前と画像はページの中にあり、価格はありません。
成功した実行は、おなじみの17列のヘッダーを持ちます。後の2回は13列で、sku_code、product_url、parsed_price、images がありません。同じ日にスキーマが増えた当社の他のカタログ系サービスとは逆向きです。2つの Target のエクスポートを突き合わせて列が合わないなら、理由はこれです。
当社のどの実行もブロックを返していません。ok でない2行は、存在しない仮のアドレスによる 404 です。Target の robots.txt は通常のリクエストに HTTP 200 で応答し、その一般向けグループには包括的な禁止がなく、当社が使った商品のパスも許可されています。ここでの障害はページへのアクセスではありません。ページに求める数字が入っていない、ということです。
データを返した行はちょうど1つです。その行でどの列が届いたかを述べるには十分ですが、成功率や多数の商品にわたる充足率、Target 一般のふるまいについての主張には到底足りません。このページが数字を示すところでは、その1行とそれらの実行を数えているだけです。
実際のエクスポートから、シートの順に読み取っています。件数は成功した1回の実行によるもので、ここで列に値が入っていたと書いてあるものは、その行だけの話です。
A-… の部分に見えています。必要なら列を待つのではなく url から取り出してください。url に入っていました。なお13列の形にはこの列自体がありません。name とあわせて、この実行が実際に届けたものです。name の最初の語です。集計に使うなら名前から取り出してください。sku_code と違う値を入れるかどうかはお伝えできません。query と同じです。商品 ID がその中にあるため、このサービスでは実質的な識別子になります。images と同一です。ok、2行が http 404 で、後者は存在しない仮のアドレスによるものです。この列で突き合わせてください。1行あたり17列 · 3つのファイル形式
この表だけでは分からないことが2つあります。第一に、なぜ金額の列が空なのか。提供元のサービス注記は、価格が Target の別建ての RedSky API からしか来ず、その API は保護されていてデータセンターのアドレスをはねつける、と記録しています。そして同じ商品ページを直接取得した結果もそれに完全に一致します。約 685 KB の HTML に商品名、商品 ID、画像配信元への千件近い参照があり、構造化データの塊はなく、価格もどこにもなく、しかもその API への事前接続の指定があります。読めるページに数字が入っていない以上、そのページを読むスクレイパーがそれを返すことはありません。第二に、ヘッダーが動きました。成功した実行は17列、後の2回は13列で、sku_code、product_url、parsed_price、images が落ちています。2つのエクスポートを比べる前に、どちらの形を持っているか確認してください。
返ってきたタイトルは、作り手、モデル、サイズ、仕上げを含む完全な小売文字列です。ページを手で開かずに、Target のリンクを自社のカタログや他店の掲載と突き合わせるにはそれで足ります。
image は Target 自身の画像配信元にある本物のアドレスとして返り、images も同じ値でした。リンクの隣に画像が要るだけなら - 社内カタログ、比較表、スライド - その部分は今日でも機能します。
目的が価格の監視なら、これは適さない情報源です。先に申し上げておきます。当社の Best Buy、CDW、Uline の各サービスは、自らの実行で本物の金額の列を返しました。それぞれのページに、どれだけ何から得たかが書いてあります。
名前と画像と時刻の入った1行は、その形の掲載が存在したという日付入りの記録です。見た目が文字と同じくらい重要なら、画面の画像と組み合わせてください。
LIVESCRAPER10 をご利用ください。同じ家電の領域を、商品ページではなく検索結果から読むもの。あちらでは価格が85行中78行に届き、各掲載の順位も付いてきました。
こちらも価格が配信されずブラウザ側で描画されるページですが、当社の実行では取得できました。その違いが何を意味するかを見るために、このページと並べて読む価値があります。
17列のスキーマによる、もう一つの米国大手小売店。特定の店より領域のほうが大事なときに。
日付入りの掲載ページの画像。必要な数字がブラウザでしか見えないとき、その画像が正直な答えになることもあります。
公開された掲載上の商品名と画像は、ありふれた商取引上の情報です。このページで興味深いのは許可の問題ではなく、ページに実際に何が入っているかです。
商品のタイトルと商品の写真は、販売されている品についての事実であり、誰にでも配信されるページから読めます。17列のどれも人物を記述しません。氏名も、メールアドレスも、電話番号も、アカウントもありません。ですから、人に関わるサービスを形づくるデータ保護の問題は、ここでは生じません。画像の権利は小売店やメーカーのもとに残ります。この列が与えるのはアドレスであって、その写真を再公開する権利ではありません。その区別を守るのは利用者側の責任です。
当社の実行では、アクセスは障害ではありませんでした。Target の robots.txt は2026年8月12日、通常のリクエストに HTTP 200 で応答しました。適切な照合器で読むと、一般向けグループには114のルールがあり、包括的な禁止はなく、当社が使った商品のパスも許可されています。当社が実行したもので、ブロックされたものはありません。価格の到着を止めたのは、サイト側の設計上の判断です。その数字はページに印字されず、保護された別の API から配信されており、提供元のサービス注記は、その API がデータセンターのアドレスをはねつけると記録しています。当社はそれを回避するのではなく報告します。作業のあとではなく前に知っていただくほうがよいからです。
当社の条件は、ここにある他のサービスと同じです。一般に公開されているページのみ、ログインの先には入らず、データ層に第三者のトラッカーは置かず、エクスポートは30日後に自動削除されます。最初の500行は無料で、クレジットカードは不要です。
name、images、image、url、query の17列中5列で、price、parsed_price、currency は空、brand、sku、rating、reviews、availability、description も空でした。ok です。リンクを商品に解決したいのなら本当に役に立つ行ですが、価格の行ではありません。sku_code、product_url、parsed_price、images がありません。2つのファイルを比べる前に、どちらの形かを確認してください。CSV、JSON、Excel の3形式です。列とその順序は、どの形式でも同じです。Target はアメリカ最大級の総合小売店で、このページはこの領域の商品ページが普通に約束することではなく、当社のサービスが実際に返したものを記します。手元には3回の実行があります。データを返したのは1回で、提供元自身が公開している例のアドレスを送り、成功して返り、17列のうち5列に値がありました。送信したアドレス、商品名、画像のアドレスが2列、そしてステータスの印です。名前は完全な小売のタイトル、画像は Target 自身の画像配信元にある本物のアドレスなので、この実行は掲載に到達し、正しく読んでいます。残る2回は存在しない仮のアドレスに対する 404 で、Target については何も語りません。
届かなかったのは価格で、その理由は普通のものではないため、丁寧に述べる価値があります。何もブロックされていません。Target の robots.txt は2026年8月12日、通常のリクエストに HTTP 200 で応答し、適切な照合器で読むと一般向けグループに包括的な禁止はなく、当社が使った商品のパスも許可されています。次に商品ページ自体を取得しました。およそ 685 キロバイトの HTML に、商品名、商品の識別子が45回、画像配信元への千件近い参照が含まれ、構造化データの塊はどこにもなく、文書全体でドル額はちょうど1つ、それはメタ説明文の送料無料のしきい値でした。マークアップは Target の別建ての API への事前接続を開いています。提供元自身のサービス記録はその API を名指しし、保護されていてデータセンターのアドレスには強い拒否を返す、と注記しています。独立した2つの情報源が同じ結論に至ります。価格は、スクレイパーが読めるページの中にはありません。
そのためこのサービスは、狭い用途には向き、よくある用途には向きません。Target のリンクを本物の商品タイトルに解決したい、あるいは公式の商品画像を社内カタログに添えたいのなら、当社の実行はどちらも機能することを示しています。価格の監視が必要なら、これは適した情報源ではありません。試用で気づいてもらうより、ここに書いておきます。当社の Best Buy のサービスは85行中78行で価格を返し、CDW と Uline のサービスは自らの実行で金額の列を揃えて返しました。それぞれのページに、何をどう測ったかが書いてあります。
実務上の注意をもう1つ。エクスポートのスキーマは2026年7月3日から14日のあいだに、しかも珍しい向きに変わりました。成功した実行は当社の他のカタログ系サービスでおなじみの17列のヘッダーを持ち、後の2回は sku_code、product_url、parsed_price、images を取り除いた13列を持ちます。2つの Target のエクスポートを突き合わせて列が合わないなら、理由はそれです。それ以外について、このページが数えているのは成功した1行と3回の実行だけです。成功率も、多数の商品にわたる充足率も、Target の価格も示しません。作り出すことも、推定することも、近隣のカタログから借りることもしません。一般に公開されているページのみ、データ層に第三者のトラッカーは置かず、エクスポートは30日後に自動削除され、最初の500行は無料でクレジットカードは不要です。