入力は製品ではなくストアです - 必要なストアやコレクションを指定すると、ジョブがそれぞれの公開内容を読み取ります。
1バリエーションにつき1行で、各行には取得元のクエリが付きます - 複数のストアにまたがる実行でも、入力リストと突き合わせられます。
何かを数える前に、これだけは知っておいてください。サイズと色の組み合わせが17ある製品は17行になります。id、タイトル、handle、説明は繰り返され、sku と variant だけが変わります。行はバリエーションです - 製品として扱えば、カタログを何倍にも数え過ぎることになります。
各行はページから読み取るのではなくストアの公開製品フィードから来るため、エクスポートは Shopify 自身の形を保ちます。本物のタイムスタンプ、handle、ベンダーと製品タイプ、そして variants、images、options の完全な構造が、平坦化されずに JSON のまま渡されます。
published_at、created_at、updated_at は UTC オフセット付きの ISO 8601 タイムスタンプで届きます。カタログのエクスポートとしては珍しいので明記しておきます - 表示用フォーマットを解読する必要はなく、素直に並べ替えるだけで、そのストアが最近何を追加し何に手を入れたかが分かります。
各行はストアが公開しているとおりの購入可能なバリエーションです。その製品が何か、そのサイズや色がいくらか、購入できるか、そして Shopify がその背後に持つ構造化データ。
下の列一覧は実際の実行エクスポートのヘッダー行であり、プラットフォームが公開している一覧でもあります。両者は完全に一致します。パーサーを書く前に、その下の注記をお読みください - このうち3列は単純な値ではなく JSON を保持しており、いま見ている行は製品ではなくバリエーションです。
エクスポートのヘッダー行を順序どおりに、プラットフォームが公開する列一覧と照合したものです。値の形が実際に観測されている項目についてはそれを記し、そうでない項目については何のための列かを述べるにとどめます。
yes または no で入ります。これに対してコードを書く前に知っておくべきことが2つあります。1つ目、1行は製品ではなくバリエーションです。id、title、handle、body_html、url、image はファイル全体で繰り返され、sku と variant だけが変わります。製品がほしいときは id でグルーピングし、行を数えるのは本当にバリエーションがほしいときだけにしてください。2つ目、variants、images、options はそれぞれ1つのセルに JSON を保持します。表計算ソフトでは長い文字列として表示されるため、パーサー側ではカンマで分割するのではなくデコードする必要があります。それ以外はすべて素のテキストで、価格も通貨記号を含みません。
ストアリンクの一覧と上限です。実質的な制約は1つだけ、サイトが Shopify で作られていること - これはストアフロント自身の公開製品フィードを読みます。
ストアのカタログデータを、チームが実際に抱えている問いに答えるためにどう使っているかの例をいくつか。
バリエーションごとに独立した行があり、在庫可否もそれぞれ持つため、そのストアがどのサイズや色を売り切ったかまで読めます。どの製品を掲載しているかだけではありません。何が売れているかの手がかりとしては、製品ページよりはるかに優れています。
参考価格が入っている行だけに絞れば、そのストアの値引きの全体像が一度で手に入ります。どのライン、どのバリエーション、どれくらいの幅か。毎週繰り返せば、競合の販促サイクルがはっきり見えてきます。
更新タイムスタンプで並べ替えると、直近の動きが自然と浮かび上がります。新規投入、書き直された説明、静かな価格変更。隣の作成日と公開日が、本当に新しい製品と、古い製品の手直しとを分けてくれます。
サブスクリプションも、最低利用額も、毎月の請求もありません。最初の500行は当社負担 - その後は従量課金で、ここにある他のスクレイパーと同じ均一料金です。
新規アカウントごとに初回のみ。クレジットカード不要。クエリごとの上限、ファイルアップロード、すべてのエクスポート形式を含みます。
1,000バリエーションあたり約 $2。1つの製品が十数行になり得ることは覚えておく価値があります - 事前見積もりが実行開始前に行数とクレジット費用を表示します。
継続的なモニタリングや非常に大規模なカタログ取得向けに、ボリューム料金、専用ワーカー、SLA をご用意します。ご希望の規模をお知らせいただければお見積もりします。
LIVESCRAPER10 をご利用ください。短い答え: 公開カタログについてははい - そしてこのエクスポートに顧客・注文・在庫のデータは含まれません。
ここにある項目はすべて、Shopify のストアフロントが誰にでも読めるよう公開している製品フィードから来ます。ストア自身のページや他所での掲載を埋めているのと同じデータです。タイトル、説明、価格、バリエーション、画像は設計上公開されています。公開されたカタログデータを収集することは長く定着した実務であり、ここではログインもカートも決済も加盟店管理画面も一切扱いません。
この出力に個人データは一切ありません。製品テーブルです。顧客名も、注文も、在庫数もありません。いずれも公開フィードにないからです。在庫可否の列が示すのはそのバリエーションを購入できるかどうかであり、あと何個残っているかとは別物です。そしてこのエクスポートには後者を知る手段がありません。
Shopify の規約と各加盟店自身の規約は自動アクセスを制限している場合があるため、これは法律の問題であると同時に規約の問題でもあります - そのストアと関係がある場合は、内容をご確認ください。当社はデータ層でサードパーティのトラッカーを一切実行せず、エクスポートは30日後に自動削除されます。
最もよくいただく質問です。ほかにご不明な点は お問い合わせください - 回答を書いているのはボットではなく人間です。
Livescraper の Shopify 製品スクレイパーは、ストアのリンクをカタログのテーブルに変えます。Shopify サイトへのリンクを1行に1件貼り付けるか - ストア全体ならドメイン、1セクションならコレクション URL - CSV、XLSX、TXT、Parquet ファイルとしてアップロードし、クエリごとの行数に上限を設けて、結果を整った CSV、Excel、JSON ファイルとしてダウンロードします。
各行は購入可能なバリエーションです。製品 id、タイトル、handle、説明、ベンダーと製品タイプ、タグ、価格と参考価格、sku、購入可否、そしてバリエーションの表記自体。さらに公開・作成・更新のタイムスタンプと、ストアの variants・images・options のデータ。各行はレンダリング済みページではなくストアフロントの公開製品フィードから来るため、エクスポートは平坦化された近似ではなく Shopify 自身の構造を保ちます。
マーチャンダイジングのチームはバリエーション単位で在庫可否を読み、そのストアが実際にどのサイズや色を売り切ったかを見ます。プライシングのチームは参考価格が入っている行に絞り、競合の値引きの全体像を一度で把握します。戦略チームは更新タイムスタンプで並べ替えてストアが何に手を入れてきたかを見て、作成日と公開日が新規投入と手直しとを分けます。
ジョブを計画する前に、実務的な注意を2つ。1行は製品ではなくバリエーションなので、数百製品のカタログでも数千行になり得ます - 製品がほしいときは製品 id でグルーピングしてください。そして variants、images、options の各列は1つのセルに JSON を保持するため、カンマで分割せずデコードしてください。無料で始められます - 最初の500行は費用もクレジットカードも不要で、その後は1行 $0.002 の均一料金です。