Extraction

Données récupérées

Les champs disponibles et les limites liées à la boutique source.

ScrapeWoo transforme les données publiques de la boutique source en un catalogue normalisé. Le résultat exact dépend de la méthode de détection et des informations réellement publiées par WooCommerce.

Aperçu du catalogue ScrapeWoo présentant le produit, le type, la catégorie, le prix et le stock
Le tableau de sélection est un aperçu synthétique. Le fichier final contient davantage de champs lorsque la boutique les expose.

Identité et contenu

ChampCe que ScrapeWoo conserve
Identifiant sourceL’identifiant public du produit ou de la variation
Nom et slugLe titre du produit et son identifiant d’URL lorsqu’il est disponible
SKULa référence commerciale publiée par la boutique
TypeProduit simple, variable ou autre type déclaré par WooCommerce
Page sourceLe lien public vers la fiche produit
DescriptionsLa description courte et la description complète

Les descriptions peuvent contenir une mise en forme HTML utile : paragraphes, listes, tableaux, liens ou emphase. ScrapeWoo nettoie les blocs non sûrs et certains éléments injectés par des extensions avant de créer le fichier.

Aucun contenu n’est inventé

ScrapeWoo ne génère pas de description, de SKU ou de caractéristique pour remplir une case vide. Un champ absent dans la source reste vide afin que vous puissiez distinguer une donnée publiée d’une donnée à compléter.

Prix et disponibilité

ScrapeWoo distingue, lorsque la source le permet :

  • le prix courant ;
  • le prix normal avant promotion ;
  • la devise et sa précision ;
  • l’état en stock ou épuisé ;
  • la quantité disponible lorsqu’elle est rendue publique.

Un statut de stock peut être connu sans quantité précise. Dans ce cas, l’export indique la disponibilité mais laisse la quantité vide. Les taxes, règles de livraison et prix dépendant du compte client ne peuvent pas être garantis à partir d’un catalogue public.

Poids et dimensions

Lorsque la boutique les publie, ScrapeWoo récupère le poids ainsi que la longueur, la largeur et la hauteur. Une variation qui ne déclare pas les siennes hérite de celles du produit parent, comme le fait WooCommerce.

Les unités ne sont pas publiées

WooCommerce conserve l’unité de poids (kg, g, lb, oz) et de dimension (cm, m, in, yd) dans ses réglages, que l’API publique n’expose pas. Les valeurs sont donc reprises telles quelles, sans conversion.

C’est sans conséquence pour un import WooCommerce, qui les interprète dans l’unité de la boutique de destination. En revanche l’export Shopify, qui exige des grammes, laisse la colonne de poids vide plutôt que de risquer un facteur mille : reportez le poids depuis l’export WooCommerce, CSV ou JSON.

Organisation du catalogue

Les catégories, étiquettes et leur relation au produit sont conservées lorsque WooCommerce les expose. ScrapeWoo peut également récupérer la catégorie parente, le slug et le nombre de produits annoncé par la source.

Le format de destination adapte ensuite cette organisation :

  • WooCommerce conserve les catégories et les étiquettes dans les colonnes d’import natives ;
  • Shopify utilise les catégories pour préparer notamment le type, les tags ou la collection ;
  • CSV standard regroupe les valeurs dans des colonnes lisibles ;
  • JSON garde la structure la plus détaillée.

Attributs et variations

Pour un produit variable, ScrapeWoo essaie de relier le produit parent à chaque variation. Une variation peut disposer de son propre :

  • identifiant et SKU ;
  • prix normal ou promotionnel ;
  • stock et quantité ;
  • ensemble de valeurs d’attributs, par exemple Taille = 42 ;
  • visuel lorsqu’une image spécifique est publiée.

L’export WooCommerce crée une ligne parent puis une ligne par variation. L’export Shopify convertit jusqu’à trois axes de variation en options, conformément à sa structure d’import CSV.

Images et provenance

Pour chaque visuel détecté, ScrapeWoo peut conserver l’URL source, le texte alternatif, la position dans la galerie et, lorsque disponibles, les dimensions ou l’identifiant du média. Consultez Images produits pour comprendre le téléchargement par la plateforme cible et les limites des URLs distantes.

Ce que l’API publique ne donne pas

ScrapeWoo lit la Store API de WooCommerce, celle qui alimente la vitrine : elle expose ce qu’un visiteur peut voir. Certains champs relèvent de l’administration de la boutique et ne sont accessibles à personne sans identifiants :

  • la classe de TVA et le statut fiscal ;
  • la classe de livraison ;
  • la gestion des commandes en attente et la vente à l’unité ;
  • la note d’achat ;
  • les ventes croisées, montées en gamme et produits groupés ;
  • les fichiers téléchargeables des produits dématérialisés.

Ces colonnes restent vides dans l’export. Ce n’est pas une limite de l’extraction mais du catalogue public lui-même.

Pourquoi certains champs sont-ils vides ?

Une valeur peut manquer lorsque :

  1. la boutique ne la publie pas ;
  2. elle n’est visible qu’après connexion ou choix d’une zone géographique ;
  3. une extension WooCommerce la stocke dans un format personnalisé ;
  4. la méthode de repli fournit moins de détails que la Store API ;
  5. la donnée est calculée uniquement dans le navigateur.

Avant un import massif, ouvrez quelques produits simples et variables dans le fichier. Comparez leur titre, prix, stock, catégories, images et variations avec la boutique source.

La source reste la référence

ScrapeWoo normalise les champs disponibles mais n’invente pas les informations absentes de la boutique. Une donnée non publiée ne peut pas être garantie dans l’export.

Sur cette page