Données récupérées
Les champs disponibles et les limites liées à la boutique source.
ScrapeWoo transforme les données publiques de la boutique source en un catalogue normalisé. Le résultat exact dépend de la méthode de détection et des informations réellement publiées par WooCommerce.

Identité et contenu
| Champ | Ce que ScrapeWoo conserve |
|---|---|
| Identifiant source | L’identifiant public du produit ou de la variation |
| Nom et slug | Le titre du produit et son identifiant d’URL lorsqu’il est disponible |
| SKU | La référence commerciale publiée par la boutique |
| Type | Produit simple, variable ou autre type déclaré par WooCommerce |
| Page source | Le lien public vers la fiche produit |
| Descriptions | La description courte et la description complète |
Les descriptions peuvent contenir une mise en forme HTML utile : paragraphes, listes, tableaux, liens ou emphase. ScrapeWoo nettoie les blocs non sûrs et certains éléments injectés par des extensions avant de créer le fichier.
Aucun contenu n’est inventé
ScrapeWoo ne génère pas de description, de SKU ou de caractéristique pour remplir une case vide. Un champ absent dans la source reste vide afin que vous puissiez distinguer une donnée publiée d’une donnée à compléter.
Prix et disponibilité
ScrapeWoo distingue, lorsque la source le permet :
- le prix courant ;
- le prix normal avant promotion ;
- la devise et sa précision ;
- l’état en stock ou épuisé ;
- la quantité disponible lorsqu’elle est rendue publique.
Un statut de stock peut être connu sans quantité précise. Dans ce cas, l’export indique la disponibilité mais laisse la quantité vide. Les taxes, règles de livraison et prix dépendant du compte client ne peuvent pas être garantis à partir d’un catalogue public.
Poids et dimensions
Lorsque la boutique les publie, ScrapeWoo récupère le poids ainsi que la longueur, la largeur et la hauteur. Une variation qui ne déclare pas les siennes hérite de celles du produit parent, comme le fait WooCommerce.
Les unités ne sont pas publiées
WooCommerce conserve l’unité de poids (kg, g, lb, oz) et de dimension (cm, m, in, yd) dans ses réglages, que l’API publique n’expose pas. Les valeurs sont donc reprises telles quelles, sans conversion.
C’est sans conséquence pour un import WooCommerce, qui les interprète dans l’unité de la boutique de destination. En revanche l’export Shopify, qui exige des grammes, laisse la colonne de poids vide plutôt que de risquer un facteur mille : reportez le poids depuis l’export WooCommerce, CSV ou JSON.
Organisation du catalogue
Les catégories, étiquettes et leur relation au produit sont conservées lorsque WooCommerce les expose. ScrapeWoo peut également récupérer la catégorie parente, le slug et le nombre de produits annoncé par la source.
Le format de destination adapte ensuite cette organisation :
- WooCommerce conserve les catégories et les étiquettes dans les colonnes d’import natives ;
- Shopify utilise les catégories pour préparer notamment le type, les tags ou la collection ;
- CSV standard regroupe les valeurs dans des colonnes lisibles ;
- JSON garde la structure la plus détaillée.
Attributs et variations
Pour un produit variable, ScrapeWoo essaie de relier le produit parent à chaque variation. Une variation peut disposer de son propre :
- identifiant et SKU ;
- prix normal ou promotionnel ;
- stock et quantité ;
- ensemble de valeurs d’attributs, par exemple
Taille = 42; - visuel lorsqu’une image spécifique est publiée.
L’export WooCommerce crée une ligne parent puis une ligne par variation. L’export Shopify convertit jusqu’à trois axes de variation en options, conformément à sa structure d’import CSV.
Images et provenance
Pour chaque visuel détecté, ScrapeWoo peut conserver l’URL source, le texte alternatif, la position dans la galerie et, lorsque disponibles, les dimensions ou l’identifiant du média. Consultez Images produits pour comprendre le téléchargement par la plateforme cible et les limites des URLs distantes.
Ce que l’API publique ne donne pas
ScrapeWoo lit la Store API de WooCommerce, celle qui alimente la vitrine : elle expose ce qu’un visiteur peut voir. Certains champs relèvent de l’administration de la boutique et ne sont accessibles à personne sans identifiants :
- la classe de TVA et le statut fiscal ;
- la classe de livraison ;
- la gestion des commandes en attente et la vente à l’unité ;
- la note d’achat ;
- les ventes croisées, montées en gamme et produits groupés ;
- les fichiers téléchargeables des produits dématérialisés.
Ces colonnes restent vides dans l’export. Ce n’est pas une limite de l’extraction mais du catalogue public lui-même.
Pourquoi certains champs sont-ils vides ?
Une valeur peut manquer lorsque :
- la boutique ne la publie pas ;
- elle n’est visible qu’après connexion ou choix d’une zone géographique ;
- une extension WooCommerce la stocke dans un format personnalisé ;
- la méthode de repli fournit moins de détails que la Store API ;
- la donnée est calculée uniquement dans le navigateur.
Avant un import massif, ouvrez quelques produits simples et variables dans le fichier. Comparez leur titre, prix, stock, catégories, images et variations avec la boutique source.
La source reste la référence
ScrapeWoo normalise les champs disponibles mais n’invente pas les informations absentes de la boutique. Une donnée non publiée ne peut pas être garantie dans l’export.