Extraction

Données récupérées

Les champs disponibles et les limites liées à la boutique source.

ScrapeWoo transforme les informations accessibles dans le catalogue de la boutique source en données normalisées. Le résultat exact dépend de ce que la boutique publie réellement.

Aperçu du catalogue ScrapeWoo présentant le produit, le type, la catégorie, le prix et le stock
Le tableau de sélection est un aperçu synthétique. Le fichier final contient davantage de champs lorsque la boutique les expose.

Identité et contenu

ChampCe que ScrapeWoo conserve
Identifiant sourceL’identifiant public du produit ou de la variation
Nom et slugLe titre du produit et son identifiant d’URL lorsqu’il est disponible
SKULa référence commerciale publiée par la boutique
TypeProduit simple, variable ou autre type déclaré par WooCommerce
Page sourceLe lien public vers la fiche produit
DescriptionsLa description courte et la description complète

Les descriptions peuvent contenir une mise en forme HTML utile : paragraphes, listes, tableaux, liens ou emphase. ScrapeWoo nettoie les blocs non sûrs et certains éléments injectés par des extensions avant de créer le fichier.

Aucun contenu n’est inventé

ScrapeWoo ne génère pas de description, de SKU ou de caractéristique pour remplir une case vide. Un champ absent dans la source reste vide afin que vous puissiez distinguer une donnée publiée d’une donnée à compléter.

Prix et disponibilité

ScrapeWoo distingue, lorsque la source le permet :

  • le prix courant ;
  • le prix normal avant promotion ;
  • la devise et sa précision ;
  • l’état en stock ou épuisé ;
  • la quantité disponible lorsqu’elle est rendue publique.

Un statut de stock peut être connu sans quantité précise. Dans ce cas, l’export indique la disponibilité mais laisse la quantité vide. Les taxes, règles de livraison et prix dépendant du compte client ne peuvent pas être garantis à partir d’un catalogue public.

Poids et dimensions

Lorsque la boutique les publie, ScrapeWoo récupère le poids ainsi que la longueur, la largeur et la hauteur. Une variation qui ne déclare pas les siennes hérite de celles du produit parent, comme le fait WooCommerce.

Les unités peuvent manquer

L’unité de poids (kg, g, lb, oz) et de dimension (cm, m, in, yd) n’est pas toujours disponible avec les valeurs publiées. Dans ce cas, celles-ci sont reprises telles quelles, sans conversion.

C’est sans conséquence pour un import WooCommerce, qui les interprète dans l’unité de la boutique de destination. En revanche l’export Shopify, qui exige des grammes, laisse la colonne de poids vide plutôt que de risquer un facteur mille : reportez le poids depuis l’export WooCommerce, CSV ou JSON.

Organisation du catalogue

Les catégories, étiquettes et leur relation au produit sont conservées lorsque WooCommerce les expose. ScrapeWoo peut également récupérer la catégorie parente, le slug et le nombre de produits annoncé par la source.

Le format de destination adapte ensuite cette organisation :

  • WooCommerce conserve les catégories et les étiquettes dans les colonnes d’import natives ;
  • Shopify utilise les catégories pour préparer notamment le type, les tags ou la collection ;
  • CSV standard regroupe les valeurs dans des colonnes lisibles ;
  • JSON garde la structure la plus détaillée.

Attributs et variations

Pour un produit variable, ScrapeWoo essaie de relier le produit parent à chaque variation. Une variation peut disposer de son propre :

  • identifiant et SKU ;
  • prix normal ou promotionnel ;
  • stock et quantité ;
  • ensemble de valeurs d’attributs, par exemple Taille = 42 ;
  • visuel lorsqu’une image spécifique est publiée.

L’export WooCommerce crée une ligne parent puis une ligne par variation. L’export Shopify convertit jusqu’à trois axes de variation en options, conformément à sa structure d’import CSV.

Images et provenance

Pour chaque visuel détecté, ScrapeWoo peut conserver l’URL source, le texte alternatif, la position dans la galerie et, lorsque disponibles, les dimensions ou l’identifiant du média. Consultez Images produits pour comprendre le téléchargement par la plateforme cible et les limites des URLs distantes.

Données qui peuvent rester indisponibles

ScrapeWoo traite les informations que la boutique rend accessibles dans son catalogue. Certains champs relèvent uniquement de son administration et ne sont pas disponibles sans les droits correspondants :

  • la classe de TVA et le statut fiscal ;
  • la classe de livraison ;
  • la gestion des commandes en attente et la vente à l’unité ;
  • la note d’achat ;
  • les ventes croisées, montées en gamme et produits groupés ;
  • les fichiers téléchargeables des produits dématérialisés.

Ces colonnes restent vides dans l’export. Ce n’est pas une limite de l’extraction mais du catalogue public lui-même.

Pourquoi certains champs sont-ils vides ?

Une valeur peut manquer lorsque :

  1. la boutique ne la publie pas ;
  2. elle n’est visible qu’après connexion ou choix d’une zone géographique ;
  3. une extension WooCommerce la stocke dans un format personnalisé ;
  4. la boutique fournit moins de détails pour certains produits ;
  5. la donnée est calculée uniquement dans le navigateur.

Avant un import massif, ouvrez quelques produits simples et variables dans le fichier. Comparez leur titre, prix, stock, catégories, images et variations avec la boutique source.

La source reste la référence

ScrapeWoo normalise les champs disponibles mais n’invente pas les informations absentes de la boutique. Une donnée non publiée ne peut pas être garantie dans l’export.

Sur cette page