Le WordPress d'aujourd'hui, décodé pour les développeurs

IA & MCP

Trois API de LLM à l’épreuve d’un catalogue Algolia de 180 000 fiches

Comparatif chiffré de trois fournisseurs de LLM pour générer en masse les méta-descriptions d'un catalogue indexé sur Algolia, sans dériver vers le SEO général.

Par WordPress Développement • 22 juin 2023 • 4 min de lecture • Aucun commentaire
Trois API de LLM à l'épreuve d'un catalogue Algolia de 180 000 fiches

180 000 fiches produit, autant de méta-descriptions à rédiger avant la prochaine réindexation Algolia. Impossible de les écrire à la main dans les délais impartis pour ce catalogue de pièces détachées industrielles. Trois fournisseurs de LLM ont été mis en concurrence sur un échantillon de 2 000 fiches avant de choisir celui qui traiterait l’ensemble du lot.

Le protocole est resté simple : un même prompt, les mêmes champs source (titre, catégorie, trois attributs techniques), et une mesure sur trois critères — coût par millier de fiches, taux de méta-descriptions exploitables sans retouche, et temps total de traitement. Ce comparatif ne traite que la génération des méta-descriptions elles-mêmes ; le référencement du catalogue dans son ensemble reste hors sujet ici.

Le protocole de test

Chaque fournisseur a reçu le même prompt, envoyé via wp_remote_post() depuis un script WP-CLI dédié, avec une limite de longueur fixée à 155 caractères et une consigne explicite : pas de guillemets, pas de mention de prix, pas de formule promotionnelle. L’échantillon de 2 000 fiches a été choisi pour couvrir toutes les catégories du catalogue, y compris les références les plus obscures dont le titre seul ne suffit pas à deviner l’usage.

Un relecteur a ensuite noté chaque méta-description sur trois axes : exactitude technique, absence de répétition mécanique du titre, et respect de la limite de caractères. Une méta-description tronquée par Algolia lors de l’affichage en résultat de recherche interne pénalise directement le taux de clic, d’où l’importance de ce dernier critère.

Les résultats chiffrés

L'essentiel à retenir : Coût par 1 000 fiches variable du simple au triple ; Qualité rédactionnelle inégale selon le fournisseur ; Débit d'appels décisif sur un très gros catalogue
FournisseurCoût / 1 000 fichesTaux exploitable sans retoucheTemps pour 2 000 fiches
Fournisseur A0,52 €81 %38 min
Fournisseur B0,24 €63 %22 min
Fournisseur C0,41 €77 %29 min

Le fournisseur B, le moins cher, générait des méta-descriptions correctes syntaxiquement mais souvent hors sujet sur les attributs techniques les plus pointus : il confondait régulièrement un diamètre de filetage avec une longueur de tige. Le fournisseur A, le plus onéreux, produisait le texte le plus fiable, mais à un coût qui aurait doublé le budget prévu pour l’ensemble du catalogue.

Le taux d’erreur technique, le vrai critère

Sur ce catalogue industriel, une méta-description approximative n’est pas seulement maladroite : elle peut induire en erreur un acheteur professionnel qui compare des références par recherche interne. Le fournisseur B a ainsi généré, sur l’échantillon, 74 méta-descriptions mentionnant une norme incorrecte (ISO au lieu de DIN, par exemple), contre 9 pour le fournisseur A.

  • Fournisseur A : le plus fiable sur le vocabulaire technique, mais le plus cher à l’échelle du catalogue complet.
  • Fournisseur B : rapide et économique, à réserver aux catégories à faible risque de confusion.
  • Fournisseur C : un compromis correct, avec un taux d’erreur intermédiaire.

Le débit d’appels, un facteur sous-estimé

Sur 180 000 fiches, le débit d’appels autorisé par chaque fournisseur change tout. Le fournisseur A imposait une limite basse par minute, obligeant à espacer les requêtes via une file gérée par wp_schedule_single_event() pour éviter les erreurs 429. Le fournisseur C, plus généreux sur ce point, a permis de traiter le lot complet en une nuit plutôt qu’en trois jours.

Sur un très gros catalogue, le coût par fiche compte moins que le débit d’appels autorisé : un fournisseur deux fois plus cher mais dix fois plus rapide reste souvent le choix le plus rentable une fois le délai de mise en ligne pris en compte.

Le choix final et son coût réel

Le fournisseur C a été retenu pour l’ensemble du catalogue, avec une relecture humaine ciblée sur les 15 % de fiches signalées par un score de confiance bas renvoyé par l’API. Le coût total pour les 180 000 fiches s’est établi à 73 ​800 €, relecture comprise, contre une estimation initiale de 95 000 € avec le fournisseur A seul.

La leçon la plus utile de ce test : ne jamais choisir un fournisseur de LLM sur la seule base du prix affiché par token. Le taux de retouche humaine nécessaire fait souvent basculer le calcul dans l’autre sens.

Notre verdict

Pour un catalogue de cette taille, le meilleur rapport qualité-prix n’est pas le fournisseur le moins cher à l’appel, mais celui qui combine un taux d’erreur technique acceptable et un débit suffisant pour tenir les délais. Un test sur un échantillon représentatif de 2 000 fiches, avant tout engagement sur le volume complet, reste le seul moyen fiable d’éviter une mauvaise surprise budgétaire.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

Partager :

À propos de l'auteur

WordPress Développement

Développeur WordPress, passionné par Elementor, le FSE et l’automatisation par IA.

Voir tous ses articles

Dans la même veine

À lire aussi