# Trois API de LLM à l’épreuve d’un catalogue Algolia de 180 000 fiches

> Comparatif chiffré de trois fournisseurs de LLM pour générer en masse les méta-descriptions d'un catalogue indexé sur Algolia, sans dériver vers le SEO général.

- Auteur : WordPress Développement
- Publié le : 2023-06-22
- Mis à jour le : 2023-06-22
- Catégorie : IA &amp; MCP
- URL : https://www.wpmoderne.fr/ia-mcp/comparatif-api-llm-meta-descriptions-algolia/

## L’essentiel

- Coût par 1 000 fiches variable du simple au triple
- Qualité rédactionnelle inégale selon le fournisseur
- Débit d'appels décisif sur un très gros catalogue

180 000 fiches produit, autant de méta-descriptions à rédiger avant la prochaine réindexation Algolia. Impossible de les écrire à la main dans les délais impartis pour ce catalogue de pièces détachées industrielles. Trois fournisseurs de LLM ont été mis en concurrence sur un échantillon de 2 000 fiches avant de choisir celui qui traiterait l'ensemble du lot.

Le protocole est resté simple : un même prompt, les mêmes champs source (titre, catégorie, trois attributs techniques), et une mesure sur trois critères — coût par millier de fiches, taux de méta-descriptions exploitables sans retouche, et temps total de traitement. Ce comparatif ne traite que la génération des méta-descriptions elles-mêmes ; le référencement du catalogue dans son ensemble reste hors sujet ici.

## Le protocole de test

Chaque fournisseur a reçu le même prompt, envoyé via `wp_remote_post()` depuis un script WP-CLI dédié, avec une limite de longueur fixée à 155 caractères et une consigne explicite : pas de guillemets, pas de mention de prix, pas de formule promotionnelle. L'échantillon de 2 000 fiches a été choisi pour couvrir toutes les catégories du catalogue, y compris les références les plus obscures dont le titre seul ne suffit pas à deviner l'usage.

Un relecteur a ensuite noté chaque méta-description sur trois axes : exactitude technique, absence de répétition mécanique du titre, et respect de la limite de caractères. Une méta-description tronquée par Algolia lors de l'affichage en résultat de recherche interne pénalise directement le taux de clic, d'où l'importance de ce dernier critère.

## Les résultats chiffrés

> L'essentiel à retenir : Coût par 1 000 fiches variable du simple au triple ; Qualité rédactionnelle inégale selon le fournisseur ; Débit d'appels décisif sur un très gros catalogue

| Fournisseur | Coût / 1 000 fiches | Taux exploitable sans retouche | Temps pour 2 000 fiches |
| --- | --- | --- | --- |
| Fournisseur A | 0,52 € | 81 % | 38 min |
| Fournisseur B | 0,24 € | 63 % | 22 min |
| Fournisseur C | 0,41 € | 77 % | 29 min |

Le fournisseur B, le moins cher, générait des méta-descriptions correctes syntaxiquement mais souvent hors sujet sur les attributs techniques les plus pointus : il confondait régulièrement un diamètre de filetage avec une longueur de tige. Le fournisseur A, le plus onéreux, produisait le texte le plus fiable, mais à un coût qui aurait doublé le budget prévu pour l'ensemble du catalogue.

## Le taux d'erreur technique, le vrai critère

Sur ce catalogue industriel, une méta-description approximative n'est pas seulement maladroite : elle peut induire en erreur un acheteur professionnel qui compare des références par recherche interne. Le fournisseur B a ainsi généré, sur l'échantillon, 74 méta-descriptions mentionnant une norme incorrecte (ISO au lieu de DIN, par exemple), contre 9 pour le fournisseur A.

- Fournisseur A : le plus fiable sur le vocabulaire technique, mais le plus cher à l'échelle du catalogue complet.
- Fournisseur B : rapide et économique, à réserver aux catégories à faible risque de confusion.
- Fournisseur C : un compromis correct, avec un taux d'erreur intermédiaire.

## Le débit d'appels, un facteur sous-estimé

Sur 180 000 fiches, le débit d'appels autorisé par chaque fournisseur change tout. Le fournisseur A imposait une limite basse par minute, obligeant à espacer les requêtes via une file gérée par `wp_schedule_single_event()` pour éviter les erreurs 429. Le fournisseur C, plus généreux sur ce point, a permis de traiter le lot complet en une nuit plutôt qu'en trois jours.

> Sur un très gros catalogue, le coût par fiche compte moins que le débit d'appels autorisé : un fournisseur deux fois plus cher mais dix fois plus rapide reste souvent le choix le plus rentable une fois le délai de mise en ligne pris en compte.

## Le choix final et son coût réel

Le fournisseur C a été retenu pour l'ensemble du catalogue, avec une relecture humaine ciblée sur les 15 % de fiches signalées par un score de confiance bas renvoyé par l'API. Le coût total pour les 180 000 fiches s'est établi à 73 ​800 €, relecture comprise, contre une estimation initiale de 95 000 € avec le fournisseur A seul.

La leçon la plus utile de ce test : ne jamais choisir un fournisseur de LLM sur la seule base du prix affiché par token. Le taux de retouche humaine nécessaire fait souvent basculer le calcul dans l'autre sens.

## Notre verdict

Pour un catalogue de cette taille, le meilleur rapport qualité-prix n'est pas le fournisseur le moins cher à l'appel, mais celui qui combine un taux d'erreur technique acceptable et un débit suffisant pour tenir les délais. Un test sur un échantillon représentatif de 2 000 fiches, avant tout engagement sur le volume complet, reste le seul moyen fiable d'éviter une mauvaise surprise budgétaire.
