Méthodologie

Comment la mesure
est faite

Le Baromètre classe des marques réelles. Voici la méthode entière, y compris ses limites — et de quoi la contester.

1. Les questions

Une liste fixe de 50 questions d'intention d'achat pour le secteur couvert — aujourd'hui la beauté, le soin et les compléments — écrites comme un client les tape : « quel est le meilleur magnésium contre la fatigue ? », pas « magnésium fatigue ». Elles ne changent pas d'une édition à l'autre.

C'est la règle la plus importante du Baromètre. Modifier les questions rendrait deux éditions incomparables, et l'historique est justement ce qu'un classement lancé plus tard ne peut pas rattraper.

2. L'échantillonnage, en deux passes

Une IA ne répond pas deux fois exactement la même chose. Un seul passage par question suffirait à faire bouger un rang au hasard. Rejouer cinq fois les 50 questions corrigerait le bruit — mais multiplierait le coût par cinq, alors que l'écart entre deux marques est déjà net dans la plupart des cas.

  1. Passe 1

    Couverture complète

    Les 50 questions sont posées une fois à chaque modèle actif. C'est ce qui donne le classement provisoire.

  2. Passe 2

    Renfort là où ça se joue

    Les questions concernant des marques séparées par moins de 3 citations sont rejouées jusqu'à 5 fois au total — au maximum 12 questions. C'est là, et seulement là, que des passages supplémentaires changent un rang publié.

Une question rejouée cinq fois ne pèse pas cinq fois plus lourd : chaque couple (question, modèle) compte pour un, et c'est le taux de citation observé sur ses passages qui est additionné.

3. Les barres d'erreur

Chaque marque repart avec un intervalle de confiance à 95 %. Il se lit ainsi : « 18 ± 2 citations » signifie que si l'on rejouait l'édition, la vraie valeur serait entre 16 et 20 dans 95 % des cas.

La règle de publication

Un mouvement de rang n'est affiché que si les intervalles de confiance des deux éditions ne se chevauchent pas. Sinon la marque est donnée stable. Quitte à être ennuyeux, jamais faux : un faux mouvement publié sur une marque réelle coûte plus cher qu'un mouvement tu.

4. Comment les marques sont relevées

Chaque réponse est lue par un modèle chargé d'en extraire les marques commerciales citées, leur position et le ton employé. Sont systématiquement écartés :

  • Institutions et autorités de santé
  • Médias et sites d'avis
  • Distributeurs génériques
  • Ingrédients, actifs et souches

Un second filtre déterministe repasse derrière, parce qu'un modèle laisse parfois passer une institution. Les sources citées, elles, ne viennent pas de cette lecture : ce sont les métadonnées natives des APIs, donc des données brutes.

5. Du décompte au palier

Score Mentio = (réponses citant la marque ÷ réponses analysées) × 100.

  • Invisible09

    Votre marque est quasi absente des réponses : moins d'une question d'achat sur dix la mentionne.

  • Aperçue1029

    Votre marque apparaît, mais rarement et jamais en tête.

  • Citée3054

    Vous faites partie des réponses, sans être un premier choix.

  • Recommandée5579

    Les IA vous recommandent régulièrement, souvent parmi les premiers.

  • Prescrite80100

    Vous êtes la réponse par défaut : cité en tête sur la majorité des questions.

Le barème est public et non négociable : sa page dédiée en donne la définition complète. Personne ne paie pour changer de palier.

6. Ce que la mesure ne dit pas

  • Ce n'est pas ce que voit exactement un client.On interroge les APIs officielles avec recherche web activée. C'est un bon reflet, documenté — pas une copie de l'application grand public, qui personnalise ses réponses.
  • Un score bas n'est pas un jugement sur la marque.Il dit ce que les modèles citent, ce qui dépend surtout des sources qu'ils lisent — pas de la qualité des produits.
  • Une édition couvre plusieurs sous-rayons. Aucune marque n'est pertinente sur les 50 questions : les scores sont structurellement bas pour tout le monde.
  • Les modèles évoluent.Une mise à jour chez un éditeur peut déplacer un classement sans que rien n'ait changé côté marques. C'est précisément pourquoi on mesure dans la durée.

L'édition en cours

30 août 2026

50
Couples question × modèle
ChatGPT + Gemini
Modèles interrogés
98
Appels au total
12
Questions renforcées
oui
Renfort mené à son terme

Exemple de lecture : La Roche-Posay obtient 14.2 ± 6 citations, soit un score de 28/100.

Un chiffre vous paraît faux ? Droit de réponse — toute erreur confirmée est corrigée, et l'historique conservé.

Voir le classement · Données brutes (API) · Version Markdown

Vous vérifiez la méthode avant de vous en servir ? La même mesure alimente le rapport que vous pouvez poser devant un client — ce que Mentio fait pour une agence. Pour une marque, le relevé gratuit applique la même lecture sur 10 questions.