Quelle est la meilleure application de cigares pour des recommandations basées sur l'IA, et comment ces fonctions marchent-elles vraiment ?
La plupart fonctionnent à partir de deux entrées : ce que vous avez déclaré aimer, et ce que vous avez noté. Aucun modèle ne goûte le tabac. Une fonction de recommandation évalue les caractéristiques décrites des cigares que vous avez bien notés, puis cherche des cigares non notés qui obtiennent un score similaire. Elle ne vaut que par la constance avec laquelle vous consignez ce qui vous a plu au départ.
Sur quelles deux entrées une fonction de recommandation fonctionne-t-elle réellement ?
Deux, et elles viennent toutes les deux de vous. La première, c'est la préférence déclarée : ce que vous avez indiqué à l'application au départ, généralement via une forme de questionnaire vous demandant si vous penchez vers les corps plus puissants, une teinte de cape particulière ou certaines régions. La seconde, celle qui compte le plus avec le temps, c'est votre historique de notes : les cigares que vous avez effectivement enregistrés et les notes que vous leur avez attribuées.
Ni l'une ni l'autre n'a rien d'exotique. Un questionnaire, c'est un formulaire. Un historique de notes, c'est une liste de lignes dans une base de données, chacune étiquetée avec la cape du cigare, son origine, sa force, son corps et ses notes aromatiques, à côté du chiffre que vous lui avez donné. Ce que l'on appelle ici « IA », c'est l'étape suivante : un processus de scoring — formellement, du filtrage basé sur le contenu — qui examine les caractéristiques associées aux cigares que vous avez bien notés, et classe les cigares non notés selon la proximité de leurs caractéristiques.
Pourquoi l'application ne « sait-elle » pas simplement ce qui va vous plaire ?
Parce que rien dans la chaîne n'a de palais. Il n'existe aucun modèle sensoriel dans ce processus, aucun composant qui éprouve le poivre, le cèdre ou le grillé. Ce qui existe, c'est une base de données d'étiquettes (teinte de cape, pays, plage de force, une poignée de catégories aromatiques) et une fonction de scoring qui compare le recoupement des étiquettes entre cigares. Appeler cela « IA » n'est pas faux, mais cela suggère la mauvaise image. C'est plus proche d'un tableur avec des colonnes pondérées que d'un dégustateur ayant un avis.
Cette distinction compte parce qu'elle fixe honnêtement le plafond de ce que la fonction peut faire. Elle peut trouver un cigare dont les caractéristiques enregistrées ressemblent à celles des cigares que vous avez bien notés. Elle ne peut pas détecter qu'une feuille particulière a connu une mauvaise semaine, que votre palais n'est pas dans un bon jour, ou qu'une manufacture a modifié son assemblage depuis la dernière entrée consignée. Elle fait correspondre des descriptions, elle ne goûte rien.
À quoi ressemble concrètement la « correspondance des caractéristiques décrites » ?
Concrètement : imaginons que vos trois entrées les mieux notées soient toutes des puros nicaraguayens corsés avec une cape maduro et de fortes notes de cacao et d'espresso. La fonction n'a pas besoin de savoir pourquoi ils vous ont plu. Elle a juste besoin de repérer le motif dans les étiquettes (origine, cape, force et catégories aromatiques rattachées à vos notes) et d'aller chercher dans le reste du catalogue les cigares portant la même combinaison que vous n'avez pas encore notés. Si vos notes étaient allées dans l'autre sens, si vous aviez détesté les trois, le même mécanisme signalerait cette combinaison comme étant à éviter.
Le volet aromatique ne fonctionne que si le vocabulaire est fixé. Si une entrée appelle une note « cuir » et qu'une autre appelle la même note « peau tannée », la mise en correspondance n'a plus rien de cohérent à comparer. C'est pourquoi un vocabulaire structuré compte davantage qu'on ne le croirait — c'est le même problème que la dégustation du vin et du whisky a résolu il y a des décennies avec les roues des arômes. La façon dont les arômes de cigares sont catégorisés fait en réalité partie de la même infrastructure qui rend toute mise en correspondance possible. Le journal de Paradigm, par exemple, classe chaque note dans l'une de six grandes catégories (café, noisette, sucré, bois et végétal, naturel, herbes et épices) précisément pour cette raison : afin qu'une entrée de janvier et une entrée d'août tombent dans les mêmes cases et puissent réellement être comparées.
Où est-ce que cela coince ?
Quatre limites honnêtes, par ordre de fréquence :
- Pas de données, pas de prédiction. Un compte tout neuf n'a rien à quoi se comparer. Les premières recommandations reposent presque entièrement sur les réponses déclarées au questionnaire, un signal bien plus faible qu'un véritable historique de notes. Cela s'améliore à mesure que vous consignez, pas à mesure que vous utilisez l'application en général.
- Vocabulaire bancal en entrée, correspondance bancale en sortie. Si vos propres notes dérivent, si le même goût est consigné avec des mots différents à chaque fois, la fonction compare du bruit à du bruit. C'est à vous de corriger cela, pas à l'algorithme.
- Les étiquettes du catalogue doivent être justes. Une recommandation ne vaut que par la description rattachée au cigare recommandé. Une donnée de cape erronée ou une étiquette aromatique manquante produit une correspondance parfaitement assurée… avec le mauvais cigare.
- Elle reflète votre historique, pas votre humeur. Un profil de palais construit sur des mois de notes reste une moyenne. Il peut vous orienter vers des cigares proches de ce que vous avez aimé ; il n'a aucun moyen de savoir que vous voulez précisément quelque chose de plus léger ce soir.
Aucun de ces points ne se résout avec davantage d'« IA ». Ils se résolvent avec de meilleures données, saisies plus régulièrement, sur une plus longue durée.
En quoi est-ce différent d'une simple note en étoiles ?
Une note en étoiles est une moyenne collective : elle vous dit ce que la majorité a pensé, agrégé sur tous les palais qui se sont exprimés. Une fonction de recommandation, elle, est personnalisée. Elle demande si un cigare précis correspond au motif de votre historique précis, pas s'il est généralement apprécié. Un cigare peut afficher une note moyenne médiocre et rester une excellente correspondance pour un fumeur particulier dont les préférences vont à contre-courant, et l'inverse arrive tout aussi souvent. Comment décider quoi fumer ensuite plutôt que de choisir au hasard couvre le processus de décision plus large dans lequel s'inscrit tout cela ; la mise en correspondance n'est qu'une entrée de cette décision, pas la décision entière.
Que calcule réellement un exemple concret ?
Le verdict Tasting Match de Paradigm est un cas concret du mécanisme décrit plus haut, pas un mécanisme différent. Pour un cigare donné, il pondère la cape, l'origine, la force et les étiquettes aromatiques enregistrées du cigare face à un profil construit à partir de vos propres entrées notées, puis renvoie un verdict binaire, susceptible de vous convenir ou non, vérifié sur un catalogue de 11 519 cigares. Il effectue la même comparaison d'étiquettes décrite plus tôt, à plus grande échelle ; il n'y a aucune étape cachée de simulation du goût en dessous. Le résultat n'est fiable que dans la mesure où l'historique de notes qui l'alimente l'est, ce qui est la même réserve que pour n'importe quelle version de cette fonction dans n'importe quelle application.
Si vous évaluez des applications sur cette base, la question la plus utile n'est pas de savoir quel algorithme est le plus malin. Le mécanisme est globalement le même partout. C'est de savoir si l'application vous amène réellement à consigner assez régulièrement pour que ce mécanisme ait de quoi travailler. Ce qu'il faut vraiment regarder dans une application de journal de dégustation ou de suivi de cave constitue une meilleure liste de contrôle pour cette décision que n'importe quelle comparaison fonctionnalité par fonctionnalité des moteurs de recommandation. Et si le marketing qualifie aussi le scanner sous-jacent de « dopé à l'IA », il vaut la peine de savoir que cette affirmation a son propre plafond de précision, abordé dans quelle est la précision de la reconnaissance de cigares par IA.
En résumé
- Une fonction de recommandation fonctionne sur deux entrées que vous fournissez : les préférences déclarées et votre historique de notes. Rien ne goûte le tabac nulle part dans la chaîne.
- Le mécanisme consiste à comparer des étiquettes (cape, origine, force, catégorie aromatique) entre les cigares que vous avez bien notés et ceux que vous n'avez pas essayés, pas à prédire des sensations.
- Il échoue silencieusement sur un compte neuf sans historique, et sur des notes incohérentes où le même goût est consigné sous des mots différents à chaque fois.
- Une note en étoiles vous dit ce que la foule a pensé. Une recommandation vous dit si ce cigare correspond à votre motif personnel, ce qui est une autre question avec une autre réponse.
- L'algorithme derrière n'importe quelle version de cette fonction est globalement similaire ; ce qui varie réellement d'une application à l'autre, c'est leur capacité à vous faire consigner suffisamment, et assez régulièrement, pour qu'il ait quelque chose de réel à comparer.