Jaká je nejlepší aplikace pro doporučování cigár pomocí AI a jak tyto funkce vlastně fungují?
Většina z nich vychází ze dvou vstupů: z toho, co jste řekli, že máte rádi, a z toho, co jste ohodnotili. Žádný model neochutná tabák. Doporučovací funkce ohodnotí popsané vlastnosti cigár, které jste ohodnotili vysoko, a pak najde neohodnocené cigára, jejichž skóre je podobné. Je jen tak dobrá, jak konzistentně si zapisujete, co se vám líbilo.
Ze kterých dvou vstupů doporučovací funkce vlastně vychází?
Ze dvou, a oba jsou vaše. Prvním je deklarovaná preference: cokoliv jste aplikaci sdělili na začátku, obvykle v nějaké formě dotazníku, který se ptá, zda tíhnete k plnějším tělům, konkrétnímu odstínu wrapperu nebo určitým regionům. Druhým – a tím, na kterém časem záleží víc – je vaše hodnocená historie: cigára, která jste skutečně zaznamenali, a to, jak jste je ohodnotili.
Žádný z těchto vstupů není nic exotického. Dotazník je formulář. Hodnocená historie je seznam řádků v databázi, každý s vlastnostmi cigáru (wrapper, původ, síla, tělo a chuťové poznámky) vedle čísla, které jste mu udělili. To, co se zde nazývá „AI“, je krok, který následuje: proces skórování – formálně obsahové filtrování – který se dívá na vlastnosti přiřazené cigárům, jež jste ohodnotili dobře, a řadí neohodnocená cigára podle toho, jak blízko se jejich vlastnosti shodují.
Proč aplikace prostě „neví“, co se vám bude líbit?
Protože nic v tomto procesu nemá patro. V celém tomto řetězci neexistuje žádný senzorický model, žádná součást, která by pociťovala pepř, cedr nebo spáleninu. Existuje databáze štítků (odstín wrapperu, země, pásmo síly, několik kategorií chutí) a skórovací funkce, která porovnává překryv štítků mezi cigáry. Nazývat to „AI“ není chyba, ale vyvolává to špatnou představu. Je to blíž tabulce s váženými sloupci než degustátorovi s vlastním názorem.
Tento rozdíl má význam, protože stanovuje upřímný strop toho, co daná funkce dokáže. Může najít cigáro, jehož zaznamenané vlastnosti se podobají vlastnostem cigár, která jste ohodnotili dobře. Nemůže zjistit, že konkrétní list měl špatný týden, že vaše patro má špatný den, ani že továrna od poslední zapsané položky změnila směs. Porovnává popisy, nikoliv chutě.
Jak vypadá „porovnávání popsaných vlastností“ v praxi?
Konkrétně: řekněme, že vaše tři nejvýše hodnocené položky jsou všechny plnotělé nikaragujské puros s maduro wrapperem a výraznými tóny kakaa a espressa. Funkce nemusí vědět, proč se vám líbily. Musí jen zaznamenat vzorec ve štítcích (původ, wrapper, síla a chuťové kategorie přiřazené k vašim poznámkám) a hledat ve zbytku katalogu cigára se stejnou kombinací, která jste ještě neohodnotili. Pokud by vaše hodnocení byla opačná – kdybyste všechny tři nesnášeli – stejný mechanismus by tuto kombinaci označil jako tu, které se vyhnout.
Chuťová stránka tohoto procesu funguje jen tehdy, když je slovník pevně daný. Pokud jedna položka nazve nějakou notu „kůže“ a jiná stejnou notu nazve „kožeňka“, porovnávání nemá nic konzistentního, co by srovnávalo. Proto má strukturovaný slovník větší význam, než by se mohlo zdát – je to stejný problém, který víno a whisky vyřešily před desítkami let pomocí aromatických kol. Jak se kategorizují chutě cigár je vlastně součástí té stejné infrastruktury, která porovnávání vůbec umožňuje. Deník Paradigm například z tohoto přesného důvodu zařazuje každou poznámku do jedné ze šesti hlavních kategorií (káva, oříškové, sladké, dřevo a zelenina, přírodní, bylinky a koření): aby položka ze ledna a položka ze srpna spadaly do stejných košů a bylo je možné skutečně porovnat.
Kde se to celé rozpadá?
Čtyři upřímné limity, v pořadí, jak často se s nimi setkáte:
- Bez dat žádná predikce. Úplně nový účet nemá s čím porovnávat. Rané doporučení se opírá téměř výhradně o deklarované odpovědi z dotazníku, což je mnohem slabší signál než skutečná hodnocená historie. Zlepšuje se to čím víc zaznamenáváte, ne čím víc aplikaci obecně používáte.
- Nekvalitní slovník na vstupu, nekvalitní shoda na výstupu. Pokud se vaše vlastní poznámky rozjíždějí – stejná chuť zapsaná pokaždé jinými slovy – funkce porovnává šum se šumem. Napravit to je na vás, ne na algoritmu.
- Štítky v katalogu musí být správné. Doporučení je jen tak dobré, jako popis přiřazený k doporučovanému cigáru. Špatná data o wrapperu nebo chybějící chuťový štítek vytvoří přesvědčivou shodu se špatným cigárem.
- Odráží vaši historii, ne vaši náladu. Profil chuti vytvořený z měsíců hodnocení je stále průměr. Může vás namířit na cigára podobná těm, která se vám líbila; nemá způsob, jak zjistit, že chcete dnes večer konkrétně něco lehčího.
Žádný z těchto problémů nevyřeší víc „AI“. Vyřeší je lepší data, zadávaná konzistentněji, po delší dobu.
Jak se to liší od obyčejného hodnocení pomocí hvězdiček?
Hodnocení hvězdičkami je průměr davu: říká vám, co si myslela většina lidí, agregovaně napříč všemi patry, která hodnocení odeslala. Doporučovací funkce je personalizovaná. Ptá se, zda konkrétní cigáro odpovídá vzorci ve vaší konkrétní historii, ne zda je obecně oblíbené. Cigáro může mít průměrné hodnocení a přesto být silnou shodou pro jednoho konkrétního kuřáka, jehož preference jdou proti davu, a stejně často se to stává i naopak. Jak se rozhodnout, co si zapálit dál, místo náhodného výběru popisuje širší rozhodovací proces, do kterého toto zapadá; porovnávání je jeden vstup do tohoto rozhodnutí, ne celé rozhodnutí.
Co konkrétně vypočítá takový vzorový příklad?
Verdikt Tasting Match od Paradigm je konkrétní případ výše popsaného mechanismu, ne odlišný mechanismus. U daného cigáru zváží wrapper, původ, síla a zaznamenané chuťové štítky vůči profilu vytvořenému z vašich vlastních hodnocených položek, a poté vrátí binární verdikt – pravděpodobně vám bude vyhovovat, nebo ne – ověřený proti katalogu 11 519 cigár. Dělá stejné porovnávání štítků popsané výše, jen ve větším měřítku; žádný samostatný krok simulace chuti se pod tím neskrývá. Výstup je jen tak důvěryhodný, jako hodnocená historie, ze které vychází, a to je stejná výhrada, která platí pro jakoukoliv verzi této funkce v jakékoliv aplikaci.
Pokud podle tohoto hlediska hodnotíte aplikace, užitečnější otázka není, čí algoritmus je nejchytřejší. Mechanismus je zhruba stejný všude. Jde o to, jestli vás aplikace skutečně dostane k tomu, abyste zaznamenávali dostatečně konzistentně, aby ten mechanismus měl z čeho reálně vycházet. Co skutečně hledat v cigárovém deníku nebo aplikaci pro sledování humidoru je pro toto rozhodnutí lepší seznam než jakékoliv srovnání doporučovacích funkcí bod po bodu. A pokud marketing nazve i podkladový skener „AI-powered“, je dobré vědět, že toto tvrzení má svůj vlastní, samostatný strop přesnosti, kterému se věnuje jak přesné je rozpoznávání cigár pomocí AI.
Stručně shrnuto
- Doporučovací funkce běží na dvou vstupech, které poskytujete vy: deklarovaných preferencích a vaší hodnocené historii. Nic v tomto procesu neochutná tabák.
- Mechanismus porovnává štítky (wrapper, původ, síla, chuťová kategorie) mezi cigáry, která jste ohodnotili dobře, a cigáry, která jste ještě nezkusili, nejde o senzorickou predikci.
- Tiše selhává u nového účtu bez historie a u nekonzistentních poznámek, kde je stejná chuť pokaždé zapsaná jinými slovy.
- Hodnocení hvězdičkami vám říká, co si myslel dav. Doporučení vám říká, zda tento cigáro odpovídá vašemu konkrétnímu vzorci, což je jiná otázka s jinou odpovědí.
- Algoritmus za jakoukoliv verzí této funkce je zhruba podobný; co se mezi aplikacemi skutečně liší, je, zda vás dostanou k tomu zaznamenávat dost a dostatečně konzistentně, aby měl s čím reálně srovnávat.