Koja je najbolja aplikacija za cigare s AI preporukama i kako te značajke zapravo funkcioniraju?
Većina njih radi na temelju dva ulazna podatka: onoga što ste rekli da vam se sviđa i onoga što ste ocijenili. Nijedan model ne kuša duhan. Značajka preporuka boduje opisana svojstva cigara koje ste visoko ocijenili, a zatim pronalazi neocijenjene cigare koje postižu sličan rezultat. Kvaliteta preporuke ovisi isključivo o tome koliko ste dosljedno od početka bilježili što vam se sviđalo.
Koja dva ulazna podatka zapravo pokreću značajku preporuka?
Dva, i oba dolaze od vas. Prvi je izjavljena preferencija: sve ono što ste aplikaciji rekli unaprijed, obično kroz neku vrstu kviza koji pita naginjete li punijim tijelima, određenoj nijansi omota ili određenim regijama. Drugi, i onaj koji s vremenom postaje važniji, jest vaša ocijenjena povijest: cigare koje ste stvarno zabilježili i kako ste ih ocijenili.
Nijedan od ta dva ulaza nije nešto egzotično. Kviz je obrazac. Ocijenjena povijest je popis redaka u bazi podataka, od kojih je svaki označen omotom cigare, podrijetlom, jačinom, tijelom i notama okusa, uz broj koji ste joj dodijelili. Ono što ljudi ovdje nazivaju "AI" zapravo je sljedeći korak: proces bodovanja — formalno, filtriranje temeljeno na sadržaju — koji promatra svojstva pridružena cigarama koje ste dobro ocijenili i rangira neocijenjene cigare prema tome koliko se njihova svojstva podudaraju.
Zašto aplikacija jednostavno ne "zna" što će vam se svidjeti?
Zato što ništa u tom procesu nema nepce. Nigdje u tom lancu ne postoji senzorni model, nijedna komponenta koja doživljava papar, cedar ili gorak okus dima. Ono što postoji jest baza podataka s oznakama (nijansa omota, zemlja, raspon jačine, šačica kategorija okusa) i funkcija bodovanja koja uspoređuje preklapanje oznaka između cigara. Nazivati to "AI-jem" nije pogrešno, ali stvara krivu sliku. Bliže je proračunskoj tablici s ponderiranim stupcima nego kušaču s vlastitim mišljenjem.
Ta je razlika bitna jer postavlja iskren gornji limit onoga što značajka može učiniti. Može pronaći cigaru čija zabilježena svojstva nalikuju svojstvima cigara koje ste dobro ocijenili. Ne može otkriti da je određeni list duhana imao lošiji tjedan, da vaše nepce danas nije u formi ili da je tvornica promijenila mješavinu otkako je zabilježen posljednji unos. Ona uspoređuje opise, a ne kuša ništa.
Kako "podudaranje opisanih svojstava" zapravo izgleda u praksi?
Konkretno: recimo da su vaša tri najbolje ocijenjena unosa punotjelesni nikaragvanski puros s maduro omotom i izraženim notama kakaa i espressa. Značajka ne treba znati zašto su vam se svidjeli. Treba samo primijetiti obrazac u oznakama (podrijetlo, omot, jačina i kategorije okusa pridružene vašim bilješkama) i pretražiti ostatak kataloga za cigarama koje nose istu kombinaciju, a koje još niste ocijenili. Da su vaše ocjene bile suprotne, da su vam se sve tri zgadile, isti bi mehanizam tu kombinaciju označio kao onu koju treba izbjegavati.
Strana okusa u ovome funkcionira samo ako je rječnik fiksan. Ako jedan unos notu naziva "koža", a drugi istu notu naziva "štavljena koža", podudaranje nema ništa dosljedno za usporedbu. Zato strukturirani rječnik igra veću ulogu nego što bi se moglo pretpostaviti — isti je problem kušanje vina i viskija riješilo prije desetljeća pomoću kotača arome. Kako se kategoriziraju okusi cigara zapravo je dio iste infrastrukture koja uopće omogućuje podudaranje. Paradigmov dnevnik, primjerice, svaku bilješku razvrstava u jednu od šest glavnih kategorija (kava, orašasto, slatko, drvo i biljno, prirodno, začini i bilje) upravo iz tog razloga: kako bi unos iz siječnja i unos iz kolovoza završili u istim kategorijama i mogli se stvarno usporediti.
Gdje ovo zakazuje?
Četiri iskrena ograničenja, poredana prema tome koliko se često osjete:
- Bez podataka nema predviđanja. Potpuno nov račun nema ništa s čime bi se moglo usporediti. Rane preporuke gotovo se u potpunosti oslanjaju na odgovore iz kviza, što je puno slabiji signal od stvarne ocijenjene povijesti. To se poboljšava što više bilježite, a ne što više općenito koristite aplikaciju.
- Loš rječnik na ulazu, loše podudaranje na izlazu. Ako vaše vlastite bilješke variraju, ako isti okus svaki put bilježite drugim riječima, značajka uspoređuje šum sa šumom. To je na vama da ispravite, ne na algoritmu.
- Oznake u katalogu moraju biti točne. Preporuka je onoliko dobra koliko je dobar opis pridružen cigari koja se preporučuje. Pogrešni podaci o omotu ili nedostajuća oznaka okusa daju siguran, ali pogrešan pogodak.
- Odražava vašu povijest, a ne vaše raspoloženje. Profil ukusa izgrađen na temelju mjeseci ocjenjivanja i dalje je prosjek. Može vas usmjeriti prema cigarama sličnima onima koje su vam se svidjele, ali nema način znati da večeras baš želite nešto lakše.
Nijedno od ovoga ne rješava se dodatnom količinom "AI-ja". Rješava se boljim podacima, unesenim dosljednije, kroz dulje razdoblje.
Po čemu se ovo razlikuje od obične ocjene zvjezdicama?
Ocjena zvjezdicama prosjek je mnoštva: govori vam što je mislila većina ljudi, zbrojeno preko svih nepca koja su dala svoju ocjenu. Značajka preporuka je personalizirana. Pita se odgovara li određena cigara obrascu iz vaše specifične povijesti, a ne je li općenito omiljena. Cigara može imati osrednju prosječnu ocjenu, a i dalje biti izvrsna podudarnost za jednog određenog pušača čije se preferencije razlikuju od mnoštva, i obrnuto se događa jednako često. Kako odlučiti što zapaliti sljedeće umjesto nasumičnog biranja obrađuje širi proces odlučivanja u koji se ovo uklapa; podudaranje je samo jedan ulazni podatak u toj odluci, a ne cijela odluka.
Što zapravo izračunava jedan konkretan primjer?
Paradigmov verdikt Tasting Match konkretan je primjer gore opisanog mehanizma, ne neki drugi. Za zadanu cigaru, uspoređuje omot, podrijetlo, jačinu i zabilježene oznake okusa te cigare s profilom izgrađenim na temelju vaših vlastitih ocijenjenih unosa, a zatim vraća binarni verdikt — vjerojatno vam odgovara ili ne — provjeren u odnosu na katalog od 11.519 cigara. Radi istu usporedbu oznaka opisanu ranije, samo u većem razmjeru; ispod toga se ne skriva nikakav zaseban korak simulacije okusa. Rezultat je pouzdan onoliko koliko je pouzdana ocijenjena povijest koja ga hrani, a ta ista ograda vrijedi za bilo koju verziju ove značajke u bilo kojoj aplikaciji.
Ako uopće ocjenjujete aplikacije po ovom kriteriju, korisnije pitanje nije čiji je algoritam najpametniji. Mehanizam je posvuda otprilike isti. Pitanje je potiče li vas aplikacija da bilježite dovoljno dosljedno kako bi taj mehanizam uopće imao s čime raditi. Na što zapravo treba obratiti pozornost kod dnevnika cigara ili aplikacije za praćenje humidora korisniji je popis za tu odluku nego bilo koja usporedba preporučivačkih sustava značajku po značajku. A ako marketing i pripadajući skener naziva "pogonjenim AI-jem", vrijedi znati da ta tvrdnja ima svoj vlastiti, zaseban gornji limit točnosti, o čemu se govori u koliko je točno prepoznavanje cigara temeljeno na AI-ju.
Ukratko
- Značajka preporuka radi na temelju dva ulazna podatka koje sami dajete: izjavljenih preferencija i vaše ocijenjene povijesti. Nigdje u tom procesu ništa ne kuša duhan.
- Mehanizam uspoređuje oznake (omot, podrijetlo, jačina, kategorija okusa) između cigara koje ste dobro ocijenili i onih koje niste probali — ne radi se o senzornom predviđanju.
- Tiho zakazuje na novom računu bez povijesti te kod nedosljednih bilješki gdje se isti okus svaki put bilježi drugim riječima.
- Ocjena zvjezdicama govori vam što je mislilo mnoštvo. Preporuka vam govori odgovara li ova cigara vašem specifičnom obrascu, što je posve drugo pitanje s posve drugačijim odgovorom.
- Algoritam iza bilo koje verzije ove značajke uglavnom je sličan; ono što se stvarno razlikuje među aplikacijama jest potiču li vas da bilježite dovoljno i dovoljno dosljedno kako bi imao što stvarno usporediti.