Koja je najbolja aplikacija za cigare za AI preporuke, i kako te funkcije zapravo rade?
Većina njih radi na osnovu dva unosa: ono što ste rekli da volite, i ono što ste ocenili. Nijedan model ne degustira tabak. Funkcija preporuka upoređuje opisane osobine cigara koje ste visoko ocenili, a zatim pronalazi neocenjene cigare sa sličnim osobinama. Kvalitet toga zavisi samo od toga koliko dosledno beležite šta vam se dopalo.
Na kojim dva ulazna podatka funkcija preporuka zapravo radi?
Dva, i oba su vaša. Prvi je deklarisana preferencija: sve što ste aplikaciji rekli unapred, obično kroz neku vrstu kviza koji pita da li naginjete ka punijim telima, određenoj nijansi omotača ili određenim regionima. Drugi, i onaj koji sa vremenom postaje važniji, je vaša istorija ocena: cigare koje ste zaista zabeležili i kako ste ih ocenili.
Nijedan od ova dva unosa nije egzotičan. Kviz je formular. Istorija ocena je spisak redova u bazi podataka, svaki označen omotačem, poreklom, jačinom, telom i notama ukusa cigare, pored broja koji ste joj dali. Ono što ljudi zovu "AI" ovde je sledeći korak: proces bodovanja — formalno, filtriranje na osnovu sadržaja — koji gleda osobine povezane sa cigarama koje ste dobro ocenili i rangira neocenjene cigare po tome koliko se njihove osobine poklapaju.
Zašto aplikacija jednostavno ne "zna" šta će vam se dopasti?
Zato što ništa u tom procesu nema nepce. Nigde u ovom lancu ne postoji senzorni model, nijedna komponenta koja oseća biber, kedar ili gorčinu. Postoji baza podataka sa oznakama (nijansa omotača, zemlja, opseg jačine, nekoliko kategorija ukusa) i funkcija bodovanja koja poredi preklapanje oznaka između cigara. Nazivati to "AI" nije pogrešno, ali stvara pogrešnu sliku. Bliže je tabeli sa ponderisanim kolonama nego degustatoru sa mišljenjem.
Ta razlika je važna jer postavlja iskren plafon onoga što ova funkcija može da uradi. Može pronaći cigaru čije zabeležene osobine podsećaju na osobine cigara koje ste dobro ocenili. Ne može otkriti da je određeni list imao lošu nedelju, da vaše nepce danas nije na nivou, ili da je fabrika promenila smešu od poslednjeg unosa. To poredi opise, ne degustira ništa.
Kako "poklapanje opisanih karakteristika" zapravo izgleda u praksi?
Konkretno: recimo da su vaša tri najviše ocenjena unosa punog tela, nikaragvanski puros sa maduro omotačem i izraženim notama kakaa i espresa. Funkciji nije potrebno da znа zašto vam se dopalo. Samo treba da primeti obrazac u oznakama (poreklo, omotač, jačina i kategorije ukusa povezane sa vašim notama) i da pretraži ostatak kataloga za cigare koje nose istu kombinaciju a koje još niste ocenili. Da su vaše ocene išle u drugom pravcu, da su vam se sva tri omrznula, isti mehanizam bi tu kombinaciju označio kao onu koju treba izbegavati.
Strana ukusa u ovome funkcioniše samo ako je rečnik fiksiran. Ako jedan unos notu naziva "koža", a drugi istu notu naziva "koža životinje", poklapanje nema šta konzistentno da poredi. Zato strukturiran rečnik ima veći značaj nego što se na prvi pogled čini — isti problem su degustacije vina i viskija rešile decenijama ranije uz pomoć aroma kolutova. Kako se kategorizuju ukusi cigara je zapravo deo iste infrastrukture koja omogućava poklapanje. Paradigm-ov dnevnik, na primer, svrstava svaku notu u jednu od šest glavnih kategorija (kafa, orašasto, slatko, drvo i povrće, prirodno, bilje i začini) upravo iz tog razloga: da bi unos iz januara i onaj iz avgusta završili u istim kategorijama i mogli stvarno da se uporede.
Gde ovo zapinje?
Četiri iskrena ograničenja, poređana po tome koliko često smetaju:
- Nema podataka, nema predviđanja. Sasvim nov nalog nema ništa sa čim bi se poredio. Rane preporuke se oslanjaju gotovo isključivo na deklarisane odgovore iz kviza, što je mnogo slabiji signal od stvarne istorije ocena. Ovo se poboljšava onoliko koliko beležite, a ne onoliko koliko uopšte koristite aplikaciju.
- Loš rečnik na ulazu, loše poklapanje na izlazu. Ako vaše sopstvene note lutaju, isti ukus zabeležen svaki put drugim rečima, funkcija poredi šum sa šumom. To je na vama da ispravite, ne na algoritmu.
- Oznake u katalogu moraju biti tačne. Preporuka je dobra samo koliko je dobar opis povezan sa preporučenom cigarom. Pogrešan podatak o omotaču ili nedostajuća oznaka ukusa proizvodi sigurno poklapanje sa pogrešnom cigarom.
- Odražava vašu istoriju, ne vaše raspoloženje. Profil ukusa izgrađen od meseci ocena je i dalje prosek. Može vas usmeriti ka cigarama sličnim onima koje su vam se dopale; nema način da zna da baš večeras želite nešto lakše.
Ništa od ovoga se ne rešava sa više "AI-a". Rešava se boljim podacima, unetim doslednije, tokom dužeg vremena.
Kako se ovo razlikuje od obične ocene u zvezdicama?
Ocena u zvezdicama je prosek mnoštva: govori vam šta je većina ljudi mislila, agregirano preko svakog nepca koje je dalo svoju ocenu. Funkcija preporuka je personalizovana. Ona pita da li određena cigara odgovara obrascu u vašoj konkretnoj istoriji, ne da li je uopšteno omiljena. Cigara može imati osrednju prosečnu ocenu i i dalje biti snažno poklapanje za određenog pušača čije preferencije idu suprotno od mnoštva, i obrnuto se dešava jednako često. Kako da odlučite šta sledeće zapušiti umesto da birate nasumično obuhvata širi proces odlučivanja u koji se ovo uklapa; poklapanje je samo jedan ulazni podatak u tu odluku, ne cela odluka.
Šta konkretan primer zapravo izračunava?
Paradigm-ova presuda Tasting Match je konkretan slučaj gore opisanog mehanizma, ne drugačiji mehanizam. Za datu cigaru, ona odmerava omotač, poreklo, jačinu i zabeležene oznake ukusa cigare u odnosu na profil izgrađen od vaših sopstvenih ocenjenih unosa, zatim vraća binarnu presudu, da li verovatno vama odgovara ili ne, provereno u odnosu na katalog od 11.519 cigara. Radi se isto poređenje oznaka opisano ranije, samo u većem obimu; ispod toga ne postoji skriven, poseban korak simulacije ukusa. Rezultat je pouzdan samo koliko je pouzdana istorija ocena koja ga hrani, što je ista ograda koja se odnosi na svaku verziju ove funkcije u svakoj aplikaciji.
Ako uopšte procenjujete aplikacije na ovoj osnovi, korisnije pitanje nije čiji je algoritam najpametniji. Mehanizam je u suštini isti svuda. Pitanje je da li vas aplikacija zaista navodi da beležite dovoljno dosledno da bi taj mehanizam imao nešto stvarno sa čim da radi. Šta zaista treba da tražite u dnevniku cigara ili aplikaciji za praćenje humidora je bolji podsetnik za tu odluku nego bilo koje poređenje funkcija preporuka jedne po jedne. A ako marketing i skener u osnovi naziva "pokretanim AI-jem", vredi znati da ta tvrdnja ima svoj poseban plafon tačnosti, obrađen u tekstu koliko je tačno AI prepoznavanje cigara.
Kratka verzija
- Funkcija preporuka radi na dva ulazna podatka koje vi obezbeđujete: deklarisane preferencije i vašu istoriju ocena. Ništa nigde u tom procesu ne degustira tabak.
- Mehanizam poredi oznake (omotač, poreklo, jačina, kategorija ukusa) između cigara koje ste dobro ocenili i cigara koje nisto probali, a ne senzorno predviđanje.
- Tiho otkazuje na novom nalogu bez istorije, i na nedoslednim notama gde se isti ukus svaki put beleži drugim rečima.
- Ocena u zvezdicama govori vam šta je mnoštvo mislilo. Preporuka govori da li ta cigara odgovara vašem konkretnom obrascu, što je drugo pitanje sa drugim odgovorom.
- Algoritam iza svake verzije ove funkcije je u suštini sličan; ono što se zapravo razlikuje između aplikacija jeste da li vas navode da beležite dovoljno, dovoljno dosledno, da bi imao nešto stvarno za poređenje.