Osam primera u septembarskom videu Metjua Bermana od 24. septembra prikazuje TypeSafe AI-jev model Jev u poznatim zadacima: čišćenju veb-stranice, pronalaženju odlomka, sortiranju prijemnog sandučeta i izboru elemenata interfejsa. Demonstracije potiču od različitih autora. Zajedničko im je da modelu daju usko definisanu procenu, dok aplikacija prikuplja ulazne podatke i sprovodi rezultat.
Svaki snimak postaje informativniji kada se odluka razdvoji od posla koji obavlja kod ili drugi model. Važna je i vrsta greške koju bi korisnik primetio. Ovo su demonstracije i rani alati; BIG CHANGE nije nezavisno testirao njihovu tačnost ni pouzdanost u svakodnevnoj upotrebi.
Velika promena
- Šta se promenilo: Autori ugrađuju tipiziranu AI procenu u postojeće softverske interakcije, od prečice u pregledaču do prikaza prijemnog sandučeta. Jev vraća izbor, ocenu ili verovatnoću; aplikacija obezbeđuje materijal za procenu i postupa prema odgovoru.
- Zašto je važno: Korisna odluka može da se donese dok neko čita, pretražuje ili razvrstava sadržaj, bez prepuštanja celog zadatka interfejsu za razgovor. Isti dizajn čini vlasnike aplikacija odgovornim za pogrešna rangiranja, skriveni sadržaj i neželjene radnje.
- Šta pratiti: Sledeći dokazi moraju da se odnose na konkretne zadatke: da li ovi alati biraju pravi odlomak, ostavljaju važne kontrole stranice dostupnim, dobro rangiraju bitnu poštu i postupaju s neizvesnim slučajevima u uobičajenoj upotrebi. Brza demonstracija sama po sebi ne može da odgovori na ta pitanja.
Čistač stranica pokazuje podelu posla
Kitzeovo proširenje pregledača Unclutter predstavlja najjasniji primer. U njegovom README-u projekta piše da proširenje izdvaja moguće elemente stranice i pita Jev koji nisu neophodni. Zatim kod pregledača primenjuje reverzibilna pravila za skrivanje, čuva ih po predlošku stranice i ponovo ih primenjuje bez novog zahteva modelu. Korisnici mogu da pauziraju proširenje, zadrže element vidljivim ili ponovo analiziraju stranicu. Slojevi s obaveštenjem o kolačićima mogu da se sakriju, ali proširenje ne bira Prihvati ili Odbij umesto korisnika.
To je važna granica. Jev može da proceni da je neki element suvišan, ali ne upravlja pregledačem, ne bira opcije saglasnosti i ne odlučuje koliko dugo pravilo važi. Praktična procena proverila bi da li navigacija, kontrole pristupačnosti, obaveštenja o naplati pristupa ili prave opcije saglasnosti ostaju upotrebljivi nakon čišćenja. Projekat nudi verzije napravljene iz izvornog koda i podešavanje uz sopstveni API ključ, ali README ne sadrži nezavisnu terensku studiju takvih grešaka.
Jev-ov detektor za veb-stranice prikazan na 3:29 u Bermanovom videu, koristi drugačiji postupak. Prema opisu autora, pregledač meri prikazane stilove, DeepSeek V4 Flash opisuje snimke ekrana, Jev procenjuje dizajn i tekst prema spisku karakteristika, a DeepSeek sastavlja kratak zaključak. Sajt prikazuje ocenu „slop“ od 26% za anthropic.com. To je stilska ocena alata izračunata prema sopstvenim kriterijumima. Ne utvrđuje koliki deo sajta kompanije Anthropic je napisao AI, uprkos Bermanovom zaključku u videu.
Rangiranje informacija je druga vrsta odluke
Demonstracija prijemnog sandučeta Džonatana Unikovskog predlaže zamenu obrnutog hronološkog redosleda rangiranjem poruka po trenutnoj važnosti. U objavi piše da ova funkcija „uskoro stiže“ u Avec. Nije prikazano aktivno prijemno sanduče, definicija važnosti ni nezavisno merenje propuštenih hitnih poruka. Sama aplikacija bi i dalje preuzimala poštu, prikazivala redosled i odlučivala da li nešto arhivira, označava ili šalje; demonstrirani zadatak Jev-a jeste određivanje prioriteta.
Proširenje Needle autora Shubham Sabooa jasnije pokazuje tu razliku. Shubham Saboo navodi da Jev ocenjuje odlomke sa stranice prema upitu čitaoca, a proširenje ističe odgovarajući tekst na samoj stranici. U njegovom opširnijem objašnjenju piše da Needle ne sastavlja odgovor: istaknuta rečenica već postoji na stranici. Time se menja ono što prečica za pronalaženje može da traži, ali istaknuta rečenica i dalje može biti pogrešna. Za testiranje su potrebni upiti s poznatim tačnim odlomcima, uključujući stranice sa sličnim, ali međusobno protivrečnim tvrdnjama.
Objava Burhana Usmana o isecanju snimka govori o pronalaženju isečaka na određenu temu u videu dužem od 90 minuta. U segmentu videa na 8:34 Berman kaže da sistem verovatno koristi transkript; to je njegova pretpostavka, a ne potvrđen opis postupka. Objava ne navodi tačan Jev-ov ulaz ni izlaz. Aplikacija za isecanje i dalje mora da pribavi izvorni materijal, odredi vremenske granice i napravi datoteke koje mogu da se preuzmu. Vremenski i cenovni podaci u objavi predstavljaju izveštaj jednog autora, bez objavljenog testa tačnosti ili razlaganja celokupnog postupka.
Šta sastavljanje interfejsa prepušta aplikaciji
Eksperiment Krisa Tejta sa json-render-om sastavlja korisnički interfejs od opcija koje obezbeđuje aplikacija. Dokumentacija projekta o Jev-u neuobičajeno je jasna: Jev bira komponente i njihov raspored; kod sastavlja i proverava specifikaciju, a renderer je prikazuje. Poslovni podaci u probnom okruženju su sintetički, a funkcije za radnje pokreću se tek kad korisnik reaguje. Demonstracija zato prikazuje način sastavljanja ograničenog interfejsa, a ne model koji samostalno piše i objavljuje veb-sajt.
Dva kreativna primera istražuju manje rizične izbore. Eksperiment Meta Dezlurijea s bojama povezuje tekstualne upite i palete boja u vizuelnoj demonstraciji. Stefanov eksperiment s emotikonima, prikazan na 9:52, rangira emotikone prema unetom tekstu. U oba slučaja aplikacija prikazuje vizuelni sadržaj koji može da se izabere. Objave prikazuju ideje za interakciju; ne dokazuju da su predlozi prikladni za brend, da zadovoljavaju zahteve kontrasta ili da funkcionišu u različitim jezicima i kontekstima.
TypeSafe-ova dokumentacija objašnjava zašto su ovi primeri slični. Jev procenjuje tipizirana pitanja Choice, Score i Da/Ne na osnovu dostavljenog stanja. Choice i Score vraćaju raspodele i vrednost pouzdanosti koju softver može da upotrebi u sopstvenim pravilima. Kompanija preporučuje testiranje pragova na stvarnom zadatku; polje pouzdanosti nije nezavisna potvrda tačnosti.
Primeri uverljivo prikazuju obrazac dizajna: softver može da postavi malo i pravovremeno pitanje kada bi fiksno pravilo bilo previše kruto. Da li određeni alat zaslužuje mesto u svakodnevnom radu zavisi od grešaka koje pravi, onoga što otkriva ili skriva i mogućnosti oporavka koje aplikacija nudi. To su svojstva celokupnog postupka rada, a ne samo odluke modela.



