Осам примера у видеу Метјуа Бермана од 24. септембра ставља модел Jev компаније TypeSafe AI у познате задатке: чишћење веб-странице, проналажење пасуса, сортирање пријемног сандучета и избор елемената интерфејса. Демонстрације потичу од различитих програмера. Заједнички им је то што моделу дају уску процену, док апликација прикупља улазне податке и спроводи резултат.
Сваки снимак је информативнији ако се одлука раздвоји од посла који обавља код или други модел. Важна је и врста грешке коју би корисник приметио. Ово су демонстрације и рани алати; BIG CHANGE није независно тестирао њихову тачност нити поузданост у свакодневној употреби.
Кључна промена
- Шта се променило: Програмери умећу типизирану процену вештачке интелигенције у постојеће интеракције софтвера, од пречице у прегледачу до приказа пријемног сандучета. Jev враћа избор, оцену или вероватноћу; апликација обезбеђује материјал за разматрање и поступа на основу одговора.
- Зашто је важно: Корисну одлуку могуће је донети док корисник чита, претражује или сортира садржај, без пребацивања целог задатка у интерфејс за разговор. Такав дизајн истовремено чини власнике апликација одговорним за погрешно рангирање, скривени садржај и ненамераване радње.
- Шта треба пратити: Следећи докази морају да се односе на конкретан задатак: да ли алати бирају прави пасус, чувају важне контроле странице, добро рангирају битну пошту и исправно поступају у неизвесним случајевима током уобичајене употребе. Брза демонстрација сама не може да одговори на та питања.
Чистач странице показује поделу посла
Kitze-ово проширење за прегледач Unclutter је најјаснији пример. Његова датотека README пројекта наводи да проширење издваја могуће елементе странице и пита Jev који нису неопходни. Затим код прегледача примењује правила за реверзибилно скривање, чува их према шаблону странице и поново их примењује без новог захтева моделу. Корисници могу да паузирају проширење, задрже елемент видљивим или поново анализирају страницу. Прекривачи колачића могу да се сакрију, али проширење уместо корисника не притиска „Прихвати“ нити „Одбиј“.
То је важна граница. Jev може да процени да је неки елемент сувишан; он не управља прегледачем, не бира сагласност и не одлучује колико дуго правило важи. Практична процена проверила би да ли су навигација, контроле приступачности, обавештења о платном зиду или стварне опције за сагласност остале употребљиве после чишћења. Пројекат нуди изворне верзије и подешавање са сопственим кључем, али README не садржи независно теренско истраживање таквих грешака.
Детектор веб-сајтова Made with Jev, приказан у 3:29, користи другачији ток обраде. Према опису самог алата, прегледач мери приказане стилове, DeepSeek V4 Flash описује снимке екрана, Jev процењује дизајн и текст према листи показатеља, а DeepSeek саставља кратку оцену. Сајт приказује оцену „slop“ од 26% за anthropic.com. То је стилска оцена коју је алат израчунао по сопственим критеријумима. Она не доказује колики део веб-сајта компаније Anthropic је написан вештачком интелигенцијом, упркос Бермановом закључку у видеу.
Рангирање информација је засебна врста одлуке
Демонстрација пријемног сандучета Џонатана Униковског предлаже да се хронолошки редослед замени рангирањем порука по тренутној важности. У својој објави наводи да функција „ускоро стиже“ у Avec. Не документује примењено решење за пријемно сандуче, дефиницију важности нити независно мерење пропуштених хитних порука. Апликација би и даље преузимала пошту, приказивала редослед и одлучивала да ли ће нешто архивирати, означити или послати; приказана улога Jev-а је одређивање приоритета.
Проширење Needle Шубама Сабуа олакшава уочавање ове разлике. Сабу каже да Jev оцењује пасусе странице према упиту читаоца, а проширење истиче одговарајући текст на самом месту. Његово опширније објашњење наводи да Needle не саставља одговор: истакнута реченица већ постоји на страници. Тиме се мења оно што пречица за претрагу може да пронађе, али истакнута реченица и даље може бити погрешна. Тестирање треба да користи упите за које су тачни пасуси познати, укључујући странице са сличним, али међусобно неусклађеним тврдњама.
Објава о исецању видео-записа Бурхана Усмана наводи да је пронашао исечке о одређеној теми у видео-снимку дужем од 90 минута. У делу видеа од 8:34 Берман каже да систем вероватно користи транскрипт; то је његова претпоставка, а не проверен опис тока обраде. Објава не прецизира тачан улаз ни излаз Jev-а. Апликација за исецање и даље мора да преузме изворни материјал, одреди временске границе и произведе исечке за преузимање. Наведени рок и цена потичу од једног програмера, без објављеног теста тачности или разложеног обрачуна целог посла.
Шта састављање интерфејса оставља апликацији
Експеримент Криса Тејта са json-render-ом саставља кориснички интерфејс од опција којима управља апликација. Документација пројекта о Jev-у нарочито је јасна: Jev бира компоненте и њихове положаје; код саставља и проверава спецификацију; приказивач је приказује. Пословни подаци у пробном окружењу су синтетички, а обрађивачи радњи покрећу се на интеракцију корисника. Демонстрација зато показује начин састављања ограниченог интерфејса, а не модел који самостално пише и поставља веб-сајт.
Два креативна примера разматрају одлуке са мањим улогом. Експеримент Мета Деслорјеа са бојама повезује текстуалне упите са палетама у визуелној демонстрацији. Експеримент Стефана са емоџијима, приказан у 9:52, рангира емоџије према унетом тексту. У оба случаја апликација приказује визуелни материјал за избор. Објаве показују идеје за интеракцију, али не потврђују да су избори прикладни за бренд, да задовољавају захтеве контраста нити да функционишу на различитим језицима и у различитим контекстима.
Компанија TypeSafe у својој документацији објашњава зашто су ови примери сродни. Jev процењује типизирана питања са избором, оценом и одговором „да/не“ на основу задатог стања. Избор и оцена враћају расподеле и вредност поузданости које софтвер може да употреби у сопственим правилима. Компанија препоручује тестирање прагова на конкретном задатку; поље поузданости није независан резултат тачности.
Примери уверљиво показују образац дизајна: софтвер може да постави мало, правовремено питање тамо где би фиксно правило било превише круто. Да ли конкретан алат заслужује место у свакодневном раду зависи од грешака које прави, од онога што открива или скрива и од тога да ли апликација омогућава људима да се опораве од грешке. То су својства целог тока рада, а не само одлуке модела.



