Тим који развија Atria Dawn Preview користио је AI у 713 од 739 задатака за које су учесници јасно одговорили да ли су га користили. У студији сопственог развојног рада, људи су ипак донели коначну одлуку у 85,5% забележених одлука о методама или параметрима. Наслов рада помиње „агентску суперинтелигенцију“, али записи о задацима дају конкретнију слику о подели посла у тиму.

Овај препринт предат је 14. септембра, а ревидиран 17. септембра 2026. Заснован је на 769 записа о задацима од 56 учесника и евиденцији агената у једном пројекту развоја модела. Аутори описују записе као студију случаја о томе како је њихов тим користио агенте за изградњу модела Atria Dawn Preview.

Суштинска промена

  • Шта се променило: Тим је бележио како су агенти и људи делили одлуке о конкретним истраживачким задацима у пројекту развоја модела, правећи разлику између предлога и коначног избора.
  • Зашто је то важно: Агент може да предложи методу и измени рад, док истраживач и даље бира циљ, одобрава методу и одлучује да ли резултат испуњава критеријуме задатка. Само бројање радњи агената занемарује ове различите улоге.
  • На шта обратити пажњу: Ово су запажања из рада једног тима, а велики део података о одлукама потиче од учесника. Налази не показују како други AI лабораторијски тимови деле одлучивање нити да ли агенти могу самостално да развијају своје наследнике.

Агенти су предлагали многе методе, а људи бирали већину

Најјаснија разлика види се у 567 забележених одлука о методама или параметрима које су донели учесници у извршним улогама. У раду се наводи да је AI предложио опцију у 64,6% тих одлука. Највећу појединачну категорију, са 55,4%, чиниле су одлуке „AI предлаже, човек бира“. Људи су донели коначну одлуку у 85,5% случајева, а AI у 9,2%. Преостале одлуке приписане су спољним ограничењима.

Расподела се разликовала према питању. Људи су донели коначну одлуку у 93,4% од 603 одлуке о циљевима или обиму и у 81,9% од 542 одлуке о критеријумима прихватања. AI је много чешће предлагао методе него циљеве. На графикону у раду бележи се и да су људи изабрали коначни циљ у 144 од 151 задатка које су учесници оценили неизводљивим без АИ-ја.

Ови проценти описују пријављене улоге у доношењу одлука. Не мере да ли је сваки људски избор био заснован на добрим информацијама. Аутори тумаче образац тако да истраживачи усмеравају рад, а агенти стварају опције у оквиру смерница које су поставили људи. Студија случаја бележи делегирано извршавање уз задржавање коначног овлашћења у овом пројекту.

Људске повратне информације често су враћале агенте на посао

Учесници су навели најважнију потешкоћу за сваки задатак и одговор на њу. Од 588 задатака са забележеном потешкоћом и реакцијом, 447, односно 76,0%, настављена су уз људску помоћ; агенти су самостално решили проблем у 135 случајева, односно 23,0%. Најчешћи облици помоћи били су додатни контекст или разјашњење захтева (207 задатака) и дијагноза проблема или промена методе (204). У четири задатка човек је преузео главни део посла.

Записи о резултатима показују сличну поделу. Од 627 задатака са познатим исходом главног AI резултата, 354 су захтевала суштинску дораду. У тој подгрупи агент је уносио измене након људских повратних информација у 75,4% случајева, док је човек непосредно уређивао резултат у 19,2%. Истраживачи су могли да усмере измену, а да је сами не унесу.

Порастао је и један показатељ из евиденције: код групе од 22 учесника дневна медијана броја забележених радњи агената по људском упиту порасла је са 11,0, 7. августа, на 28,5, 4. септембра. Показатељ користи претходни седмодневни период, а за сваки дан били су доступни важећи односи за 21 или 22 особе. Он броји активност, па не може да утврди да ли су агенти добили већа овлашћења или им се квалитет резултата побољшао.

Шта записи о задацима могу да покажу

Учесници су процењивали да ли би могли да заврше свој део задатка без АИ-ја уз исти обим, квалитет и остале ресурсе. Од 455 завршених задатака уз AI са употребљивим одговорима, учесници су 151, односно 33,2%, оценили неизводљивим без АИ-ја. То је самопроцена хипотетичког исхода, а не експеримент у ком је тим поновио те задатке без агента. Не доказује да нико не би покушао да обави неки посао под другачијим условима.

У раду се не описује поступак избора 56 учесника или 769 записа о задацима, а јавне везе не пружају појединачне одговоре о задацима ни евиденцију агената потребну за независну поновну анализу. Резултати тестова перформанси процењују Atria Dawn Preview као модел. Не показују да је AI систем самостално унапредио свог наследника. Тимовима који одлучују шта да делегирају граница из овог рада је конкретна: агенти су у овом пројекту често предлагали и дорађивали рад, док су учесници навели да су задржали већину одлука о циљевима, методама и прихватању резултата.