Atria Dawn Preview-ஐ உருவாக்கிய குழு, AI பயன்பாடு குறித்து பங்கேற்பாளர்கள் தெளிவான பதில் அளித்த 739 பணிகளில் 713-இல் AI-ஐப் பயன்படுத்தியது. அந்தக் குழுவின் சொந்த உருவாக்கப் பணியைப் பற்றிய ஆய்வில், முறைகள் அல்லது அளவுருக்கள் குறித்துப் பதிவான முடிவுகளில் 85.5%-க்கு இறுதித் தேர்வை மனிதர்களே செய்தனர். ஆய்வுக் கட்டுரையின் தலைப்பில் “agentic superintelligence” எனக் குறிப்பிடப்பட்டாலும், குழு வேலையை எவ்வாறு பகிர்ந்துகொண்டது என்பதைப் பற்றிய துல்லியமான கதையைப் பணிப் பதிவுகள் கூறுகின்றன.

இந்த முன்வெளியீட்டுக் கட்டுரை 2026 செப்டம்பர் 14 அன்று சமர்ப்பிக்கப்பட்டு, செப்டம்பர் 17 அன்று திருத்தப்பட்டது. ஒரே மாதிரி உருவாக்கத் திட்டத்திலிருந்து 56 பங்கேற்பாளர்களின் 769 பணிப் பதிவுகளையும் ஏஜென்ட் பதிவுகளையும் இது ஆய்வு செய்கிறது. Atria Dawn Preview-ஐ உருவாக்கும்போது தங்கள் குழு ஏஜென்ட்களை எவ்வாறு பயன்படுத்தியது என்பதற்கான நிகழ்வு ஆய்வாக இப்பதிவுகளை ஆசிரியர்கள் விவரிக்கின்றனர்.

முக்கிய மாற்றம்

  • என்ன மாறியது: ஒரு மாதிரி உருவாக்கத் திட்டத்தில், குறிப்பிட்ட ஆய்வு முடிவுகளை ஏஜென்ட்களும் மனிதர்களும் எவ்வாறு பகிர்ந்துகொண்டனர் என்பதை குழு பதிவு செய்தது; முன்மொழிவையும் இறுதித் தேர்வையும் தனித்தனியாகக் கணக்கிட்டது.
  • இது ஏன் முக்கியம்: ஓர் ஏஜென்ட் முறையை உருவாக்கியும் திருத்தத்தைச் செய்தும் இருக்கலாம்; அதேவேளையில் ஆய்வாளர் இலக்கைத் தேர்ந்தெடுத்து, முறைக்கு ஒப்புதல் அளித்து, முடிவு பணியின் நிபந்தனைகளைப் பூர்த்தி செய்கிறதா எனத் தீர்மானிக்கலாம். ஏஜென்டின் செயல்களை மட்டும் எண்ணுவது இத்தகைய வேறுபட்ட பொறுப்புகளைத் தவறவிடும்.
  • கவனிக்க வேண்டியது: இவை ஒரே குழுவின் பணியிலிருந்து கிடைத்த கவனிப்புகள்; முடிவுகள் குறித்த சான்றுகளில் பெரும்பகுதியைப் பங்கேற்பாளர்களே வழங்கினர். பிற AI ஆய்வகங்கள் முடிவுகளை எவ்வாறு பகிர்கின்றன, ஏஜென்ட்கள் தங்களை உருவாக்கிய அடுத்த தலைமுறையைத் தன்னாட்சியாக மேம்படுத்த முடியுமா என்பதைக் கண்டறிய இவை போதாது.

ஏஜென்ட்கள் பல முறைகளை வழங்கினர்; பெரும்பாலானவற்றை மனிதர்கள் தேர்ந்தெடுத்தனர்

முறைகள் அல்லது அளவுருக்கள் குறித்து, செயல்பாட்டுப் பொறுப்பிலிருந்த பங்கேற்பாளர்கள் எடுத்ததாகப் பதிவான 567 முடிவுகள் இதைத் தெளிவாகக் காட்டுகின்றன. அவற்றில் 64.6%-இல் AI ஒரு விருப்பத்தை முன்மொழிந்ததாகக் கட்டுரை தெரிவிக்கிறது. மிகப் பெரிய ஒற்றைப் பிரிவு 55.4%: “AI முன்மொழிகிறது; மனிதர் தேர்ந்தெடுக்கிறார்.” இறுதித் தேர்வை 85.5% முடிவுகளில் மனிதர்களும், 9.2%-இல் AI-யும் செய்தனர். மீதமுள்ள முடிவுகள் வெளிப்புறக் கட்டுப்பாட்டுக்குச் சாட்டப்பட்டன.

கேள்வியைப் பொறுத்து முடிவுப் பகிர்வு மாறியது. இலக்குகள் அல்லது வரம்பு குறித்த 603 முடிவுகளில் 93.4%-க்கும், ஏற்றுக்கொள்ளும் நிபந்தனைகள் குறித்த 542 முடிவுகளில் 81.9%-க்கும் மனிதர்களே இறுதித் தேர்வைச் செய்தனர். இலக்குகளைவிட முறைகள் தொடர்பாக AI முன்மொழிவுகள் அதிகம் இருந்தன. AI இன்றி பணி சாத்தியமில்லை எனப் பங்கேற்பாளர்கள் மதிப்பிட்ட 151 பணிகளில் 144-இல், இறுதி இலக்கை மனிதர்களே தேர்ந்தெடுத்ததாகவும் கட்டுரையின் வரைபடம் காட்டுகிறது.

இந்தச் சதவீதங்கள் முடிவெடுப்பதில் யார் என்ன பங்கு வகித்தனர் என்ற அறிக்கைகளை விவரிக்கின்றன; ஒவ்வொரு மனிதத் தேர்வும் போதிய தகவலுடன் எடுக்கப்பட்டதா என்பதை அளவிடவில்லை. மனிதர்கள் திசை காட்டிய பின்பு ஏஜென்ட்கள் விருப்பங்களை உருவாக்க, ஆய்வாளர்கள் பணியை வழிநடத்தினர் என ஆசிரியர்கள் இந்தப் போக்கை விளக்குகின்றனர். இந்தத் திட்டத்தில் இறுதி அதிகாரம் மனிதர்களிடமே இருந்தபோதும், செயல்பாடுகளை ஏஜென்ட்களிடம் ஒப்படைத்ததை நிகழ்வு ஆய்வு ஆவணப்படுத்துகிறது.

மனிதர்களின் பின்னூட்டம் ஏஜென்ட்களை அடிக்கடி மீண்டும் பணிக்குத் திருப்பியது

ஒவ்வொரு பணியிலும் ஏற்பட்ட மிக முக்கியமான சிரமம் என்ன என்பதைப் பங்கேற்பாளர்கள் நினைவுகூர்ந்தனர். சிரமமும் அதற்கான பதிலும் பதிவான 588 பணிகளில், 447 (76.0%) மனித உதவியுடன் முன்னேறின; 135-இல் (23.0%) ஏஜென்ட்கள் தாங்களாகவே மீண்டன. கூடுதல் சூழல் அல்லது தெளிவான தேவைகள் (207 பணிகள்), சிக்கலைக் கண்டறிதல் அல்லது முறையை மாற்றுதல் (204) ஆகியவை முக்கிய உதவி வகைகள். நான்கு பணிகளில் மனிதர் முக்கிய வேலையைத் தாமே மேற்கொண்டார்.

வெளியீட்டுப் பதிவுகளிலும் இதே பிரிவு தெரிகிறது. முதன்மை AI வெளியீட்டின் இறுதி நிலை தெரிந்த 627 பணிகளில், 354-க்கு கணிசமான திருத்தம் தேவைப்பட்டது. அந்தத் திருத்தம் செய்யப்பட்ட பணிகளில் 75.4%-இல் மனிதப் பின்னூட்டத்துக்குப் பிறகு ஏஜென்டே மாற்றங்களைச் செய்தது; 19.2%-இல் மனிதர் நேரடியாகத் திருத்தினார். திருத்தத்தைத் தாமே செய்யாமலேயே ஆய்வாளர்கள் மாற்றத்துக்கு வழிகாட்ட முடிந்தது.

பதிவிலிருந்து கணக்கிடப்பட்ட இன்னொரு அளவீடும் மேம்பாட்டின்போது உயர்ந்தது: 22 பங்கேற்பாளர்கள் கொண்ட குழுவில், மனிதரின் ஒவ்வொரு தூண்டுதலுக்கும் பதிவான ஏஜென்ட் செயல்களின் நாளாந்த இடைநிலை எண்ணிக்கை ஆகஸ்ட் 7 அன்று 11.0 ஆகவும், செப்டம்பர் 4 அன்று 28.5 ஆகவும் இருந்தது. இதற்கு முந்தைய ஏழு நாள் சாளரம் பயன்படுத்தப்பட்டது; ஒவ்வொரு நாளிலும் 21 அல்லது 22 பேருக்கான விகிதங்களே செல்லத்தக்கவையாக இருந்தன. இந்த அளவீடு செயல்பாட்டை எண்ணுகிறது; ஏஜென்ட்களுக்கு அதிக அதிகாரம் கிடைத்தது அல்லது அவற்றின் வெளியீடு மேம்பட்டது என்பதை நிரூபிக்காது.

பணிப் பதிவுகள் எதை நிறுவ முடியும்

ஒரே அளவு, தரம், பிற வளங்களுடன் தமது பணிப் பகுதியை AI இன்றி முடித்திருக்க முடியுமா எனப் பங்கேற்பாளர்கள் மதிப்பிட்டனர். பயன்படுத்தத்தக்க பதில்கள் கிடைத்த, AI உதவியுடன் முடிக்கப்பட்ட 455 பணிகளில் 151 (33.2%) AI இன்றி சாத்தியமில்லை என அவர்கள் மதிப்பிட்டனர். இது பங்கேற்பாளர்களின் சுய அறிக்கையிலான எதிர்நிகழ்வு மதிப்பீடு; ஏஜென்ட் இன்றி அதே பணிகளை மீண்டும் செய்த பரிசோதனை அல்ல. வேறு சூழலில் அந்தப் பணிகள் எதுவும் முயற்சிக்கப்படாது என்பதை இது நிறுவாது.

56 பங்கேற்பாளர்களையோ 769 பணிப் பதிவுகளையோ எவ்வாறு மாதிரியாகத் தேர்ந்தெடுத்தனர் என்பதை ஆய்வுக் கட்டுரை விளக்கவில்லை. சுயாதீன மறுபகுப்பாய்வுக்குத் தேவையான அடிப்படைப் பங்கேற்பாளர் பதில்களையும் ஏஜென்ட் பதிவுகளையும் அதன் பொது இணைப்புகள் வழங்கவில்லை. Atria Dawn Preview மாதிரியாகச் செயல்பட்டதையே benchmark முடிவுகள் மதிப்பிடுகின்றன; ஓர் AI அமைப்பு தனது அடுத்த தலைமுறையைத் தன்னாட்சியாக மேம்படுத்தியது என்பதை அவை காட்டவில்லை. எதை ஒப்படைப்பது என முடிவெடுக்கும் குழுக்களுக்கான அறிக்கைத் தெளிவு இதுதான்: இந்தத் திட்டத்தில் ஏஜென்ட்கள் அடிக்கடி பணியை முன்மொழிந்து திருத்தின; அதேவேளை இலக்குகள், முறைகள், ஏற்றுக்கொள்ளும் நிபந்தனைகள் குறித்த பெரும்பாலான தேர்வுகள் தங்களிடமே இருந்ததாகப் பங்கேற்பாளர்கள் தெரிவித்தனர்.