Tavus-இன் புதிய Griffin-Lite மாதிரியுடன் ஒரு நிமிட வீடியோ அழைப்பில் பேசிய 54 பேரில் 26 பேர், உண்மையான நபருடன் பேசினோம் என நம்பியதாக நிறுவனம் கூறுகிறது. Tavus நடத்திய ஆய்வின் கவனிக்கத்தக்க முடிவு இது; ஆனால் குறிப்பிட்ட அழைப்புக்கும் கேள்விக்கும் எதிரான பதில்களையே இது அளக்கிறது. Griffin-Lite இன்னும் தேர்ந்தெடுக்கப்பட்ட ஆய்வுச் சோதனையாளர்களுக்கான முன்னோட்டமாகவே உள்ளது; வாடிக்கையாளர்கள் பயன்படுத்துவதற்கு முன் AI என்பதை வெளிப்படுத்தும் பாதுகாப்பு அம்சங்களை உருவாக்கி வருவதாக Tavus கூறுகிறது.

முக்கிய மாற்றம்

  • என்ன மாறியது: வீடியோ உதவியாளர் ஆய்வை ஒரே உரையாடலின்போது கேட்டு, பார்த்து, முகத்தையும் குரலையும் உருவாக்கும் அமைப்பை நோக்கி Tavus நகர்த்தியுள்ளது. நிறுவனம் நடத்திய குறுகிய அழைப்புகளில் 54 பேரில் 26 பேர் மாதிரி ஒரு மனிதர் என நம்பினர்.
  • இது ஏன் முக்கியம்: வீடியோ முகவர்களை வடிவமைக்கும் குழுக்களுக்கு, உரையாடல் நேர்த்தியும் வெளிப்பாட்டு மிக்க காணொளியும் இடைமுகத்தைப் பயன்படுத்த எளிதாக்கலாம். அழைப்பாளர்கள் AI-ஐச் சந்திக்கிறார்கள் என்பதைப் பின்னர் யோசித்துச் சொல்ல முடியாது என்பதையும் இதே ஆய்வு காட்டுகிறது.
  • எதைக் கவனிக்க வேண்டும்: தேர்ந்தெடுக்கப்பட்ட ஆய்வுச் சோதனையாளர்களுக்கு மட்டுமே Griffin-Lite கிடைக்கிறது. AI என்பதை வெளிப்படுத்தும் அம்சங்களும் மேலதிகப் பாதுகாப்பு நடைமுறைகளும் உருவாக்கத்தில் உள்ளன என Tavus கூறுகிறது; அவற்றின் வடிவமும் செயல்திறனும், வாடிக்கையாளர் அணுகலும், Griffin-க்கான தனிப்பட்ட விலையும் இன்னும் அறிவிக்கப்படவில்லை.

26/54 என்ற முடிவு எதை அளந்தது

Tavus-இன் அக்டோபர் 1 ஆய்வு விளக்கத்தில், பங்கேற்பாளர்கள் இந்த ஆண்டில் எதிர்பார்த்துக் கொண்டிருப்பதைப் பற்றி ஒரு நிமிட வீடியோ அழைப்பில் மற்றொரு பங்கேற்பாளருடன் இணைக்கப்படுவதாகக் கூறப்பட்டது. ஆனால் மறுமுனையில் இருந்தது Griffin-Lite இயக்கிய Tavus AI persona. அழைப்புக்குப் பிறகு உரையாடலைப் பங்கேற்பாளர்கள் மதிப்பிட்டனர்; அவர்களின் துணை உண்மையானவர் அல்லவோ என்று சந்தேகித்தார்களா என்றும் கேட்கப்பட்டது. பின்னர் அந்தத் துணை AI என Tavus வெளிப்படுத்தியது.

Griffin-Lite குழுவிலிருந்த 54 பேரில் 26 பேர், துணை ஒரு உண்மையான நபர் என்றனர்—சுமார் 48%. முந்தைய Phoenix-4.5, Sparrow-2, Raven-1 அமைப்புகளுக்கும் இதே நெறிமுறையைப் பயன்படுத்தியதாக Tavus கூறுகிறது; அந்தக் குழுவில் 41 பேரில் ஒருவர் மட்டுமே தமது துணை மனிதர் என்றார். ஒரே நபர்களின் முன்-பின் முடிவுகள் இவை அல்ல; வெவ்வேறு அழைப்பாளர் குழுக்களின் முடிவுகள். நீண்ட அழைப்புகள், வேறு தலைப்புகள் அல்லது AI முகவர் தோன்றலாம் என்பதை மக்கள் அறிந்த அன்றாடப் பயன்பாடு ஆகியவற்றில் இந்தப் பதில் எப்படி மாறும் என்பதை அறிவிப்பு நிறுவவில்லை.

இந்த முடிவை நேரடி வீடியோ Turing சோதனையில் தேர்ச்சி என Tavus அழைக்கிறது. அது நிறுவனத்தின் ஒரு நிமிட ஆய்வுக்கான விளக்கம் மட்டுமே; மனித உரையாடலை ஒத்த எல்லா உரையாடல்களுக்கும் பொருந்தும் பொதுச் சான்றிதழ் அல்ல. RuntimeWire-இன் சுயாதீன அறிமுகச் செய்தியும் 48% எண்ணிக்கையை சிறிய, நிறுவனமே நடத்திய முடிவாகக் கருதுகிறது; முன்னோட்டம் வாடிக்கையாளர்களுக்கு இன்னும் கிடைக்கவில்லை என்றும் குறிப்பிடுகிறது. குறிப்பிட்ட சூழலில் பங்கேற்பாளர்கள் அளித்த தீர்ப்புகளுக்கான சான்றே இந்த ஆய்வு; ஏமாற்றப்பட்டவர்களின் விகிதத்தைச் சுயாதீனமாக மீண்டும் உறுதிசெய்ததல்ல.

தனியான benchmark உரையாடல் தரத்தைச் சோதிக்கிறது

NVIDIA-வின் VideoFDB தரவரிசைப் பட்டியல் Griffin-Lite-க்கு உருவாக்கத்தில் 5-க்கு 3.83, உணர்திறனில் 3.73 மதிப்பெண்களை அளிக்கிறது. உண்மையான வீடியோ அழைப்புகளிலிருந்து எடுக்கப்பட்ட clip-களையும், அளவுகோல் அடிப்படையிலான மொழி மாதிரி மதிப்பீட்டாளரையும் benchmark பயன்படுத்துகிறது. உருவாக்க மதிப்பீடு மாதிரியின் குரல், முகம், உரையாடல் நடத்தை பொருத்தமா என அளக்கிறது; உணர்திறன் மதிப்பீடு ஒருவரின் ஒலி மற்றும் காணொளிக்கு அது எவ்வாறு பதிலளிக்கிறது என அளக்கிறது. இரு பாதைகளிலும் பட்டியலிடப்பட்ட அமைப்புகளுக்கு மேல் Griffin-Lite மதிப்பெண் பெற்றதாக NVIDIA அட்டவணை காட்டுகிறது; மனிதக் குறிப்புநிலை மதிப்பெண்கள் முறையே 3.92 மற்றும் 4.20.

அழைப்பாளர்கள் தங்கள் துணை மனிதர் என நினைக்கிறார்களா என்று கேட்பதிலிருந்து இந்த மதிப்பெண்கள் வேறொரு பணியை அளக்கின்றன. ஒப்பீட்டுக் குழுக்களும் நிபந்தனைகளும் வேறு: உருவாக்க அட்டவணையில் தொடர் பேச்சிலிருந்து avatar உருவாக்கும் அமைப்புகள் உள்ளன; உணர்திறன் அட்டவணையில் ஒலி மற்றும் காணொளி அல்லது தனி வரிகளில் ஒலி மட்டும் கொண்டு மதிப்பிடப்பட்ட அமைப்புகள் உள்ளன. NVIDIA வெளியிட்ட அளவுகோலின்படி கிடைத்த முடிவுக்கு இந்தத் தரவரிசை ஆதரவளிக்கிறது. Tavus-இன் 48% அழைப்பு ஆய்வை இது உறுதிப்படுத்துவதில்லை; வாடிக்கையாளர் சேவை, கற்பித்தல் அல்லது சுகாதாரத் தயாரிப்பாக Griffin எவ்வாறு செயல்படும் என்றும் காட்டுவதில்லை.

அமைப்பு எவ்வாறு செயல்படுகிறது என Tavus கூறுவது

Griffin இரண்டு பகுதிகளைக் கொண்ட வடிவமைப்பு என Tavus விவரிக்கிறது. தொடர்ச்சியான உரையாடல் மாதிரி அழைப்பாளரின் ஒலி மற்றும் காணொளியைப் பெற்று, என்ன சொல்ல வேண்டும், எப்போது பேச வேண்டும், எப்படிப் பிரதிபலிக்க வேண்டும் என்பதற்கான கட்டுப்பாடுகளை வழங்குகிறது. அந்தக் கட்டுப்பாடுகளைப் பயன்படுத்தி ஸ்ட்ரீமிங் பேச்சு மற்றும் காணொளி உருவாக்கிகள் குரலையும் நகரும் காட்சியையும் உருவாக்குகின்றன. பேசிக்கொண்டிருக்கும்போதே கேட்கவும், குறுக்கிட்டால் பேசுவதை நிறுத்தி இடம் கொடுக்கவும், ஒவ்வொரு உரையாடல் முறையும் முடியும் வரை காத்திருக்காமல் காட்சிச் சூழலுக்கு எதிர்வினையாற்றவும் அமைப்பு முடியும் என நிறுவனம் கூறுகிறது. இவை Tavus-இன் தொழில்நுட்ப விளக்கங்களும் காட்சிப்படுத்தல்களும் மட்டுமே; BIG CHANGE முன்னோட்டத்தை அணுகவோ அதன் நடத்தையை அளக்கவோ இல்லை.

உருவாக்கப்பட்ட முகம் மட்டும் முழு உரையாடலாகாது என்பதால் இந்த வேறுபாடு முக்கியம். இடைநிறுத்தம், பார்வை, குறுக்கீடு ஆகியவற்றுக்கு பதிலளிக்கும் அமைப்பு, அழைப்பாளர் புரிந்துகொள்ளப்பட்டதாக உணர்வதையோ மென்பொருளுடன் பேசுவதை உணர்வதையோ மாற்றலாம். benchmark நெறிமுறையில் உரையாடல் நடத்தைக்கு VideoFDB மதிப்பெண் அடிப்படையிலான ஒப்பீட்டை வழங்குகிறது. மனித அழைப்பு ஆய்வு, அடையாளம் குறித்த தீர்ப்புகளைப் பற்றிய குறுகிய அவதானிப்பை வழங்குகிறது. நீடித்த நம்பகத்தன்மை, நேரடி deployment-இல் வெளிப்படுத்தல் அல்லது பயனர்களின் தகவலறிந்த ஒப்புதல் ஆகியவற்றுக்கான பொது ஆதாரத்துக்கு இவற்றில் எதுவும் மாற்றாகாது.

அணுகலும் அடுத்த முடிவும்

ஆய்வு முன்னோட்டமாக தேர்ந்தெடுக்கப்பட்ட நம்பகமான சோதனையாளர்களுக்கு மட்டுமே Griffin-Lite திறக்கப்பட்டுள்ளது; Tavus வாடிக்கையாளர்களுக்கு இது கிடைக்காது என நிறுவனம் கூறுகிறது. சோதனைக்காகக் கோரிக்கைப் படிவத்தை அது வழங்குகிறது. Griffin இன்னும் பொதுத் தளத்திலோ பொது API-யிலோ இல்லை; Griffin-க்கான தனி விலையையும் அறிவிப்பு குறிப்பிடவில்லை. Tavus-இன் தற்போதைய Phoenix, Raven, Sparrow மாதிரிகள் தனியான தயாரிப்பு வழியாகத் தொடர்கின்றன.

பரந்த வெளியீட்டுக்கு முன் AI என்பதை வெளிப்படுத்தும் அம்சங்களையும் மேலதிகப் பாதுகாப்பு நடைமுறைகளையும் உருவாக்கி வருவதாக நிறுவனம் கூறுகிறது. வெளியீட்டுத் தேதியையோ விரிவான வெளிப்படுத்தல் வடிவமைப்பையோ அந்த நடவடிக்கைகள் செயல்படுகின்றன என்பதற்கான ஆதாரத்தையோ அது வெளியிடவில்லை. நேரடி வீடியோ முகவரை மதிப்பிடுவோருக்கு உடனடி கேள்வி இதுதான்: Griffin வாடிக்கையாளர் தயாரிப்பாவதற்கு முன், மறுமுனையில் யார் அல்லது எது இருக்கிறது என்பதை அழைப்பாளர் எப்படித் தெரிந்துகொள்வார்; அதை எப்படிச் சரிபார்ப்பார்கள்?

ஆதாரங்களும் மேலும் வாசிப்பும்