కొత్త Griffin-Lite మోడల్‌తో చేసిన ఒక నిమిషపు వీడియో కాల్‌లలో 54 మందిలో 26 మంది నిజమైన వ్యక్తితో మాట్లాడామని భావించారని Tavus చెబుతోంది. Tavus స్వయంగా నిర్వహించిన అధ్యయనంలో ఇది గమనించదగ్గ ఫలితం; అయితే నిర్దిష్ట కాల్, ప్రశ్నకు వచ్చిన స్పందనలనే ఇది కొలుస్తుంది. Griffin-Lite ఇంకా ఎంపిక చేసిన పరీక్షకుల కోసం పరిశోధన ప్రివ్యూలో ఉంది; వినియోగదారులకు అందించే ముందు AI అని వెల్లడించే రక్షణ చర్యలను అభివృద్ధి చేస్తున్నామని Tavus చెబుతోంది.

పెద్ద మార్పు

  • ఏం మారింది: Tavus తన వీడియో సహాయక పరిశోధనను, ఒకే సంభాషణలో విని, చూసి, ముఖం, స్వరాన్ని సృష్టించే వ్యవస్థ దిశగా తీసుకెళ్లింది. కంపెనీ నిర్వహించిన చిన్న కాల్‌లలో 54 మందిలో 26 మంది మోడల్‌ను వ్యక్తిగా భావించారు.
  • దీని ప్రాధాన్యం: వీడియో ఏజెంట్‌లను రూపొందించే బృందాలకు, సంభాషణ సమయం, భావవ్యక్తీకరణతో కూడిన వీడియో ఇంటర్‌ఫేస్‌తో పరస్పర చర్యను సులభం చేయవచ్చు. కాల్‌లో మాట్లాడుతున్నది AI అని ముందుగానే తెలియజేయడం తర్వాత చూసుకునే విషయం కాదని అదే అధ్యయనం చూపిస్తుంది.
  • గమనించాల్సినవి: Griffin-Lite ఎంపిక చేసిన పరిశోధన పరీక్షకులకే పరిమితం. AI అని వెల్లడించే ఫీచర్‌లు, అదనపు భద్రతా విధానాలు అభివృద్ధిలో ఉన్నాయని Tavus చెబుతోంది; వాటి రూపం, ప్రభావం, వినియోగదారుల ప్రాప్యత, Griffin ప్రత్యేక ధర ఇంకా ప్రకటించలేదు.

54 మందిలో 26 మంది ఫలితం ఏం కొలిచింది

Tavus అక్టోబర్ 1నాటి పరిశోధన వివరణలో పాల్గొనేవారికి ఈ ఏడాది తాము ఎదురు చూస్తున్న విషయంపై మరో పాల్గొనేవారితో ఒక నిమిషం వీడియో కాల్ చేయాలని చెప్పారు. అయితే వారి భాగస్వామి Griffin-Liteతో నడిచే Tavus AI వ్యక్తి. కాల్ తర్వాత వారు సంభాషణను రేట్ చేశారు, అవతలి వ్యక్తి నిజమైనవాడు కాదేమోనని అనుమానం వచ్చిందా అని అడిగారు. ఆ తర్వాత భాగస్వామి AI అని Tavus వెల్లడించింది.

Griffin-Liteతో కాల్ చేసిన 54 మందిలో 26 మంది అవతలి వ్యక్తి నిజమైన మనిషి అని చెప్పారు—సుమారు 48 శాతం. అంతకుముందు Phoenix-4.5, Sparrow-2, Raven-1 వ్యవస్థల కోసం కూడా ఇదే విధానాన్ని ఉపయోగించామని Tavus చెబుతోంది; ఆ బృందంలో 41 మందిలో ఒకరు తమ భాగస్వామి వ్యక్తి అని చెప్పారు. ఇవి వేర్వేరు కాలర్ బృందాలు; ఒకే వ్యక్తులను ముందు, తర్వాత పరీక్షించిన ఫలితం కాదు. ఎక్కువసేపు మాట్లాడితే, వేర్వేరు అంశాలపై లేదా AI ఏజెంట్ కనిపించవచ్చని ప్రజలకు తెలిసిన రోజువారీ వాడకంలో ఈ స్పందన ఎలా మారుతుందో ప్రకటన నిర్ధారించదు.

ఈ ఫలితాన్ని ప్రత్యక్ష వీడియో ట్యూరింగ్ పరీక్షలో ఉత్తీర్ణతగా Tavus పేర్కొంటుంది. అది కంపెనీ నిర్వహించిన ఒక నిమిషపు అధ్యయనానికి ఇచ్చిన వివరణ మాత్రమే; మానవుని తరహా సంభాషణకు సార్వత్రిక ధ్రువీకరణ కాదు. RuntimeWire స్వతంత్ర ప్రారంభ కథనం కూడా 48 శాతం ఫలితం చిన్నది, కంపెనీ నిర్వహించిందని చెబుతూ, ప్రివ్యూ వినియోగదారులకు ఇంకా అందుబాటులో లేదని పేర్కొంటుంది. తెలిపిన పరిస్థితుల్లో పాల్గొన్నవారి అభిప్రాయాలకు ఈ అధ్యయనం ఆధారం; మోసపోయిన వారి శాతాన్ని స్వతంత్రంగా మళ్లీ పరీక్షించిన ఫలితం కాదు.

వేరే బెంచ్‌మార్క్ పరస్పర చర్య నాణ్యతను పరీక్షిస్తుంది

ఈ NVIDIA VideoFDB లీడర్‌బోర్డ్‌లో Griffin-Liteకు జనరేషన్‌లో 5కు 3.83, పర్సెప్షన్‌లో 3.73 స్కోర్లు ఉన్నాయి. నిజమైన వీడియో కాల్‌ల క్లిప్‌లు, నియమాధారిత భాషా-మోడల్ న్యాయనిర్ణేతను బెంచ్‌మార్క్ ఉపయోగిస్తుంది. మోడల్ స్వరం, ముఖం, సంభాషణ ప్రవర్తన ఎంత సముచితంగా ఉన్నాయో జనరేషన్ అంచనా వేస్తుంది; వ్యక్తి ఆడియో, వీడియోకు అది ఎలా స్పందిస్తుందో పర్సెప్షన్ కొలుస్తుంది. NVIDIA పట్టికలో రెండు విభాగాలకూ జాబితా చేసిన వ్యవస్థలపై Griffin-Lite ఉంది; మానవ సూచన స్కోర్లు వరుసగా 3.92, 4.20.

భాగస్వామి మనిషా అని కాలర్‌లను అడిగే పనితో ఈ స్కోర్లు వేరే విషయాన్ని కొలుస్తాయి. పోలిక బృందాలు, పరిస్థితులూ వేర్వేరు: జనరేషన్ పట్టికలో దశలవారీగా కలిపిన మాట-నుంచి-అవతార్ వ్యవస్థలు ఉన్నాయి; పర్సెప్షన్ పట్టికలో ఆడియో, వీడియోతో లేదా వేరు వరుసల్లో ఆడియోతో మాత్రమే అంచనా వేసిన వ్యవస్థలు ఉన్నాయి. NVIDIA ప్రచురించిన ప్రమాణాలపై వచ్చిన ఫలితానికి లీడర్‌బోర్డ్ ఆధారం ఇస్తుంది. Tavus అధ్యయనంలోని 48 శాతం ఫలితాన్ని ఇది ధృవీకరించదు; కస్టమర్ సేవ, బోధన లేదా ఆరోగ్య సంరక్షణ ఉత్పత్తిగా Griffin ఎలా పనిచేస్తుందో కూడా చూపదు.

వ్యవస్థ ఏం చేస్తుందని Tavus చెబుతోంది

Griffinను రెండు భాగాల రూపకల్పనగా Tavus వివరిస్తుంది. నిరంతర సంభాషణ మోడల్ కాలర్ ఆడియో, వీడియోను స్వీకరించి, ఏం చెప్పాలి, ఎప్పుడు మాట్లాడాలి, ఎలా భావాన్ని వ్యక్తం చేయాలి అన్న నియంత్రణలను ఇస్తుంది. ప్రసార వాయిస్, వీడియో జనరేటర్లు వాటిని స్వరంగా, కదిలే దృశ్యంగా మారుస్తాయి. మాట్లాడుతూనే వినగలదని, మధ్యలో అడ్డుకుంటే మాట ఆపుతుందని, ప్రతి వంతు పూర్తయ్యేదాకా వేచి ఉండకుండా దృశ్య సందర్భానికి స్పందిస్తుందని కంపెనీ చెబుతోంది. ఇవి Tavus ఇచ్చిన సాంకేతిక వివరణలు, ప్రదర్శనలు; BIG CHANGE ప్రివ్యూను పొందలేదు లేదా దాని ప్రవర్తనను కొలవలేదు.

రూపొందించిన ముఖం మాత్రమే మొత్తం పరస్పర చర్య కాదనే కారణంగా ఈ తేడా ముఖ్యం. విరామాలు, చూపు, మధ్యలో మాట ఆపడం వంటి వాటికి స్పందించే వ్యవస్థ వల్ల కాలర్‌కు తనను అర్థం చేసుకున్నట్టు అనిపించవచ్చు లేదా సాఫ్ట్‌వేర్‌తో మాట్లాడుతున్నానని గుర్తించవచ్చు. VideoFDB ఫలితం బెంచ్‌మార్క్ విధానంలో సంభాషణ ప్రవర్తనను స్కోరు చేసి పోలుస్తుంది. Tavus మానవ కాల్ అధ్యయనం మాత్రం ఎవరు మనిషని భావించారనే పరిమిత పరిశీలన. దీర్ఘకాల విశ్వసనీయత, ప్రత్యక్ష వినియోగంలో వెల్లడింపు, వినియోగదారుల సమాచారసహిత సమ్మతిపై ప్రజా ఆధారాలకు ఈ రెండింటిలో ఏదీ ప్రత్యామ్నాయం కాదు.

ప్రాప్యత, ముందున్న నిర్ణయం

Griffin-Lite పరిశోధన ప్రివ్యూగా ఎంపిక చేసిన విశ్వసనీయ పరీక్షకులకే తెరిచి ఉందని ఎంపిక చేసిన విశ్వసనీయ పరీక్షకులకే Griffin-Lite అందుబాటులో ఉంది పరిశోధన ప్రివ్యూ మాత్రమే; Tavus కస్టమర్‌లకు ఇది అందుబాటులో లేదు. పరీక్ష కోసం అభ్యర్థన ఫారమ్‌ను కంపెనీ అందిస్తోంది. Griffin ఇంకా సాధారణ ప్లాట్‌ఫారమ్‌లో లేదా ప్రజా APIలో లేదు; దానికి ప్రత్యేక ధరను ప్రకటన పేర్కొనలేదు. Tavus ప్రస్తుత Phoenix, Raven, Sparrow మోడల్‌లు వేరే ఉత్పత్తి మార్గంగా కొనసాగుతున్నాయి.

విస్తృతంగా విడుదల చేయడానికి ముందు వెల్లడింపు ఫీచర్‌లు, అదనపు భద్రతా విధానాలపై పని చేస్తున్నామని కంపెనీ చెబుతోంది. తేదీని, వెల్లడింపు రూపకల్పన వివరాలను లేదా ఆ చర్యలు పనిచేస్తాయనే ఆధారాన్ని ప్రచురించలేదు. అందువల్ల నిజ-సమయ వీడియో ఏజెంట్‌ను అంచనా వేసేవారికి ఇప్పటి ప్రశ్న స్పష్టమైనది: అవతలి వైపు ఎవరు లేదా ఏది ఉందో కాలర్‌కు ఎలా తెలుస్తుంది, Griffin కస్టమర్ ఉత్పత్తి కావడానికి ముందు ఆ వెల్లడింపును ఎలా తనిఖీ చేస్తారు?

మూలాలు, మరింత చదవడానికి