కొత్త Griffin-Lite మోడల్తో చేసిన ఒక నిమిషపు వీడియో కాల్లలో 54 మందిలో 26 మంది నిజమైన వ్యక్తితో మాట్లాడామని భావించారని Tavus చెబుతోంది. Tavus స్వయంగా నిర్వహించిన అధ్యయనంలో ఇది గమనించదగ్గ ఫలితం; అయితే నిర్దిష్ట కాల్, ప్రశ్నకు వచ్చిన స్పందనలనే ఇది కొలుస్తుంది. Griffin-Lite ఇంకా ఎంపిక చేసిన పరీక్షకుల కోసం పరిశోధన ప్రివ్యూలో ఉంది; వినియోగదారులకు అందించే ముందు AI అని వెల్లడించే రక్షణ చర్యలను అభివృద్ధి చేస్తున్నామని Tavus చెబుతోంది.
పెద్ద మార్పు
- ఏం మారింది: Tavus తన వీడియో సహాయక పరిశోధనను, ఒకే సంభాషణలో విని, చూసి, ముఖం, స్వరాన్ని సృష్టించే వ్యవస్థ దిశగా తీసుకెళ్లింది. కంపెనీ నిర్వహించిన చిన్న కాల్లలో 54 మందిలో 26 మంది మోడల్ను వ్యక్తిగా భావించారు.
- దీని ప్రాధాన్యం: వీడియో ఏజెంట్లను రూపొందించే బృందాలకు, సంభాషణ సమయం, భావవ్యక్తీకరణతో కూడిన వీడియో ఇంటర్ఫేస్తో పరస్పర చర్యను సులభం చేయవచ్చు. కాల్లో మాట్లాడుతున్నది AI అని ముందుగానే తెలియజేయడం తర్వాత చూసుకునే విషయం కాదని అదే అధ్యయనం చూపిస్తుంది.
- గమనించాల్సినవి: Griffin-Lite ఎంపిక చేసిన పరిశోధన పరీక్షకులకే పరిమితం. AI అని వెల్లడించే ఫీచర్లు, అదనపు భద్రతా విధానాలు అభివృద్ధిలో ఉన్నాయని Tavus చెబుతోంది; వాటి రూపం, ప్రభావం, వినియోగదారుల ప్రాప్యత, Griffin ప్రత్యేక ధర ఇంకా ప్రకటించలేదు.
54 మందిలో 26 మంది ఫలితం ఏం కొలిచింది
Tavus అక్టోబర్ 1నాటి పరిశోధన వివరణలో పాల్గొనేవారికి ఈ ఏడాది తాము ఎదురు చూస్తున్న విషయంపై మరో పాల్గొనేవారితో ఒక నిమిషం వీడియో కాల్ చేయాలని చెప్పారు. అయితే వారి భాగస్వామి Griffin-Liteతో నడిచే Tavus AI వ్యక్తి. కాల్ తర్వాత వారు సంభాషణను రేట్ చేశారు, అవతలి వ్యక్తి నిజమైనవాడు కాదేమోనని అనుమానం వచ్చిందా అని అడిగారు. ఆ తర్వాత భాగస్వామి AI అని Tavus వెల్లడించింది.
Griffin-Liteతో కాల్ చేసిన 54 మందిలో 26 మంది అవతలి వ్యక్తి నిజమైన మనిషి అని చెప్పారు—సుమారు 48 శాతం. అంతకుముందు Phoenix-4.5, Sparrow-2, Raven-1 వ్యవస్థల కోసం కూడా ఇదే విధానాన్ని ఉపయోగించామని Tavus చెబుతోంది; ఆ బృందంలో 41 మందిలో ఒకరు తమ భాగస్వామి వ్యక్తి అని చెప్పారు. ఇవి వేర్వేరు కాలర్ బృందాలు; ఒకే వ్యక్తులను ముందు, తర్వాత పరీక్షించిన ఫలితం కాదు. ఎక్కువసేపు మాట్లాడితే, వేర్వేరు అంశాలపై లేదా AI ఏజెంట్ కనిపించవచ్చని ప్రజలకు తెలిసిన రోజువారీ వాడకంలో ఈ స్పందన ఎలా మారుతుందో ప్రకటన నిర్ధారించదు.
ఈ ఫలితాన్ని ప్రత్యక్ష వీడియో ట్యూరింగ్ పరీక్షలో ఉత్తీర్ణతగా Tavus పేర్కొంటుంది. అది కంపెనీ నిర్వహించిన ఒక నిమిషపు అధ్యయనానికి ఇచ్చిన వివరణ మాత్రమే; మానవుని తరహా సంభాషణకు సార్వత్రిక ధ్రువీకరణ కాదు. RuntimeWire స్వతంత్ర ప్రారంభ కథనం కూడా 48 శాతం ఫలితం చిన్నది, కంపెనీ నిర్వహించిందని చెబుతూ, ప్రివ్యూ వినియోగదారులకు ఇంకా అందుబాటులో లేదని పేర్కొంటుంది. తెలిపిన పరిస్థితుల్లో పాల్గొన్నవారి అభిప్రాయాలకు ఈ అధ్యయనం ఆధారం; మోసపోయిన వారి శాతాన్ని స్వతంత్రంగా మళ్లీ పరీక్షించిన ఫలితం కాదు.
వేరే బెంచ్మార్క్ పరస్పర చర్య నాణ్యతను పరీక్షిస్తుంది
ఈ NVIDIA VideoFDB లీడర్బోర్డ్లో Griffin-Liteకు జనరేషన్లో 5కు 3.83, పర్సెప్షన్లో 3.73 స్కోర్లు ఉన్నాయి. నిజమైన వీడియో కాల్ల క్లిప్లు, నియమాధారిత భాషా-మోడల్ న్యాయనిర్ణేతను బెంచ్మార్క్ ఉపయోగిస్తుంది. మోడల్ స్వరం, ముఖం, సంభాషణ ప్రవర్తన ఎంత సముచితంగా ఉన్నాయో జనరేషన్ అంచనా వేస్తుంది; వ్యక్తి ఆడియో, వీడియోకు అది ఎలా స్పందిస్తుందో పర్సెప్షన్ కొలుస్తుంది. NVIDIA పట్టికలో రెండు విభాగాలకూ జాబితా చేసిన వ్యవస్థలపై Griffin-Lite ఉంది; మానవ సూచన స్కోర్లు వరుసగా 3.92, 4.20.
భాగస్వామి మనిషా అని కాలర్లను అడిగే పనితో ఈ స్కోర్లు వేరే విషయాన్ని కొలుస్తాయి. పోలిక బృందాలు, పరిస్థితులూ వేర్వేరు: జనరేషన్ పట్టికలో దశలవారీగా కలిపిన మాట-నుంచి-అవతార్ వ్యవస్థలు ఉన్నాయి; పర్సెప్షన్ పట్టికలో ఆడియో, వీడియోతో లేదా వేరు వరుసల్లో ఆడియోతో మాత్రమే అంచనా వేసిన వ్యవస్థలు ఉన్నాయి. NVIDIA ప్రచురించిన ప్రమాణాలపై వచ్చిన ఫలితానికి లీడర్బోర్డ్ ఆధారం ఇస్తుంది. Tavus అధ్యయనంలోని 48 శాతం ఫలితాన్ని ఇది ధృవీకరించదు; కస్టమర్ సేవ, బోధన లేదా ఆరోగ్య సంరక్షణ ఉత్పత్తిగా Griffin ఎలా పనిచేస్తుందో కూడా చూపదు.
వ్యవస్థ ఏం చేస్తుందని Tavus చెబుతోంది
Griffinను రెండు భాగాల రూపకల్పనగా Tavus వివరిస్తుంది. నిరంతర సంభాషణ మోడల్ కాలర్ ఆడియో, వీడియోను స్వీకరించి, ఏం చెప్పాలి, ఎప్పుడు మాట్లాడాలి, ఎలా భావాన్ని వ్యక్తం చేయాలి అన్న నియంత్రణలను ఇస్తుంది. ప్రసార వాయిస్, వీడియో జనరేటర్లు వాటిని స్వరంగా, కదిలే దృశ్యంగా మారుస్తాయి. మాట్లాడుతూనే వినగలదని, మధ్యలో అడ్డుకుంటే మాట ఆపుతుందని, ప్రతి వంతు పూర్తయ్యేదాకా వేచి ఉండకుండా దృశ్య సందర్భానికి స్పందిస్తుందని కంపెనీ చెబుతోంది. ఇవి Tavus ఇచ్చిన సాంకేతిక వివరణలు, ప్రదర్శనలు; BIG CHANGE ప్రివ్యూను పొందలేదు లేదా దాని ప్రవర్తనను కొలవలేదు.
రూపొందించిన ముఖం మాత్రమే మొత్తం పరస్పర చర్య కాదనే కారణంగా ఈ తేడా ముఖ్యం. విరామాలు, చూపు, మధ్యలో మాట ఆపడం వంటి వాటికి స్పందించే వ్యవస్థ వల్ల కాలర్కు తనను అర్థం చేసుకున్నట్టు అనిపించవచ్చు లేదా సాఫ్ట్వేర్తో మాట్లాడుతున్నానని గుర్తించవచ్చు. VideoFDB ఫలితం బెంచ్మార్క్ విధానంలో సంభాషణ ప్రవర్తనను స్కోరు చేసి పోలుస్తుంది. Tavus మానవ కాల్ అధ్యయనం మాత్రం ఎవరు మనిషని భావించారనే పరిమిత పరిశీలన. దీర్ఘకాల విశ్వసనీయత, ప్రత్యక్ష వినియోగంలో వెల్లడింపు, వినియోగదారుల సమాచారసహిత సమ్మతిపై ప్రజా ఆధారాలకు ఈ రెండింటిలో ఏదీ ప్రత్యామ్నాయం కాదు.
ప్రాప్యత, ముందున్న నిర్ణయం
Griffin-Lite పరిశోధన ప్రివ్యూగా ఎంపిక చేసిన విశ్వసనీయ పరీక్షకులకే తెరిచి ఉందని ఎంపిక చేసిన విశ్వసనీయ పరీక్షకులకే Griffin-Lite అందుబాటులో ఉంది పరిశోధన ప్రివ్యూ మాత్రమే; Tavus కస్టమర్లకు ఇది అందుబాటులో లేదు. పరీక్ష కోసం అభ్యర్థన ఫారమ్ను కంపెనీ అందిస్తోంది. Griffin ఇంకా సాధారణ ప్లాట్ఫారమ్లో లేదా ప్రజా APIలో లేదు; దానికి ప్రత్యేక ధరను ప్రకటన పేర్కొనలేదు. Tavus ప్రస్తుత Phoenix, Raven, Sparrow మోడల్లు వేరే ఉత్పత్తి మార్గంగా కొనసాగుతున్నాయి.
విస్తృతంగా విడుదల చేయడానికి ముందు వెల్లడింపు ఫీచర్లు, అదనపు భద్రతా విధానాలపై పని చేస్తున్నామని కంపెనీ చెబుతోంది. తేదీని, వెల్లడింపు రూపకల్పన వివరాలను లేదా ఆ చర్యలు పనిచేస్తాయనే ఆధారాన్ని ప్రచురించలేదు. అందువల్ల నిజ-సమయ వీడియో ఏజెంట్ను అంచనా వేసేవారికి ఇప్పటి ప్రశ్న స్పష్టమైనది: అవతలి వైపు ఎవరు లేదా ఏది ఉందో కాలర్కు ఎలా తెలుస్తుంది, Griffin కస్టమర్ ఉత్పత్తి కావడానికి ముందు ఆ వెల్లడింపును ఎలా తనిఖీ చేస్తారు?
మూలాలు, మరింత చదవడానికి
- Tavus Research, “Griffin పరిచయం: తొలి మానవ పరస్పర చర్య మోడల్”, 2026 అక్టోబర్ 1. విక్రేత వ్యవస్థ వివరణ, అధ్యయన విధానం, ఫలితాలు, అందుబాటు, భద్రతా ప్రకటనలు. మానవులతో చేసిన కాల్ అధ్యయనాన్ని Tavus నిర్వహించింది; ఇక్కడ పరిశీలించిన మూలాల్లో స్వతంత్రంగా పునరావృతం చేయలేదు.
- NVIDIA, David AI, “VideoFDB: సంభాషణ ఏజెంట్లలో పూర్తి-డ్యూప్లెక్స్ దృశ్య-మాట సామర్థ్యాల మూల్యాంకనం”, 2026 అక్టోబర్ 2న తనిఖీ. బెంచ్మార్క్ నిర్వాహకుల పద్ధతి, ప్రత్యక్ష లీడర్బోర్డ్; Griffin-Lite జనరేషన్, పర్సెప్షన్ స్కోర్లు సహా. మోడల్-న్యాయనిర్ణేత స్కోర్లు Tavus మానవ-కాల్ అధ్యయనానికి వేరు.
- Ryan Merket, RuntimeWire, “ఒక నిమిషపు వీడియో కాల్లలో 48% పరీక్షకులను మభ్యపెట్టిందని Tavus చెబుతోంది”, 2026 అక్టోబర్ 1. నమూనా పరిమాణం, కస్టమర్ ప్రాప్యత లోటును గుర్తించిన స్వతంత్ర కథనం; రచయితలు మళ్లీ పరీక్షించలేదు లేదా Griffinను ప్రత్యక్షంగా పరీక్షించలేదు.



