Tavus کا کہنا ہے کہ اس کے نئے Griffin-Lite ماڈل کے ساتھ ایک منٹ کی ویڈیو کالز میں 54 میں سے 26 افراد نے سمجھا کہ انہوں نے حقیقی شخص سے بات کی۔ Tavus کے اپنے مطالعے کا یہ نمایاں نتیجہ ہے، مگر یہ ایک مخصوص کال اور سوال پر لوگوں کے ردِعمل کو ناپتا ہے۔ Griffin-Lite اب بھی منتخب آزمائش کرنے والوں کے لیے تحقیقی پیش نظارہ ہے، اور Tavus کہتا ہے کہ صارفین کو استعمال کی اجازت دینے سے پہلے وہ AI ہونے کے انکشاف کے حفاظتی طریقے بنا رہا ہے۔
بڑی تبدیلی
- کیا بدلا: Tavus نے اپنی ویڈیو اسسٹنٹ تحقیق کو ایسے نظام کی طرف بڑھایا ہے جو ایک ہی گفتگو میں سنتا، دیکھتا اور چہرے و آواز کے ساتھ جواب بناتا ہے۔ کمپنی کی مختصر، خود کروائی گئی کالز میں 54 میں سے 26 افراد نے ماڈل کو شخص سمجھا۔
- یہ کیوں اہم ہے: ویڈیو ایجنٹس بنانے والی ٹیموں کے لیے گفتگو کا بروقت جواب اور اظہار سے بھرپور ویڈیو انٹرفیس کو استعمال میں زیادہ دل چسپ بنا سکتے ہیں۔ اسی مطالعے سے یہ بھی ظاہر ہوتا ہے کہ کال کرنے والوں کو یہ بتانا بعد میں سوچنے کی بات نہیں ہو سکتی کہ وہ AI سے بات کر رہے ہیں۔
- کس بات پر نظر رکھیں: Griffin-Lite صرف منتخب تحقیقی آزمائش کرنے والوں کے لیے ہے۔ Tavus کہتا ہے کہ AI disclosure کی خصوصیات اور مزید حفاظتی طریقے زیرِ تیاری ہیں؛ ان کی شکل اور مؤثریت، صارفین کی رسائی اور Griffin کی مخصوص قیمت کا اعلان ابھی نہیں ہوا۔
26 میں سے 54 کا نتیجہ کیا ناپتا ہے
Tavus کے یکم اکتوبر کے تحقیقی بیان کے مطابق، شرکا کو بتایا گیا کہ انہیں ایک منٹ کی ویڈیو کال میں اس بات پر گفتگو کے لیے کسی دوسرے شریک سے ملایا جائے گا کہ وہ اس سال کن چیزوں کے منتظر ہیں۔ اس کے بجائے ان کا ساتھی Griffin-Lite سے چلنے والا Tavus کا AI persona تھا۔ کال کے بعد لوگوں نے گفتگو کو نمبر دیے اور ان سے پوچھا گیا کہ کیا انہیں خیال آیا تھا کہ ساتھی حقیقی نہیں۔ اس کے بعد Tavus نے بتایا کہ ساتھی AI تھا۔
Griffin-Lite کے ساتھ 54 شرکا میں سے 26 نے کہا کہ ساتھی حقیقی شخص تھا، یعنی تقریباً 48%۔ Tavus کے مطابق اس نے یہی طریقۂ کار اپنے پہلے Phoenix-4.5، Sparrow-2 اور Raven-1 سسٹم کے لیے بھی استعمال کیا تھا؛ اس گروپ میں 41 میں سے ایک شریک نے کہا کہ سامنے والا شخص تھا۔ یہ مختلف کال کرنے والوں کے گروپ ہیں، انہی لوگوں کے ساتھ پہلے اور بعد میں کیا گیا تجربہ نہیں۔ اعلان سے یہ ثابت نہیں ہوتا کہ طویل کال، مختلف موضوعات یا عام استعمال میں—جہاں لوگوں کو معلوم ہو کہ AI ایجنٹ آ سکتا ہے—جواب کیا ہوگا۔
Tavus اس نتیجے کو حقیقی وقت کی ویڈیو Turing test میں کامیابی کہتا ہے۔ یہ کمپنی کی ایک منٹ کے مطالعے کی تشریح ہے، انسانی گفتگو جیسی صلاحیت کا عالمی سرٹیفکیٹ نہیں۔ RuntimeWire کی آزاد اجرا رپورٹ بھی 48% کو کمپنی کے چھوٹے پیمانے کے نتیجے کے طور پر بیان کرتی ہے اور بتاتی ہے کہ پیش نظارہ ابھی صارفین کے لیے دستیاب نہیں۔ یہ مطالعہ اپنی بیان کردہ شرائط کے تحت شرکا کے فیصلوں کا ثبوت ہے؛ دھوکے کی شرح کا آزادانہ طور پر دہرایا گیا نتیجہ نہیں۔
ایک الگ بینچ مارک گفتگو کے معیار کو جانچتا ہے
NVIDIA کی VideoFDB لیڈر بورڈ Griffin-Lite کو generation میں 5 میں سے 3.83 اور perception میں 3.73 نمبر دیتا ہے۔ اس بینچ مارک میں حقیقی ویڈیو کالز کے clips اور قواعد پر مبنی language-model judge استعمال ہوتے ہیں۔ generation میں ماڈل کی آواز، چہرے اور گفتگو کے رویے کی مناسبت دیکھی جاتی ہے؛ perception میں کسی شخص کی آڈیو اور ویڈیو پر اس کے جوابات جانچے جاتے ہیں۔ NVIDIA کی جدول میں دونوں زمروں میں Griffin-Lite کا اسکور فہرست کے دوسرے نظاموں سے زیادہ ہے، جبکہ انسانی حوالہ جاتی اسکور بالترتیب 3.92 اور 4.20 ہیں۔
یہ اسکور کال کرنے والوں سے یہ پوچھنے والے ٹیسٹ سے مختلف کام ناپتے ہیں کہ آیا انہیں ساتھی انسان لگا۔ ان کے موازنے کے گروپ اور شرائط بھی الگ ہیں: generation جدول میں speech-to-avatar کے یکجا نظام شامل ہیں، جبکہ perception جدول میں audio اور video، یا الگ قطاروں میں صرف audio کے ساتھ جانچے گئے نظام شامل ہیں۔ لیڈر بورڈ NVIDIA کے شائع کردہ rubric پر نتیجے کی تائید کرتا ہے۔ یہ Tavus کے کال مطالعے کے 48% نتیجے کی توثیق نہیں کرتا اور نہ دکھاتا ہے کہ Griffin customer service، تدریس یا صحت کی پروڈکٹ کے طور پر کیسا چلے گا۔
Tavus کے مطابق یہ نظام کیسے کام کرتا ہے
Tavus Griffin کو دو حصوں کے ڈیزائن کے طور پر بیان کرتا ہے۔ ایک مسلسل گفتگو کرنے والا ماڈل کال کرنے والے کی آڈیو اور ویڈیو لیتا اور یہ کنٹرول جاری کرتا ہے کہ کیا کہنا، کب بولنا اور کیسے اظہار کرنا ہے۔ اسٹریمنگ speech اور video generators انہی کنٹرولز کو آواز اور متحرک منظر میں بدلتے ہیں۔ کمپنی کہتی ہے کہ نظام بولتے ہوئے سن سکتا ہے، بیچ میں ٹوکے جانے پر رک سکتا ہے اور ہر بار گفتگو کا دور مکمل ہونے کا انتظار کیے بغیر بصری سیاق پر ردِعمل دے سکتا ہے۔ یہ Tavus کی تکنیکی وضاحتیں اور ڈیمو ہیں؛ BIG CHANGE نے پیش نظارہ تک رسائی حاصل نہیں کی اور نہ رویہ ناپا ہے۔
یہ فرق اس لیے اہم ہے کہ صرف چہرہ تیار کرنا پوری گفتگو نہیں۔ توقف، نگاہ اور بیچ میں مداخلت پر جواب دینے والا نظام اس بات کو بدل سکتا ہے کہ کال کرنے والے کو اپنی بات سمجھی ہوئی محسوس ہوتی ہے یا اسے احساس ہوتا ہے کہ دوسری طرف software ہے۔ VideoFDB کا نتیجہ بینچ مارک کے طریقے کے تحت گفتگو کے رویے کا عددی موازنہ دیتا ہے۔ Tavus کا انسانی کال مطالعہ اس سے محدود مشاہدہ ہے کہ لوگوں نے سامنے والے کی شناخت کے بارے میں کیا فیصلہ کیا۔ دونوں میں سے کوئی بھی طویل مدتی قابلِ اعتماد کارکردگی، حقیقی deployment میں انکشاف، یا صارفین کی باخبر رضامندی کے عوامی شواہد کا متبادل نہیں۔
رسائی اور آئندہ فیصلہ
Tavus کے مطابق Griffin-Lite کا تحقیقی پیش نظارہ صرف منتخب قابلِ اعتماد آزمائش کرنے والوں کے لیے کھلا ہے، عام Tavus صارفین کے لیے نہیں۔ کمپنی نے آزمائش کی درخواست کے لیے فارم دیا ہے۔ Griffin ابھی اس کے عمومی platform یا عوامی API پر نہیں ہے، اور اعلان میں Griffin کے لیے مخصوص قیمت نہیں دی گئی۔ Tavus کے موجودہ Phoenix، Raven اور Sparrow ماڈلز الگ موجودہ پروڈکٹ راستہ ہیں۔
کمپنی کا کہنا ہے کہ وسیع تر اجرا سے پہلے وہ AI ہونے کے انکشاف کی خصوصیات اور مزید حفاظتی طریقوں پر کام کر رہی ہے۔ اس نے تاریخ، انکشاف کے تفصیلی ڈیزائن یا ان اقدامات کی مؤثریت کے شواہد شائع نہیں کیے۔ حقیقی وقت کے ویڈیو ایجنٹ کا جائزہ لینے والوں کے لیے فوری سوال مخصوص ہے: کال کرنے والے کو کیسے معلوم ہوگا کہ دوسری طرف کون یا کیا ہے، اور Griffin کے صارفین کی پروڈکٹ بننے سے پہلے اس بات کی جانچ کیسے ہوگی؟
ذرائع اور مزید مطالعہ
- Tavus Research، “Introducing Griffin: The First Human Interaction Model”، یکم اکتوبر 2026۔ فراہم کنندہ کے نظام کی وضاحت، مطالعے کا طریقۂ کار اور نتائج، دستیابی اور حفاظت سے متعلق بیانات۔ دستیاب ذرائع میں انسانی کال مطالعے کی آزادانہ تکرار نہیں ملی۔
- NVIDIA اور David AI، “VideoFDB: Evaluating Full-Duplex Vision-Speech Capabilities in Conversational Agents”، 2 اکتوبر 2026 کو دیکھا گیا۔ بینچ مارک آپریٹر کا طریقۂ کار اور براہِ راست لیڈر بورڈ، بشمول Griffin-Lite کے generation اور perception اسکور۔ اس میں model-judge کے اسکور Tavus کے انسانی کال مطالعے سے الگ ہیں۔
- Ryan Merket، RuntimeWire، “Tavus says Griffin fooled 48% of testers in one-minute video calls”، یکم اکتوبر 2026۔ آزاد رپورٹ میں نمونے کی تعداد اور صارفین تک رسائی کا فرق درج ہے؛ یہ اپنی جانب سے تجربے کی تکرار یا Griffin کا hands-on test رپورٹ نہیں کرتی۔



