AI-translated from English; not yet reviewed by a fluent editor.

# آکسفورڈ کے مطابق، Bodleian کی ڈیجیٹلائزیشن بھی OpenAI کے تربیتی ڈیٹا میں حصہ ڈالتی ہے

> آکسفورڈ کے مطابق، Bodleian کی ڈیجیٹلائزیشن کا آزمائشی منصوبہ OpenAI کو تربیتی ڈیٹا فراہم کرتا ہے۔ عوامی منصوبہ ریکارڈ میں اسکیننگ اور نقلِ متن کی تفصیل ہے، مگر مواد یا استعمال کیے گئے ماڈلز کی نہیں۔

By BIG CHANGE Editorial

Published: 2026-09-27T01:10:31.965Z
Updated: 2026-09-27T01:10:31.965Z
Canonical: https://bigchange.ai/blog/oxford-bodleian-digitisation-openai-training-data

![An unidentified open bound volume rests in an archival cradle beneath a mounted document camera, with library shelves behind it.](https://bigchange.ai/api/media/file/oxford-bodleian-digitisation-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE.

آکسفورڈ نے OpenAI کے ساتھ اپنے کام کو عوامی ملکیت کے کتب خانہ مواد کو اسکین کرنے اور محققین کے لیے تلاش آسان بنانے کے طریقے کے طور پر پیش کیا ہے۔ [The Guardian نے 26 ستمبر کو رپورٹ کیا](https://www.theguardian.com/technology/2026/sep/26/oxford-university-bodleian-library-open-ai-chat-gpt) کہ یونیورسٹی کی داخلی دستاویزات میں ڈیجیٹلائز کیے گئے مواد کو OpenAI کے تربیتی مجموعے میں شامل کرنے میں مدد دینے کا ذکر ہے۔ آکسفورڈ کے ترجمان نے اخبار کو بتایا کہ عملہ اس بارے میں واضح رہا ہے کہ منصوبہ تربیتی ڈیٹا میں حصہ ڈالے گا۔ عوامی منصوبہ جاتی وضاحت اسکیننگ اور نقلِ متن کی تحقیق تفصیل سے بیان کرتی ہے، مگر اس دوسرے استعمال کی وضاحت نہیں کرتی۔

## بڑی تبدیلی: ڈیجیٹلائزیشن AI کی تربیت میں بھی کام آتی ہے

- **کیا بدلا:** The Guardian کی داخلی دستاویزات سے متعلق رپورٹ کے بعد آکسفورڈ نے عوامی ڈیجیٹلائزیشن کے آزمائشی منصوبے کے ساتھ تربیتی ڈیٹا کا مقصد بھی تسلیم کیا ہے۔ عوامی ریکارڈ اب بھی کسی ایسے ماڈل کی نشاندہی نہیں کرتا جس کی تربیت Bodleian کے مواد سے ہوئی ہو۔
- **یہ کیوں اہم ہے:** کتب خانے تلاش کے قابل ڈیجیٹل ذخیرے حاصل کر سکتے ہیں، جبکہ ٹیکنالوجی کا شراکت دار AI کی تیاری کے لیے مواد حاصل کر سکتا ہے۔ محققین اور عوام کو جاننے کی ضرورت ہے کہ کون سے مجموعے کس مقصد کے لیے استعمال ہو رہے ہیں تاکہ اس تبادلے کا جائزہ لیا جا سکے۔
- **کس بات پر نظر رکھیں:** آکسفورڈ کا کہنا ہے کہ اسکینز کے حقوق اس کے پاس رہیں گے اور ڈیجیٹلائز شدہ مواد کھلے طور پر شائع کرنے کا منصوبہ ہے۔ OpenAI کے ساتھ کیا مواد بانٹا گیا اور اسے کس تربیتی مقصد کے لیے استعمال کیا جا سکتا ہے، اس کی مجموعہ وار فہرست سے اس انتظام کا جائزہ لینا آسان ہوگا۔

## عوامی منصوبہ اسکیننگ اور نقلِ متن سے متعلق ہے

[آکسفورڈ کے مارچ 2025 کے اعلان](https://www.bodleian.ox.ac.uk/about/media/oxford-and-openai-launch) میں Bodleian کے عوامی ملکیت والے ایسے مواد کو ڈیجیٹلائز کرنے کے آزمائشی منصوبے کی وضاحت ہے جو آن لائن دستیاب نہیں تھا۔ اس میں دنیا بھر کے طلبہ اور محققین کے لیے تلاش اور رسائی ممکن بنانے کی غرض سے 1498 سے 1884 تک کے 3,500 عالمی مقالوں کا نام دیا گیا تھا۔ اس میں OpenAI کے تربیتی مجموعے کو منتقلی کا ذکر نہیں تھا۔

Bodleian کے [منصوبے کا صفحہ](https://www.bodleian.ox.ac.uk/node/4611321) کہتا ہے کہ آزمائشی منصوبہ فروری 2025 میں OpenAI کی مالی معاونت سے شروع ہوا۔ اس کے کام کے شعبوں میں اسکیننگ کے آلات اور طریقوں کی جانچ، یہ دیکھنا کہ آپٹیکل کریکٹر ریکگنیشن اور ہاتھ سے لکھی تحریر کی شناخت اسکینز سے متن کیسے نکالتی ہے، اور AI کی مدد سے میٹا ڈیٹا اور مجموعوں کی تلاش شامل ہیں۔ ان کاموں سے ڈیجیٹل تصاویر، نقل شدہ متن اور فہرست کے ریکارڈ تیار ہو سکتے ہیں۔ یہ جانچنا کہ کوئی نظام اسکین شدہ صفحہ پڑھ سکتا ہے، بذاتِ خود یہ ثابت نہیں کرتا کہ صفحہ یا اس کا نقل شدہ متن ماڈل کی تربیت کے ڈیٹا سیٹ میں شامل ہوا۔

Bodleian کے مطابق، اس نے اپنے Global Dissertations مجموعے سے تقریباً 125,000 تصاویر حاصل کی ہیں اور ہاتھ سے لکھے فہرستی کارڈز سے مزید 429,000 فائلیں بنائی ہیں۔ اس کا صفحہ مقالوں کے نمونے کو انیسویں اور بیسویں صدی کے یورپی اور امریکی پی ایچ ڈی کے مقالے قرار دیتا ہے؛ 2025 کے اعلان میں 1498 سے 1884 کے 3,500 مقالے بتائے گئے تھے۔ عوامی صفحات یہ واضح نہیں کرتے کہ یہ دونوں وضاحتیں اسکین یا منتقل کیے گئے مواد سے کیسے مطابقت رکھتی ہیں۔ یہ تعداد ڈیجیٹلائزیشن کے نتیجے میں تیار فائلیں بتاتی ہے، OpenAI کے تربیتی ڈیٹا کی شائع شدہ فہرست نہیں۔

## نئی رپورٹ کیا ثابت کرتی ہے

The Guardian کے مطابق، داخلی دستاویزات میں OpenAI کے ذریعے ڈیجیٹلائز کیے گئے Bodleian مواد کے لیے “OpenAI کے تربیتی مجموعے کو پُر کرنے” کی عبارت استعمال ہوئی ہے۔ اخبار یہ بھی رپورٹ کرتا ہے کہ جون 2025 تک تاریخی مقالوں کی 125,000 تصاویر OpenAI کے ساتھ بانٹی گئی تھیں، اور اسکین کیے گئے دیگر متون میں سولہویں صدی کے 10,000 بروڈسائیڈ گیت شامل تھے۔ رپورٹ یہ ثابت نہیں کرتی کہ اسکین کیے گئے تمام گیت تربیتی ڈیٹا بنے۔ اخبار کے مطابق، معلومات کی آزادی کی درخواست سے حاصل یونیورسٹی میٹنگ کے منٹس میں عملے کے کچھ افراد نے شراکت کے ساکھ اور ماحول پر ممکنہ اثرات کے خدشات درج کیے۔ جن داخلی دستاویزات کا ہم جائزہ لے سکے وہ دستیاب نہیں تھیں؛ اس لیے ان کی عین عبارت، تاریخیں اور The Guardian کے بیان سے آگے کا دائرہ یہاں غیر مصدقہ ہے۔

یونیورسٹی کے ترجمان نے The Guardian کو بتایا کہ ڈیجیٹلائز کیا جانے والا مواد حجم میں محدود، حقِ اشاعت سے آزاد اور OpenAI کے لیے غیر خصوصی بنیاد پر دستیاب تھا۔ ترجمان نے کہا کہ اسکینز کے حقوق Bodleian کے پاس رہے اور انہیں مہینوں کے اندر کھلے طور پر آن لائن شائع کرنے کا منصوبہ تھا۔ ترجمان نے اس تاثر کی بھی تردید کی کہ مشین لرننگ کے حصے کو چھپایا گیا؛ اخبار کو بتایا کہ عملہ یہ بات واضح کرتا رہا تھا کہ منصوبہ تربیتی ڈیٹا میں حصہ ڈالے گا۔ OpenAI نے The Guardian کو بتایا کہ اسے خوشی ہے کہ تاریخی علم کو AI ماڈلز میں شامل کرنے میں مدد دے رہا ہے؛ اس کا شائع شدہ [NextGenAI اعلان](https://openai.com/index/introducing-nextgenai/) Bodleian کے کام کو نایاب متون کی ڈیجیٹلائزیشن اور نقلِ متن کے لیے اپنی API کے استعمال کے طور پر بیان کرتا ہے۔

مجموعی طور پر رپورٹ اور آکسفورڈ کا جواب اس بات کی تائید کرتے ہیں کہ اس انتظام کا ایک حصہ تربیتی ڈیٹا میں شراکت ہے۔ ان سے یہ ثابت نہیں ہوتا کہ کون سے مجموعہ جاتی مواد کس ڈیٹا سیٹ میں رکھے گئے، تصاویر یا نقل شدہ متن استعمال ہوا، کسی خاص جاری شدہ ماڈل کی تربیت ان پر ہوئی، یا OpenAI کن شرائط کے تحت اسے دوبارہ استعمال کر سکتا ہے۔ کسی مخصوص ماڈل کی تربیت سے پہلے بھی تربیتی مجموعہ تیار کیا جا سکتا ہے۔ آکسفورڈ کی عوامی ڈیجیٹلائزیشن وضاحت اور OpenAI کا 2025 کا اعلان ان سوالات کا جواب نہیں دیتے۔

## تربیتی استعمال کی تفصیل کے لیے مزید ریکارڈ درکار ہیں

آکسفورڈ کے منصوبے کا صفحہ کہتا ہے کہ ٹیم نے اپنے پانچ کام کے شعبوں میں سے ہر ایک پر کھلی رسائی کی رپورٹیں شائع کرنے کا منصوبہ بنایا تھا۔ ایسی رپورٹ یا مجموعہ وار فہرست جو OpenAI کو فراہم کردہ مواد کے نام اور اس کے مجاز تربیتی استعمال بتائے، محققین کو عوامی رسائی کے فائدے کا کمپنی کو دیے گئے ڈیٹا کے ساتھ موازنہ کرنے دے گی۔ اس وقت تک اس دوسرے استعمال کی واضح ترین تفصیل The Guardian کی دستاویزات پر مبنی رپورٹ اور آکسفورڈ و OpenAI کے جوابات ہیں۔

## ماخذ اور مزید مطالعہ

The Guardian کی [26 ستمبر 2026 کی تحقیقات](https://www.theguardian.com/technology/2026/sep/26/oxford-university-bodleian-library-open-ai-chat-gpt) داخلی دستاویزات سے متعلق دعوے، مقالوں کی تصاویر شیئر ہونے کی رپورٹ، میٹنگ کے منٹس میں درج خدشات، اور آکسفورڈ و OpenAI کے جوابات کا ماخذ ہیں۔ بنیادی داخلی دستاویزات آزادانہ معائنے کے لیے دستیاب نہیں تھیں۔

[آکسفورڈ کا 4 مارچ 2025 کا اشتراک سے متعلق اعلان](https://www.bodleian.ox.ac.uk/about/media/oxford-and-openai-launch) عوامی ملکیت والے مواد کے آزمائشی منصوبے اور محققین کو اس کی مجوزہ رسائی کی وضاحت کرتا ہے۔ اس میں OpenAI کے ماڈل کی تربیت کے استعمال کی تفصیل نہیں۔

Bodleian Digitisation Research [منصوبے کا صفحہ](https://www.bodleian.ox.ac.uk/node/4611321) آزمائشی منصوبے کے کام کے شعبوں اور تصاویر کی تعداد کی تفصیل دیتا ہے۔ اس کے اعداد اسکیننگ کے نتائج بتاتے ہیں؛ صفحہ کسی تربیتی ڈیٹا سیٹ یا اس پر تربیت یافتہ ماڈل کی نشاندہی نہیں کرتا۔

[OpenAI کا 4 مارچ 2025 کا NextGenAI اعلان](https://openai.com/index/introducing-nextgenai/) Bodleian میں ڈیجیٹلائزیشن اور API کے ذریعے نقلِ متن بیان کرتا ہے۔ اس میں تربیتی مجموعے کے مواد یا اس اسکین شدہ مواد پر تربیت یافتہ ماڈل کی شناخت نہیں۔

## Sources

- [The Guardian: آکسفورڈ OpenAI کو Bodleian Library پر اپنے AI ماڈلز کی تربیت کی اجازت دیتا ہے](https://www.theguardian.com/technology/2026/sep/26/oxford-university-bodleian-library-open-ai-chat-gpt) — 26 ستمبر 2026 کی اصل رپورٹ میں داخلی دستاویزات اور یونیورسٹی میٹنگ منٹس کا ذکر ہے؛ اس میں آکسفورڈ اور OpenAI کے جوابات بھی شامل ہیں۔ بنیادی داخلی دستاویزات آزادانہ معائنے کے لیے دستیاب نہیں تھیں، اس لیے تربیتی مجموعے کی عبارت اور مواد کے اشتراک کی تفصیل The Guardian سے منسوب ہے۔
- [آکسفورڈ اور OpenAI نے تحقیق و تعلیم کو آگے بڑھانے کے لیے اشتراک شروع کیا](https://www.bodleian.ox.ac.uk/about/media/oxford-and-openai-launch) — آکسفورڈ کے 4 مارچ 2025 کے اعلان میں عوامی ملکیت والے Bodleian مواد کی ڈیجیٹلائزیشن، محققین کو مطلوبہ رسائی اور مقالوں کا ابتدائی مجموعہ بیان ہے۔ اس میں تربیتی ڈیٹا کے استعمال کی وضاحت نہیں۔
- [Bodleian Digitisation Research منصوبہ](https://www.bodleian.ox.ac.uk/node/4611321) — Bodleian کا عوامی منصوبہ جاتی صفحہ اسکیننگ، OCR/HTR، میٹا ڈیٹا اور مواد دریافت کرنے کے کام کے شعبے، اور تصاویر کی تعداد بیان کرتا ہے۔ یہ ڈیجیٹلائزیشن سے تیار مواد ہے، OpenAI کے تربیتی مواد کی شائع شدہ فہرست نہیں۔
- [OpenAI: NextGenAI متعارف کرایا جا رہا ہے](https://openai.com/index/introducing-nextgenai/) — OpenAI کے 4 مارچ 2025 کے اعلان میں Bodleian کی ڈیجیٹلائزیشن اور اپنی API سے نقلِ متن کا ذکر ہے۔ یہ کسی تربیتی مجموعے یا اس مواد پر تربیت یافتہ ماڈل کی شناخت نہیں کرتا۔
