На догађају Fellows Forum, 23. септембра, Борис Пауер, директор примењених истраживања у OpenAI-ју, проценио је да се 80–90% истраживања компаније усмерава на „GPT-7, GPT-8 и касније генерације“. Ту процену је изнео објашњавајући како OpenAI усклађује рад на актуелним производима са истраживањима способнијих модела. То је његова процена из јавног разговора; OpenAI није објавио расподелу истраживања са којом би се она могла упоредити.

Суштинска промена

  • Шта се променило: Пауер је описао два повезана правца рада: побољшање модела које људи већ користе и истраживање усмерено на будуће генерације. Проценио је да ово друго чини већи део истраживања OpenAI-ја.
  • Зашто је то важно: Снажнији велики модел може да да примере за обучавање мањег и јефтинијег модела за одређени задатак. Зато програмере занимају најнапреднија истраживања чак и када у својим производима користе мање моделе.
  • Шта треба пратити: Будућа издања модела и техничка објављивања могу да покажу да ли се напредак великих модела преноси на мање. У интервјуу нису наведени датуми издања, спецификације нити резултати за GPT-7 или GPT-8.

Контекст Пауерове процене

Пауер је одговарао на питање Закарија Липтона о томе како захтеви корисника утичу на истраживања. Рекао је да OpenAI може да побољша одређено понашање, попут употребе алата, помоћу специјализованих података за обучавање и примењених истраживања. Према његовом објашњењу, такве потребе се често решавају постепеним ажурирањима у оквиру једне генерације модела. Тврдио је да нова генерација већих модела може да промени које су специјализоване дораде и даље потребне. Неке садашње инвестиције описао је као начин да се већ данас брже учи и напредује, чак и ако нису део дугорочне стратегије.

Та разлика је довела до Пауерове процене од 80–90% која се чује на снимку форума Fellows Forum у 1:32:52. Пауер је говорио о истраживањима у OpenAI-ју, а не само у свом тиму. Ни снимак ни објављени материјали OpenAI-ја не наводе шта се тачно рачуна као истраживање, на који се период процена односи, нити буџет, број запослених или начин израчунавања. Зато број треба разумети као Пауеров опис приоритета, а не као ревидирану меру потрошње или броја запослених.

Пауер је GPT-7 и GPT-8 навео као примере будућих генерација. Није најавио ниједан од тих модела, открио фазу развоја нити дао распоред издавања. Актуелни каталог модела OpenAI-ја наводи GPT-6 Astra, Sol и Luna. Он пружа јавни контекст за називе које је Пауер поменуо, али не даје доказе о стању будућих генерација.

Зашто је поменуо дестилацију

Непосредно после процене, Пауер је описао како велики модел GPT-6 Astra обучава мањи модел GPT Luna. Поента му је била да снажан велики модел може да обезбеди примере за обучавање мањег модела. Објашњавао је истраживачки приступ, а није документовао да је неки конкретан објављени модел Luna обучен помоћу модела Astra.

Упутство OpenAI-ја за надгледано фино подешавање описује тај поступак. Програмер најпре проверава да ли већи модел добро обавља одређени задатак, издваја одговарајуће излазе, користи их као примере за обучавање мањег модела, а затим процењује мањи модел на том задатку. OpenAI наводи да се тако учинак мањег модела може приближити учинку већег на одређеном задатку. То не значи да мањи модел наслеђује све способности модела који га је обучавао. И објава OpenAI-ја о дестилацији модела описује евалуацију, прикупљене излазе и фино подешавање као итеративан поступак.

Идеја има дужу историју. У научном раду из 2015. године Џефри Хинтон, Ориол Винјалс и Џеф Дин проучавали су пренос знања из већих система у модел који је лакше применити. Тај рад објашњава концепт наставника и ученика; не говори ништа о томе како OpenAI тренутно распоређује истраживачке ресурсе.

Ово објашњава везу коју је Пауер повукао између најнапреднијих истраживања и практичних модела. Способнији модел-наставник може да створи користан материјал за обучавање мањих система усмерених на одређене задатке и јефтинијих за рад. Успех зависи од задатка, избора примера и евалуације. Пауер није изнео резултате дестилације нити упоредна мерења за пример Astra–Luna.

Пауерова процена је значајна јер показује његово виђење тога где OpenAI очекује највећу истраживачку вредност. Јавни докази потврђују његову изјаву и општу технику коју је поменуо. Они не откривају како OpenAI заправо распоређује ресурсе нити шта ће донети нека будућа генерација GPT модела.