OpenAI је 5. октобра најавио textGrain, невидљиви водени жиг који мења статистички образац речи које његови модели бирају. Компанија каже да почиње постепено увођење као одговор на правила ЕУ о пореклу текста. Одговарајући детектор може да тражи тај образац у одломку, али резултат пружа само ограничену назнаку о томе да ли је OpenAI систем генерисао или обрадио текст.
Шта се суштински мења
- Шта се променило: OpenAI прелази са истраживања порекла текста на ограничено пуштање у употребу. Подобни излази ChatGPT-а и Codex-а у ЕУ добиће водени жиг током наредних недеља; одабрани корисници API-ја већ сада могу да га укључе широм света.
- Зашто је важно: Организације које процењују текст генерисан вештачком интелигенцијом можда ће у будућности имати сигнал уграђен у саму формулацију. Објављени резултати OpenAI-ја показују зашто резултату детектора треба контекст: кратки или строго ограничени одломци и измењени текст могу да измакну детекцији, а могући су и лажно позитивни резултати.
- Шта треба пратити: Прво ће се испитати колико поуздано сигнал опстаје у уобичајеној употреби, кроз различите дужине текста, теме и језике. OpenAI ограничава приступ детектору на одобрене истраживаче и стручне организације док процењује та ограничења.
Два начина увођења, различит приступ
OpenAI каже да ће током наредних недеља додати textGrain у текстуалне излазе ChatGPT-а и Codex-а који испуњавају услове на свим плановима у Европској унији. То је планирано регионално увођење, а не тврдња да сваки одговор у ЕУ већ данас носи водени жиг. За API корисници широм света могу да га укључе за одабране моделе од 5. октобра; водени жиг је подразумевано искључен. OpenAI каже да корисници могу да га укључе у подешавањима пројекта или организације и изаберу подржане моделе. Списак подобних модела налази се у тим подешавањима и може да се мења.
TextGrain функционише тако што модел бира међу могућим речима или деловима речи, који се називају токени. OpenAI каже да тајни кључ усмерава незнатне промене тих избора током генерисања. Детектор са одговарајућим кључем и подешавањима затим проверава да ли одломак садржи настали статистички образац. Водени жиг не додаје скривене знакове, размаке ни видљиве знаке интерпункције. Зато за копирање текста није потребно преносити засебне метаподатке, али ни очување непромењених речи не гарантује да сигнал може да се открије.
Та разлика такође ограничава ко може да провери одломак. OpenAI прима пријаве за приступ детектору текста, у почетку од одобрених истраживача и стручних организација. При покретању га неће отворити за јавност. Његови јавни алати за проверу подржаних слика и звука одвојени су и не омогућавају отворену проверу textGrain-а.
Сигнал може да измакне детекцији или да буде погрешно утврђен
OpenAI наводи стопе детекције при циљаној стопи лажно позитивних резултата од 1% у једној процени. Код психолошких текстова детектор је пронашао водени жиг у око 80% узорака од 200 токена и око 95% узорака од 400 токена. Компанија каже да је детекција била знатно слабија код математике, где је мања слобода у формулацији. То су резултати процене компаније у задатим условима, а не измерена стопа успешности за текстове на које се наилази у стварном свету.
У другом тесту компаније на одломцима од 400 токена, измене су ослабиле сигнал: замена 10% речи синонимима снизила је детекцију са око 92% на 66%, а замена 25% на 17%. Документација OpenAI-ја наводи и превођење, опсежно парафразирање, кратке одговоре и код као тежа подручја за детекцију. Компанија каже да се детекција разликује по језику. Зато негативан резултат не доказује да је текст написала особа. Одломак може бити прекратак, измењен, настао пре увођења функције или га може генерисати модел или производ који водени жиг не покрива.
И позитиван резултат има ограничења. Детектор може погрешно да пријави водени жиг. Ако пронађе сигнал, OpenAI каже да је то доказ да је његов систем вероватно генерисао или обрадио бар део одломка. Резултат не мери колико је нека особа допринела, не открива налог или упит, нити утврђује ко је написао текст, коме он припада или ко за њега одговара. Не може да провери да ли је одломак тачан. Сам резултат не открива особу која је користила алат.
OpenAI планира даља испитивања и каже да намерава да објави textGrain као технологију отвореног кода. За сада је практична промена ужег обима: део новог текста генерисаног системима OpenAI-ја садржаће сигнал читљив машинама, док су начин провере и закључци које сигнал подржава и даље ограничени. Наш извештај заснива се на најави и документацији за помоћ OpenAI-ја; BIG CHANGE није генерисао текст са воденим жигом нити покретао детектор.



