SVET NE STOJI U MESTU.RSS
BIG CHANGE.

Markdown izdanje

AI-translated from English; not yet reviewed by a fluent editor.

# GPT-Policy testira kontekst u zadacima sa robotskom rukom i mobilnim istraživanjem

> Septembarski preprint opisuje zadatak mobilnog istraživanja sa tri probe, uz eksperimente sa robotskom rukom. Ne potvrđuje zasebnu tvrdnju sa Reddita o GPT-6 Astra i robotu Unitree G1.

By BIG CHANGE Editorial

Published: 2026-09-27T06:11:48.387Z
Updated: 2026-09-27T06:11:48.387Z
Canonical: https://bigchange.ai/blog/gpt-policy-robot-learning-vlm-agents

![A conceptual robot arm reaches toward a bottle cap on a workbench beneath a mounted camera.](https://bigchange.ai/api/media/file/gpt-policy-robot-arm-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE.

Septembarski [arXiv preprint „In-Context Robot Learning with VLM Agents“](https://arxiv.org/html/2609.19138v1) predstavlja GPT-Policy, koji povezuje fiksni vizuelno-jezički model sa robotskim alatima pomoću demonstracija, slika i istorije interakcija. Eksperimenti obuhvataju zadatke sa robotskom rukom i mobilno istraživanje. Ne potvrđuju zasebnu tvrdnju u [objavi na Redditu o GPT-6 Astra i robotu Unitree G1](https://www.reddit.com/r/singularity/s/tjaYXdzfnI).

## Suštinska promena

- **Šta se promenilo:** GPT-Policy daje opštem vizuelno-jezičkom modelu strukturisan način da demonstracije i aktuelni prikaz kamere pretvori u zahteve za robotske alate, pa da na osnovu povratnih informacija o izvršavanju izabere sledeću radnju bez ažuriranja težina modela za konkretan zadatak.
- **Zašto je to važno:** Ovaj pristup razdvaja opšte vizuelno rezonovanje od provera kretanja i izvršavanja. U ograničenom broju proba autora, dodatni kontekst pomogao je u nekim zadacima, dok su za radnje osetljive na kontakt ponekad bile potrebne usklađene reference robotskih pokreta.
- **Na šta obratiti pažnju:** U radu se navode samo tri probe po uslovu i opisuju spora izvršavanja sklona greškama, uključujući sudare robotskih ruku. Pre nego što ti rezultati mnogo govore o radu robota u blizini ljudi, važni su ponavljanje eksperimenta, veće evaluacije i nezavisne bezbednosne kontrole.

## Šta radi GPT-Policy

Rad je predat na arXiv 16. septembra. Postavlja pitanje da li opšti vizuelno-jezički model može da koristi primere i povratne informacije za obavljanje zadatka iz novog početnog stanja, bez finog podešavanja ili izmene parametara modela za taj zadatak. Autori svoj okvir nazivaju GPT-Policy i navode GPT-6 Astra među modelima koje su evaluirali.

Sistem objedinjuje više vrsta konteksta: uputstvo za zadatak, trenutni prikaz kamere i stanje, kao i opcione video-demonstracije ljudi, robotske demonstracije sa referentnim radnjama, ciljnu sliku, prethodne pokušaje robota ili ljudsku interakciju. Kompajler konteksta bira vizuelne prelaze važne za zadatak i kombinuje ih sa uputstvima, ograničenjima i šemama alata. Vizuelno-jezički model zatim predlaže strukturisani zahtev za robotski alat.

Taj zahtev prosleđuje se kontroleru prilagođenom konkretnom telu robota. Autori opisuju proveru rešenja inverzne kinematike, uzorkovanje Dekartovih poza i vremensko usklađivanje referenci zglobova pre izvršavanja ili odbacivanja pokreta. Kontroler vraća opažanja i povratne informacije o izvršavanju za sledeću odluku modela. Model predlaže radnje, a kod za konkretan robot ih proverava i izvršava.

Ova povratna sprega glavni je doprinos rada. Ona omogućava fiksnom vizuelno-jezičkom modelu da prilagodi sledeću radnju primerima i nedavnim ishodima, bez ažuriranja gradijentima. „Učenje u kontekstu“ ovde opisuje način na koji sistem koristi informacije dostavljene tokom zadatka. To ne znači da je model trajno naučio novu veštinu niti da svaki robot može da koristi isti interfejs alata.

## Šta su probe merile

Autori izveštavaju o pet grupa eksperimenata u deset zadataka sa robotima, uz tri probe po uslovu. Na njihovoj [stranici projekta](https://cheng-haha.github.io/GPT-Policy/) navedena su testiranja na pravim robotima, ishodi zadataka, odluke i proteklo vreme. Pri podizanju peškira GPT-6 Astra je uspeo u dve od tri probe uz ljudski video-snimak, a ni u jednoj od tri bez njega. I kod podizanja sveske rezultat se promenio sa nula uspeha od tri bez demonstracije na dva od tri uz demonstraciju.

Zadaci koji uključuju kontakt pokazuju zašto dodatni kontekst nije opšte rešenje. Pri odvrtanju čepa boce, video-snimak robota doneo je dva uspeha u tri probe, dok su uz dodavanje usklađenih robotskih radnji uspela sva tri pokušaja. Pri vađenju i ponovnom uključivanju utikača, nije bilo uspeha u tri probe samo sa videom, dok su video i reference radnji zajedno doneli dva uspeha. To su mali brojevi po uslovima, a ne procene pouzdanosti.

Projekat takođe navodi tri uspeha u tri probe za raspored blokova i voća prema ciljnoj slici i za dva zadatka sa ljudskom interakcijom. Uz istoriju sopstvenih interakcija, u radu se navode tri uspeha u tri probe i za zadatke „Limun na roze tanjiru“ i „Mobilno istraživanje“. U drugom zadatku robot je aktivno izbegavao prepreke dok je tražio cilj; prosečno proteklo vreme iznosilo je 25,53 minuta. Na slici 1 prikazano je i preuzimanje pokretnog predmeta. Ovi rezultati proširuju obuhvat rada izvan manipulacije na stolu, ali se i dalje odnose na odabrane zadatke sa tri probe po uslovu. Probe su trajale po nekoliko minuta: na stranici projekta navodi se prosečno 18,9 minuta za podizanje peškira uz ljudski video-snimak i 17,9 minuta za zadatak sa čepom uz video i reference radnji. Latencija i operativni troškovi zato ostaju praktična pitanja, a ne rešeni detalji.

U dodatku B se među opisanim konfiguracijama robota u radu navode Morphi Kino, YAM i ARX X5. Za Morphi Kino navodi se da ima mobilnu osnovu, struk i glavu, kao i dve ruke sa po sedam zglobova. Rad zato pored robotskih ruku obuhvata i konfiguraciju mobilne platforme; u dodatku se ne pominje Unitree G1.

## Mobilni zadatak iz rada ne potvrđuje scenario sa Reddita

U [objavi na Redditu](https://www.reddit.com/r/singularity/s/tjaYXdzfnI) tvrdi se da GPT-6 Astra upravlja robotom Unitree G1 u nepoznatoj prostoriji, pamti gde se nalaze predmeti i kasnije ih donosi na osnovu neodređenih zahteva. U radu se opisuje zaseban zadatak „Mobilno istraživanje“ i navodi da Morphi Kino ima mobilnu osnovu, ali ni u radu ni u materijalima projekta ni u [javnom repozitorijumu na GitHub-u](https://github.com/cheng-haha/GPT-Policy) ne navodi se da je GPT-Policy testiran u scenariju sa robotom G1 iz objave na Redditu. Objava ostaje zasebna, nepotvrđena tvrdnja; ovo poređenje je ne opovrgava.

Na [stranici projekta autora](https://cheng-haha.github.io/GPT-Policy/) nalaze se video-snimci eksperimenata, koji su dokaz o zadacima o kojima autori izveštavaju, a ne nezavisna potvrda. U javnom [repozitorijumu koda](https://github.com/cheng-haha/GPT-Policy) trenutno se navode adapteri za ARX X5 i I2RT/YAM, a piše i da javno stablo ne obuhvata servere za primenu, privatne upite, snimke izvršavanja, kalibraciju za konkretnu lokaciju niti istoriju evaluacija. Spisak adaptera opisuje objavljeni repozitorijum, a ne pun obuhvat rada, u kome se takođe opisuje mobilno istraživanje i navodi Morphi Kino u dodatku B. Dostupni materijali nisu dovoljni da BIG CHANGE ponovi prijavljene probe; nismo testirali robota.

## Granica kontrole i dalje je važna

Na stranici projekta navode se dugački nizovi radnji i teškoće pri izvršavanju. U raspravi se kaže da su uočeni sudari između robotskih ruku pokazali da postojeće zaštitne mere nisu dovoljne za bezbednu autonomnu primenu. Autori pozivaju na nezavisno praćenje fizičkog rastojanja i kontakta, uz bržu kontrolu na niskom nivou i bezbedniji oporavak od grešaka. To što kontroler odbacuje neke neispravne pokrete samo po sebi ne znači da predstavlja potpun bezbednosni sistem.

Studija daje konkretan istraživački rezultat: kontekst može da pomogne opštem vizuelno-jezičkom modelu da usmerava robotske alate u određenim zadacima, a vrsta konteksta je važna. Mali obim evaluacije, trajanje proba, nepotpuni javni materijali za ponavljanje i prijavljeni sudari daleko su od dokaza da kućni humanoidni robot pouzdano razume i izvršava otvorene zahteve.

## Izvori i dodatna literatura

- [Cheng i dr., „In-Context Robot Learning with VLM Agents“ (arXiv:2609.19138, verzija 1, predato 16. septembra 2026.)](https://arxiv.org/abs/2609.19138) — primarni preprint o metodi, evaluaciji i navedenim ograničenjima; nije recenzirani dokaz niti izveštaj o primeni.
- [Stranica projekta GPT-Policy autora](https://cheng-haha.github.io/GPT-Policy/) — opisi eksperimenata, snimci, rezultati po uslovima i rasprava. Reč je o materijalima samih autora.
- [Javni repozitorijum koda GPT-Policy-ja autora](https://github.com/cheng-haha/GPT-Policy) — dokumentuje trenutno objavljene adaptere za robotske ruke i ono što nije dostupno u javnom stablu; sama dostupnost repozitorijuma ne dokazuje da se prijavljeni eksperiment može ponoviti.
- [Objava na Redditu koja je podstakla ovaj izveštaj](https://www.reddit.com/r/singularity/s/tjaYXdzfnI) — izvor tvrdnje o robotu Unitree G1; u objavi se ne navode dokazi koji povezuju taj scenario sa radom.

## Sources

- [Cheng i dr., In-Context Robot Learning with VLM Agents, arXiv:2609.19138, verzija 1](https://arxiv.org/abs/2609.19138) — Primarni preprint, predat 16. septembra; opisuje predloženu metodu GPT-Policy i izveštava o evaluaciji i ograničenjima autora. Nije prošao stručnu recenziju i ne predstavlja dokaz o primeni.
- [Stranica projekta GPT-Policy autora](https://cheng-haha.github.io/GPT-Policy/) — Primarni materijali autora za opis sistema, eksperimente, tabele rezultata, video-snimke i raspravu; nisu nezavisna potvrda.
- [Javni repozitorijum koda GPT-Policy-ja autora](https://github.com/cheng-haha/GPT-Policy) — Primarni dokaz o objavljenim adapterima i sadržaju i izostavljenim delovima repozitorijuma; ne pruža sve podatke o kalibraciji, upitima i istoriji evaluacije potrebne za neposredno ponavljanje.
- [Objava na Redditu u kojoj se tvrdi da GPT-6 Astra upravlja robotom Unitree G1 u nepoznatoj prostoriji](https://www.reddit.com/r/singularity/s/tjaYXdzfnI) — Izvor viralne tvrdnje koja se proverava; nije dokaz da su rad ili navedene platforme sa robotskim rukama izveli opisani scenario.
Bilten BIG CHANGE

Šira slika. Vašim tempom.

Nedavne priče o veštačkoj inteligenciji i robotici, promene vredne praćenja i praktične ideje za primenu. Izaberite dnevni pregled, nedeljni sažetak ili mesečnu perspektivu.