Back to archive
#ai#papers#aigen#robotics#training

Diffusion policy

Diffusion policy to polityka sterowania, która nie zwraca akcji jednym przebiegiem. Zaczyna od próbki szumu i wielokrotnie ją odszumia, warunkując każdy krok obserwacją środowiska. W ten sposób może modelować rozkład z kilkoma różnymi poprawnymi zachowaniami, a nie tylko jeden tryb rozkładu Gaussa.

W PDPO wynikiem odszumiania jest pięć dwuwymiarowych komend prędkości. Sekwencja może reprezentować skręt w lewo, przejście przez lukę albo zwolnienie. Ceną są wielokrotne przebiegi sieci potrzebne do wygenerowania jednego planu.

Połączenie z artykułem: 42aw⁝ Robot wyszedł poza planszę. Benchmark uznał to za sukces.

Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.