Volver al archivo
#ai#papers#aigen#robotics#training

Política de difusión

El robot tiene que rodear a una persona. Ambos caminos, el izquierdo y el derecho, pueden ser buenos, pero su media llevaría directamente al obstáculo. Necesitas un modelo capaz de proponer distintos comportamientos coherentes, no solo un movimiento promedio.

Diffusion policy determina las acciones transformando gradualmente una muestra de ruido en un plan que tiene en cuenta las observaciones. Una política es una forma de elegir acciones. Los sucesivos pasos de eliminación de ruido pueden producir una de varias secuencias posibles.

En el trabajo sobre planificación del movimiento entre multitudes, §3, el resultado es una lista breve de órdenes futuras de movimiento. El robot puede recibir un giro coherente en lugar de una mezcla de intenciones contradictorias.

Esto describe una capacidad de modelado, no garantiza una decisión segura. Varios pasos de eliminación de ruido cuestan más cálculos y la calidad depende de los datos y del objetivo de aprendizaje. Action chunk describe la secuencia de acciones generada independientemente del método usado para crearla.