Os modelos de Visão-Linguagem-Ação (VLA) estão transformando a robótica ao permitir que humanoides processem percepção sensorial e execução motora de…