Diversity-Driven RL Fine-Tuning for VLA Generalization
An analysis of reinforcement learning fine-tuning for vision-language-action policies reveals how exploration dynamics impact generalization performance.
An analysis of reinforcement learning fine-tuning for vision-language-action policies reveals how exploration dynamics impact generalization performance.