CF-VLA Optimizes Vision-Language-Action Policies via Two-Stage Generation
September 1, 2026
CF-VLA improves flow-based VLA policy efficiency by replacing multi-step noise recovery with a coarse-to-fine two-stage process. It uses a coarse initialization step to create an action-aware starting point followed by a single-step local refinement.
HOW THIS AFFECTS YOU
●
builderThis enables more efficient real-time action generation for robotics without sacrificing policy quality.
●
researcherThe coarse-to-fine formulation offers a more efficient alternative to standard multi-step flow-based sampling.