Teaching Vision-Language-Action Models What to See and Where to Look 文章

ArXiv CS.CV2026-07-03PAPERen作者: Yuguang Yang, Canyu Chen, Zhewen Tan, Yizhi Wang, Zichao Feng, Chunyang Liu, Kehua Sheng, Juan Zhang, Linlin Yang, Baochang Zhang, Yan Wang, Bo Zhang, Xianbin Cao

Teaching Vision-Language-Action Models What to See and Where to Look · 相关技术