VLA 模型的語意理解可能是假的
RoboSemanticBench 用一個刁鑽設計戳破盲點:讓機器人先答對數學或常識題,才能抓到對應方塊。
RoboSemanticBench 用一個刁鑽設計戳破盲點:讓機器人先答對數學或常識題,才能抓到對應方塊。結果多數 VLA 策略根本靠視覺捷徑過關,不是真的在做語意推理。對 embodied AI 團隊的啟示很直接:評測設計若能被捷徑繞過,你量的不是能力,是運氣。
本文由 DeltaMedia 編輯團隊審核後發布 · 編輯原則
RoboSemanticBench 用一個刁鑽設計戳破盲點:讓機器人先答對數學或常識題,才能抓到對應方塊。
RoboSemanticBench 用一個刁鑽設計戳破盲點:讓機器人先答對數學或常識題,才能抓到對應方塊。結果多數 VLA 策略根本靠視覺捷徑過關,不是真的在做語意推理。對 embodied AI 團隊的啟示很直接:評測設計若能被捷徑繞過,你量的不是能力,是運氣。