打破黑盒猜想:大模型通往真正「空间智能」的破局之路
给模型做一次脑部“CT”,低成本重塑真实空间智能。 作者丨张 璐 编辑丨幸丽娟 先来看一道简单的多模态大模型视觉考题:观察给出的几张室内多视角照片,请回答:从图 1 的视角来看,蓝色椅面的办公椅右边是什么?A. 单人沙发以及旁边的一张小桌子B. 摆着微波炉的桌子C. 小厨房D. 蓝色垃圾桶Qwen2.5-VL-7B精准选择了正确答案 A;LLaVA-OneVision-8B却选了 D。按照以往的习惯,我们大概率会把原因归咎于模型在做多视角坐标转换时逻辑迷航了,或者它的空间推理能力不够,把左右相对位置搞混了。但中山大学团队却在论文《SpatialSV: Internalizi
原文:雷峰网