跳到正文
中文资讯检索 · AI与大模型·· 8 小时前AI 评分18

看懂不等于做对:VA-Bench 测出大模型空间智能的执行断层

看懂不等于做对:VA-Bench测出大模型空间智能的执行断层|GPT-5.6 Sol|Qwen 3|机械臂|GPT-6|Qwen3.8_手机新浪网 - finance.sina.cn

AI 导读

VA-Bench 评测显示大模型在空间智能上存在“看懂不等于做对”的执行断层。相关测试涉及 GPT-5.6 Sol、Qwen 3、Qwen3.8、GPT-6 等模型及机械臂应用场景。

来源:中文资讯检索 · AI与大模型 · news.google.com