跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 2 天前AI 评分53

GPT-6 Astra 跨计算机视觉评测揭示通用模型的能力边界

Hard Vision, Easy Vision: What GPT-6 Astra Reveals Across Computer Vision

AI 导读

该论文在 9 个领域、34 项能力和 55 个基准上评测 GPT-6 Astra 及五个前沿通用 AI 系统,并与专用模型和人类参考水平比较。Astra 在视觉与空间推理及多种结构化预测上显著领先其他系统;语义解释、推理和以物体为中心的预测接近或达到参考水平,但在度量几何精度、忠实重建、时序一致的密集预测和细粒度专业知识上仍有较大差距,附加推理与专用工具只能弥合部分缺口。

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org