OmniTools 7月28日消息,Kimi.ai 正式发布视觉感知基准 PerceptionBench。该基准基于当前前沿模型在 42 个现有基准上的失败模式归纳构建,旨在系统评估大模型的视觉感知能力。
PerceptionBench 将视觉感知细分为 10 种原子能力,涵盖形状识别、空间关系判断等基础维度,并配套构建 3000 道验证题目。每道题目仅考察单一感知能力,不依赖推理或外部知识。
该基准面向研究者开放,可用于模型能力诊断与技术迭代参考。
OmniTools 7月28日消息,Kimi.ai 正式发布视觉感知基准 PerceptionBench。该基准基于当前前沿模型在 42 个现有基准上的失败模式归纳构建,旨在系统评估大模型的视觉感知能力。
PerceptionBench 将视觉感知细分为 10 种原子能力,涵盖形状识别、空间关系判断等基础维度,并配套构建 3000 道验证题目。每道题目仅考察单一感知能力,不依赖推理或外部知识。
该基准面向研究者开放,可用于模型能力诊断与技术迭代参考。
从这条动态出发,继续查看相关分析、产品详情和同主题更新。
刚收录的 AI 工具,适合顺手发现可用产品。