OmniTools 6月30日消息,NVIDIA官方博客发布面向视觉AI智能体(Vision AI Agent)的三类可复用开发工作流,旨在提升其在工厂、城市、仓储及交通等边缘场景中的识别准确率。该方案整合NVIDIA Metropolis、Omniverse及Cosmos技术栈,覆盖缺陷图像生成、视频数据增强与模型微调等关键环节。
针对制造业真实缺陷样本稀缺的痛点,NVIDIA Defect Image Generation技能结合Cosmos基础模型,可在仅8张实拍缺陷图基础上生成高质量合成数据。与康宁(Corning)合作的基准测试显示,该方案使模型平均精度达95%,最难缺陷类召回率达100%,将原本需数季度完成的质检模型迭代压缩至数天。
在智慧城市与工业运营场景中,Linker Vision与富士康(Foxconn)分别采用NVIDIA VSS(视频搜索与摘要)蓝图和Live SOP验证智能体,实现开发效率提升85%、事件响应时间缩短80%,并在GB300服务器产线达成99%关键操作步骤识别准确率。