英伟达VSS蓝图3.3降低视觉AI智能体开发与运行成本
英伟达正式发布视频搜索与摘要蓝图VSS 3.3,旨在降低视觉AI智能体的构建与运营成本。该产品深度整合Cosmos视觉语言模型、Nemotron大语言模型及检索增强生成技术,将实时视频流转化为自然语言搜索、视觉问答与自动化报告。针对视觉AI部署长期面临的开发与运维高耗难题,VSS 3.3推出两项核心架构升级。开发端新增构建视觉智能体技能,开发者仅需输入自然语言提示,系统即可基于四大已验证开发基座自动生成部署方案,智能收敛并共享Kafka、Redis等中间件与存储资源,实现30分钟内从需求到可运行环境的快速闭环。运行端则引入自适应高效视频采样技术,通过精准识别画面突变点,剔除冗余静止帧,使视觉语言模型输入令牌骤降80%,在同等GPU算力下并发流处理能力提升46%。结合10月1日线上技术演示中的灌装线场景验证,该方案成功实现溢瓶检测、警报复核与班次报告生成的全自动化。此次迭代大幅压缩了从概念验证到生产部署的工程周期,为工业仓储与智慧城市等领域的视觉AI规模化应用提供了低成本、高兼容的标准化架构。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
