先说结论
旷视科技是中国的AI视觉四小龙之一——跟商汤、云从、依图一起被称为CV四小龙。但2026年的旷视已经从「人脸识别公司」进化成了「物理世界AI智能体平台」。它的定位很清晰:不是做软件、不是做硬件、是做让AI在真实物理世界自己能看自己能动的完整链条——从相机拍到的画面→大模型理解→自主决策→自动执行。Brain++是它做了很多年的自研深度学习训练平台,2026年打通了训推一体的闭环——模型在生产环境里推理的时候发现的新Case能自动反哺到训练里,实现了真正的「越用越准」。零代码编排器让普通业务人员拖拽就能搭工业场景的AI技能——不用程序员介入。2026年还跟海光DCU深度适配,国产化方案整体性能提升150%。
2026年三个核心进展
物理世界AI智能体:旷视把AI定义为五个维度——自主感知、记忆、决策、执行、自进化。跟虚拟Agent不一样,旷视的智能体要直接操作物理世界的设备——摄像头转过去盯人、工业机器人改变姿势、告警系统触发报警并自动生成工单分配给特定人员。比如安全生产场景——AI盯着高空作业的工人有没有系安全绳、动火区域有没有可燃物——发现问题不需要人介入,自动告警自动分级自动推送工单。
E-ViC多模态推理:入选了2026年ACL顶会。以前的AI看一张图,得先把图「翻译」成文字(描述图片上有XX、XX大致在什么位置)然后交给大模型理解。E-ViC的思路倒过来——AI直接在图像的像素上做操作,画框、标坐标、绘路径。这种不经过文字「编译」的视觉推理在需要精确空间位置的场景上精度提升明显。
零代码编排+训推一体:拖拽搭AI技能,一次编排之后可以在不同工厂、不同产线直接复制用。模型在生产环境里跑的过程中不断拿新数据回来继续训→模型越用越准。
基本信息
| 工具名称 | 旷视科技 Megvii |
| 官网 | megvii.com |
| 核心平台 | Brain++ 2.0 自研深度学习平台 |
| 核心能力 | 物理世界AI智能体/零代码编排/端边云大小模型协同/训推一体化 |
| 2026标志 | ACL/ICML论文入选+国产方案提效150% |
| 核心场景 | 安全生产/智慧城市/工业质检/物流仓储 |
| 国产适配 | 海光DCU深度适配 |
相关导航
暂无评论...
