旷视科技
中国
📸 AI图像处理

旷视科技

AI视觉国家队,物理世界智能体能看会动。零代码编排+训推一体越用越准。国产芯片适配提效150%。

标签:

先说结论

旷视科技是中国的AI视觉四小龙之一——跟商汤、云从、依图一起被称为CV四小龙。但2026年的旷视已经从「人脸识别公司」进化成了「物理世界AI智能体平台」。它的定位很清晰:不是做软件、不是做硬件、是做让AI在真实物理世界自己能看自己能动的完整链条——从相机拍到的画面→大模型理解→自主决策→自动执行。Brain++是它做了很多年的自研深度学习训练平台,2026年打通了训推一体的闭环——模型在生产环境里推理的时候发现的新Case能自动反哺到训练里,实现了真正的「越用越准」。零代码编排器让普通业务人员拖拽就能搭工业场景的AI技能——不用程序员介入。2026年还跟海光DCU深度适配,国产化方案整体性能提升150%。

2026年三个核心进展

物理世界AI智能体:旷视把AI定义为五个维度——自主感知、记忆、决策、执行、自进化。跟虚拟Agent不一样,旷视的智能体要直接操作物理世界的设备——摄像头转过去盯人、工业机器人改变姿势、告警系统触发报警并自动生成工单分配给特定人员。比如安全生产场景——AI盯着高空作业的工人有没有系安全绳、动火区域有没有可燃物——发现问题不需要人介入,自动告警自动分级自动推送工单。

E-ViC多模态推理:入选了2026年ACL顶会。以前的AI看一张图,得先把图「翻译」成文字(描述图片上有XX、XX大致在什么位置)然后交给大模型理解。E-ViC的思路倒过来——AI直接在图像的像素上做操作,画框、标坐标、绘路径。这种不经过文字「编译」的视觉推理在需要精确空间位置的场景上精度提升明显。

零代码编排+训推一体:拖拽搭AI技能,一次编排之后可以在不同工厂、不同产线直接复制用。模型在生产环境里跑的过程中不断拿新数据回来继续训→模型越用越准。

基本信息

工具名称 旷视科技 Megvii
官网 megvii.com
核心平台 Brain++ 2.0 自研深度学习平台
核心能力 物理世界AI智能体/零代码编排/端边云大小模型协同/训推一体化
2026标志 ACL/ICML论文入选+国产方案提效150%
核心场景 安全生产/智慧城市/工业质检/物流仓储
国产适配 海光DCU深度适配

相关导航

暂无评论

暂无评论...
AI助手
AI 智能实验室 ×
你好!我是 aipluschat 助手。有什么可以帮你的吗?