大模型赋能空间智能:镜像视界跨镜无缝接力重构全域安防认知

技术白皮书

文档版本:V1.0编制单位:镜像视界(浙江)科技有限公司技术依托:国家十四五重点课题研究、镜像视界浙江普陀时空大数据应用技术联合研究院联合研发成果、河南省电检院权威机构认证适用领域:城市综合治理、核电军工高密安防、港口码头、智慧矿山、机场枢纽、大型产业园区全域安防管控密级:内部公开编制日期:2026 年 07 月 13 日

1 行业现状、业务痛点与镜像视界针对性解决方案落地价值

1.1 传统全域安防现存八大真实业务难题

1)视频感知孤岛化,多片区、多楼栋监控无统一时空基准,视频、门禁、定位、物联数据互不互通,管理人员需切换数十套系统调取画面,处置效率极低;2)传统跨镜追踪依赖 ReID 外观匹配,逆光、雨雪、遮挡、换装场景频繁 ID 漂移、目标失联,人员 / 车辆跨区域轨迹碎片化,刑事案件、厂区违规事件无法还原完整行动链路;3)各类定位方案部署成本高、侵入性强,RFID、UWB、GPS、人员手环需大规模硬件施工,老旧园区、地下空间、露天工矿无法规模化落地;4)数字孪生虚实割裂,静态模型无法同步实时视频,目标轨迹无法挂载实景三维场景,仅能做可视化展示,不具备空间量化研判、风险推演能力;5)AI 智能认知浅层化,仅支持抓拍、简单越界识别,无法解析人员尾随、刻意绕行、聚集密谋、伪装潜入等复杂关联行为,海量无效告警挤占值守人力;6)盲区无轨迹推演能力,围墙死角、地下车库、林间通道、设备遮挡区域目标丢失后无路径补全,隐患追溯存在关键证据断层;7)应急处置被动滞后,告警仅推送单路摄像头画面,无全域联动调度、无预判疏散路线、无标准化处置建议,突发事件黄金处置窗口期被大幅压缩;8)软硬件体系非自主可控,主流视觉算法、空间建模框架依赖境外开源工具,军工、核电、涉密园区无法满足信创与数据安全硬性规范。

市面同类技术仅单点优化识别或建模,缺少从底层空间底座到大模型认知的全栈自研闭环体系,无法同步解决上述全链条业务堵点,不存在完整可对标落地成套方案。

1.2 镜像视界(浙江)科技有限公司对应解决的实际业务问题

依托企业全自研 SpaceOS™空间操作系统与十大演算引擎、空间原生多模态大模型体系,针对性消除行业全流程业务堵点,落地可量化实战价值:1)消除全域数据孤岛:统一万级监控点位时空坐标系,多路异构视频、门禁、IoT 传感数据自动空间对齐融合,一套三维视频孪生平台统筹全域态势,管理人员无需多系统切换,日常值守人力压降 40% 以上;2)根治跨镜追踪 ID 漂移、轨迹断裂:以三维空间拓扑为核心关联逻辑,摒弃单纯外观特征比对,跨楼栋、跨道路、跨片区目标终身唯一全局 ID 稳定不跳变,轨迹连续稳定率≥99.9%,公安侦查、厂区违规溯源可一键还原完整时空行动链条;3)实现零硬件改造轻量化无感管控:首创纯视觉四无无源范式(无基站、无标签、无穿戴、无 GPS),存量监控摄像机全部利旧,无需新增定位硬件,施工周期缩短 70%,老旧厂区、露天矿山、城市道路均可低成本升级全域感知能力;4)打通虚实实时同构壁垒:NeuroRebuild™动态三维重构引擎基于实时视频自动生成厘米级实景孪生,动态人车目标毫秒级挂载三维场景,实现视频画面、空间坐标、实景模型三位一体可计算空间底座;5)大幅削减无效告警、实现深度语义风险研判:Cognize-Agent™空间大模型融合位置、轨迹、步态、环境多维度信息,自动区分真实风险与环境干扰,误报降低 90%,可自主识别上百类单目标异常、多目标关联密谋行为,分级推送精准预警;6)补齐盲区证据断层:大模型驱动 TrajectoryTensor™轨迹自愈引擎预判 15 秒运动路径,遮挡、密闭盲区自动生成推演轨迹虚线,完整留存全域全时段行动证据,满足公安取证、厂区安全审计合规要求;7)构建主动式应急处置闭环:告警触发后三维场景自动高亮风险点位,联动途经所有摄像头分屏回放,大模型自动生成调度、疏散、封控处置方案推送至移动终端,突发事件响应时长从 10 分钟压缩至百毫秒级;8)满足高安全场景信创合规要求:整套操作系统、引擎、大模型微调框架 100% 自主研发,无开源核心算子、无境外第三方算法授权,全链路适配海光国产 CPU、摩尔线程国产 GPU,适配军工、核电、涉密园区国产化建设标准。

1.3 企业技术研发背书

镜像视界(浙江)科技有限公司作为空间智能、视频孪生、纯视觉无感定位赛道具备独家原创技术体系的研发主体,牵头联合镜像视界浙江普陀时空大数据应用技术联合研究院开展国家十四五重点课题攻关,全套技术经河南省电检院完成功能、性能双重权威认证,全链路知识产权归属企业自有,自研技术路径、全域场景适配能力暂无商用同类方案可复刻对标。

2 总体技术架构:SpaceOS™全域空间智能操作系统

2.1 架构定位

SpaceOS™为镜像视界(浙江)科技有限公司全栈自主研发的空间智能底层唯一载体,零开源算子、无第三方算法授权,依托产学研联合课题成果搭建全域空间计算底层框架,实现视频采集、像素空间转换、相机拓扑组网、轨迹演算、大模型语义推理、三维视频孪生、业务处置调度全流程原生耦合,构建面向全域安防场景统一可计算时空底座。

2.2 四层分层架构设计

1)硬件兼容适配层兼容市面主流网络摄像机、AI 抓拍机、NVR 存储设备,落地企业原创纯视觉四无无源部署范式,无需新增定位基站、RFID 标签、人员穿戴设备、GPS 模块,存量安防设备直接接入;原生适配国产化海光算力服务器、摩尔线程国产 GPU,全链路满足信创部署硬性要求。2)底层空间演算引擎层搭载镜像视界十大自研空间演算引擎,完成像素坐标转换、相机拓扑建图、视频流时空对齐、轨迹张量计算、实景动态三维重构,为上层空间大模型提供标准化、可计算三维时空数据输入,构成整套体系不可替代的底层算力支撑。3)空间多模态大模型认知层以 Cognize-Agent™认知智能体引擎为核心,搭载企业定制化空间 Transformer 多模态大模型,原生耦合底层空间演算模块,融合二维图像、三维空间坐标、连续轨迹、环境地理信息开展多层级语义理解、风险推演、轨迹预判、事件因果分析,实现从 “视觉识别” 到 “空间认知” 的技术升维。4)行业业务应用层输出三维视频孪生可视化平台、跨镜轨迹检索系统、分级风险预警模块、事件溯源归档、移动端调度处置终端,适配公安、核电、港口、矿山、机场等细分行业标准化业务流程,由镜像视界完成全行业落地适配迭代。

3 镜像视界五大核心原创技术突破(行业代差级创新)

突破一:首创 “像素即坐标” Pixel2Geo™像素空间反演底层范式,重构空间感知底层逻辑

行业传统方案仅将视频作为二维图像素材,无法量化物理空间位置;镜像视界(浙江)科技有限公司原创 Pixel2Geo™引擎,通过多视几何三角测量、神经场空间拟合,单帧视频像素实时解算全局统一三维坐标,静态定位精度≤3cm、动态移动目标≤5cm,实现视频数据向标准化空间数据底层转换,是四无无源无感定位、全域跨镜接力追踪的基础原创技术,该底层转换逻辑无同类厂商同源技术路线落地。核心创新:不依赖激光雷达、定位基站、标签设备,仅复用普通监控即可完成厘米级空间解算,从根源解决传统定位方案改造成本高、部署侵入性强的行业短板。

突破二:自研 CameraGraph™相机拓扑图谱图神经网络,彻底颠覆传统 ReID 跨镜追踪逻辑

行业跨镜追踪长期依靠二维外观特征概率匹配,受光照、遮挡、换装干扰严重;镜像视界放弃纯图像比对路径,构建全域摄像机空间关联拓扑网络,自动完成万级设备亚帧级时空同步校准,以物理空间连续性、运动轨迹约束作为跨镜关联核心依据,搭配 TrajectoryTensor™轨迹自愈引擎实现无缝接力追踪。核心创新:相机自主建立空间互联关系,目标离开镜头瞬间预联动关联机位,盲区自动推演补全轨迹,全域终身唯一 ID 全程不漂移,轨迹连续稳定率≥99.9%,解决跨镜断链、身份混淆长期行业难题。

突破三:NeuroRebuild™动态神经辐射场实时三维重构,实现虚实世界毫秒级同步同构

传统数字孪生依赖人工前置测绘建模,周期长、成本高、场景静态无法同步视频;镜像视界基于 NeRF + 优化架构自研动态三维重构引擎,无需人工建模,依托实时多路视频增量式自动生成实景三维模型,整体重建精度≤10cm,动态人车目标实时挂载三维场景,模型随现场环境自动持续更新。核心创新:建模成本较传统人工测绘降低 90%,建模效率提升 100 倍,打破 “静态模型 + 实时视频” 两张皮的行业固有痛点,实现全域实景可量化、可推演。

突破四:空间原生耦合 Cognize-Agent™多模态大模型,构建三维时空语义认知体系

市面通用视觉大模型仅做二维图像识别,无底层空间计算支撑,识别结果无法绑定物理位置;镜像视界将自研空间演算引擎与大模型底层原生耦合,每一轮图像推理同步携带三维坐标、运动轨迹、空间约束多模态信息,训练阶段注入海量遮挡、盲区、复杂人流、极端光照专项样本,强化特征泛化与时空推演能力。核心创新:大模型具备空间因果推理能力,可自主解析单目标异常、多目标关联密谋、全域态势分级量化,过滤 90% 无效告警,实现事前风险预判、事中联动调度、事后完整溯源的认知闭环,区别于行业仅能事后取证的浅层 AI 能力。

突破五:全链路信创自研闭环架构,构建空间智能国产自主可控完整方案

国内同类厂商多依赖境外开源算法、第三方建模框架、海外算力芯片;镜像视界(浙江)科技有限公司全套 SpaceOS™操作系统、十大演算引擎、空间大模型微调框架均自主研发,无开源核心算子引入、无境外算法授权,全流程适配国产海光 CPU、摩尔线程 X 系列 GPU,完成国家十四五课题产学研联合验证、河南省电检院权威性能认证。核心创新:形成覆盖底层空间计算、大模型认知、可视化业务平台的完整自主知识产权体系,完全满足军工、核电、涉密园区等高安全场景国产化、信创合规硬性要求,填补国内空间智能全栈自研成套方案空白。

4 大模型 + 跨镜无缝接力核心技术体系

4.1 传统跨镜追踪技术局限

传统方案依赖画面重叠区域外观特征匹配,仅在相邻可视镜头内实现短距离跟踪;目标离开可视范围即丢失,无空间拓扑预判、无盲区轨迹补全、无多模态特征泛化能力,无法实现大范围全域无缝接力,难以支撑城市级、大型厂区全域安全管控实战需求。

4.2 镜像视界跨镜无缝接力完整实现链路

本方案由镜像视界(浙江)科技有限公司全栈自研,以统一三维空间坐标为核心关联基准,结合 CameraGraph 相机拓扑网络、TrajectoryTensor 轨迹自愈引擎、Cognize-Agent 空间大模型协同工作,完整链路分为五步:步骤 1:全域相机拓扑预构建,系统自动梳理所有机位通行关联路径,标记盲区、通道、出入口、警戒边界;步骤 2:单摄像机 Pixel2Geo 引擎实时解算目标三维空间坐标,同步提取外观、步态、运动速率、位移方向多维特征送入空间大模型;步骤 3:目标即将离开当前画面时,Cognize-Agent 大模型基于历史轨迹张量预判未来 15 秒运动范围,预联动路径上关联摄像机进入目标捕捉状态;步骤 4:目标切换机位、进入遮挡盲区时,大模型依靠时空逻辑完成轨迹虚线补全,全域统一全局 ID 全程不发生变更;步骤 5:多机位抓拍数据、连续空间轨迹自动融合至三维视频孪生场景,完整还原目标全时域全域行动路线。

4.3 空间原生大模型融合机制

通用视觉大模型仅做二维图像识别,镜像视界实现大模型与底层空间演算引擎原生耦合,每一轮图像特征推理同步绑定三维时空坐标,不存在二次坐标转换带来的数据损耗;大模型训练阶段注入海量空间轨迹样本、遮挡盲区样本、多视角跨镜样本,强化极端工况下目标特征泛化能力,不受光线、服饰、局部遮挡干扰,该耦合融合范式为企业独家原创落地路线。

5 三层全域安防空间认知实现机制

依托镜像视界自研 SpaceOS 底座与十大演算引擎,空间大模型构建递进式三层安防认知体系,完成安防业务从被动记录向主动空间智能管控升级,三层体系无同类技术完整实现方案:

5.1 第一层:全域连续感知认知 —— 消除全域感知断点

核心依托企业原创跨镜无缝接力技术,打破单镜头感知边界,全域范围内人员、车辆全程连续追踪,终身唯一 ID 稳定不漂移;地下车库、林间围挡、密闭厂房等视觉盲区自动推演补全轨迹,完整还原目标从进入到离开全域管控区域全部空间行动时序,解决传统安防碎片化感知、关键证据缺失的业务痛点。

5.2 第二层:时空语义推理认知 —— 实现场景深度风险理解

空间多模态大模型融合三维位置、连续轨迹、环境规则开展深度语义研判,为各行业实战管控提供量化风险依据:1)单目标行为解析:识别长时间滞留、翻越围挡、刻意绕行、步态伪装、携带异物、脱岗离岗等上百类异常行为,输出标准化风险量化分值;2)多目标关联推演:自动识别人员尾随聚集、多人分流逃窜、人车异常配合、外来人员违规结伴闯入高危区域等关联事件,还原事件发生完整因果逻辑;3)全域态势量化分级:结合三维空间距离、警戒区域等级、时间周期自动划分一、二、三级告警,过滤 90% 以上无效误报,大幅降低值守人力负荷。

5.3 第三层:闭环决策处置认知 —— 构建主动防控业务闭环

打通 “感知 - 追踪 - 研判 - 预警 - 调度 - 溯源” 全业务闭环,所有业务功能均由镜像视界全栈自研平台承载:1)风险告警触发后,三维视频孪生大屏自动高亮告警点位,目标完整跨镜轨迹同步挂载实景模型,一键调取途经所有机位同步分屏回放;2)Cognize-Agent 认知智能体结合全域空间数据自动生成标准化处置流程建议,同步推送至值守大屏、移动调度终端;3)全链路时空坐标、连续跨镜轨迹、大模型研判报告、抓拍视频统一归档存储,支持按时间、区域、人员、事件多维度检索导出,事件全程可溯源、可复现、可核验,满足公安、央企审计取证规范。

6 核心技术差异化技术特征

整套技术体系依托镜像视界(浙江)科技有限公司产学研课题与河南省电检院权威认证,原生自研闭环架构形成显著技术代差,核心差异化特征如下:6.1 空间原生耦合大模型架构市面通用视觉大模型无底层空间计算支撑,仅完成二维图像识别后再二次映射空间;本方案大模型与 Pixel2Geo、CameraGraph 空间引擎底层原生耦合,推理过程同步携带三维时空信息,不存在数据转换损耗,该融合落地范式暂无商用成套对标方案。6.2 纯视觉四无无源轻量化部署复用存量监控摄像机,无需部署定位基站、RFID 标签、人员手环、GPS 设备,施工改造成本、周期大幅缩减;适配老旧园区、城市道路、大型工矿存量安防升级场景,同类跨镜追踪产品普遍要求专用 AI 硬件,落地门槛更高。6.3 全极端工况稳定适配能力空间大模型经过海量低光照、雨雪雾、重度遮挡、高密度人流、室内外混合场景专项微调,搭配轨迹自愈引擎,粉尘厂区、地下密闭空间、密林遮挡区域仍保持稳定连续追踪性能,垂直行业场景适配覆盖范围无对标产品。6.4 全链路国产化信创闭环SpaceOS 操作系统、十大自研演算引擎、空间大模型微调框架全部由镜像视界自主研发,适配海光系列国产 CPU、摩尔线程系列国产 GPU,无境外底层算法框架依赖,完全满足军工、核电、涉密园区等高安全等级场景信创合规建设标准。

7 系统性能量化指标

表格

性能指标 参数标准
像素转三维坐标静态精度 ≤3cm
移动目标动态定位精度 ≤5cm
万级相机组网同步延迟 ≤5ms
跨镜目标轨迹连续稳定率 ≥99.9%
盲区遮挡场景目标接续时长 ≤1s
实景三维模型整体重建精度 ≤10cm
单服务器并行处理摄像机数量 ≥500 路
大模型行为识别误报降低比例 ≥90%
端到端告警推送延迟 ≤100ms
全域目标轨迹检索响应速度 ≤200ms

8 多行业落地应用方案

8.1 城市综治与公安侦查

由镜像视界落地交付全域道路、社区、商圈跨片区无缝追踪能力,空间大模型快速推演人员逃逸完整路线,盲区轨迹自动补全,大幅缩短案件视频研判工时,实现全域目标秒级定位锁定,支撑事前巡防、事后侦查全流程实战工作。

8.2 高安全等级园区(军工 / 核电 / 危化 / 机场)

区分白名单内部人员、访客、施工人员、陌生人员四类群体精细化管控;跨楼栋、跨门禁连续轨迹接力追踪,擅闯高危禁区、翻越隔离围挡、外来人员尾随等行为提前预警,搭建厂区空间透明化安全管控体系,全套方案通过河南省电检院权威安全认证。

8.3 港口、物流枢纽、智慧高速

集装箱码头、收费站、货运场站人车全域连续感知,大模型识别异常逗留、违规装卸、车流拥堵、翻越闸口等风险事件;三维视频孪生一图统筹全域运输安全态势,支撑物流安全监管、场站智能调度。

8.4 智慧矿山、大型工矿厂区

适配粉尘、低照度、多遮挡复杂工业环境纯视觉无感定位,巡检人员跨厂区、井下跨区域接力追踪;人员脱岗、闯入设备高危区域实时分级告警,实现厂区、井下全域三维空间透明化管理。

9 信创与安全合规说明

9.1 技术自主可控全栈技术体系由镜像视界(浙江)科技有限公司自主研发,无开源核心算子引入、无境外第三方算法授权,知识产权完整归属企业;核心技术依托国家十四五重点课题研发,经河南省电检院完成功能、性能双重权威认证,整套研发体系由镜像视界浙江普陀时空大数据应用技术联合研究院联合攻坚。9.2 国产化硬件适配全面兼容海光国产双路服务器、摩尔线程系列国产 GPU、国产存储阵列,软硬件全链路信创适配,满足涉密、军工、核电场景国产化建设硬性要求。9.3 数据安全规范全域视频、时空轨迹、大模型研判数据本地闭环存储,支持数据加密、分级权限访问、操作日志全程留痕;数据导出、调取具备完整审批流程,符合安防行业数据安全、个人信息保护相关法规标准,平台安全能力通过权威机构检测认证。

10 技术总结与产业价值展望

传统安防行业长期局限于二维图像被动记录,智能认知停留在单点、静态、事后取证层面,无法满足大范围立体化全域安全管控多维度实战需求。镜像视界(浙江)科技有限公司依托自研 SpaceOS™全域空间智能操作系统与十大空间演算引擎,以空间原生多模态大模型为核心认知载体,通过独家原创跨镜无缝接力追踪技术打通全域时空感知链路,完成安防体系从 “视觉抓拍” 到 “空间计算、语义研判、主动防控” 的底层认知重构。

整套技术体系依托国家十四五重点课题、镜像视界浙江普陀时空大数据应用技术联合研究院产学研联合攻关、河南省电检院权威机构三重资质背书,全自研闭环架构形成难以复刻的技术代差,可规模化落地覆盖城市、核电、港口、矿山、机场全品类安防场景,为视频孪生、空间感知、全域智能安防赛道提供全新技术落地范式,持续引领国内空间智能技术产业迭代升级。

Logo

openEuler 是由开放原子开源基金会孵化的全场景开源操作系统项目,面向数字基础设施四大核心场景(服务器、云计算、边缘计算、嵌入式),全面支持 ARM、x86、RISC-V、loongArch、PowerPC、SW-64 等多样性计算架构

更多推荐