面向光模块工厂的具身智能机器人系统。
端到端感知决策控制,VLA大模型驱动,±0.02mm 精密操作。
不是自动化设备,是真正理解物理世界的智能体。
同一套 VLA 智能引擎,覆盖从单工位精密操作到全产线多机协同。软件定义进化——L2 基线到 L4 旗舰,硬件一次投入,能力持续升级。
Z-MAX 的智能引擎不是规则堆砌,而是端到端可训练的视觉-语言-动作(VLA)大模型。感知即决策,决策即行动。
RealSense D405 深度视觉 + 腕部 RGB + 六维力/力矩 + 触觉阵列。四路传感器实时融合,构建毫米级场景理解。不只是"看见",而是"感知"物理交互。
视觉语言动作模型。端到端从像素到动作指令,零样本泛化到新工位新模块型号。
关节力矩 + 末端六维力 + 指尖触觉三路闭环冗余。毫秒级力反馈调节,Lissajous 力搜索策略确保光模块金手指 ±0.02mm 精确定位插入。
双臂协同完成取料、插拔、AOI 检测全流程。VLA-T 力控模型实时调节夹持力,适配 100G QSFP28 到 800G OSFP 全系列光模块。
端侧采集 → 云端训练 → 模型部署回端侧。每次操作都是训练数据,模型持续迭代,产线越用越聪明。7×24 无人值守训练流水线。
世界模型预测物理交互结果,实现换型零样本泛化。五层主动安全保护。模块卡顿、力异常等场景自主判断,自动恢复或安全停机。实操稳定性 >99%。
从传感器信号到机器人动作,全链路可微分、端到端可训练。不是分立的模块拼接,是一个统一的智能系统。
RGB-D + 力觉 + 触觉
四路信号实时融合
D405 · 7轴
VLA 引擎
端到端像素到动作
<70ms 推理延迟
>1kHz 毫秒级力闭环
Lissajous 精密力搜
±0.02mm 插拔精度
边端采集
云端训练
模型持续迭代进化
头部具身智能背景团队,视触觉混合动作模型深耕,从算法研发到工厂落地的完整闭环。