← 主页
Z700 模型产品 · 分阶段规划
规划原则:每个阶段明确"研发什么模型、模型解决什么问题、模型达到什么指标、模型如何部署"。逐阶段递进,前阶段成果是后阶段输入。
一、模型演进主线
| 阶段 | 模型形态 | 解决的核心问题 | 关键指标 |
| Phase 0 | 状态机 | 长程插拔任务时序难建模→状态机调度 | 力控插拔≤2N·节拍≤6s·成功率≥99% |
| Phase 1 | 视触觉端到端模型 | 移动带来的定位误差→视觉+触觉联合决策补偿 | 定位±10mm臂补偿·跨工位异步 |
| Phase 2 | 触觉世界模型 | 双臂协同+精密操作→世界模型预演动作后果 | ±0.02mm对位·5场景全流程 |
二、Phase 0 · 状态机
研发内容
| 模块 | 输入 | 输出 | 用途 |
| 状态机 | YOLO检测框+接触信号 | 8阶段动作调度指令 | 接近→对位→下降→抓取→抬起→转移→插入→完成 |
| YOLO感知 | 图像 | hand/peg/hole检测框 | 视觉定位·22MB独立模型 |
Phase 0 技术逻辑:固定工位无移动损耗,任务时序清晰可控。采用规则状态机按工艺步骤调度机械臂动作,YOLO负责视觉定位。此阶段不引入学习模型,用最短路径验证力控插拔和视觉引导的精度与节拍,为后续阶段积累真机工艺数据。
研发里程碑
| 里程碑 | 内容 | 验收 |
| M0.1 | 仿真环境搭建(MuJoCo metaworld peg) | 仿真抓起8/8 |
| M0.2 | 状态机调度调试+YOLO视觉对位 | 插入成功率≥99%·力控≤2N |
| M0.3 | 固定工位真机部署 | 72h·5000次·成功率99% |
三、Phase 1 · 视触觉端到端模型
研发内容
| 模块 | 技术要点 | 解决痛点 |
| 视觉-触觉融合 | 相机图像+指尖触觉联合输入 | 移动定位误差靠视觉+触觉补偿 |
| 端到端动作生成 | 图像直接到动作·无需中间状态 | 跨工位场景泛化 |
| 导航-操作耦合 | SLAM定位+臂运动学闭环 | 工位对接±10mm→臂补偿至±0.1mm |
研发里程碑
| 里程碑 | 内容 | 验收 |
| M1.1 | 视触觉数据集采集(真机+仿真) | 5000帧含触觉标注 |
| M1.2 | 端到端模型训练 | 跨工位成功率≥98% |
| M1.3 | 移动底盘集成+导航联调 | 场景1/2/3全流程 |
四、Phase 2 · 触觉世界模型
研发内容
| 模块 | 技术要点 | 解决痛点 |
| 触觉世界模型 | 预测下一状态+接触+力反馈 | 双臂协同预演·避免碰撞/损伤 |
| 精密力控 | 力觉反馈闭环·±0.02mm对位 | 透镜耦合等精密操作 |
| 双臂协同 | 一臂持料一臂操作·时空协调 | 光纤插拔·清洁·分拣 |
研发里程碑
| 里程碑 | 内容 | 验收 |
| M2.1 | 世界模型训练(预测接触) | 接触预测准确率≥95% |
| M2.2 | 双臂协同策略 | 场景5 ATS全流程≤15s |
| M2.3 | 全场景工艺包+换型 | 5场景验收·换型≤0.5H |
五、模型投入与产出
| 阶段 | 研发人力(人月) | 算力(TOPS) | 数据量 | 产出 |
| Phase 0 | 4 | ≤20 | 3600帧真机 | 状态机模型+YOLO+状态机 |
| Phase 1 | 6 | ≤20 | 5000帧视触觉 | 端到端模型+导航 |
| Phase 2 | 8 | ≤20 | 10000帧+力觉 | 世界模型+双臂协同 |
📐 产品规划 ·
🗺️ 演进路线图