| 时间 | Phase 0 固定臂 | Phase 1 移动导航 | Phase 2 精密操作 |
|---|---|---|---|
| T0+0~2月 | 仿真环境搭建 状态机调度调试 力控插拔≤2N | — | — |
| T0+2~4月 | 插入7/8达标 固定工位真机部署 72h验收 | 视触觉数据采集 开始端到端训练 | — |
| T0+4~6月 | 场景1固化 进入量产复制 | 端到端模型达标 移动底盘集成 导航联调 | 世界模型调研 双臂协同预研 |
| T0+6~8月 | — | 场景1/2/3全流程 移动版验收 | 世界模型训练 接触预测≥95% |
| T0+8~10月 | — | — | 双臂协同策略 场景5 ATS≤15s |
| T0+10~12月 | — | — | 全5场景工艺包 换型≤0.5H 全厂无人化 |
| 能力维度 | Phase 0 | Phase 1 | Phase 2 |
|---|---|---|---|
| 感知 | YOLO视觉+力觉 | +触觉融合 | +世界模型预演 |
| 决策 | 状态机+状态机 | 端到端 | 世界模型+双臂协同 |
| 移动 | 固定 | SLAM导航 | SLAM+协同 |
| 操作 | 单工序插拔 | 跨工位上下料 | 全场景精密操作 |
| 精度 | ±0.1mm | ±0.1mm(补偿) | ±0.02mm |
| 节拍 | ≤6s | ≤6s异步 | ≤15s全场景 |
| 模型规模 | ~64万参数 | ~100万参数 | ~500万参数 |
| 推理 | 0.19ms | <70ms | <70ms |
| Phase 1 依赖 Phase 0 | Phase 2 依赖 Phase 1 |
|---|---|
| 状态机的接触判定逻辑→视触觉端到端的监督信号 | 视触觉数据的触觉标注→世界模型的训练输入 |
| 固定工位的力控数据→移动版的力控先验 | 跨工位操作的动作数据→双臂协同的策略库 |
| YOLO感知模型→移动导航的视觉定位基础 | 端到端模型的动作生成→世界模型的预测目标 |
| 风险 | 阶段 | 应对 |
|---|---|---|
| 仿真到真机转移失败 | Phase 0→1 | 仿真物理碰撞已定位→真机力控+视觉对准(技术协议v3已写) |
| 移动定位误差超限 | Phase 1 | 臂补偿±0.1mm + 触觉反馈闭环 |
| 双臂碰撞/物料损伤 | Phase 2 | 世界模型预演 + 力控上限保护 |
| 换型周期超0.5H | Phase 2 | 200原子技能库参数化复用 |