岗位职责
- 01设计并实现面向大量 UMI、遥操作站和机器人设备的并发上传链路,支持断点续传、内容校验、幂等提交、失败重试与带宽控制
- 02建设以 Episode 为核心的数据生命周期系统,统一管理原始数据、元数据、索引、预览、质量报告和派生产物,并保证来源可追溯
- 03开发任务下发、自动质检、人工审核、返工、拒绝、Episode / Clip 标注、权限与操作审计等平台能力
- 04建设样本池、数据集冻结、版本与 lineage 机制,为训练流水线提供确定、可复现的数据输入和高效导出
- 05建立队列、存储、任务和服务的可观测性与容量模型,持续优化吞吐、延迟、可靠性和基础设施成本
- 06与采集设备、机器人、算法和数据团队共同定义协议、数据模式与质量标准,并推动新能力稳定上线
任职要求
- 计算机、软件工程等相关专业,本科及以上学历;具有突出系统工程成果者可适当放宽
- 具备生产级后端或分布式系统开发经验,能够独立完成架构设计、实现、压测、上线和故障处理
- 熟练使用 Go、Python、Java、Rust 等至少一种后端语言,具备清晰的数据建模、API 设计和工程质量意识
- 熟悉对象存储、关系型数据库、缓存与消息队列,理解一致性、幂等、背压、重试和并发控制
- 具备大文件或边缘设备数据上传经验,理解分片上传、断点续传、内容哈希、去重与弱网络恢复
- 能够把审核、标注、权限和审计等复杂业务规则抽象为可维护的状态机与工作流
- 重视数据正确性、可观测性和可复现性,能够用指标、压测和故障演练证明系统能力
加分项
- 机器人、IoT 或边缘设备到云端的数据平台经验
- 熟悉 MCAP、HDF5、ROS bag 或图像、时序等多模态数据
- 开发过审核标注、众包任务、数据质量或人工参与工作流
- 熟悉 Kubernetes、数据湖、列式存储,或具备 React / TypeScript 产品开发能力