VLA与世界动作模型方向
自动化类·计算机类
使用简历深度优化功能,快速提升简历质量
职位介绍
招聘部门:研发中心
岗位职责(具身大脑方向)
1、VLA/VLN 算法研发与落地
研发基于多模态大模型的 VLA(视觉-语言-动作)与 VLN(视觉-语言-导航)架构。
负责高维语义指令(如行业 SOP、长程作业规划)到具身技能基元(Skill Primitives)的动态解码与编排,实现复杂开放场景下的长程任务执行。
设计并优化多模态时空思维链(Spatial-Temporal CoT),赋予模型在真实物理场景下的空间具象观察与逻辑推理能力。
2、世界动作模型(World Action Model)的构建与探索
研发基于潜空间的世界动作交互模型,实现对城市动态环境(如行人博弈、车辆交互、抓取操作)的高质量前向模拟与未来状态生成。
结合大模型认知中枢(Agent),落地基于世界动作模型算法,解决操作和移动类的问题(统一通用模型)。
3、具身对齐与闭环反思(Reflection)机制建设
探索并落地基于强化学习(RL)的连续控制与对齐技术,在传统离线行为克隆(BC)的基础上,进一步突破模型在复杂开放环境下的操作天花板与行为边界。
构建基于底层物理反馈的 VLM 闭环反思引擎,实现技能的动态重规划与端侧自治。
职位要求::
计算机、人工智能、机器人控制或相关专业硕士及以上学历。
经历要求(满足其一即可):
在具身智能和 AI 领域顶级会议/期刊(如 NeurIPS, ICLR, CVPR, ICRA 等)以第一作者发表过 VLM、VLA、RL、世界模型或端到端算法相关的高水平论文。
在行业头部具身智能企业或顶尖 AI 实验室拥有相关的核心算法研发与真机/仿真落地实习经验
所属批次:酷哇科技有限公司 2027届校园招聘简章企业职位库在招档案→

