**********************
vlm后训练算法专家(VQA agent)-北京/杭州
  • 收藏职位
  • 分享职位
80-120万 北京、杭... 本科 5-8年 招聘 2 人 预计佣金 104.4K 5天前发布
职位亮点
面聊
JD基本信息
岗位职责
负责app上通用场景下的多模态问答的算法能力建设,持续推进模型效果和应用场景落地,核心专注于提升 VQA Agent 在复杂视觉场景下的准确率,具体职责包括: 1、多模态planner的优化&探索,主要负责在复杂多轮/多模场景下的意图理解、路径规划、ToolUse、反思纠错等能力的建设,以及探索Agentic RL在复杂长程路径规划场景下的应用&创新; 2、VLM后训练技术探索&落地,包括不限于SFT/RLVR/RLHF等训练范式,以及如RFT的循环迭代机制,提升模型在多轮对话、RA引用、指令遵循、用户偏好等方面的能力; 3、建设完备的算法迭代体系,包括自动化数据飞轮流程以及数据合成体系,模拟真实用户的复杂多轮搜索需求,构建包括CoT、ToolUse及Reflection路径在内的高质量训练数据集,同时设计高可用的自动化评测体系以及建设对应完备的Benchmark;
任职要求
1、计算机科学、人工智能、数学、电子信息等相关专业硕士及以上学历; 2、有扎实的深度学习基础,基本工具(python/pytorch)熟练使用,熟悉业界前沿模型架构&技术; 3、具有VLM Post-Training、Agentic RL相关的理论功底和实践经验; 4、优秀的逻辑思维和创新意识,对技术充满热情,接受挑战&持续学习;
所属行业:
互联网、人工智能/大模型/算力
职能分类:
算法工程师
工作城市:
北京,招聘1人,详细地址:北京杭州,招聘1人,详细地址:杭州
职位要求
学历要求:
本科·统招·985/211
工作年限:
5-8年
技能/证书:
-
薪资福利
年薪范围:
80-120万*16薪
薪资福利:
大厂福利待遇
团队架构
所属部门:
面聊
下属人数:
不限
部门架构:
面聊
汇报对象:
面聊
职级职称:
面聊
面试信息
面试轮次:
4轮
面试流程:
三轮业务+一轮HR
视频面试:
可以接受
为你推荐