招聘城市:北京
…Agentic Vision 新范式:探索视觉模型与代码执行、工具调用、环境反馈等能力的结合,推动模型从一次性 Visual2Code 生成进一步走向“理解—生成—执行—观察—修正”的 Agentic Vision 闭环,提升模型自主解决复杂视觉任务的能力。
岗位要求:
1.计算机视觉、人工智能、机器学习、计算机科学等相关方向硕士及以上学历,具备扎实的深度学习与编程基础;
2.在多模态大模型、代码大模型、Agent、视觉理解或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对 SFT、强化学习、代码生成与执行反馈等技术有较深入理解;
4.具备较强的数据构建、算法研究与实验分析能力,能够独立推动从数据、模型、训练到评测的完整研发闭环;
5.对 Visual2Code、Agentic Vision 及多模态…
…Agentic Vision 新范式:探索视觉模型与代码执行、工具调用、环境反馈等能力的结合,推动模型从一次性 Visual2Code 生成进一步走向“理解—生成—执行—观察—修正”的 Agentic Vision 闭环,提升模型自主解决复杂视觉任务的能力。
岗位要求:
1.计算机视觉、人工智能、机器学习、计算机科学等相关方向硕士及以上学历,具备扎实的深度学习与编程基础;
2.在多模态大模型、代码大模型、Agent、视觉理解或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对 SFT、强化学习、代码生成与执行反馈等技术有较深入理解;
4.具备较强的数据构建、算法研究与实验分析能力,能够独立推动从数据、模型、训练到评测的完整研发闭环;
5.对 Visual2Code、Agentic Vision 及多模态…