牛大妈在校招职位搜索REDstar视觉与多模态算法工程师 有 6 条结果

招聘城市:北京,上海
…视频生成相关算法研发优化, 跟进该领域的前沿技术研究;
2、参与技术规划制定, 跟进图像&视频生成技术最新发展趋势,打造业内领先的模态内容生成能力。;
3、推动技术在图像&视频编辑/素材生成/辅助设计/特效等领域的应用。
任职要求:
1、硕士及以上学历,计算机等相关专业优先;
2、熟练掌握TensorFlow/PyTorch/Caffe/ MXNet等深度学习框架中的至少一种;
3、具备优秀的编程能力和经验,熟悉Python、C/C++、Java等编程语言,对数据结构和算法设计有较为深刻的理解;
4、优秀的分析和解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证;
5、了解Diffusion、LLM、VLM、Agent等前沿技术;
6、关注模态文本生成领域的业界…
招聘城市:北京,上海
…视频生成相关算法研发优化, 跟进该领域的前沿技术研究;
2、参与技术规划制定, 跟进图像&视频生成技术最新发展趋势,打造业内领先的模态内容生成能力;
3、推动技术在图像&视频编辑/素材生成/辅助设计/特效等领域的应用。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、熟练掌握TensorFlow/PyTorch/Caffe/ MXNet等深度学习框架中的至少一种;
3、具备优秀的编程能力和经验,熟悉Python、C/C++、Java等编程语言,对数据结构和算法设计有较为深刻的理解;
4、优秀的分析和解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证;
5、了解Diffusion、LLM、VLM、Agent等前沿技术;
6、关注模态文本生成领域的业界…

小红书 【REDstar】NLP模态算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…文本理解、模态理解、模态推理等多个前沿方向在业务中的前瞻应用。
任职要求:
1、本科及以上学历,计算机等相关专业;
2、扎实的NLP和机器学习理论基础,熟悉预训练、LLM,文本理解,模态理解等相关算法,有搜索问答,大模型,NLP中台相关场景的业务实践经验者优先
3、编程基本功扎实,熟悉常用的数据结构和算法,擅长Java/C++/Python中至少一门语言,熟悉TensorFlow、PyTorch、Caffe、MXNet等主流深度学习框架;
4、具备独立开展研究工作的能力,熟悉机器学习、信息检索、数据挖掘、自然语言处理领域的经典算法,并能在业务中灵活解决实际问题,在大模型、自然语言处理、计算机视觉模态技术、深度学习等领域有着深厚技术积累,有搜索…
招聘城市:北京,上海
…及以上学历,计算机、人工智能、数学等相关专业;
2、深入理解 Transformer 架构大模型训练全流程(CPT / Mid-train / SFT / RL / OPD),熟悉主流 VLM 架构(如 LLaVA、Qwen-VL、InternVL 等);
3、在大规模预训练、CPT、Mid-training、SFT、RL、在线策略蒸馏(OPD / MOPD)、MLLM 推理优化、视觉对齐或视频理解等方向有深入研究或落地经验;
4、精通 PyTorch,熟悉 Megatron-LM、DeepSpeed 等分布式训练框架,具备百亿/千亿级参数模型的大规模训练经验,熟悉 veRL、OpenRLHF 者优先;
5、对模态数据的构建、清洗及 Data Mixing 策略有独特见解,理解各训练阶段的数据需求差异;
6、熟悉主流模态评测集,能构建垂直领域 Benchmark,并以评测结果反向驱动数据算法迭代。
【加分项】:
1、在 CVPR、ICCV、ECCV…
招聘城市:上海,北京,杭州
…可执行的投放创意决策;并打通生成素材在投放链路中的效果反馈,驱动模型策略迭代。
任职要求:
1、本科及以上学历,计算机、人工智能等相关专业;
2、AIGC 方向(LLM/MLLM、文生图/图像编辑、文生视频)有研发经验,有规模化业务落地经验者优先;
3、熟悉以下至少一个方向并有深度实践:LLM 后训练 Agent(SFT/RLHF、奖励建模、工具调用 Agent 编排);视觉内容生成(扩散模型、潜在扩散、可控生成视频编辑);模态理解数据智能;
4、工程能力扎实,熟练使用 Python(C/C++ 加分)及至少一种开源深度学习框架,有大规模训练或高并发推理服务经验者优先;
5、具备数据驱动意识,能从业务效果指标反向定位模型链路问题…
招聘城市:北京,上海,杭州
模态 Agent 能力,使模型能够进行任务分解、计划生成、工具调用、结果验证和自我修正;
4、建设 VLM Tool-use 能力,支持搜索、知识库、商品库、OCR、ASR、视频分析、审核规则等内部工具调用;
5、优化长视频理解和帧推理能力,提升模型对视频内容、事件、时序关系和深层语义的理解效率;
6、面向小红书搜索、推荐、广告、电商、审核和内容创作等业务场景,构建数据、训练、评测和上线闭环。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、深入理解 Transformer 架构及大模型训练全流程;
3、熟悉主流 VLM 架构(如 LLaVA, Qwen-VL, InternVL 等);
4、在计算机视觉(CV)、模态学习 或 视频理解 领域有深入研究;
5、在 Search(搜索)、Code(代码生成/工程