招聘城市:北京,杭州
岗位职责:
1.负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路。
2.探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值。
3.跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、熟悉Java/Python语言
2、热爱技术研发,具备高度抽象设计能力和快速学习能力,注重代码质量,能够独立分析解决问题,责任心强
3、27届,能够实习6个月以上,每周出席4天及以上。
招聘城市:北京,上海,杭州
岗位职责:
本课题希望探索有效的“多模态理解与生成”统一大模型基座方案,打破公司内部当前“模态隔离”与“任务隔离”的双重技术壁垒。目前在实际业务中,系统高度碎片化:一方面,我们维护着多套用于提取图文Embedding和标签的vlm理解类模型,以支持搜索和推荐的端到端建模;另一方面,我们独立部署了大量图像生成式大模型,包含用于社区封面生成、商品图修图、营销海报生成的图像生成模型(如基于Diffusion的文生图/图生图模型)。
这种“理解与生成分离、文本与视觉割裂”的基建现状导致了极高的算力消耗、部署成本及维护代价。更关键的是,模型间存在“知识壁垒”——图像生成模型无法直接复用理解模型对业务…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1.构建面向文本、图片、音频、视频的多模态数据理解系统,包括 embedding、retrieval、clustering、classification、tagging 等能力;
2.分析海量数据分布、多样性、冗余、缺失及长尾问题,持续优化训练数据质量;
3.设计高效的数据去重、聚类、召回、采样和数据配比策略,服务于预训练、SFT、RL 等数据生产;
4.与模型团队共同完成数据实验,持续分析数据对模型能力的影响,形成自动化数据飞轮;
5.推动数据分析平台、可视化工具和自动化数据 Pipeline 建设,提高整体数据生产效率。
工作要求:
1.2027届本科及以上学历,熟悉 Qwen-VL、Gemma、Gemini 等多模态模型。
2.有 PB 级数据处理经验(Spark/Ray/Flink 等)。
3.有训练数据分析、数据飞轮或推荐系统经验。
4.我们希望…
招聘城市:北京,上海,杭州
岗位职责:
1、负责向量索引、标量索引的研发和优化工作,支撑AI、社交、搜推广、电商等核心业务场景;
2、负责AI时代标量、向量、全文等混合索引检索引擎的架构设计和研发工作,打破数据孤岛;
3、学习和吸纳业界优秀技术成果,积极探索和拓展创新的产品能力,构建行业第一梯队的产品和服务;
任职要求:
1、计算机相关专业,熟练使用AI coding类工具,具备扎实的工程能力并有成型的作品;
2、有向量数据库、ES、KV数据库、表格数据库、时序数据库、多模数据库产品相关经验者优先;
3、具备良好的分析和解决问题能力,对技术有强烈的好奇心和热情,具备优秀的自驱力和心力;
4、具备良好的英文写作能力,熟练阅读英文…
招聘城市:北京,上海,杭州
岗位职责:
深入研究和应用AI大模型技术,对工程架构做全面设计,推动架构智能化升级,确保系统具备高扩展性、高稳定性和高性能,以适应不断变化的业务需求和数据量的增长。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、具备优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++、Python等一个或多个编程语言;
3、熟悉大模型相关的算法和技术,有自然语言处理、大模型训练、强化学习算法经验者优先;
4、在软件工程或者人工智能领域有出色的科研经历,在NeurlPS/ICRL/ICML/ISSTA/ACL/EMNLP等国际顶级期刊会议上发表论文者优先;
5、良好的沟通协作能力,责任心强,积极…
招聘城市:北京
岗位职责:
我们是小红书应用算法部/内容理解算法组,目前专注于内容理解场景的技术落地和产品预研。我们希望寻求优秀在读硕士生/博士生共同突破多模态/视觉大模型理解和生成算法在多模态内容理解行业落地的技术挑战,作为实习生,你将有机会与产品、工程紧密合作,将研究算法应用到实际问题中,并解决有难度有价值的问题,促进领域前沿技术的发展。欢迎投递简历。该岗位的核心研究方向包括但不限于:
1. 计算机视觉:解决视觉理解中指代关系特征归一化和识别研究;
2. 多模态表征:多源数据中多模态表征技术,包括局部/全局匹配、视频表征、多模态表征、对抗性和泛化性等问题。
3. 通用多模态…
招聘城市:北京,上海
岗位职责:
1.负责通用视觉技术能力的构建,如OCR、人脸人体分析、图像视频理解、3D视觉、图形和渲染算法、基础模型、跨模态理解与生成、MLOps等;
2.负责视觉技术在美团全场景下的落地,包括但不限于内容审核、视频结构化理解、智能文档分析、身份核验、智能创作、自动驾驶、场景数字化、摄像头视觉感知、视频流分析、IoT视觉等;
3.负责前瞻技术的探索及攻坚,如生成式AI、神经网络渲染、点云处理、增强现实等。
任职要求:
1.本科及以上学历;
2.熟练掌握模式识别和图像视频处理领域的基础理论和方法,在一个或多个领域有深入研究;在机器学习和深度学习方面具备扎实的理论基础和工程实现能力,熟悉PyTorch、TensorFlow等主流…
招聘城市:北京
岗位职责:
工作职责:
1、参与/负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
你将参与下一代音视频生成MOE大模型的研发,包括 text-to-audio+video、image-to-audio+video、multi-reference generation、video-to-video、long video generation等多模态多任务的统一生成模型研发。你会和数据、评测、平台、内容团队一起,以模型全面能力提升为核心目标。
工作要求:
1.2027届本科及以上学历,熟悉 PyTorch以及分布式训练框架,理解并有实际经验Diffusion model、MOE、VAE、SFT、RLHF、Distillation 中至少两部分;
2.有多条件参考/图像/视频/音频生成、编辑、超分、插帧、人物一致性、多镜头、音画同步等相关经验;能主动设计实验、分析失败案例,并优化实验结果;
3.能独立负责一个子方向,如数据配比、训练 recipe、编辑能力、多模态控制、训练和推理优化…
招聘城市:北京,上海,杭州
岗位职责:
深入研究和应用AI大模型技术,对工程架构做全面设计,推动架构智能化升级,确保系统具备高扩展性、高稳定性和高性能,以适应不断变化的业务需求和数据量的增长。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、具备优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++、Python等一个或多个编程语言;
3、熟悉大模型相关的算法和技术,有自然语言处理、大模型训练、强化学习算法经验者优先;
4、在软件工程或者人工智能领域有出色的科研经历,在NeurlPS/ICRL/ICML/ISSTA/ACL/EMNLP等国际顶级期刊会议上发表论文者优先;
5、良好的沟通协作能力,责任心强,积极…
招聘城市:上海,北京
岗位职责:
1、拥抱大模型技术,深度改进多模态内容理解技术,应用到小红书各业务线(推荐、增长、交易、搜索、发布等业务场景)来解决实际业务问题;
2、进行大模型前沿技术探索和研发,发表国际顶级论文
3、参与多模态大模型相关的业务落地,包括但不限于笔记图文内容结构化、文本&多模态内容理解、视频结构化、作者画像、主题发现、信息抽取、智能摘要、意图理解等;
任职要求:
1.对大模型、多模态有强烈兴趣,或在大模型方向有相关经验者优先;
2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力;
3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力;
4.熟悉至少一个深度…
招聘城市:深圳
岗位职责:
1、跟踪大模型应用、训练优化、强化学习等前沿进展,追求极致,将相应技术应用到多模态内容理解和生成等小红书实际的业务场景;
2、跟踪大模型多模态算法的前沿进展,负责多模态搜索、精排、对话、工具调用、文生图、强化学习等相关算法优化。
任职要求:
1、计算机/电子信息/自动控制/软件工程/数学等相关专业,硕士及以上学历在读同学;
2、扎实的大模型和机器学习理论基础,熟悉MLLM / Agent/ Skill / Harness 等相关算法,有大模型相关场景的业务实践经验者优先;
3、具备优秀的研究和创新能力,在CVPR/ICCV/ECCV/ACL/EMNLP/NAACL/COLING/CVPR/ICCV/ICLR/NeurIPS等会议上发表过论文者优先;
4、具备优秀的编程能力和经验,熟悉…
招聘城市:北京,上海,杭州
岗位职责:
1、负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情…
招聘城市:北京,上海,深圳
岗位职责:
1. 负责通用视觉技术能力的构建,如OCR、人脸人体分析、图像视频理解、3D视觉、图形和渲染算法、基础模型、跨模态理解与生成、MLOps等;
2. 负责视觉技术在美团全场景下的落地,包括但不限于内容审核、视频结构化理解、智能文档分析、身份核验、智能创作、自动驾驶、场景数字化、摄像头视觉感知、视频流分析、IoT视觉等;
3. 负责前瞻技术的探索及攻坚,如生成式AI、神经网络渲染、点云处理、增强现实等。
任职要求:
1. 本科及以上学历;
2. 熟练掌握模式识别和图像视频处理领域的基础理论和方法,在一个或多个领域有深入研究;在机器学习和深度学习方面具备扎实的理论基础和工程实现能力,熟悉PyTorch、TensorFlow等主流…
招聘城市:北京,上海
岗位职责:
工作职责:
1、参与千亿级大模型的分布式强化学习 RL 训练框架研发,提升百卡~千卡级训练吞吐与资源利用率
2、参与 100B以上多模态强化学习算法流程适配(如DAPO等),各领域任务的 RL 正确性验证
3、实验并调优不同并行策略(Tensor/ZeRO/FSDP/Pipeline Parallelism)在超大规模模型上的最佳配置组合
4、协助定位分析分布式训练中的关键性能瓶颈(如GPU利用率低、显存瓶颈、网络通信阻塞、I/O延迟等),设计并实施优化方案进行验证。
5、参与研发/优化训练引擎的关键特性,如大规模集群下的稳定断点续训、高性能异步Rollout机制、以及高性能算子(Kernel)的集成与优化。
任职要求:
任职资格:
1、优秀的代码…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1.参与大规模MoE模型的预训练和持续预训练(cpt/midtrain):数据清洗与混合策略、训练调优与结果分析;
2.参与Agentic RL强化学习训练流程:数据构建、reward shaping、训练调优;
3.参与多语种机器翻译(MT)方向:语料处理、模型微调、评测;
4.参与Long horizon agentic RL 方向:轨迹构建,环境构建、优势与奖励设计。
工作要求:
1.2027届应届毕业生,计算机科学、人工智能、计算机视觉等相关专业本科及以上学历,具备扎实的机器学习、深度学习理论基础,熟悉现代LLM架构。
2.熟悉常见大模型训练框架(Megatron/Verl/slime等)
3.有LLM相关项目经验:pretrain、CPT、SFT、RL、non parametric 任意方向即可
4.有阅读论文与复现能力,能快速上手实验
5.良好…
招聘城市:北京,上海,杭州,深圳
岗位职责:
本课题聚焦全模态Agent(GUI操作、代码生成、网页导航)在长程交互任务领域的算法研究。旨在解决Agent执行跨越数百至数千步的复杂任务时,传统强化学习仅依赖终态奖励信号,导致信用分配路径过长、梯度信号衰减,策略优化难以收敛的问题。研究方向包括:设计层次化时间抽象信用分配机制,缓解长程任务中flat policy的优化不稳定问题;设计验证跨模态可验证奖励机制,抑制Reward hacking对训练过程的干扰,实现全模态长程Agentic RL 稳定收敛。该研究成果将在WebArena、SWE-bench等主流评测基准上验证方法的有效性,应用于公司内社区生态Agent基座、AI跨模态深度搜索等业务场景,并集成至自研开源的强化学习引擎Relax,增强业界…
招聘城市:上海
岗位职责:
1、负责计算机视觉&多模态&3DGS相关算法研发,面向但不限于:3DGS、3D重建、多模态检索、embedding、多模态目标检测、分割、Metric Learning、主体识别、质量评价等等;时刻follow与探索前沿技术;(以上方向擅长一个即可)
2、负责相关算法和系统的持续迭代和进化;同时能够深入小红书丰富的业务场景,结合实际需求进行技术落地和创新;
任职要求:
任职资格
1、研究生在读;
2、 计算机/电子信息/自动控制/软件工程/数学等相关专业;
3、优秀的分析、解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证;
4、熟练掌握TensorFlow/PyTorch/Caffe/ MXNet等深度学习框架中的至少一种;
5、具备优秀的编程能力和经验,熟悉Python、C/C++、Java…
招聘城市:北京,上海
岗位职责:
创作发布算法方向:
1、负责图像编辑、视频剪辑、文案创作等内容创作相关算法的研发与优化,并在社区发布、商业化&电商创作等场景落地;
2、跟进多模态大模型内容生产、Agent等相关技术的最新发展趋势,保持技术先进性,持续探索Agent在内容创作方面的潜力。
AIGC生成方向:
1、负责多模态生成/GAN/Diffusion等图像&视频生成相关算法研发与优化, 跟进该领域的前沿技术研究;
2、参与技术规划制定, 跟进图像&视频生成技术最新发展趋势,打造业内领先的多模态内容生成能力;
3、推动技术在图像&视频编辑/素材生成/辅助设计/特效等领域的应用。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、熟练掌握TensorFlow/PyTorch/Caffe/ MXNet等深度学习…
招聘城市:北京,上海,杭州,深圳
岗位职责:
本课题聚焦于多模态理解与生成的高效算法研究,旨在通过创新的模型压缩与加速技术,在保持模型性能的前提下显著降低计算开销与延迟。课题将深入分析现有多模态模型的视觉感知与生成机制,探索视觉Token自适应压缩(如文本引导的动态token剪枝、跨层信息复用等前沿技术)、Agent上下文管理、扩散模型一致性蒸馏与潜在一致性模型(LCM)加速生成(如SANA-Sprint、TLCM等一步/少步生成方法)、跨模态高效注意力等前沿方向。课题研究成果将转化成论文等科研产出,提升小红书前沿技术影响力,同时支持小红书各个多模态业务场景有效推理降本及加速。
任职要求:
1、不限年级,本科及以上在读…