招聘城市:北京市朝阳区
…模型的训练和调优,以满足特定业务场景需求;
2.负责大模型相关的数据处理,包括数据爬取、数据增强、数据清洗、数据标注及后处理等;
3.与其他团队成员紧密合作,完成模型集成及部署,保障模型稳定运行及持续优化;
4.研究和应用*新的NLP技术和趋势,深入理解底层算法原理,以支持业务创新和发展。
岗位要求:
1.计算机、数学、统计等相关专业本科及以上学历,有机器学习、LLM模型相关经验;
2.扎实的机器学习、深度学习和自然语言处理理论基础,具备优秀的工程开发能力,有LLM模型训练和调优经验;
3.熟悉PyTorch,TensorFlow等深度学习平台,熟练掌握Python/C++编程语言;
4.能够对领域前沿技术保持持续关注和学习,愿意持续投入研究…
招聘城市:北京,上海,深圳
岗位职责:
1. 研究大模型前沿技术,包括但不限于预训练,指令微调和强化学习等对齐技术,多模态、可控文本生成等;
2. 负责大模型高效分布式训练和性能优化;
3. 研究模型压缩和推理优化技术,包括但不限于剪枝、量化及知识蒸馏等;
4. 推动大模型在搜索、客服、推荐、广告等场景规模化落地;
5. 参与大模型平台建设。
任职要求:
1. 本科及以上学历,计算机、数学、统计学或相关专业;
2. 扎实的算法功底,熟悉自然语言处理和机器学习技术,对技术开发及应用有热情;
3. 熟悉Python/Java等编程语言,有一定工程能力;
4. 熟悉PyTorch/TensoraFlow/Megatron等深度学习分布式框架并有实际项目经验;
5. 熟悉Transformer/BERT/GPT等基础模型;
6. 在NLP…
招聘城市:北京
…信息
时序大模型研究员/工程师
2026-06-01 14:55:32
职位描述
职位职责:
1.负责时间序列算法模型的前沿研发工作,设计并实现基于Transformer变体、MoE 或 Linear-RNN的创新架构,通过大规模预训练与指令微调技术,构建具备强泛化能力的通用时序基础模型;
2.探索时间序列与表格、NLP等模态的交互、对齐问题;
3.聚焦复杂场景下的时序建模问题,解决长序列依赖、高频噪声干扰及多变量耦合等实际难题;4.探索 Agentic时间序列建模,在复杂建模问题上进行自适应时序建模工作流。
基本要求:
1.专业背景:国内985或海外重点高校,计算机、信号处理、自动化、人工智能等相关专业硕博,具备极强的模型算法设计和数学建模能力,对于…
招聘城市:北京,上海
岗位职责:
1.研究大模型前沿技术,包括但不限于预训练,指令微调和强化学习等对齐技术,多模态、可控文本生成等;
2.负责大模型高效分布式训练和性能优化;
3.研究模型压缩和推理优化技术,包括但不限于剪枝、量化及知识蒸馏等;
4.推动大模型在搜索、客服、推荐、广告等场景规模化落地;
5.参与大模型平台建设。
任职要求:
1.硕士及以上学历,计算机、数学、统计学或相关专业;
2.扎实的算法功底,熟悉自然语言处理和机器学习技术,对技术开发及应用有热情;
3.熟悉Python/Java等编程语言,有一定工程能力;
4.熟悉PyTorch/Tensorflow/Megtron等深度学习分布式框架并有实际项目经验;
5.熟悉Transformer/BERT/GPT等基础模型;
6.在NLP…
招聘城市:北京
…大模型算法)
10000元以上
jo***.cn[点击查看]
工作地域:北京市 职位类别:工程技术人员 学历要求:硕士研究生在学 招聘人数:15人
发布时间:2026-03-13
* 专业要求:
计算机、数学、人工智能等相关专业学历
* 职位描述:
岗位职责:
①使用机器学习、深度学习和大模型相关技术,开发和优化工业算法模型;
②参与多模态大模型相关的训练、对齐、任务调优等研发工作,训练垂类大模型(LLama3,千问, Gemma);
③参与基于大模型的训练开发与调优工作,包括但不限于基础模型的调研、指令微调、训练数据清洗、模式质量评估等;
④针对细分业务场景的数据处理、模型微调、prompt工程等,以适应场景并达成业务目标;
⑤研究和探索新的算法和技术,为…
招聘城市:北京,上海,杭州
…语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型训练实战经验,包括模型…
招聘城市:北京
大模型数据算法工程师
更新时间:2026-08-27
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
1.参与页面分析挖掘算法的研究与实现,通过算法策略优化页面分类模型、文本分类模型;
2.利用文本挖掘、图像理解等业界先进技术,对多模态内容进行挖掘与理解;
3.工作范围涵盖网页筛选与理解、网页与站点分类和去重、多类型非网页类多模态数据的处理和理解。
岗位基本要求
1.计算机相关专业本科及以上相关学历,具备优秀的理解力、沟通能力和团队协作能力;
2.熟练掌握 c++/python/Java等编程语言,并且在机器学习,自然语言处理领域有扎实的理论功底和动手能力。具备优秀的逻辑思维能力和数据科学能力,在…
招聘城市:北京,上海,杭州
…语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型训练实战经验,包括模型…
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,以高效推理模式为核心优化目标,探索全新模型结构和scaling law。
2、在工作中能快速成长,积极探索前沿技术,解决好业务中遇到的实际问题,完成数据处理、建模和工程上线,对AI技术始终保持热爱,实习期间可发表论文。
任职要求:
1、硕士/博士在读,计算机、数学等相关专业,国内985/全球TOP高校优先,实习期至少3个月;
2、大模型领域前沿技术有深度研究,在国际顶会/顶刊发表过高水平论文者优先;
3、在大模型领域有实践经验,包括数据过滤、数据去重、数据合成,或继续预训练、SFT、RLHF,或知识蒸馏、量化和模型剪枝,或参与过rag和agent商业产品研发;
4、有良好代码能力…
招聘城市:北京,上海
岗位职责:
参与视觉语言大模型的研发工作,主要负责:
1、VIT Pretrain:提升模型感知能力,包括但不限于 Vision Encoder Pretrain 算法架构 / 多种感知能力数据构建;
2、VLM Pretrain:提升 vlm pretrain 的通用能力,探索各种不同训练阶段设计 / 不同通用数据的组织形式;
3、VLM Post train:提升 vlm 通用能力,包括但不限于合成数据 / RL 等方法;
4、生成理解统一:探索生成理解统一架构,同时提升理解和生成能力。
任职要求:
1、本科及以上学历,计算机等相关专业方向优先;
2、熟练掌握代码的阅读和编写技术,善于利用AI编程,在python和pytorch技术栈上有深入实践;
3、在视觉领域有深入的实践和理解,有一定深度的专业认知和见解;
4、具备良好的科学研发习惯、问题定义…
招聘城市:北京
…等关键技术,提升模型在复杂真实场景下的表现。
【为什么是我们】
1.团队扁平,人才密度高,近年团队在ICLR、NeurIPS、ICML、ACL等顶会累计发表论文数十篇,团队员工获EMNLP/ACL等Outstanding Paper;
2.参与大语言模型核心技术研发,接触大规模RL、超长上下文、分布式训练和推理优化等前沿技术;
3.充足算力保障,拥有大规模分布式训练环境和丰富数据资源。
岗位基本要求
1.全球Top高校计算机科学、人工智能、数学、物理或相关领域应届博士/顶尖硕士毕业生;
2.在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文;
3.具备扎实的算法和数学理论基础及良好的编程基础,熟悉自然…
招聘城市:北京
…训练语言模型,参与模型评测方案的制定与评测数据集的建设;
2.通过对模型进行全方面细致的评测,明确模型能力边界,对模型能力进行深入分析,产出围绕大模型的客观认知,从而为模型训练迭代提供指导意见;
3.追踪大模型方向前沿进展,积极主动地学习和探索新的评测及分析的方法和技术;
4.与各相关部门保持良好沟通,深度参与大模型训练及应用,为各大模型相关方提供评测及相关的模型分析支持,共同推动大模型的训练与应用。
岗位基本要求
1.硕士及以上学历,计算机、数学、统计学或相关专业;
2.熟悉Java/Python/C++等编程语言,良好的编码习惯和一定的工程能力;
3.具有机器学习或深度学习算法的基础…
招聘城市:北京
…和实验结果,分析和评估模型效果,讨论优化方案;
3. 熟悉Python语言,熟练使用Transformers、Pytorch等;
4. 拥有扎实的NLP算法基础,拥有大模型预训练/微调/模型评估等实践经验;
5. 了解deepspeed、vllm等训练和推理框架;
6. 具有较强的学习能力,具有钻研探索精神,能独立分析和解决问题;责任心强,具备良好的团队合作精神。
7、一周之内可到岗
加分项:
1. 曾发表相关方向顶会论文;
2. NOI、ICPC、CCPC等算法竞赛获奖者;
3. 熟悉Docker等技术,有相关应用经验;
4. 拥有广泛的技术视野。
收起
招聘简章
岗位要求:
1. 调研大模型算法相关前沿工作、论文,协助团队设计和实施模型算法实验;
2. 记录实验设计和实验结果,分析和评估模型效果,讨论优化方案…
招聘城市:深圳,其它
…大模型算法研究员
2026-03-0509:29:17
职位描述
岗位职责:1、构建垂直领域大数据和大模型,应用于药物研发、化学和材料等领域。2、基于自研机器人产生的大量数据和GPT等识别公开的数据,构建药物分子的可合成性、合成条件、物质性质等预测模型。3、探索人工智能在AIforscience的应用实践,结合实际需求,提出具有突破性的解决方案。任职要求:1、3年以上机器学习算法开发经验,硕士以上学历,计算机、电子、自动化或化学信息等相关专业。2、熟练进行Python开发,具备良好的面向对象编程思想。3、精通常见机器学习算法模型,如XGB、图神经网络、Transformer等;熟练使用PyTorch、Tensorflow等进行深度学习算法开发。4、有机器学习算法与应用…
招聘城市:北京
…定制AI解决方案
大模型算法工程师招聘10人
学历:本科
专业:计算机类,自动化类
工作地点:北京市海淀区,
职位描述: 岗位要求:
1. 调研大模型算法相关前沿工作、论文,协助团队设计和实施模型算法实验;
2. 记录实验设计和实验结果,分析和评估模型效果,讨论优化方案;
3. 熟悉Python语言,熟练使用Transformers、Pytorch等;
4. 拥有扎实的NLP算法基础,拥有大模型预训练/微调/模型评估等实践经验;
5. 了解deepspeed、vllm等训练和推理框架;
6. 具有较强的学习能力,具有钻研探索精神,能独立分析和解决问题;责任心强,具备良好的团队合作精神。
7、一周之内可到岗
加分项:
1. 曾发表相关方向顶会论文;
2. NOI、ICPC、CCPC等算法竞赛获奖者…
招聘城市:北京,上海
岗位职责:
文本大模型团队的主要负责小红书大语言模型的端到端全链路自研。主要研究方向包括:
1、持续探索大语言模型在不同阶段的高效scaling策略;
2、预训练的关键技术探索: 包括从数据策略(筛选,配比,合成,学习效率的提升)、优化技术、可解释性,到下一代模型结构的设计、long context建模、学习范式探索等;
3、通用alignment技术探索: 包括大规模RL的探索,持续提升大模型在通用能力、reasoning、长文本、agent、各方向中长尾知识等多个方向的综合能力,支撑更广泛的应用场景;
4、跟下游的多模态同学一起探索端到端全模态大模型的设计和高效scaling策略;
团队有充足的GPU计算资源,同时跟整个技术社区也…
招聘城市:北京,上海
…研究大模型和搜索推荐前沿技术,基于AI技术对搜索推荐系统进行技术升级和下一代算法架构新范式的探索。
2. 负责美团生成式搜索和交互式对话系统的设计与开发,探索Agent、RAG、领域模型调优等相关技术在生活服务场景落地。
3. 负责生成式推荐技术的探索和开发,并在美团推荐场景落地。
4. 探索大模型技术在美团平台各场景的落地应用,参与产品需求分析,通过技术提升用户体验,提供有价值的解决方案。
任职要求:
1. 计算机相关专业,熟悉机器学习、深度学习,自然语言处理等领域的专业知识。
2. 优秀的编程能力,熟悉PyTorch、TensorFlow深度学习框架。
3. 熟悉主流大模型,如GPT/LLaMA等,对模型背后的原理和差异有深入…
招聘城市:北京
…参与/负责研发面向大语言模型(LLM)/多模态大模型(MLLM)等类型模型的推理服务框架;
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,打造高效、易用、领先的AI推理框架;
2、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等;
3、与全公司各业务算法部门深度合作,为重点项目进行算法与系统的联合优化,支撑业务目标达成。
任职要求:
任职资格:
1、优秀的代码能力、数据结构和基础算法功底,熟悉C++/Python开发,熟悉 Linux/Git 开发环境;
2、熟悉至少一种主流基础深度学习训练或推理框架(TensorFlow/PyTorch/PaddlePaddle/TensorRT等)的使用和实现;
3、熟悉主流LLM模型结构,熟悉至少一种主流LLM推理…
招聘城市:北京,上海
岗位职责:
1、量化方向:负责但不限于大语言模型的低精度训练(FP8)、推理(W8A8KV8等)、低精度优化器(量化梯度、优化器状态、参数等);
2、高性能模型结构:大语言模型Finetune或者其他阶段的LoRA系列(熟悉各种变种),训练阶段的MQA/GQA系列等;
3、稀疏化方向:大语言模型剪枝、稀疏、蒸馏、Sparse Attention等;
4、新型方向:Medusa、超长文本、Speculative Sampling等。
任职要求:
1、本科及以上学历,计算机等相关专业方向优先;
2、拥有上述一个或多个方向的实际落地经验,能独立从头到尾完成上述某个方向;
2、熟练使用主流大规模训练或推理引擎开发,例如DeepSpeed/Megatron/Transformer Engine等;
3、具备实际Cuda算子开发经验者和工程能力较强者优先。
招聘城市:北京,上海
岗位职责:
1.研究大模型和搜索推荐前沿技术,基于AI技术对搜索推荐系统进行技术升级和下一代算法架构新范式的探索;
2.负责美团生成式搜索和交互式对话系统的设计与开发,探索Agent、RAG、领域模型调优等相关技术在生活服务场景落地;
3.负责生成式推荐技术的探索和开发,并在美团推荐场景落地;
4.探索大模型技术在美团平台各场景的落地应用,参与产品需求分析,通过技术提升用户体验,提供有价值的解决方案。
任职要求:
1.计算机相关专业,熟悉机器学习、深度学习,自然语言处理等领域的专业知识;
2.优秀的编程能力,熟悉PyTorch、TensorFlow深度学习框架;
3.熟悉主流大模型,如GPT/LLaMA等,对模型背后的原理和…