招聘城市:深圳
岗位职责:
1.作为技术带头人负责跨团队大型AI项目的技术方案设计和研发;
2.跟进业界先进的大模型算法趋势和应用,评估价值并探索在团队内部场景落地;
3.制定团队AI能力发展蓝图和计划,包括不限于技能培训、考试和梯队培养等;
4.负责外部技术资源的对接和引入,包括不限于高校合作、内外部技术交流等。
岗位要求:
1.硕士以上学历,8年以上工作经验,有数据工程、数据挖掘、大模型等项目经验,有大模型在垂直领域(如智能客服、金融风控等)的落地应用经验优先;
2.精通大模型pre_traing,post_traing,推理优化等技术方案,熟悉机器学习、深度学习等常用算法;
3.熟练掌握Python、C++、SQL等一种或多种语言;
4.有…
招聘城市:深圳
岗位职责:
1.负责搭建基于AIGC的智能化研发工具解决方案,从研发过程视角,面向未来探索、落地标准的AI产品控件,如:需求理解、代码生成、自动化测试等;
2.推动设计文档,代码协议、接口、注释标准化,通过知识注入增强模型对大代码工程的理解,增强工程级代码自动生成能力;
3.通过标准DSL、清洗、合成增强等手段构建专有数据集,持续分析和打磨底座模型性能与垂直领域效果,扩展多模态的能力,支撑研发工具能力提升;
4.跟踪行业发展动态,评估和探索新能力在研发智能方向的应用潜力,结合业务探索创新性的应用方案并推动落地。
岗位要求:
1.精通机器学习框架和数据处理工具,能够进行机器学习算法实现,算法结构调整,及现代大模型…
招聘城市:北京
岗位职责:
1.负责AI搜索、大模型对话等场景中AI Agent方向的算法研究,提升大模型逻辑推理和任务规划能力;
2.优化Agent的工具调用、记忆管理能力,解决AI搜索下多卡片、多API的调用精度,提升与环境的交互能力;
3.优化Agent上下文理解能力,解决查询意图、查询拆解、问题补全等实际问题;
4.LLM相关的算法探索与落地工作,包括不限于RAG、SFT+强化学习、Multi-Agent等前沿方向。
岗位要求:
1.硕士及以上学历,计算机、机器学习或数学等相关专业,主导相关项目或论文者优先;
2.具备强烈的进取心、求知欲,对大模型有着非常强的兴趣;
3.出色的问题分析和解决能力,优秀的数据组织与挖掘能力;
4.实践能力强,优秀…
招聘城市:北京,上海
岗位职责:
开发研究多模态 LLM 驱动的智能体技术及其应用,包括但不限于:
提升 long context 场景下模型对复杂指令遵循能力;
提升模型的推理规划能力、工具(例如搜索等)使用、记忆管理能力等;
探索多智能体场景下的合作、辩论、对话等应用;
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作…
招聘城市:北京
岗位职责:
1.负责生成式大模型预训练相关的工作,包括但不限于:大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练…
招聘城市:威海
新北洋博士(AI大模型方向)招聘公告
新北洋招聘
招聘概要:
新北洋(SNBC)现面向2024届、2025届、2026届博士开展AI大模型方向算法工程师社会招聘。公司为科技创新型企业,核心技术团队由北京理工大学博士领衔,聚焦“无人化、少人化”主航道,致力于将前沿AI技术转化为行业级产品。岗位职责包括:垂直领域大模型(LLAMA、QWEN等)微调优化;构建高并发低延迟推理服务及RAG/AGENT架构;推进模型压缩加速(VLLM/TENSORRT);建立MLOPS流水线;跟踪前沿技术并推动落地。要求:计算机科学、人工智能、数学、统计学等相关专业博士;精通Python及PyTorch/TensorFlow;深入理解Transformer及深度学习原理;具备LLAMA/QWEN等模型微调及Prompt Engineering实战经验;熟悉Linux/Docker/Git协同开发…
招聘城市:北京,上海
岗位职责:
【训练推理框架研发】
大模型hi lab AI Infra团队专注于大语言模型领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责机器学习框架的研究与开发,服务于公司各个产品;
2、高效部署,优化NLP/多模态大模型核心业务模型;
【轻量化】
机器学习系统团队需要将传统或者新型的轻量化算法和工程有机结合起来进行加速,提高大语言模型训练或者推理性能的同时,通过算法手段尽可能降低效果损失。候选人将在以下几个方向进行深入探索和落地:
1、量化方向:负责但不限于大语言模型的低精度…
招聘城市:北京,上海,杭州
岗位职责:
我们相信,通向更高阶智能的路径不止于更大的 LLM。
Post-Training 正在成为模型能力跃迁的关键阶段:从“学会语言”走向“理解世界、优化行为、持续进化”。该岗位将深度参与 多模态、强化学习、自进化 Agent 系统 等前沿方向,探索超越纯预训练范式的新能力边界,构建可持续学习、可记忆、可进化的智能系统。
1. Post-Training 核心研究与系统构建
设计并实现面向 推理能力、策略优化和长期表现 的后训练方法
探索 Reasoning RL Scaling、RLAIF for Fuzzy Task、Self-Play、Scalable Oversight 等在大模型中的新用法
将 Post-Training 视为 系统级优化问题,而非单次调参或 reward hacking
2. 强化学习与持续进化机制
设计基于试错和反馈的训练闭环(例如,Natural…
招聘城市:北京,上海,杭州
岗位职责:
我们是小红书中台大模型 Infra 团队,专注打造领先易用的「AI 大模型全链路基础设施」!团队深耕大模型「数-训-压-推-评」技术闭环,在大模型训练加速、模型压缩、推理优化、部署提效等方向积累了深厚的技术优势,基于 RedAccel 训练引擎、RedSlim 压缩工具、RedServing 推理部署引擎、DirectLLM 大模型 API 服务、QuickSilver 大模型生产部署平台等核心产品,持续赋能社区、商业、交易、安全、数平、研效等多个核心业务,实现 AI 技术高效落地!
1、负责大模型平台的架构设计和核心功能研发,构建云原生架构,设计高可用、高性能的微服务体系;
2、负责构建面向大模型全流程的DevOps,与下游云原生平台深度融合,支撑大模型在公司内各业务…
招聘城市:上海,北京,杭州
岗位职责:
1、预训练:模型架构设计和实现,持续打磨多阶段预训练技巧,结合自动化和人工筛选,持续迭代化数据配比方案(质量、类别分布、难度等),训练全尺寸Dense和MoE模型,以及探索Hybrid架构、Diffusion训练/推理等新一代大模型范式;
2、后训练:SFT数据合成、拒绝采样、数据配比、模型训练,样本级标签体系建设,RL数据合成、Reward Model设计、router replay、RL算法创新,显著提升alignment阶段模型生成能力;
3、数据&评测:持续改进数据体系pipeline,包括:数据收集、清洗、去重和配比等,合成各种高质量agentic/reasoning训练数据,提升模型通用能力;持续完善大模型评估体系和Bench,能有效评估STEM、math、code、知识、指令跟随、多语言等维度能力。
任职要求:
1、背景: 计算机、电子、数学等相关专业…
招聘城市:北京
岗位职责:
1.负责AI搜索中大模型后训练方向的核心技术研发,包括SFT、偏好学习、强化学习等算法研发、优化与创新,提升AI搜索的回复效果;
2.跟踪AI搜索领域的前沿技术,参与前沿算法研究,推动研究成果在业务场景的落地应用;
3.参与产品讨论,基于技术对产品提出改进建议。
岗位要求:
1.计算机科学、人工智能等相关专业硕士及以上学历;
2.具备良好的LLM技术基础,熟练使用深度学习训练和推理框架,深入理解Transformer、GPT等模型架构;
3.在Post-training方向有一定研究基础,熟悉SFT/DPO/PPO/GRPO/Reward Model等;
4.具备良好的分析和解决问题的能力,针对具体的应用场景能合理设计和优化算法并应用;
5.对于探索前沿技术有很大…
招聘城市:深圳
岗位职责:
负责通用AI大模型相关的评测与应用的规划、落地以及平台化能力建设,包括但不限于:
1.通用AI大模型评测基准的构建:建立覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等多模态的评测基准,设计全面、准确的多维度指标,构建自动化评测工具链,并随着模型能力的演进持续探索全模态的评测基准;
2.评测数据的自动化生产能力构建:基于数据泛化等能力,构建领域增强型评测数据集生产链路,支持多模态场景的自动化数据扩增与效果验证;
3.自动化评测与归因分析:探索并实现各个模态大模型的自动化评测与模型缺陷归因机制。
岗位要求:
1.计算机或者相关专业硕士…
招聘城市:深圳
岗位职责:
1.通用AI大模型评测体系的构建:通过紧跟先进模型及应用的前沿发展,设计全面、准确的多维度指标,建立覆盖文生文、多模态理解、多模态(音视频/3D/图/视频生成)生成等全面、多维度的评测体系;
2.行业动态洞察:持续完善快速评测体系构建、快速反馈行业动态及模型能力,发现行业模型以及应用的前进方向、亮点;
3.结果归因以及调优指导:通过各种数据分析方法,深度分析模型评测结果,为大模型的更新调优提供精准的问题分析结论。
岗位要求:
1.计算机编程、数学、设计、3D(建模师、独立开发者等)、视频等相关专业硕士或以上学历,对该领域有深度了解,2年以上工作经验;
2.了解AI大模型技术原理…
招聘城市:北京
岗位职责:
1.负责生成式大模型预训练相关的工作,包括但不限于:大规模模型预训练,长文本预训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型预训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型预训练…
招聘城市:北京,上海,杭州,深圳
岗位职责:
工作职责:
1、负责大模型平台的架构设计和核心功能研发,构建云原生架构,设计高可用、高性能的微服务体系;
2、负责构建面向大模型全流程的DevOps,与下游云原生平台深度融合,支撑大模型在公司内各业务生产链路稳定高效地落地;
3、负责万卡规模GPU集群效能分析及优化,通过调度策略优化、在离线混部、GPU虚拟化、存储&网络加速等手段,提升GPU集群使用效率;
4、将平台和框架结合,通过任务调度、弹性容灾、性能优化等措施端到端提升AI生产效率,涉及k8s/kubeflow、网络通信、分布式训练等;
5、优化各AI平台性能,提升系统稳定性和可扩展性,保障大规模并发场景下的服务质量与用户体验…
招聘城市:上海,北京,杭州
岗位职责:
1、Post-Training Pipeline 设计与迭代:搭建并持续优化 SFT、RM、RLHF / RLAIF / RLVF 等后训练流水线,支持多模态模型的高效迭代,让千亿级大模型在一次次“后训练”中真正变得聪明、智慧、安全
2、可扩展监督与反馈系统:设计低成本人类 + AI 组合反馈机制,自动化完成偏好采集、对齐传递与数据质量评估,通过 Product-Research co-design 探索构建真实用户反馈的模型迭代机制
3、通用推理与工具使用能力提升:构建跨模态强化学习环境和多样化奖励体系,帮助模型学会调用外部工具、提升模型利用文本-图像-语音跨模态信息进行复杂推理和问题解决能力
4、长期记忆、个性化与终身学习:探索持久记忆与动态偏好建模,使模型能够跨会话记住用户偏好…
招聘城市:北京,上海
岗位职责:
建立文本和多模态数据源、数据格式解析(网页,PDF等)、数据策略、模型能力、下游任务的全链路归因能力
建立并持续完善的数据质量、多样性、重复度、覆盖率等评估体系,分析和量化每个维度的影响
针对模型核心能力进行重点强化,包括不限于数学、推理、Code、Agent、ICL、OCR等
探索如何使用更少数据量,达到同样模型能力的策略,持续提升per token的通用能力训练效果
探索基于各类策略
任职要求:
对大模型方向充满兴趣,且能充分意识到数据对于模型能力的重要价值和数据侧的巨大空间
有很好的数据感觉,对人类文明积累下来的优质数据分布有很好的判断
有很好的NLP/多模态经验,在数据和算法…
招聘城市:深圳
岗位职责:
1.负责大语言模型在AI原生搜索引擎上的优化和落地;
2.建设AI原生搜索系统,包括大模型在内容理解、召回、排序、时效性、权威性、query分析等模块的应用落地;
3.调研业界前沿算法,包括大模型引用预估、搜索领域后训练、LLM for ranking&retrieval,Listwise/setwise ranking等前沿技术在搜索引擎理的研究和应用;
4.参与产品讨论,基于技术对产品提出改进建议。
岗位要求:
1.有大语言模型应用经验优先,包括精调(SFT)、强化(GRPO)等技术的落地;
2.有RAG或LLM Agent的应用落地经验者优先;
3.熟悉搜索系统模块,有内容理解、召回、排序、时效性、权威性、query分析等落地经验优先;
4.熟悉TensorFlow,Keras,Pytorch等常规深度学习框架;
5.熟悉自然…
招聘城市:北京
岗位职责:
1.负责AI搜索、大模型对话等场景中AI Agent方向的算法研究,提升大模型逻辑推理和任务规划能力;
2.优化Agent的工具调用、记忆管理能力,解决AI搜索下多卡片、多API的调用精度,提升与环境的交互能力;
3.优化Agent上下文理解能力,解决查询意图、查询拆解、问题补全等实际问题;
4.LLM相关的算法探索与落地工作,包括不限于RAG、SFT+强化学习、Multi-Agent等前沿方向。
岗位要求:
1.硕士及以上学历,计算机、机器学习或数学等相关专业,主导相关项目或论文者优先;
2.具备强烈的进取心、求知欲,对大模型有着非常强的兴趣;
3.出色的问题分析和解决能力,优秀的数据组织与挖掘能力;
4.实践能力强,优秀…
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,完成扩散模型(diffusion model)在大语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业,博士研究生优先;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法…