牛大妈在社招职位搜索混元大模型预训练算法研究员 专家研究员深圳 北京 上海 有 22 条结果

招聘城市:北京
…负责生成式模型训练相关的工作,包括但不限于:大规模模型训练,长文本训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型训练实践经验者…
招聘城市:北京
…负责生成式模型训练相关的工作,包括但不限于:大规模模型训练,长文本训练,线性模型结构探索;
2.探索与跟进前沿技术,寻求技术突破,推动机器在AIGC能力的提升和突破;
3.探索高效的模型知识嵌入方法以及模型知识在线学习更新;
4.探索文本模型训练的scaling law,在小规模小成本下更精准地预测大规模训练后的表现。
岗位要求:
1.熟练掌握Python,熟悉Linux环境开发,精通应用深度学习框架TensorFlow或者PyTorch;
2.持续跟进前沿的深度学习技术,了解前沿的深度学习相关算法,熟悉Transformer等模型结构;
3.具备分析问题定义问题和解决问题能力,具备持续的自驱力来面对挑战;
4.有大规模模型训练实践经验者…

腾讯 腾讯LLM正在热招,一起探索模型智能上限

全职 北京,深圳,上海
招聘城市:北京,深圳,上海
…后训练等方面有深入研究和显著成果,推动模型能力不断提升。
招聘摘要: 腾讯基础模型部现面向社会和高校进行招聘,诚邀各界优秀人才加入。公司介绍:腾讯基础模型部以AGI为愿景,探索智能的边界。团队人才济济,近50%为博士,来自海内外顶尖高校,还有多位一线模型实战经验的专家,平均年龄28岁。团队领军人是腾讯首席AI科学家姚顺雨。团队在训练、强化学习、后训练等方面深入研究,推动模型不断发展。招聘职位:1. 青云热招课题相关岗位,包括大规模强化学习框架性能优化研究等多个方向,同步开放实习岗位。2. 社招岗位众多,如模型算法研究模型训练算法研究
招聘城市:深圳
…原生搜索系统,包括模型在内容理解、召回、排序、时效性、权威性、query分析等模块的应用落地;
3.调研业界前沿算法,包括模型引用预估、搜索领域后训练、LLM for ranking&retrieval,Listwise/setwise ranking等前沿技术在搜索引擎理的研究和应用;
4.参与产品讨论,基于技术对产品提出改进建议。
岗位要求:
1.有语言模型应用经验优先,包括精调(SFT)、强化(GRPO)等技术的落地;
2.有RAG或LLM Agent的应用落地经验者优先;
3.熟悉搜索系统模块,有内容理解、召回、排序、时效性、权威性、query分析等落地经验优先;
4.熟悉TensorFlow,Keras,Pytorch等常规深度学习框架;
5.熟悉自然语言处理方向常用的理论和方法,熟悉阅读理解、问答、搜索、语言模型训练等核心技术…
招聘城市:北京
…行为及空间关系等核心能力,提升模型对复杂动态场景、细粒度视觉信息及长程上下文的感知和理解能力;
3.提升复杂视频推理:探索面向视频场景的多步推理、时空推理、因果推理及组合推理能力,研究视频信息与语言模型推理能力的深度融合,提升模型解决复杂视频任务的泛化能力;
4.建设视频评测与数据飞轮:建立系统化的视频能力评测体系,持续分析模型能力边界与核心 Badcase,形成“评测—数据—训练—验证”的研发闭环,驱动模型能力持续迭代;
5.推进视频全流程研发:负责视频方向的 训练、中训练、后训练的数据生产,开展SFT、强化学习等后训练算法研发,建设高质量视频训练数据及自动化数据生产流程,探索更高效的视频能力…
招聘城市:深圳
…基础模型算法的设计,针对训练/SFT/RL相关的优化,模型能力的评测,各种下游应用场景的探索;
2.科学分析研发中的各种问题,找到模型性能的瓶颈,从第一性原理出发找到解决方案,加速世界模型的开发和迭代,确保模型的竞争力和领先性;
3.探索实现世界模型的不同范式,研究下一代的模型架构,探索世界模型的边界。
岗位要求:
1.计算机、人工智能、数学等相关专业的全日制本科(优先)以上;
2.具有扎实的深度学习算法基础,具备扎实的模型研发经验,有Diffusion Models和Autoregressive Models相关经验优先,有相关方向顶级论文者优先,有文生图文生视频实践经验者优先;
3.熟悉各类深度学习网络和算子底层实现细节,训练和推理模型
招聘城市:深圳
…针对训练/SFT/RL相关的优化,模型能力的评测,各种下游应用场景的探索;
2.科学分析研发中的各种问题,找到模型性能的瓶颈,从第一性原理出发找到解决方案,加速模型的开发和迭代,确保模型的竞争力和领先性;
3.探索实现Omni模态理解、生成能力的不同范式,研究下一代的模型架构,探索多模态模型的边界。
岗位要求:
1.计算机、人工智能、数学等相关专业的全日制本科(优先)以上;
2.熟悉大规模多模态数据处理,高质量数据生成等实践经验者特别优先;
3.具有扎实的深度学习算法基础,具备扎实的模型研发经验,有Diffusion Models和Autoregressive Models相关经验优先,有相关方向顶级论文者优先,有跨模态(例如音视频)研究实践经验…
招聘城市:北京
算法研究,探索下一代语音、音频生成新范式,拓展语音生成边界能力;
2.探索多模态语音模型的前沿技术,结合文本、语音、视觉等技术提升语音交互体验;
3.负责语音模型的技术研发工作,推动模型性能提升与创新应用。
岗位要求:
1.计算机科学、人工智能、电子工程、信号处理等相关专业硕士、博士研究生;
2.掌握语音模型、语音合成、语音识别、音频生成、语音转换、语音Codec等一项或多项研究和开发经验;
3.熟悉主流对话模型(如GPT4o、GLM-4-Voice、Qwen2.5-Omni、Voila等),有相关项目实践经验者优先;
4.熟练掌握PyTorch等深度学习框架,有模型训练框架Megatron/Deepspeed实践经验者优先;
5.熟悉模型相关结构设计及原理,有大规模训练、后训练
招聘城市:深圳
…将其应用于模型基座,持续提升模型的推理能力。
岗位要求:
1.有过模型代码/数学/reasoning方向的研发经历;
2.在post-training方向有一定研究基础,熟悉SFT/DPO/PPO/Reward Model等pipeline;
3.较强的工程实现能力,熟练使用Python语言,有实际编程项目经验,熟悉DeepSpeed、Megatron等分布式训练框架,熟练使用pytorch深度学习框架;
4.计算机科学、机器学习、统计学、应用数学等相关专业在校硕士、博士生;
5.在高水平国际会议和学术期刊发表过相关论文,或有高水平竞赛获奖经历优先。
部门介绍:
机器学习平台部负责腾讯“太极”机器学习平台的建设,构建面向搜索、广告、推荐的稀疏模型语言模型及稠密模型和通用机器学习的平台能力…
招聘城市:深圳,北京,上海,杭州
…加入腾讯模型团队,一起构建向善的AGI。一、公司简介腾讯AI Infra团队由首席AI科学家姚顺雨带队,团队成员超50%来自海内外顶尖高校,平均年龄28.8岁。团队为腾讯提供全链路优化,从训练到推理,打造强大的进化引擎。在训练和推理方面均取得显著成果,如训练框架重建、稳定性体系搭建,以及推理多方面优化等。二、招聘职位及工作城市1. 青云热招课题:涵盖模型分布式训练基础框架、infra稳定性、多模态理解与生成模型相关算法及推理框架等研究岗位,工作城市为深圳、北京、上海。2. 社招热招岗位:包括文本/多模态训练框架研发、训练Infra、模型训练性能优化、模型Infra稳定…
招聘城市:北京
…NVILA、InternVL 等前沿技术,推动数据算法的工程化落地。​;
5.技术沉淀与创新:跟踪 VLM 领域数据相关前沿研究(如训练数据设计、模态融合策略),主导技术攻关与专利申请;输出可复用的数据处理算法组件与技术文档,建立团队数据算法基准体系。
岗位要求:
1.计算机科学、人工智能、自动化等相关专业硕士及以上学历,1年以上多模态模型或计算机视觉领域研发经验。​;
2.扎实的算法基础:精通深度学习、计算机视觉与自然语言处理核心理论,深入理解 Transformer 架构、模态对齐原理及多模态训练机制。​;
3.工程能力突出:熟练掌握 Python 编程语言,精通 PyTorch 框架及 HuggingFace 生态,具备大规模数据处理(Spark/Flink)与分布式训练(DDP/FSDP/DeepSpeed)经验。​…
招聘城市:北京
…对等手段,解决模型在搜索场景中的幻觉问题,确保生成结果的真实性与权威性;
4.长文本与信息合成:优化长上下文(Long Context)建模能力,实现多篇长文档的信息提取、冲突处理及深度摘要生成;
5.前沿技术转化:探索推理类模型(Reasoning Models)在搜索Agent的落地,包括基于过程监督的思维链(CoT)优化及搜索反馈驱动的强化学习(RL)策略。
岗位要求:
1.背景要求:计算机、数学或统计学相关专业硕士及以上学历,2 年以上 NLP 或搜索相关工作经验,有模型实际项目落地经验者优先;
2.算法深度:深入理解 Transformer 架构,熟悉 LLM 的全生命周期(训练、SFT、RLHF/DPO);精通 RAG 技术栈,对索引构建、检索策略、上下文压缩有深入研究
招聘城市:北京
…落地,覆盖训练、SFT、多模态、代码、长文本等核心数据类型;
2.建立海外数据技术准入标准,从数据质量、稀缺性、重复噪声、场景适配性做专业评估,筛选真正对模型有效增益的高价值数据;
3.对齐训练算法团队,根据模型能力短板,制定海外数据采买、补充、配比策略,精准支撑模型迭代;
4.负责外购数据的格式适配、清洗去重、质检、版本管理,无缝对接内部训练数据工作流,实现规模化复用;
5.把控海外数据版权、隐私、跨境合规风险,搭建标准化海外数据准入与风控体系;
6.沉淀海外供应商资源池与数据资产体系,持续优化数据采买、测评、治理流程,构建长期数据壁垒。
岗位要求:
1.计算机、人工智能、数据、统计等相关专业,具备模型/NLP/算法/数据…
招聘城市:深圳
岗位职责:
1.负责语音/音频模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发;
2.负责训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视频多模态、语言模型训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:深圳
…负责语音/音频模型研发,包括语音对话(语音交互/音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频模型训练、后训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、语言模型训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有ACM…
招聘城市:深圳
…1.搭建规范的大规模的pretrain data workflow, 确保整个训练数据可复现,可追踪,每一步可debug/可校验;
2.全面负责训练数据工程体系建设,主导端到端数据工作流(Workflow) 设计、搭建与规模化落地,保障数据供给效率与稳定性;
3.负责训练数据全生命周期管理:数据标准、质量治理、资产化管理、权限与版本管控;
4.带队攻坚数据处理关键技术与工程瓶颈,跨团队协同模型训练算法和底层架构工程、推动数据架构持续迭代。
岗位要求:
1.本科及以上,有大规模技术栈负责人/数据体系负责人经验;
2.精通大规模训练数据 Pipeline 建设,熟悉分布式数据处理栈(Spark/Ray/OSS 等),理解存储,网络等data infra硬件瓶颈;
3.优秀的架构设计…
招聘城市:深圳
岗位职责:
1.负责语言模型在人机语音交互、音视频对话能力上的算法设计优化;
2.调研业界前沿算法,追踪最前沿的技术动态,并应用在相关的项目中;
3.参与产品讨论,基于技术对产品提出改进建议。
岗位要求:
1.有语言模型应用经验优先,包括精调(SFT)、强化(DPO,PPO)等技术的落地;
2.熟悉Pytorch,Megatron, DeepSpeed等模型训练框架;
3.熟悉自然语言处理方向常用的理论和方法,熟悉阅读理解、问答、对话、语言模型训练等核心技术;
4.有高质量论文发表者优先(如NeurIPs,ICLR, ICML, ACL, EMNLP, CVPR,AAAI等);
5.具有良好的数学基础,良好的英语阅读能力,具备强烈的进取心、求知欲及团队合作精神,热衷于追求技术创新;
6.具备激情,好学…
招聘城市:北京
模型训练性能优化经验者优先;
4.熟练掌握CUDA性能优化手段,有算子编写优化项目经验者优先;
5.对模型前沿技术比较敏锐者优先;
6.有实际模型训练调参和效果评测项目经验的优先;
7.良好的沟通能力、解决问题能力。
部门介绍:
机器学习平台部负责腾讯“太极”机器学习平台的建设,构建面向搜索、广告、推荐的稀疏模型语言模型及稠密模型和通用机器学习的平台能力,为腾讯广告,微信搜索、社交、游戏、金融、云等多个业务提供易用、高效的一站式机器学习平台服务。我们的技术包括但不限于训练模型框架、高性能参数服务器、CPU/GPU 训练和推理加速、图神经网络、NLP自然语言处理、搜索工程与算法
招聘城市:北京
岗位职责:
1.负责腾讯模型数据飞轮整体规划与落地,设计自动化、可自生长的数据迭代闭环,形成模型数据正向增长飞轮;
2.负责模型数据平台、智能采样、难例挖掘、数据质检、正负样本管理等数据基建产品的需求设计与迭代落地;
3.联动算法训练、评测、业务团队,针对推理、代码、长文本、Agent调用等核心场景,制定数据迭代策略,定向产出高质量增量数据,驱动模型效果迭代升级;
4.建立统一的模型数据质量标准、流程规范与效率指标体系,优化数据清洗、蒸馏、精标全链路,提升模型迭代效率、降低迭代成本;
5.搭建模型幻觉、事实错误、逻辑偏差、安全风险等负样本数据闭环,持续优化模型对齐效果、稳定性与安全性;
6.结合腾讯元宝、行业解决…
招聘城市:北京
…数据生成及自动化评估等业务需求;
2.负责优化框架的易用性与稳定性,解决实际运行中的性能瓶颈,保障实验流程的高效执行;
3.支持各类外部Agent策略及评估逻辑的接入,维护相关接口与组件,确保系统的兼容性与扩展性;
4.结合模型训练视角,配合算法团队进行新Agent范式的工程化落地与探索。
岗位要求:
1.具备扎实的Python编程能力,熟悉异步编程(Asyncio)及并发处理的最佳实践,有良好的代码规范意识;
2.熟悉模型与Agent相关应用技术,熟练使用AI编程工具并理解其工作原理;
3.熟悉K8S及容器化技术,具备相关环境下的开发或部署经验;
4.了解模型训练全流程(如训练、SFT、RLHF)及基本原理;…