招聘城市:深圳
…2.全面负责预训练数据工程体系建设,主导端到端数据工作流(Workflow) 设计、搭建与规模化落地,保障数据供给效率与稳定性;
3.负责预训练数据全生命周期管理:数据标准、质量治理、资产化管理、权限与版本管控;
4.带队攻坚数据处理关键技术与工程瓶颈,跨团队协同模型训练算法和底层架构工程、推动数据架构持续迭代。
岗位要求:
1.本科及以上,有大规模技术栈负责人/数据体系负责人经验;
2.精通大规模预训练数据 Pipeline 建设,熟悉分布式大数据处理栈(Spark/Ray/OSS 等),理解存储,网络等data infra硬件瓶颈;
3.优秀的架构设计、团队管理与跨部门推进能力,能独立负责整条数据战线;
4.熟悉大模型预训练流程和算法(文本或多…
招聘城市:北京
…推动能力,以平台能力的实际使用规模与效率提升衡量交付成果。
加分项:
1.有万卡级训练集群建设或运营经验,或异构算力适配与统一调度经验;
2.有 RL 训练链路工程化经验,包括训推混部编排、权重同步、工具沙箱环境管理;
3.有大模型评测体系、数据血缘或元数据管理系统的建设经验;
4.主导过多平台整合、技术栈收敛或大规模系统迁移;
5.在 PyTorch、Megatron-LM、vLLM、SGLang、Ray、Kubernetes 生态有代码贡献,或在 MLSys、OSDI、NSDI 等会议有论文发表。
岗位介绍:
在腾讯,技术人解决问题的激情永不熄灭。无论是面对产品、程序的问题,还是生活与人的问题,腾讯技术人都力图交出漂亮的答卷。我们善用科学工具,以强大…
招聘城市:北京
…核心 Badcase,形成“评测—数据—训练—验证”的研发闭环,驱动模型能力持续迭代;
5.推进视频全流程研发:负责视频方向的 预训练、中训练、后训练的数据生产,开展SFT、强化学习等后训练算法研发,建设高质量视频训练数据及自动化数据生产流程,探索更高效的视频能力学习与对齐方法。
岗位要求:
1.计算机视觉、人工智能、机器学习等相关方向硕士及以上学历,具备扎实的深度学习基础;
2.在视频理解、多模态大模型、视觉语言模型或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对多模态模型训练及后训练方法有较深入理解;
4.具备较强的算法研究、实验分析与工程实现能力,能够独立推动研究问题从定义到落地…
招聘城市:北京
…交互体验;
3.负责语音大模型的技术研发工作,推动模型性能提升与创新应用。
岗位要求:
1.计算机科学、人工智能、电子工程、信号处理等相关专业硕士、博士研究生;
2.掌握语音大模型、语音合成、语音识别、音频生成、语音转换、语音Codec等一项或多项研究和开发经验;
3.熟悉主流对话大模型(如GPT4o、GLM-4-Voice、Qwen2.5-Omni、Voila等),有相关项目实践经验者优先;
4.熟练掌握PyTorch等深度学习框架,有大模型训练框架Megatron/Deepspeed实践经验者优先;
5.熟悉大模型相关结构设计及原理,有大规模预训练、后训练经验者优先。
部门介绍:
腾讯AI Lab是腾讯的公司级AI实验室,于2016年4月在深圳成立。借助腾讯丰富应用场景、大数据、计算…
招聘城市:深圳
岗位职责:
1.负责文档数据处理的全链路工程实现,包括负责支持文档数据存储计算处理、解析、去重、质量筛选等数据处理环节;
2.有丰富的文档解析或大模型预训练数据处理经验、基于Agent的数据生产链路研发经验优先;
3.有多模态理解数据处理经验优先。
岗位要求:
1.硕士及以上学历,计算机视觉、自然语言处理或多模态方向背景优先;
2.熟练掌握深度学习框架(如PyTorch、TensorFlow),熟悉模型训练及数据处理经验,具备优秀的独立开发与分析调研能力;
3.能handle十亿量级的数据处理,对常用的数据工程技术如spark、hadoop、ray,文件存储系统有实践经验;
4.具备良好的团队协作能力,具备强烈的自我驱动力,能够独立完成系统分析与优化,落地…
招聘城市:深圳
…模型训练与推理的多模态数据处理与构建管线,覆盖图像、视频、音频、文本、3D 及多模态理解等数据类型,支撑预训练、后训练(SFT / RLHF / Preference)及评测数据构建;
2.大规模数据工程与系统建设:构建高可靠、可扩展的数据处理系统,支持 TB / PB 级数据规模,负责批处理与流式处理任务的工程实现,参与或主导分布式并行计算(CPU / GPU 混合)的工程落地;
3.数据质量与稳定性保障:建立数据校验与质量评估机制,覆盖数据完整性、一致性、分布异常与质量回归等场景,设计并推动数据处理链路的监控与异常治理;
4.数据资产化与标准化建设:推动多模态数据结构的标准化设计,建设数据元信息、版本管理与可追溯机制,提升数据的…
招聘城市:北京
…工作经验,有大模型实际项目落地经验者优先;
2.算法深度:深入理解 Transformer 架构,熟悉 LLM 的全生命周期(预训练、SFT、RLHF/DPO);精通 RAG 技术栈,对索引构建、检索策略、上下文压缩有深入研究;
3.推理与 Agent 能力:熟悉推理类模型的训练或微调方法,了解如何通过数据工程提升模型的逻辑推理与长链条思考能力;熟悉主流的 Agent 框架(如 LangChain, LlamaIndex, AutoGPT 等)及其在复杂调研任务中的应用;
4.底层技术功底:熟练掌握 PyTorch 等深度学习框架;了解分布式训练与高效推理优化技术;
5.综合素质:具备优秀的数据敏感度与逻辑思维能力,能够从复杂的业务需求中抽象出核心技术挑战,对 AI 搜索的未来演进(如思考型搜索)有独到见解;
6…
招聘城市:北京
…维护,支持强化学习、数据生成及自动化评估等业务需求;
2.负责优化框架的易用性与稳定性,解决实际运行中的性能瓶颈,保障实验流程的高效执行;
3.支持各类外部Agent策略及评估逻辑的接入,维护相关接口与组件,确保系统的兼容性与扩展性;
4.结合大模型训练视角,配合算法团队进行新Agent范式的工程化落地与探索。
岗位要求:
1.具备扎实的Python编程能力,熟悉异步编程(Asyncio)及并发处理的最佳实践,有良好的代码规范意识;
2.熟悉大模型与Agent相关应用技术,熟练使用AI编程工具并理解其工作原理;
3.熟悉K8S及容器化技术,具备相关环境下的开发或部署经验;
4.了解大模型训练全流程(如预训练、SFT…
招聘城市:深圳
岗位职责:
1.负责语音/音频大模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发;
2.负责预训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:深圳
…1.负责语音/音频大模型研发,包括语音对话(语音交互/音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频大模型的预训练、后训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有…
招聘城市:北京
…负责混元平台核心架构设计与迭代开发,聚焦大模型训练、推理、评估、数据多个核心场景,解决大规模训练、数据处理、评测等场景问题,持续提升大模型训练稳定性与平台整体性能上限;
2.LLMOps工程体系迭代与研发效能升级:持续深耕并跟进业界AIGC、大模型工程化前沿技术与落地实践,结合内部模型预训练、后训练、迭代、部署全流程诉求,持续优化平台技术方案与产品形态。聚焦平台易用性、自动化、标准化建设,降低大模型研发与落地门槛,持续完善、升级、落地全链路LLMOps研发体系。
岗位要求:
1.本科及以上学历,具备扎实的AI工程化、大模型研发底座技术功底,熟练掌握 PyTorch/TensorFlow/DeepSpeed 等主流深度学习框架,拥有真实落地的模型训练优化、分布式训练…
招聘城市:北京
…跟踪 VLM 领域数据相关前沿研究(如预训练数据设计、模态融合策略),主导技术攻关与专利申请;输出可复用的数据处理算法组件与技术文档,建立团队数据算法基准体系。
岗位要求:
1.计算机科学、人工智能、自动化等相关专业硕士及以上学历,1年以上多模态大模型或计算机视觉领域研发经验。;
2.扎实的算法基础:精通深度学习、计算机视觉与自然语言处理核心理论,深入理解 Transformer 架构、模态对齐原理及多模态预训练机制。;
3.工程能力突出:熟练掌握 Python 编程语言,精通 PyTorch 框架及 HuggingFace 生态,具备大规模数据处理(Spark/Flink)与分布式训练(DDP/FSDP/DeepSpeed)经验。;
4.数据处理实战经验:具备 VLM 预训练数据构建全流程经验,熟悉图像去重…
招聘城市:北京
…参与 Research 场景下 Agent 框架的研发与维护,支持强化学习、数据生成、自动化评估和实验复现等业务需求;
2.统一封装模型调用、工具调用、任务执行、上下文管理、日志 Trace、结果收集和评估逻辑,沉淀稳定可复用的框架组件;
3.支持各类 Agent 策略及评估逻辑接入,维护相关接口、组件和验证机制;
4.优化框架易用性、稳定性和性能表现,解决实际运行中的并发、资源、链路和行为一致性问题,保障实验流程高效执行;
5.结合大模型训练视角,与算法团队共同推进新 Agent 范式、强化学习训练链路和评测方法的工程化落地。
岗位要求:
1.具备扎实的 Python 编程能力,熟悉异步编程(Asyncio)、并发处理和工程化最佳实践;
2.熟悉大模型与 Agent 相关应用技术,理解模型…
招聘城市:深圳
…5.构建并维护高质量的语音多模态数据集、自动标注与数据合成技术。
岗位要求:
1.计算机、电子工程、人工智能、语言学或相关领域博士,或硕士加多年相关工作经验;
2.深入理解语音音频信号处理、声学建模、语言模型和大模型架构;
3.熟练掌握 语音识别,语音翻译等 一项多多项系统开发流程,具有多语言、多任务或端到端系统经验者优先;
4.对以下方向具备深入研究或实践经验者优先:;
5.语音表征预训练(如 HuBERT, Wav2Vec, Whisper 等);
6.多模态对齐与跨模态建模(音视频和文本);
7.有推动大模型在音频理解任务上达到 SOTA 性能的经验优先;
8.熟练掌握 PyTorch、TensorFlow等深度学习框架,有大规模训练与分布式系统经验者优先…