招聘城市:北京
…云原生环境下超大规模分布式系统的服务能力与平台化能力,为业务提供高可用、可扩展、高易用性的集群化服务;
4.参与开源共建与合作,提升团队与个人在业界的影响力。
岗位要求:
1.计算机相关专业,本科及以上学历,3年及以上工作经验;
2.精通 C++/Python/Java 中的一种,同时熟悉C++和Python更佳,具备丰富的大型软件系统研发经验;
3.具有大数据 infra 或 AI infra 方向的从业经验,并且至少参与过一种分布式系统的研发、优化或运维,包括但不限于计算引擎、调度引擎、任务编排框架、高性能计算与通信系统、应用与服务框架等;
4.非必需但可以加分的情况:熟悉Ray;参与过 Data + AI 的系统工程…
招聘城市:成都
…核心计算/存储引擎(如 Spark, Flink, ClickHouse, Iceberg 等)研发经验;
2.核心技能: 精通 C/C++ 或 Rust,具备扎实的系统编程与底层调优能力,熟悉 Linux 操作系统内核、多线程编程、并发控制、内存管理及 CPU/硬件加速技术(如 SIMD/AVX512);
3.领域知识: 深入理解 OpenSearch / Elasticsearch / Lucene 或主流向量搜索引擎(如 Milvus, FAISS 等)的实现原理与源码;对 HNSW/IVF 等向量索引算法及文本/全文检索有实际研发与性能调优经验者优先;
4.生态与计算框架: 具备开源大数据生态(如 Spark, Flink, Iceberg, ClickHouse 等)底层源码级开发或社区贡献经验者优先;熟悉 Ray 等分布式 AI 计算框架内核,或具备大规模异构资源调度与计算下推实战经验者优先。
岗位介绍:
在腾讯,后台开发工程师…
招聘城市:上海
…弹幕),构建高质量对齐数据集,助力 AI 搜多模态大模型研发与场景化应用。
工作要求:
【硬性要求】
1、本科及以上学历,计算机、大数据、人工智能等相关专业,5 年以上 AI 数据开发 / 数据工程相关工作经验,有大厂大模型 / 搜索 / 内容平台数据领域从业经历优先。
2、精通 Python 开发,熟练掌握Ray/Spark/Hadoop等分布式数据处理框架,了解 GPU 异构集群管理、MinIO/Alluxio 等存储技术,有爬虫系统开发、多模态数据处理经验者优先;熟悉内容平台数据特点(如音视频 / 弹幕 / UGC)者加分。
3、有AI 数据体系从 0 到 1 搭建经验,主导过大模型知识库、RAG 材料库、多模态数据集等项目落地,能独立完成搜索 / 内容场景数据处理架构设计与工程化实现…
招聘城市:上海
…要求:
职位要求
1. 精通 Python、Java、Go 等至少一种编程语言,具备扎实的分布式系统基础。
2. 深入理解以下至少一种技术体系,并具备线上平台化实践经验:
- 计算引擎(Ray)及其平台化封装;
- 数据湖/湖仓一体方案(Iceberg/Paimon/Lance)及元数据管理;
- 分布式调度系统、资源管理(YARN/K8s)或工作流编排平台。
3. 理解大模型训练与推理全链路中的数据流转机制,熟悉数据从采集、清洗、标注、增强到训练样本构造的全生命周期管理。
4. 对业务敏感,能快速理解业务背景,具备优秀的技术与业务结合能力、需求抽象能力和架构能力;学习能力强,能够快速学习新技术并应用于工程实践。
加分项
1. 有大厂或 AI 公司内部数据平台、评估平台的建设经验…
招聘城市:上海
…
5、质量与评估体系:建立数据质量监控与评估体系,确保输出数据集的洁净度、一致性与有效性,并能量化数据质量对最终模型效果的影响。
工作要求:
1、计算机科学、软件工程、大数据或相关专业本科及以上学历,有3年以上数据开发或算法工程经验。
2、精通Python,熟练使用Pandas、PyTorch等数据处理和深度学习框架,必须具备构建或优化训练数据Dataloader的实际经验。
3、深入理解多模态数据的特性及处理技术,具备丰富的数据建模和数据架构经验,能够设计统一、高效的数据处理抽象。
4、有使用Spark、Ray等分布式框架进行大规模数据处理的实战经验,理解其核心原理。
5、具备优秀的业务理解能力和跨团队(数据、算法、Infra)沟通…
招聘城市:上海
…流程研发,自主完成算法问题定义、生成模型架构设计、核心算法方案迭代、训练数据算法闭环构建、量化评测算法体系搭建,针对性优化模型生成效果与算法性能。
3. 联动数据、评测、内容等团队,基于算法实验结果与量化指标,制定模型优化迭代方案,聚焦多模态生成算法能力升级,推动音视频生成算法效果落地与规模化最优迭代。
4. 自主设计系统性算法对照实验,深度复盘实验失败案例、定位算法缺陷与瓶颈,针对性优化模型生成精度、画面连贯性、音画一致性等核心指标,持续迭代升级生成算法能力。
工作要求:
任职要求
1. 本科及以上学历,计算机、人工智能、深度学习、多媒体技术等相关专业,具备扎实的深度学习、多模态生成技术功底。
2. 熟练掌握PyTorch框架及分布式训练…
招聘城市:北京,上海,杭州
…优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士;深入理解 Transformer 架构及大模型训练全流程。
专业深耕: 在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment 或 RL(强化学习) 领域有深厚积累。
工程能力: 熟练使用 PyTorch,有 DeepSpeed、Megatron-LM 或 Ray 等大规模分布式训练实战经验。
加分项:
在 NeurIPS, ICML…
招聘城市:深圳
…Ray/Spark 等框架,优化万亿级 Token 的处理效率,挑战多模态超大规模数据的计算瓶颈;
5.质量度量体系:建立数据与模型效果的强关联指标,通过自动化评测闭环,量化每一批次数据对模型“智商”的贡献。
岗位要求:
1.计算机相关专业,硕士及以上学历,3年以上数据研发或 AI 平台经验,对 Data-Centric AI 有深刻理解;
2.既能玩转 大规模分布式计算(Spark/Flink/Ray/Hudi),又深度理解 多模态模型训练流程(Pytorch/DeepSpeed),能与算法同学无缝对话;
3.熟悉图像、视频、语音等非结构化数据的处理逻辑,有 VLM(视觉语言模型) 或 音频大模型 数据管线建设经验者重磅加分;
4.具备自研自动化标注、合成及评估工具的能力,能通过工程手段…
招聘城市:北京
…Ray/Spark 等框架,优化万亿级 Token 的处理效率,挑战多模态超大规模数据的计算瓶颈;
5.质量度量体系:建立数据与模型效果的强关联指标,通过自动化评测闭环,量化每一批次数据对模型“智商”的贡献。
岗位要求:
1.计算机相关专业,硕士及以上学历,3年以上数据研发或 AI 平台经验,对 Data-Centric AI 有深刻理解;
2.既能玩转 大规模分布式计算(Spark/Flink/Ray/Hudi),又深度理解 多模态模型训练流程(Pytorch/DeepSpeed),能与算法同学无缝对话;
3.熟悉图像、视频、语音等非结构化数据的处理逻辑,有 VLM(视觉语言模型) 或 音频大模型 数据管线建设经验者重磅加分;
4.具备自研自动化标注、合成及评估工具的能力,能通过工程手段…
招聘城市:北京
…定义、模型实现到实验验证的闭环能力者优先。8. 在 ICLR / ICML / NeurIPS / CVPR / CoRL / ICRA / IROS 等会议发表过相关论文,或有高质量开源项目、竞赛经历、顶尖实验室经历者优先。【AI INFRA】世界模型 AI Infra 高级工程师 / 实习生AI Infra · Training Systems | 北京 · 全职 / 实习| 岗位职责 RESPONSIBILITIES1. 负责世界模型、DiT、多模态生成模型的大规模训练基础设施建设,持续提升训练吞吐、MFU、显存效率、集群扩展效率、任务稳定性和资源利用率。2. 围绕 FSDP、Megatron、TorchTitan 等分布式训练框架开展工程适配和性能调优,设计并优化并行策略、计算与通信效率以及大规模 GPU 集群下的训练扩展能力。3. 建立数据驱动的训练性能分析与优化体系,定位计算、通信、网络、显存、I/O、Checkpoint…