招聘城市:北京,上海,杭州
岗位职责:
1.海量数据的高效筛选与质量评估
2.智能数据配比与动态增强
3.严谨可复现的算法评测与验证体系
4.面向预训练效率的训练算法优化
5.通用场景下可扩展的数据管线设计
6.端到端自动化高性能数据流水线构建
任职要求:
1. 年级不限,本科及以上在读,计算机、人工智能、软件工程或相关交叉学科背景优先;
2. 拥有卓越的工程实现能力与扎实的算法功底,熟练掌握至少一门主流编程语言及 PyTorch 框架,熟练使用 Code Agent 者优先;
3. 深耕机器学习与深度学习领域,具备大型语言模型(LLM)项目实战或大规模预训练实际经验者优先;
4. 在 NeurIPS、ICML、COLT、ICLR、CVPR 等顶级会议或期刊上发表相关研究成果…
招聘城市:北京,上海
岗位职责:
1. 负责模型策略相关评估体系的搭建与优化
2. 结合业务场景设计有效的评测方案并推动落地
任职要求:
1. 善于沟通、按时完成上级交给的工作
2. 拥有良好的团队合作精神,能迅速融入团队
3. 具备良好的学习能力,能够不断改进工作方法
招聘城市:北京,上海
…方法探索:深入研究图像生成模型(Text-to-Image / Image Editing 等)在真实使用场景中的失效模式,如语义偏移、指令遗漏、风格漂移、结构崩坏、幻觉生成等问题;探索并实践包括但不限于:
-SFT / Preference Learning / RL-based 方法在图像生成中的应用
-多模态 reward model 及 reward system 设计
-Spatial difusion model RL 算法设计及实验验证
-探索图像编辑能力与 agentic 能力结合,基于小红书的 deep research 能力,为用户在穿搭、家装场景等生活提供独特体验
-探索图像生成能力与 thinking with generated images 结合提升模型的推理能力
3、跨职能协作与能力落地:与产品、工程、评测及安全团队紧密合作,将对齐与 post-train 成果落地到实际图像生成与编辑产品中,持续推动模型在可控性…
招聘城市:北京,上海,杭州
岗位职责:
面向大模型训练/推理场景,开发和优化高性能 GPU 算子(Attention、GEMM、LayerNorm、MoE、Element-wise 等),逼近硬件理论峰值
针对新模型结构(长 context、MoE、线性 Attention 等)设计定制化 kernel,解决原生框架无法覆盖的性能瓶颈
深度优化访存效率、计算-访存重叠、算子融合(fusion),降低 kernel launch 开销与显存占用
参与推理引擎核心链路优化:KV Cache 管理、量化算子(INT8/FP8/INT4)、投机采样、continuous batching 等
与训练框架、模型算法团队紧密协作,将算法需求转化为高效的系统实现
探索新硬件(新一代 GPU / 国产算力)上的算子适配与性能调优
任职要求:
基础要求
扎实的 CUDA 编程能力,深入理解 GPU 体系结构(SM、warp、shared memory、tensor core、访存层级)
熟悉性能分析工具(Nsight Compute/Systems、nvprof…
招聘城市:北京,上海
…实现类人的多模态能力。
探索方向
多模态理解模型基础
具备对图片/视频/语音的全面感知,例如文字/表格/实体/动作/空间关系/情感/声音事件等;
具备视觉和语音联合感知,例如在视频上同时输入视觉和语音能够增强理解;
具备多模态输入的推理能力,模型能够无偏地利用 context 中不同模态的信息进行高质量的结构化推理,解决复杂问题。
视觉生成基础
具备高质量多模态输入的图片生成模型,提升真实感、一致性和复杂度;
具备强可控与可编辑的能力,支持多种控制方式并保持编辑前后的一致性;
探索 Diffusion 理论,在生成效率和效果上追求 10x 提升的架构创新。
音频生成基础
具备高质量多模态输入的音频生成模型,包括人声、哼唱…
招聘城市:北京,上海,杭州
…现有 Attention、NTP 等范式保持批判性思考,例如探索全新的
探索新架构、新目标函数、新训练范式在 Post-Training 中的可能性
参与从模型 → 推理过程 → 自学习环境(System-level Scaling)的演进
任职要求:
基础要求
扎实的机器学习 / 深度学习基础,对模型训练全流程有深入理解
熟悉至少一个方向:
强化学习(RL Scaling / RLAIF / Online RL 等)
多模态学习(尤其是视频、时序、感知建模)
Agent / 多智能体系统
良好的工程能力,能将研究想法落地为稳定系统
加分项
有大模型 Post-Training 或 MOE RL Scaling 实战经验
RL Algo & Infra co-design
对 Token 效率、推理效率、多尺度学习 等问题有深入思考
参与过 Agent 系统或复杂训练闭环的设计
有“系统思维”,不满足于单点指标提升
招聘城市:北京,上海,杭州
…针对性优化,提升大模型的应用价值。
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 对大模型 RL 技术有极大热情
2. 有 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI 等顶级学术会议发表过有影响力研究成果的优先。
3. 主导、参与过 AI 相关的有大影响力的开源/闭源…
招聘城市:上海,北京,杭州
…复杂应用场景下应用这些工具的实践经验。
2、对齐技术研究经验:深入理解监督学习、强化学习、表示学习等方法,并在至少一个 AI 领域有过研究经历或通过机器学习算法成功解决过复杂问题。
3、卓越的实验设计与问题解决能力:具备设计复杂实验和分析实验结果的能力,能够识别并解决模型在真实应用中的关键技术挑战,具备创新思维,并能够有效沟通、与团队协作。
加分项:
在顶级学术会议(如 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI)发表过有影响力的研究成果。
在 ACM/ICPC、NOI/IOI、Kaggle 等竞赛中获得优异成绩者优先。
参与过 AI 相关的有大影响力的开源/闭源项目、有 AI Alignment 相关研究经验或大模型应用项目经历者优先。
招聘城市:北京,上海,杭州
…以下几个方向进行深入探索和落地:
1、量化方向:负责但不限于大语言模型的低精度训练(FP8)、推理(W8A8KV8等)、低精度优化器(量化梯度、优化器状态、参数等)
2、高性能模型结构:大语言模型Finetune或者其他阶段的LoRA系列(熟悉各种变种),训练阶段的MQA/GQA系列等
3、稀疏化方向:大语言模型剪枝、稀疏、蒸馏、Sparse Attention等
4、新型方向:Medusa、超长文本、Speculative Sampling等
任职要求:
分布式
1、熟练掌握Linux环境下的C/C++、Python语言;
2、具备扎实的计算机科学功底和编程能力,熟悉常见算法和数据结构,具有良好的编程习惯;
3、能够熟练使用至少一种主流的机器学习框架(TensorFlow / PyTorch等),熟悉框架内部实现;
4、熟悉Transformer模型及其应用场景等;
轻量化
1…
招聘城市:北京,上海,杭州
…新型模型结构探索
探索 Transformer 之后的结构优化方向,包括但不限于:
- MoE
- Hybrid Attention
- Retrieval-enhanced Architecture
以及:长上下文建模 / KV Cache 优化 / 推理效率优化 / 稀疏化与动态计算
我们希望找到:真正影响模型能力边界的结构,而不是参数堆叠。
3. 优化器与训练系统
研究超大模型训练中的优化与稳定性问题,包括:
- AdamW / Muon / Sophia / Shampoo 等优化器探索
- 混合精度训练
- 大 Batch 训练
- 大规模训练异常分析
任职要求:
我们希望你具备
基础要求
- 计算机 / 数学 / 物理等相关专业本科以上
- 扎实的 Python 能力,熟悉 PyTorch
- 良好的机器学习与深度学习基础
加分项
数学 / 算法能力强:ACM / ICPC / NOI / IOI / 数学物理竞赛背景 / 强统计学与优化基础
有大模型训练经验:Pretraining / MoE / 长上下文训练…
招聘城市:北京,上海
…Dots)AI 对话应用的全栈功能研发,熟练借助 AI 编程工具(如 Claude Code、Cursor、Codex 等)实现人机协同编程,独立完成完整功能模块的端到端(Client-Server-AI)架构设计与高质量交付。
2、Agent 系统与工作流建设:参与构建连接大模型与业务场景的 Agent 系统,设计并落地多步推理(Multi-step Reasoning)、动态 Workflow 编排、多模型路由、多样 Tool Calling 、 DeepResearch 等核心机制。
3、服务端与高并发对话系统研发:参与 AI 对话产品服务端核心架构设计,构建支撑千万级并发的流式消息分发与路由系统(基于 SSE / WebSocket / gRPC 等协议);推进微服务系统容量规划、全链路追踪(Trace)与性能瓶颈调优。
4、大前端与跨端交互体验攻坚:具备跨端视野,深度参与大前端…