招聘城市:北京
…化等;
2、参与/负责多个业务场景中的模型压缩技术实现,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案,参与或主导过大型项目业务落地或有相关论文者优先;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
5、有大模型压缩或小型化模型设计经验者优先;
6、有优秀…
招聘城市:北京,上海
…使模型能主动在重复性任务或封闭任务域中总结、提炼认知与经验,并进行有效复用,达到不断自进化 / 自迭代 / 持续学习的效果。
3、训练智能体系统的系统性长程任务高效处理能力,可以自主进行合理的任务拆解、分工;探索通过 agent swarm 或其他先进的 multi-agent system 进行系统性长程任务的并行执行和提效。
4、探索多模态推理和多模态环境交互的范式,并基于此进行增强智能体系统在复杂全模态环境下的任务完成能力。
任职要求:
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读;
2、在强化学习、文本 / 多模态大模型训练、Agent、世界模型等一个或多个领域有较深入的研究和实践经验…
招聘城市:北京,上海
…方向。
2、探索通过世界模型作为物理仿真引擎的进阶,兼顾仿真和真机的优点,实现泛化评测、强化学习和多样性数据合成。
3、探索通过环境交互的在线强化学习,涉及仿真环境的搭建、数据合成和真机实验,研究通过自我进化的下一代智能提升的关键途径。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
4、在大模型领域或强化学习领域,主导过大影响力的项目或论文者优先;
5、出色…
招聘城市:北京,上海
…书业务场景中的模型压缩技术的实现和优化,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
任职资格:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
加分项:
有优秀开源项目经历;
参与或主导过大型项目业务落地或有压缩相关论文;
有大模型压缩或小型化模型设计经验
招聘城市:北京,上海
…生成过程带来新的能力跃迁并进行度量,分析模态和任务间的相互关联,指引模型架构、训练策略等选型。
3、多模交互方向:包括通用世界模型、音视频交互等,研究动态多轮交互中的一致性、真实性和长程记忆等关键能力的自动化度量,指引基座模型的迭代。
任职要求:
1、硕士及以上学历,计算机或相关专业,博士优先。;
2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurIPS / ICML / ICLR / CVPR / ICCV / ICASSP 等顶级会议发表论文者优先;
3、优秀的代码和算法功底,具备工匠精神,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
4、在大模型领域或强化学习领域,主导过大影响力的项目或论文者优先…
招聘城市:深圳,北京
岗位职责:
工作职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
任职资格:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:北京,上海
…建设 Trillion 级别的大规模跨模态数据处理与合成链路。负责从训练数据获取到配比建模的全流程优化
合成方法演进:探索大规模合成数据 (Synthetic Data) 与自蒸馏 (Self-distillation) 技术,制定合成数据应用策略
理论探索:研究Data Scaling Laws,解决数据扩展中的模型坍塌(Model Collapse)与多样性瓶颈问题,通过课程学习(Curriculum Learning)等训练策略,显著优化Token/FLOPs转化效率
2. 长上下文 (Long Context) 与高效架构演进
长窗口突破: 持续Scaling Up模型的Context Length,优化超长上下文机制,重点提升LongCat基座模型在长上下文上的表现
架构优化: 探索并验证MoE(混合专家)、稀疏注意力(Sparse Attention)、线性注意力等模型结构;结合剪枝与稀疏化技术,协同优化训练与推理效率,提升超长…
招聘城市:北京,上海
…1、计算机、人工智能、数学、统计学、电子信息或相关专业本科高年级、硕士或博士在读;
2、具备扎实的机器学习基础,对以下至少一个方向有较深入理解: - 大语言模型与后训练 - 强化学习 / Online learning / Bandit / Sequence decision making - Agent / Tool use / Planning / Reasoning - 记忆增强模型 / RAG / 长上下文建模 - Reward modeling / Preference learning / PRM / ORM
3、熟悉 Python,具备较强的工程实现能力,能够独立完成实验、调参与结果分析,并具有一定的大模型训练或推理实践经验;
4、具备较强的论文阅读、问题抽象与实验设计能力,能够围绕一个研究问题提出清晰假设、设计验证方案并推进落地;
5、具备良好的沟通协作能力与研究主动性,能够在不确定性较高的前沿问题中快速学习、持续推进…
招聘城市:北京
…与机制设计、在线学习与探索利用权衡、大规模稀疏模型的学习、研究或工业实践
【为什么是我们】
1.研究环境稀缺:多数 Agent 与后训练研究的评价止于静态 benchmark 或仿真环境。本岗位同时具备硬约束、真实资金代价与小时级无偏反馈,策略优劣由线上实验判定——该量级的实时决策反馈数据与实验能力在学术环境中不可得,在工业界亦不多见。
2.业务杠杆直接:为年度百亿规模的直接资金投放,分配效率每提升一个百分点即对应可计量的绝对收益。
3.方法论可外推:带全局约束的序贯资源分配是一类通用问题结构,与流量分配、库存与定价、算力调度同构。本场景中验证有效的奖励设计、约束优化与…
招聘城市:北京,上海
岗位职责:
岗位职责:
1、基于大模型的策略算法创新研发,包括用户舆情的多模态解析等项目
2、数据智能提效体系建设,开发基于LLM的数据分析、数据挖掘自动化流水线
任职要求:
任职要求:
1、掌握Prompt设计方法论,具备多轮对话调试经验;熟练使用LangChain/LlamaIndex等框架进行RAG系统开发
2、 熟悉大模型基础原理,了解大模型微调技术
3、扎实的Python编程能力,熟练掌握tensorflow、pytorch等深度学习代码框架
4、2026年毕业的本/硕在读(计算机、软件工程、数学或相关专业优先)。自我驱动,结果导向,对新技术有好奇心和探索能力
招聘城市:北京,上海
…输出序列长度等约束下的模型能力,如长序列能力、记忆能力等。
2、探索更科学和前沿的训练策略,对影响training dynamic的关键变量(如学习率、batchsize、初始化等)形成更科学的认知,探索diffusion LLM,test-time scaling等技术。
3、研究模型结构和数据的耦合关系,优化分阶段训练范式。
4、结合MLsys解决大规模训练中遇到的卡点问题,实现算法和工程联合设计。
任职要求:
1、熟悉NLP、LLM、MLsys、Optimization、OR、Control、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验;
2、熟悉Python、C++等至少一门编程语言,熟悉LINUX环境;
3、熟悉Pytorch、 Megatron、DeepSpeed 等开源训练框架。
加分项:
1、有影响力的开源项目中做出过核心贡献…
招聘城市:北京,上海
…3. 探索VLA的data-scaling方案,通过VLM的基座能力提升来推进具身任务泛化,实现zero-shot/few-shot的跨任务、跨本体的泛化;
4. 积极探索多模态大模型同环境交互的学习方法,研究通过强化学习的下一代智能提升的关键途径。
5. 与各相关部门保持良好沟通,深度参与多模态模型的训练过程,共同推动多模态大模型持续优化。
任职要求:
1. 硕士及以上学历,计算机、数学、统计学或相关专业。
2. 熟悉Java/Python/C++等编程语言,良好的编码习惯和一定的工程能力 。
3. 具有深度学习和大模型原理的基础知识,具有多模态大模型、具身智能或强化学习之一的研究经验。
4. 良好的沟通能力、团队合作精神以及较强的问题…
招聘城市:北京,上海
岗位职责:
1、探索新一代大语言模型基座架构,以高效推理模式为核心优化目标,探索全新模型结构和scaling law。
2、在工作中能快速成长,积极探索前沿技术,解决好业务中遇到的实际问题,完成数据处理、建模和工程上线,对AI技术始终保持热爱,实习期间可发表论文。
任职要求:
1、硕士/博士在读,计算机、数学等相关专业,国内985/全球TOP高校优先,实习期至少3个月;
2、大模型领域前沿技术有深度研究,在国际顶会/顶刊发表过高水平论文者优先;
3、在大模型领域有实践经验,包括数据过滤、数据去重、数据合成,或继续预训练、SFT、RLHF,或知识蒸馏、量化和模型剪枝,或参与过rag和agent商业产品研发;
4、有良好代码能力…
招聘城市:上海,北京
…中的模型压缩技术的实现和优化,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效;
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地;
任职要求:
任职资格:
1、熟悉蒸馏、剪枝、量化等模型压缩常用方案;
2、熟悉至少一种主流的大模型训练或推理框架(PyTorch / Megatron / vLLM / SGLang等)的原理和实现;
3、熟练使用Python/C++至少一种语言,并具备良好的代码质量和风格;
4、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
加分项:
1. 有优秀开源项目经历;
2. 参与或主导过大型项目业务落地或有压缩相关论文;
3. 有大模型压缩或小型化模型设计经验
招聘城市:上海
岗位职责:
1、参与LLM/VLM相关的技术业务落地,解决小红书社区治理中的实际问题;
2、进行大模型的前沿技术探索、模型后训练和应用,包括但不限于数据分析、多模态理解、Agent搭建、RAG、SFT/DPO等技术。
任职要求:
1、计算机/数学/统计学/模式识别相关专业,硕士及以上学历;
2、有扎实的编程基础,熟悉Python/SQL等编程语言,至少熟悉一个常用深度学习框架;
3、熟练掌握大规模语言模型/图模型/视觉语言模型/机器学习/数据挖掘/深度学习/强化学习/大模型异常检测中的一项或多项,有顶会paper或者竞赛获奖优先;
4、优秀的沟通协作、分析问题和解决问题的能力,对解决具有挑战性问题充满激情。
招聘城市:北京,上海
岗位职责:
1、海量文本数据处理,包含分类、质量打分、语义识别等;
2、建立文本处理流程,持续优化模型效果;
3、跟踪最新NLP研究成果,并应用到处理流程中。
任职要求:
1、计算机相关方向本科及以上学历;
2、良好的编程能力,熟练运用Python语言,熟悉常见的机器学习框架;
3、熟悉常见的机器学习和NLP算法,了解当前热点和前沿技术;
4、有高水平会议或期刊论文者优先。
5、可尽快到岗者优先,至少实习3个月,每周工作日出勤至少4天。
招聘城市:上海
…1. 参与LLM/MLLM/Agent/Embedding相关算法研发与业务落地,解决小红书社区生态内容治理中的实际问题;
2. 进行大模型的前沿技术探索、模型后训练和应用,包括但不限于数据分析、多模态理解、Agent搭建、RAG、SFT/GRPO等技术;
3. 面向基于内容理解技术的生态审核场景,持续提升目标域的机审召回率及准确率能力;
任职要求:
1.硕士及以上学历,计算机科学与技术、人工智能、计算机、机器学习、大数据、数学等相关专业;
2.熟悉Python、C/C++等语言,具有较强的代码开发和实现能力,至少熟练掌握Pytorch等主流深度学习框架,能熟练使用Linux。
3.发表过多模态大模型领域知名论文、有多模态/大模型训练调优、Agent、RAG、PE…
招聘城市:上海,北京
岗位职责:
1、面向多类任务(任务型/复杂指令/多轮对话/工具使用/推理/偏好/安全),批量构造 prompt families
2、设计 Prompt diversity、difficulty 的维度设计和系统实现
3、结合模型输出结果,基于 score / RM / heuristics 做 prompt×response 联合筛选
4、全程参与做 data → model → eval → refine 的闭环和模型合版实验
5、参与 SFT-prompt 和 RL-prompt 的差异化设计(多阶段 / multi-turn RL-friendly prompt)
任职要求:
对 LLM 对齐、后训练、对话系统有兴趣,细致耐心,善于发现模型边界与异常案例
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、采购项目后端工作的协助推进,负责每月账单金额核对及拆分、协助完成成本使用数据更新;
2、跨部门协调沟通,根据业务类别,与相关业务部门项目对接人员核对并根据合同签署内容确认账单最终版本后提交采购业务负责人;
3、协助完成采购项目的进度跟进,问题收集与反馈等;
4、其他与采购项目相关的数据资料整理工作;
工作要求:
1、熟练使用office办公软件,Excel表格能力突出;
2、具有较强的逻辑性及沟通能力;
3、工作细致、仔细、责任心强;
4、对数字敏感,统计、财务、法律、审计、采购等相关专业背景优先。
实习期:平均每周工作日不少于4天,能实习6个月以上的人员优先
投递简历
招聘城市:上海
岗位介绍:
职位亮点
加入我们,你将参与核心推荐系统的精排模型研发。面对海量用户行为数据,你将运用最前沿的深度学习技术,优化排序精度,直接提升业务点击率(CTR)、转化率(CVR)等核心指标。
职位描述
工作职责:
1、模型迭代:参与精排模型重点模块如特征交叉、序列建模、多目标/多场景建模的研发与优化。
2、前沿跟进:追踪顶会论文,将前沿算法落地于实际业务。
工作要求:
1、计算机、数学、统计学或相关专业全日制统招在读(硕士/博士优先),2027届及以后毕业;具备扎实的数学基础,熟悉常用机器学习和深度学习算法。
2、代码能力:熟悉python,能高效进行数据处理及模型训练;具备良好的 C++ 基础;熟悉 SQL,能进行简单数据分析。
3、具备…