招聘城市:北京,深圳
…能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.参与Agentic强化学习算法研究,改进奖励函数设计和强化训练效率
2.参与研发computer use agent (CUA) 项目研发
3.参与研发数字GUI模型和物理Embodied模型统一的强化学习算法
4.参与自研Agent模型的研发和技术成果沉淀
任职要求:
1.对深度学习、图像处理、自然语言处理等领域有较深入的研究和实践经验。
2…
招聘城市:北京,杭州
…优秀的分析、解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证;
3、熟练掌握 TensorFlow/PyTorch 等深度学习框架中的至少一种,具备优秀的编程能力,熟悉 Python 等编程语言,具有扎实的数据结构和算法功底;
4、有推荐系统、搜索广告、CTR/CVR 预估、用户行为建模等广告算法相关经验者优先;
5、有游戏、网服工具、短剧小说垂类行业投放经验者优先;
6、具备以下 AI 相关经验者优先:熟悉 GPT/LLaMA 等主流大模型原理,有 RAG、Agent、SFT/RLHF、Prompt Engineering 等实践经验;或熟悉多模态大模型、生成式 AI 技术,有图像/文案生成项目经验;或熟悉强化学习算法,有序列决策、智能出价应用经验;
7、具备优秀的研究和创新能力,在…
招聘城市:武汉,北京
…学习基础;
4) 对大型语言模型技术有强烈的求知欲和一定的知识储备;
5) 具备优秀的逻辑分析能力、团队合作精神和沟通能力,能够清晰地表达技术观点,并与跨职能团队高效协作,共同解决问题;
加分项
1) 在校期间有相关的项目、实习或竞赛经验(如NLP、推荐系统、CV等);
2) 对PromptEngineering有深入理解,或有LoRA/QLoRA等微调方法的实践经验;
3) 熟悉RLHF(如DPO)等对齐优化技术;
4) 在顶级会议或期刊上发表过相关论文;
核心算法实习生(27-28届,武汉或北京均可)
实习内容:
1)参与大模型应用、训练相关工作;
2)大模型专项能力提升,包括Instruct、Reasoning、agent等;
职位要求
1)自然语言处理/多模态/深度学习/强化学习…
招聘城市:北京
…加分。
量化交易算法研究员20K-30K 14薪
【岗位职责】 1. 股票多因子量化策略分析,alpha因子挖掘; 2. 期货CTA及相关量化交易策略研究; 3. ETF、期权及其他衍生品量化策略研究。 【任职要求】 1、本科及以上学历,至少1~3年量化交易经验 2、掌握至少一种数据分析语言包括但不限于Python/C等,熟悉 Linux 等操作系统; 3、熟练 SQL语言,熟练使用MYSQL、PostgreSQL等关系型数据库; 4、计算机、数学、金融相关专业优先,对机器学习有基础者优先; 5、具有金融相关行业从业经验,或者对金融行业有一定了解。
量化交易算法实习生 400-800/天
【岗位职责】 1. 股票和期货CTA策略研发; 2. Alpha因子挖掘; 3. 机器学习预测模型研发;4量化金融Agent设计。…
招聘城市:北京,上海
…强化学习: 研发并优化 SFT、RL(如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化。
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士在读;深入理解 Transformer 架构及大模型训练全流程。
专业深耕: 在 Search(搜索)、Code(代码生成/工程)、tool-use、alignment 或 RL(强化…
招聘城市:北京,上海
…产品和解决方案。
任职要求:
1.熟悉掌握常用的算法,在机器学习、深度学习等算法方向具有良好的理论基础和算法调优经验。
2.熟悉大模型的基本技术及原理,包括预训练、SFT、RL,对于业界大模型的前沿技术发展有一定的理解。
3.具备良好的团队合作、沟通、逻辑思维能力,对工作有激情。
岗位亮点:
1.前景好,商业变现作为公司的核心业务之一,业务前景好。
2.挑战大, 覆盖B端和C端,有很好的AIGC业务落地场景;能参与前沿大型模型技术研究和落地,探索大模型技术在实际业务场景中的应用。
3.成长快,完善的新人培养和融入机制,团队同学多来自业内大厂,在深度学习、生成式、强化学习、大模型应用方面…
招聘城市:深圳,其它
…强化学习算法工程师(AgentReinforcementLearningEngineer)
学历:本科,硕士,博士,外国留学生
需求人数:10
需求专业:数学与应用数学(华罗庚数学班),工科试验班类(中外合作办学,中法未来科技试验班),理科试验班类
|||需求专业:理科试验班类,工科试验班类(中外合作办学,中法未来科技试验班),数学与应用数学(华罗庚数学班)
工作地点:广东省深圳市
职位描述:理想经验:
?有强化学习/Agent/决策系统经验
?能将现实问题抽象为状态、动作、奖励
?熟悉PyTorch/Python
?有系统工程意识
?对真实商业系统有好奇心
加分项:
?多智能体系统
?运筹优化/博弈
?供应链/定价/资源调度经验
?LLMAgent框架
你将面对的典型问题:
?一个渠道价格策略在不同区域表现完全不同,Agent如何通过强化学习自动…
招聘城市:深圳
…文生图、强化学习等相关算法优化。
任职要求:
1、计算机/电子信息/自动控制/软件工程/数学等相关专业,硕士及以上学历在读同学;
2、扎实的大模型和机器学习理论基础,熟悉MLLM / Agent/ Skill / Harness 等相关算法,有大模型相关场景的业务实践经验者优先;
3、具备优秀的研究和创新能力,在CVPR/ICCV/ECCV/ACL/EMNLP/NAACL/COLING/CVPR/ICCV/ICLR/NeurIPS等会议上发表过论文者优先;
4、具备优秀的编程能力和经验,熟悉Python、C/C++、Java等编程语言,具有扎实的数据结构和算法功底;
5、优秀的分析、解决问题能力,对新技术充满好奇,敢于挑战高难度,善于提出解决方案并快速验证。
6、熟悉以下研究方向优先:多模态理解,搜索,文生图, Omni ,工具调用…
招聘城市:上海
…体强化学习)方向:搭建复杂交互环境与任务流、多步骤推理轨迹(Trajectory)收集、Reward设计与策略网络优化
6.编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
我们希望你:
1. 深度学习基础扎实,熟悉Transformer原理,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有影响力工作
2. 有自己的LLM项目
3. 有机器翻译(MT)经验
4. 熟悉生成式推荐(前沿进展,有相关研究或业务落地经验
5. 有 Agent RL相关的项目经验或算法调…
招聘城市:北京
…智能出价agent算法,开发并评估不同技术选型(MPC、强化学习、生成式)的最佳方案,迭代业界先进经验沉淀paper;
2、端到端延迟建模:电商广告长周期归因场景下,针对回流延迟建设端到端预估模型,包括特殊应用场景大促活动下的时间序列建模,提升广告投放效率;
3、冷启动:研究和优化广告召回、出价算法、排序机制等算法模块,解决客户投放冷启问题,围绕生成式推荐、跨域数据利用、多模态信息进行深度优化探索。
任职要求:
1、计算机、人工智能、统计学、数学等相关专业;
2、扎实的编程和开发功底(熟练Python、Java、SQL),熟练掌握PyTorch/TensorFlow等深度学习框架;
3、熟悉机器学习、自然语言处理、大模型、强化学习、生成式学习中一项或多项,有机器学习…
招聘城市:北京
…Agent,支持智能客服、销售、数据分析、C端助理等项目,通过预训练、微调、强化学习等全链路的技术实践,实现类人的理解和执行能力,提升美团服务能力和效率;
5. 不断探索技术新领域,推动技术能力的沉淀和技术氛围的建设。
任职要求:
1. 熟悉大模型的原理,具备数据处理、精调、预训练、强化等方面的经验;
2. 熟悉自然语言处理常见算法与模型,具备深度学习技术在NLP领域的应用实践;
3. 具备良好的编程实现能力,熟悉C++、Python、Java等常用编程语言中至少一种;
4. 具备强烈的进取心、求知欲及团队合作精神,热衷于追求技术创新;
5. 每周至少全职工作四天,保证实习至少6个月,实习须征得导师同意。
岗位亮点:
1、资深算法…
招聘城市:上海
岗位职责:
1、参与LLM/VLM相关的技术业务落地,解决小红书社区治理中的实际问题;
2、进行大模型的前沿技术探索、模型后训练和应用,包括但不限于数据分析、多模态理解、Agent搭建、RAG、SFT/DPO等技术。
任职要求:
1、计算机/数学/统计学/模式识别相关专业,硕士及以上学历;
2、有扎实的编程基础,熟悉Python/SQL等编程语言,至少熟悉一个常用深度学习框架;
3、熟练掌握大规模语言模型/图模型/视觉语言模型/机器学习/数据挖掘/深度学习/强化学习/大模型异常检测中的一项或多项,有顶会paper或者竞赛获奖优先;
4、优秀的沟通协作、分析问题和解决问题的能力,对解决具有挑战性问题充满激情。
招聘城市:上海
…安全,让生活变得更美好。
岗位职责:
参与信贷风控垂类大模型算法研发,探索LLM在风险评估、反欺诈、客户画像等场景的应用
基于业务数据构建垂域知识增强框架,优化风险预测、文本理解、决策推理等核心能力
开发面向金融场景的Prompt Engineering方案,提升模型对信贷政策的理解能力
研究大模型与传统风控模型(评分卡、GBDT等)的融合应用,构建混合智能风控系统,通过监督微调和强化学习持续提升模型识别能力
跟踪RAG、Agent等前沿技术,探索在贷前、贷中、贷后监控中的落地场景
任职要求:
核心能力
计算机科学/数学/统计学硕士及以上在读,熟悉Transformer、BERT、GPT等大模型技术原理
熟练掌握PyTorch/TensorFlow框架,具备NLP/LLM算法项目经验…
招聘城市:上海
…优化
5.编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
我们希望你:
1. 深度学习基础扎实,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有影响力工作
2. 有自己的LLM项目
3. 有机器翻译(MT)经验
4. 有 Agent RL相关的训练经验,或 harness engineering 经验
网申须知
网申开始日期:2026-06-15 00:00
网申截止日期:2027-06-30 00:00
仅限 2026-09 至 2030-06 毕业的大学生,快来投递吧~
投递简历
招聘城市:北京
…并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1. 探索LLM前沿领域研究,包括但不限于RAG、Agent、领域大模型、多模态融合等相关工作。
2. 通过微调/强化学习、预训练等技术方法,持续提高算法的效率和性能。
3. 参与LLM在搜索、对话系统等业务场景的应用。
任职要求:
1. 计算机科学、数学、统计学或相关领域的硕士或博士在读。
2. 熟悉Python、Java等至少一种编程语言与深度学习框架,具有良好的编程能力和扎实的数学理论基础。
3. 熟悉大…
招聘城市:北京,上海
…持续改进和优化现有模型;
3. 有机会负责创新AI功能端到端的开发,需要全方位地思考问题,能够在机器学习技术栈中承担不同角色,解决各个环节问题。
任职要求:
1. 硕士及以上学历,计算机科学、人工智能、自然语言处理或相关专业;
2. 熟练掌握至少一种深度学习框架,如PyTorch、TensorFlow等,熟悉Python/Java编程语言,良好的编码习惯和工程能力;
3. 具有生成式模型训练及开发经验,如大模型数据处理、模型微调、预训练、强化学习、AI Agent等。
4. 有良好的沟通协作能力,能够在团队中积极主动地分享知识和经验;
5. 善于分析和发现问题,具备较强的自驱力,有强烈的学习意愿和创新精神,对大模型技术有浓厚的兴趣和热情。
招聘城市:北京
岗位职责:
工作职责
参与商业广告算法相关方向的研究、开发与优化,包括但不限于信息流广告、品牌广告、线索广告、电商广告等业务场景。如对某一方向有意向投递简历时需备注,无备注默认分配。实习生根据团队方向和个人背景,承担以下一个或多个方向的工作:
1. 广告投放链路算法优化
- 参与广告召回、粗排、精排、混排等核心模型的建设与迭代;
- 优化 CTR/CVR/转化价值预估、用户行为建模、广告相关性与排序策略,提升广告投放效率和用户体验。
2. 智能出价与投放策略优化
- 参与智能出价、预算分配、流量策略、机制策略等方向的算法建设;
- 探索强化学习、MPC、生成式建模、Agent 等技术在自动化出价和投放决策中的应用;
- 支持冷启动、拉…
招聘城市:上海
岗位职责:
工作职责
参与商业广告算法相关方向的研究、开发与优化,包括但不限于信息流广告、品牌广告、线索广告、电商广告等业务场景。如对某一方向有意向投递简历时需备注,无备注默认分配。实习生根据团队方向和个人背景,承担以下一个或多个方向的工作:
1. 广告投放链路算法优化
- 参与广告召回、粗排、精排、混排等核心模型的建设与迭代;
- 优化 CTR/CVR/转化价值预估、用户行为建模、广告相关性与排序策略,提升广告投放效率和用户体验。
2. 智能出价与投放策略优化
- 参与智能出价、预算分配、流量策略、机制策略等方向的算法建设;
- 探索强化学习、MPC、生成式建模、Agent 等技术在自动化出价和投放决策中的应用;
- 支持冷启动、拉…
招聘城市:北京
…分。
Agent模型算法实习生
【职位描述】
1.面向有道词典、词典笔、学习规划/小P老师等产品线,负责 Agent 能力的整体方案与核心算法研发,包括任务分解、计划-执行/反思循环(Plan-Execute / ReAct / Reflection)、长短期记忆与工具路由等。
2. 负责 SLM(Small Language Model)持续预训练与指令微调(SFT),构建高效压缩与蒸馏方案,面向端侧/低延迟场景优化推理效率。
3. 设计与实现工具调用(Function/Tool Calling)体系:工具编目与路由、参数填充、结果验证与回退、调用链追踪与可观测性,提升工具使用的成功率与收益。
4. 基于强化学习(PPO/GRPO/DPO 类方法等)与奖励建模,面向语义理解、工具使用成功率、内容生成质量等目标进行对齐与优化,支持离线/在线策略迭代…
招聘城市:上海
…Agent、多模态理解、语义检索等方向,并愿意探索其在推荐场景中的应用
加分项
1.有推荐、搜索、广告、信息流、视频/直播推荐、内容理解、NLP、多模态、图学习或大模型应用相关项目经验
2.熟悉大规模推荐系统链路,包括召回、粗排、精排、重排、特征工程、在线服务、A/B 实验等模块
3.有 LLM4Rec、生成式推荐、语义召回、向量检索、自动标注、推荐解释、用户兴趣建模等实践经验
4.有调用 OpenAI、Claude、Gemini、Qwen、DeepSeek、豆包、通义千问等大模型 API 的项目经验,并能结合推荐目标设计评估方式
5.熟悉 Prompt 优化、RAG、Embedding 检索、LoRA/SFT、模型蒸馏、向量数据库、离线评测集构建等技术者优先
6.有顶会论文、科研经历,或算法、机器学习竞赛优秀成绩…