招聘城市:北京
…理想汽车有限公司
招聘信息
强化学习算法研究员
2026-02-1409:58:40
职位描述
职位描述:
1.负责面向自动驾驶与具身智能的强化学习算法研究与开发,包括Model-based/FreeRL、Online/OfflineRL等;
2.构建大规模分布式强化学习训练系统,推动RL算法在真实场景的规模化应用;
3.研究数据合成与评测技术,建立数据引擎与评测基准,实现realsimreal快速迭代闭环;
4.探索模仿学习、逆强化学习、ScalableOversight等技术,提升策略学习效率与泛化能力;
5.与世界模型团队协作,利用学习式仿真环境进行策略训练与验证,推动sim2real迁移;
6.参与前沿研究,发表顶会论文,推动强化学习在自动驾驶与具身智能领域的技术进步。
职位要求:
1.硕士及以上学历,机器学习、强化学习…
招聘城市:北京
…入口。
【你将参与】
方向一:个性化自进化与主动探索算法机制
1.探索与利用权衡: 负责设计前沿的主动探索训练目标与触发机制,引入不确定性感知等机制,使 Agent 能够根据当前交互状态、上下文历史自主判断自适应进化方向。
2.高价值信息捕获: 在极低用户打扰的约束下,设计高效的主动追问与澄清策略,精准、主动地获取用户深层高价值偏好信息。
方向二:多轮交互奖励建模与 RL 策略优化
1.长期价值奖励建模: 负责构建面向长期交互与用户留存的奖励模型体系,将用户显式反馈(追问、点击)与隐式行为(停留、改写)转化为高置信度的显式/隐式奖励信号。
2.强化学习策略对齐: 运用先进的强化学习算法(如 PPO…
招聘城市:上海
…于利用科学模型为投资者带来可持续的稳健收益。
开放职位
量化研究员(AI算法方向)
岗位内容:
1)主导或参与大规模参数量的深度学习网络(Transformer等)的端到端(End-to-End)架构设计与训练,探索AI在量化交易中的前沿应用;
2)针对高维、异构的金融时序与多模态数据,设计开拓性的特征提取、收益预测与组合优化算法;
3)紧跟领域前沿,推动大模型技术与量化场景的结合,通过模型架构创新与优化,发挥极致的信息提取与策略生成能力。
岗位要求:
1)国内外重点大学数学、物理、统计、计算机、电子、人工智能等相关专业硕士或博士学位;
2)熟练掌握深度学习基础理论,对 Transformer、LLM、RL(强化学习)或组合优化算法有深刻理解;…
招聘城市:上海,北京
…信号融合有系统性研究,对股市场风格变化、周期性变化有深刻认知;
3. 扎实的代码功底,较强的工程实现能力,较强的自主学习能力;
4. 对量化行业有热情,自我驱动能力强,坚定职业发展方向;
5. 认同开放共进的团队文化,乐于挑战,勤奋踏实,严谨细致,有良好的沟通协调能力。
四、 AI 算法研究员
岗位内容
1. 在特征提取、收益预测、组合优化等不同场景实践算法
2. 针对不同金融数据,设计开拓性的深度学习网络结构
3. 紧跟领域前沿,推动基础研究,使其在不同量化场景下发挥信息提取、模型搭建等作用。
岗位要求
1. 国内外重点大学本科及以上学历,数学、物理、统计、计算机、电子等专业
2. 熟悉任意分支领域深度学习、强化学习…
招聘城市:北京,上海
…提供L2+至L4级全栈智能驾驶解决方案。
招聘对象 2025年9月-2026年8月期间毕业的2026届应届毕业生。
招聘职位 自动驾驶VLA算法研究员 决策规划控制算法工程师 自动驾驶强化学习算法工程师 自动驾驶端到端模型算法研究员 自动驾驶端到端感知算法工程师 自动驾驶VLM多模态大模型算法工程师 工作地点:北京 / 上海
网申流程 网申时间: 2026年3月11日 - 2026年5月31日
面试时间:3月中旬起陆续安排线上面试
Offer发放:面试通过后立即沟通Offer
注:部分岗位招满将提前结束网申,建议尽早投递。
投递方式 扫码进入 千里智驾校招官网 ,查看职位详情,一键投递简历。
也可…
招聘城市:上海
…系统性研究,对A股市场风格变化、alpha周期性变化有深刻认知;
3.扎实的代码功底,较强的工程实现能力,较强的自主学习能力;
4.对量化行业有热情,自我驱动能力强,坚定职业发展方向;
5.认同开放共进的团队文化,乐于挑战,勤奋踏实,严谨细致,有良好的沟通协调能力。
?AI算法研究员
岗位内容:
1.在特征提取、收益预测、组合优化等不同场景实践AI算法;
2.针对不同金融数据,设计开拓性的深度学习网络结构;
3.紧跟领域前沿,推动基础研究,使其在不同量化场景下发挥信息提取、模型搭建等作用。
岗位要求:
1.国内外重点大学本科及以上学历,数学、物理、统计、计算机、电子等专业;
2.熟悉任意AI分支领域 (深度学习、强化学习…
招聘城市:上海
…方面相关经历,对多信号融合有系统性研究,对A股市场风格变化、alpha周期性变化有深刻认知;
扎实的代码功底,较强的工程实现能力,较强的自主学习能力;
对量化行业有热情,自我驱动能力强,坚定职业发展方向;
认同开放共进的团队文化,乐于挑战,勤奋踏实,严谨细致,有良好的沟通协调能力。
AI 算法研究员
岗位内容 :
在特征提取、收益预测、组合优化等不同场景实践AI算法;
针对不同金融数据,设计开拓性的深度学习网络结构;
紧跟领域前沿,推动基础研究,使其在不同量化场景下发挥信息提取、模型搭建等作用。
岗位要求 :
国内外重点大学本科及以上学历,数学、物理、统计、计算机、电子等专业;
熟悉任意AI分支领域(深度学习、强化学习…
招聘城市:北京
…能力、团队合作意识强。
机器学习量化算法研究员20K-35K 14薪
【岗位职责】 1、针对量化交易的机器学习算法研究,运用机器学习算法、深度学习算法进行选股和短期价格预测; 2、以机器学习的方式理解量化交易,构开发和优化用于金融市场预测和交易策略的机器学习模型: 3、开发、部署自动化机器学习加速量化策略迭代效率; 4、分析海量金融数据集,提取有价值的信息并建立可执行的投资信号; 5、基于历史数据对策略进行历史回测分析,优化交易模型; 6、评估和改进现有机器学习算法的性能,包括监督学习、无监督学习和强化学习的应用; 7、紧跟最新的机器学习研究动态,定期提出新的研究方向和改进建议。 【任职要求】 1…
招聘城市:北京
…模模型训练与强化学习系统:构建稳定、可扩展的分布式系统,支持千亿级别参数稀疏模型的并行训练,并为复杂的强化学习任务提供高效的系统级解决方案。
4.极低位宽模型量化技术:探索前沿的模型量化方法,将模型参数压缩至极低位宽,在最小化精度损失的前提下,极大降低模型的存储和计算成本。
(十)可信大模型
1.风险评测:面向大模型存在的幻觉、合法性不足、价值观偏见等严峻挑战,建立面向合事实、合法、合价值等目标评测基准,揭示模型的可信边界与潜在风险;
2.模型机理:剖析导致大模型产生幻觉、违反法律与规范等不可信行为的原因与机理,理解模型不可信表现的机理;
3.可信对齐:研究创新对齐算法…
招聘城市:北京
…师 工程 大模型强化训练 博士/硕士
48 项目经理(含专项项目聘) 工程 项目全生命周期管理 博士/硕士
49 行政主管 支撑 管理学、财务经验优先 硕士
50 算法安全评估算法工程师(专项项目聘) 工程 算法安全评估试验场核心算法、大模型或推荐算法 硕士
51 数据分析工程师(专项项目聘) 工程 海量关键数据接入、治理与分析算法 硕士
52 云原生系统研发工程师(专项项目聘) 工程 服务治理 硕士
53 实时数据平台研发工程师(专项项目聘) 工程 大数据处理 硕士
54 智能体研发工程师(专项项目聘) 工程 智能体研发与优化 硕士
55 网络数据采集工程师(专项项目聘) 工程 网络爬虫、Selenium、Appium、Playwright 硕士
56 社会计算方向副研究员 研究 社交网络分析、图机器学习…
招聘城市:北京
…师 工程 大模型强化训练 博士/硕士
48 项目经理 (含专项项目聘) 工程 项目全生命周期管理 博士/硕士
49 行政主管 支撑 管理学、财务经验优先 硕士
50 算法安全评估算法工程师 (专项项目聘) 工程 算法安全评估试验场核心算法、大模型或推荐算法 硕士
51 数据分析工程师 (专项项目聘) 工程 海量关键数据接入、治理与分析算法 硕士
52 云原生系统研发工程师 (专项项目聘) 工程 服务治理 硕士
53 实时数据平台研发工程师 (专项项目聘) 工程 大数据处理 硕士
54 智能体研发工程师 (专项项目聘) 工程 智能体研发与优化 硕士
55 网络数据采集工程师 (专项项目聘) 工程 网络爬虫、Selenium、Appium、Playwright 硕士
56 社会计算方向 副研究员 研究 社交网络分析、图机器学习…
招聘城市:上海
量化研究员(AI算法方向)
发布时间:2026-04-20 结束时间:2027-08-31
申请职位
公司名称:上海启林投资管理有限公司
工作地点:上海市 - 上海市市辖区
工作性质:全职
职能类别:金融/保险类
招聘人数:3人
薪资待遇:30000-49999
工作内容描述
岗位内容:
1. 在特征提取、收益预测、组合优化等不同场景实践AI算法;
2. 针对不同金融数据,设计开拓性的深度学习网络结构;
3. 紧跟领域前沿,推动基础研究,使其在不同量化场景下发挥信息提取、模型搭建等作用。
岗位要求:
1. 国内外重点大学本科及以上学历,数学、物理、统计、计算机、电子等专业;
2. 熟悉任意AI分支领域 (深度学习、强化学习、组合优化等),具备科研创新能力;
3. 扎实的代码功底,较强的工程实现能力…
…以「世界模型+NWM」全新版本正式开启推送,国内首次将完整的闭环强化学习应用于智能辅助驾驶研发,打造「世界模型+闭环强化学习」领先技术架构,全面模型化城区与高速领航辅助,实现「类人安心感」和「类人效率」升级。
招聘对象:
• 社招:基础模型研究员 / 算法工程师、智能辅助驾驶端到端模型研发工程师 / 专家、大模型 - VLM/VLA 多模态算法工程师、大模型 - 端到端算法工程师、智能辅助驾驶世界模型算法研发专家
• 校招:2024-2026届毕业生(2023年9月-2026年8月期间毕业),含智能辅助驾驶AI研究员、多模态大模型算法工程师、强化学习算法工程师、大模型算法工程师(VLA / 世界模型)
投递方式:
• 社招岗位: 点击进入
• 校招岗位: 点击…
招聘城市:北京
【LongCat大模型人才校招】Agentic Coding算法研究员
更新时间:2026-06-03
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
和我们一起开发前沿Agentic Coding模型,持续提升模型在长程复杂任务和真实开发场景中的表现,并通过代码提升数字世界的智能上限。加入团队,你将参与如下工作:
1.代码全链路训练:包括pretrain、midtrain、SFT、RL等环节,持续提升模型在代码生成、代码理解、代码修复等方向的能力边界。
2.高质量数据建设:构建高质量Coding数据生产、数据配比与数据质量评估体系,覆盖软件工程任务、仓库级代码生成、终端任务、Web开发等方向,推动模型能力持续演进。
3.Coding 强化学习:构建面向 Coding 场景的大规模 RL 训练体系,研究 Reward Design、Self…
招聘城市:北京
…强化学习增强的生成与对齐、智能体(Agent)决策与规划等,业务影响覆盖美团外卖每天数千万的订单,核心工作是为用户及商家实现地理空间的智能规划,包括商家配送范围(决策用户是否能在该商家下单)、Area of Interest边框挖掘(AOI,即用户所处地理社区边界,保证用户下单体验的一致性)、用户拼单范围、骑手取件区域的建模与优化。目标是构建能够理解复杂业务需求、驱动范围智能调整的Agent系统,实现“技术驱动业务范式”的升级转变,最终促进平台供给繁荣与用户的供需匹配优化。
【建议研究方向】
1.多模态感知与表征建模:集成地理信息(GIS)、用户热力、图像、自然语言等多模态数据,进行联合表征学习与建模,攻克跨模态语义对齐…
招聘城市:北京
…驾驭能力:能引导LLM Agent完成复杂研究任务及工程实现,能够独立完成问题建模、论文阅读、算法复现、实验设计、结果分析和迭代优化。有识别AI输出质量问题的技术判断力与review能力。
4.熟悉LLM及Agent基本机制,包括Agent Loop、Tool Use、Multi-Agent、Reasoning等;熟练使用Python及PyTorch等主流框架。
5.自驱力强,能在开放性问题中主动推进,在不完美条件下快速验证假设,动手能力和执行能力强。
加分项:
1.有AutoML、Neural Architecture Search、AI驱动科研工具(如AI Scientist、AIDE、MLR-Bench类)的研究或工程经验。
2.熟悉ClaudeCode、OpenClaw等开源Harness的设计与实现,或有Agent评估框架搭建经验。
3.具有跨学科视野,能将运筹优化、强化学习等方法引入AutoResearch体系…
招聘城市:深圳,其它
…量化研究员
发布时间:2026-07-24 结束时间:2026-08-15
申请职位
公司名称:宝盈基金
工作地点:不限
工作性质:全职
职能类别:其他
招聘人数:若干
薪资待遇:面议
工作内容描述
宝盈基金2026年校招补录
【量化投资部】量化研究员(机器学习方向)
招聘人数:1-2名
岗位职责:
1、选股因子挖掘与研究: 利用机器学习算法(如神经网络、树模型、强化学习等)对海量多维数据进行深度挖掘,寻找具有逻辑支撑和
统计显著性的预测因子。
2、模型构建与优化: 研究并开发适配中国市场的机器学习预测模型,解决过拟合、数据时效性等实际问题,持续优化模型结构及训练方法。
3、Alpha策略研发: 参与从数据分析、特征工程到策略回测的全流程研究…
招聘城市:北京,上海
…Human in the Loop 多轮交互下 Agent 基础建模的新方案、以及与复杂环境的交互学习能力
- 探索模型在 Non-Rule Based Outcome 场景下利用复杂信息进行有效 Reasoning 推理的范式,包括 Proactive Agent 的建模方案
- 探索研究更多内在奖励的机制,从而激发模型主动学习和自我更新的能力
- 探索构建长期记忆机制,为下一代高效的推理模型、长序列推理及建模提供基础
任职要求:
- 博士在读优先,计算机、人工智能、自动化、数学、物理等相关专业
- 在强化学习、语言模型、机器学习等一个或多个领域有较深入的研究者
- 好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者
- 具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极…
招聘城市:北京
…下生成最优调价方案,最大化运力供给与用户体验。
4.供需平衡与智能调控:探索供需预测、运力调控的序贯决策优化,研究LLM增强的因果推断与反事实推演,实现从"数据相关性分析"到"因果性决策"的跨越。
任职要求:
【任职资格】
2027届本科及以上学历,计算机、人工智能等相关专业,且以下条件至少满足一项:
1.在顶级期刊或学术会议(NeurIPS/ICML/ICLR/KDD/AAAI/OR等)以第一作者身份发表论文(或导师一作,自己为二作)。
2.在顶级大赛(ACM-ICPC/Kaggle等)上获奖。
3.有大厂实验室实习经验,或有贡献突出的开源项目。
加分项:
1.有强化学习、运筹优化、因果推断、时空建模方向的研究背景;熟悉LLM与决策科学融合的前沿方向。
…
招聘城市:北京
…社会认可、服务10亿用户的配送品牌。
【你将参与】
方向一:Agent技术体系研究与落地
1.设计并构建面向真实业务场景的Agent技术体系,涵盖任务规划、工具调用、多轮推理、自我反思与纠错等核心模块
2.深入抽象业务核心问题,建立可量化的评估反馈信号,驱动Agent在复杂履约场景中实现可度量的效果提升
3.探索Multi-Agent协作框架,研究Agent在千万级并发场景下的可靠性、安全性与成本效率
方向二:LLM后训练算法研究
1.负责面向特定业务场景的指令精调(SFT)、偏好对齐(RLHF/DPO/GRPO等)全链路研究与工程落地
2.研究ScalableOversight、持续学习、AI和环境反馈的强化学习(RLXF)等前沿方向。同时探索奖励模型与反馈机制、可泛化的…