招聘城市:杭州,上海,北京
…从而完成目前数仓、DI等日常工作。例如,对于数据开发场景,DataEngineer Agent 可以实现需求理解-> 找表 -> 指标设计 -> 数据建模 -> 任务代码生成->任务编排 -> 数据测试 -> 任务发布的全流程,从而进一步释放数据开发工程师的人力需求,支撑我们在保持精简的组织架构下,继续支撑业务的高速增长,实现卓越型组织架构。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先;
4、在顶级学术会议或期刊发表论文或有…
招聘城市:北京,杭州
岗位职责:
【业务介绍】
数据引擎是大数据Infra团队,提供大数据存储、计算、平台基础能力,支持EB级别数据的实时集成、开发加工、消费使用的全链路数据解决方案。
【职位描述】
1. 负责大数据计算引擎以及数据平台的研发工作,支撑公司内社区、电商以及商业化业务;
2. 面向PB级海量数据的解决方案设计,处理每日千亿级增量的用户行为数据;
3. 通过提供优秀的引擎和平台产品,配合数据产品及数据仓库团队,建设高效的数据研发体系,提供高效稳定的数据服务,降低数据的使用门槛,实现数据的最大价值。
任职要求:
1. 27年毕业同学,计算机相关专业,基础扎实,对新技术有强烈的学习热情
2. 有大数据相关框架/工具经验者优先,e.g. Hadoop…
招聘城市:北京,上海,杭州
岗位职责:
1、负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情…
招聘城市:北京,上海,杭州
岗位职责:
1、负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情…
招聘城市:北京,杭州
岗位职责:
1.负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路。
2.探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值。
3.跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、熟悉Java/Python语言
2、热爱技术研发,具备高度抽象设计能力和快速学习能力,注重代码质量,能够独立分析解决问题,责任心强
3、27届,能够实习6个月以上,每周出席4天及以上。
招聘城市:北京,杭州
岗位职责:
1. 协同AI平台与算法团队,面向AI大模型训练和多样化数据处理场景,研发云原生文件系统和缓存加速系统,为AI业务提供极致的存储解决方案并推动在业务侧落地。
2. 应对小红书超大规模多模态应用挑战,攻克单集群百亿级元信息、Tbps级高吞吐等行业技术难题,保障AI业务的安全、稳定和高效运行。
3. 持续进行系统架构优化与技术迭代,结合AI负载特征,实现数据智能调度、数据预取和缓存管理,不断优化I/O路径,有效提升GPU等算力资源利用率。
任职要求:
1、熟悉Golang/Java语言
2、热爱技术研发,具备高度抽象设计能力和快速学习能力,注重代码质量,能够独立分析解决问题,责任心强
3、27届…
招聘城市:上海,北京,杭州
…以上,计算机、大数据、人工智能等相关专业,2027届应届毕业生,学业基础扎实;
3、编程能力:熟练掌握Java/C++/Python任一语言,编码功底良好,代码逻辑清晰;
4、核心素养:热爱分布式引擎底层研发与AGI数据方向,学习能力强,敢于攻坚复杂技术问题;
5、综合素质:沟通协作良好,做事踏实严谨,有意长期深耕大数据引擎与AGI基建方向。
优先加分项
1、有大模型AGI数据链路、大数据相关项目/实习/竞赛经历;
2、熟悉Spark核心原理(RDD、DAG、Shuffle等),掌握分布式计算基础,具备基础的问题排查与调优能力;
3、算法能力突出,具备海量数据处理、分布式架构攻坚经验者优先。
我们能提供
1、核心赛道成长:深耕AGI大模型数据引擎核心基建,掌握行业前沿稀缺技术;…
招聘城市:杭州,上海,北京
…从而完成目前数仓、DI等日常工作。例如,对于数据开发场景,DataEngineer Agent 可以实现需求理解-> 找表 -> 指标设计 -> 数据建模 -> 任务代码生成->任务编排 -> 数据测试 -> 任务发布的全流程,从而进一步释放数据开发工程师的人力需求,支撑我们在保持精简的组织架构下,继续支撑业务的高速增长,实现卓越型组织架构。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先;
4、在顶级学术会议或期刊发表论文或有…
招聘城市:北京
…数据领域Agent和AIOps技术风险领域的前沿技术和应用场景,包括智能问答、推理分析、容量规划、数据治理、业务诊断、风险预测等,并将研究结果应用到数据平台和数据业务领域,不断推动服务能力升级。
2、整合多源异构数据来源,构建数据基座,结合传统AI算法和LLM,设计和实现Agent或传统AIOps架构。
3、解决算法工程化的问题,包括端到端应用算法解决方案、模型优化和在线模型更新、场景仿真实验和调优等。不断提升各应用场景的召回率和准确率。
任职要求:
1、计算机相关专业。
2、有大数据和技术风险领域的经验,深入原理并有相关真实场景的实践。
3、熟悉机器学习/深度学习算法(如 LSTM、GNN、异常检测算法等),熟练掌握数据…
招聘城市:北京,上海,杭州
岗位职责:
1. 负责基于Ray的分布式计算平台建设与优化。
2. 支撑训练、推理、多模态数据处理等AI场景的工程化落地。
3. 参与Ray核心模块研发,包括资源调度、弹性伸缩、监控告警、可观测性等平台能力建设。
4. 参与Ray的AI Workload能力建设,包括多模态计算引擎、强化学习、大模型推理等方向。
任职要求:
1. 本科及以上学历,计算机相关专业。
2. 熟悉PythonC++/Rust中至少一种编程语言,了解Ray或其他分布式计算框架。
3. 熟悉分布式系统、容器化和云原生技术。
4. 有分布式计算、Native Engine、资源调度经验者优先。
5. 有AI平台、强化学习、多模态数据处理开发经验者优先。
招聘城市:北京,上海,杭州
岗位职责:
1. 打造业内领先的PB级云原生OLAP引擎,提供海量数据上的交互式分析能力,支撑小红书内部核心业务线。
2. 支持千亿级数据量上的秒级交互分析场景,高效支撑广告/实验平台/用户行为分析/Adhoc等业务场景。
3. 参与OLAP系统核心模块设计与开发,包括但不限于查询解析、查询优化器、执行引擎、存储引擎、混合检索等。
任职要求:
1. 本科及以上学历,计算机相关专业。
2. 熟悉Java/C++/Rust中至少一种编程语言,具备良好的编码能力和工程实践能力。
3. 熟悉数据库系统原理,理解 SQL 解析、查询优化、执行计划、事务机制、索引结构、列式存储等核心概念。
4. 熟悉主流 OLAP 技术或产品中的一种或多种,如ClickHouse、Doris、StarRocks、Apache Druid…
招聘城市:北京,成都
…业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.负责大数据相关业务(数据引擎、数据中台、数据应用等)全流程的质量保证工作;
2.参与需求分析评审、系统设计、制定测试计划、设计和执行测试用例、开发维护自动化测试用例、把控项目进度和风险、分析和改进线上问题等;
3.根据项目需要,推动产品、设计、研发等角色,按时保质交付产品上线;
4.分析产品质量和研发过程质量,熟练应用质量相关工具,推动质量持续改进;
5.建设大数据稳定性测试体系,包括性能压测、可靠性、长稳、规格等,保障并…
招聘城市:北京,上海
岗位职责:
本课题聚焦于超大规模预训练数据的深度理解、提纯与价值挖掘,建立数据与模型能力之间的因果联系,打造下一代万亿基座模型的高效数据引擎,致力于提升基座模型的智能上限。研究内容包括但不限于:
1.研发基于模型的高效数据质量评估、去重与清洗算法,提高数据质量、多样性和覆盖度。
2.深入探究数据分布与模型能力的因果关系,建立“训练数据-模型效果”归因机制,探索并突破基座模型的能力上限。
3.探索自动化数据筛选机制、动态配比(Data Mixture)与多阶段训练范式,探索不同类型数据对模型能力的Scaling Law。
4.构建科学、多维度的基座模型能力和潜力评估,驱动预训练数据策略的优化,形成高效的数据迭代闭环。
【为什么是…
招聘城市:上海,北京,杭州
…数据引擎,有真实项目或课程经历
4. AI 应用有工程级理解:对大语言模型有自主学习积累,能说清楚 RAG 检索策略、Agent 工具调用机制、Prompt Engineering 方法论
5. 逻辑清晰,对数据敏感,具备问题拆解能力与动手执行力;每周可实习 4 天及以上,实习周期不少于 3 个月
加分项
- 有 LLM / Agent 相关项目实践经验(知识库构建、Agent 链路搭建、RAG 系统开发等)
- 了解知识图谱构建方法(实体识别、关系抽取、图数据库使用等)
- 有特征工程经验(面向 CTR / CVR / 推荐等场景的特征定义与生产)
- 有数据竞赛经历(Kaggle、天池等)
你能获得什么
1. 真实商业化场景:深度参与广告核心数仓,接触小红书商业化最核心的数据链路
2. AI × 数据…
招聘城市:北京,上海
岗位职责:
简介:本课题聚焦于超大规模预训练数据的深度理解、提纯与价值挖掘,建立数据与模型能力之间的因果联系,打造下一代万亿基座模型的高效数据引擎,致力于提升基座模型的智能上限。研究内容包括但不限于:
1、研发基于模型的高效数据质量评估、去重与清洗算法,提高数据质量、多样性和覆盖度。
2、深入探究数据分布与模型能力的因果关系,建立“训练数据-模型效果”归因机制,探索并突破基座模型的能力上限。
3、探索自动化数据筛选机制、动态配比(Data Mixture)与多阶段训练范式,探索不同类型数据对模型能力的Scaling Law。
4、构建科学、多维度的基座模型能力和潜力评估,驱动预训练数据策略的优化,形成高效的数据迭代闭环。
任职…
…责任公司是一家以计算机图形学+数据引擎双核驱动的国家级专精特新小巨人企业。公司以运营JS-G3S城市孪生平台与SuperCity、StructCity、SynerCity三大产品为核心,融合BIM、CIM、AI等技术,为企业和个人用户提供全球顶尖的城市孪生场景、C端和B端应用平台以及行业解决方案,致力于成为领先的AI孪生城市空间智能服务商。
招聘摘要: 见山科技|“未来城市构建者计划”2027届实习生招聘空间智能,链接物理世界与数字世界的桥梁,重塑每一座城市的门户入口。在这里,你不是在求职,而是在应征未来。四川见山科技有限责任公司,是一家以计算机图形学+数据引擎双核驱动的国家级专精特新小巨人企业…
招聘城市:上海
岗位介绍:
职位亮点
## **你将获得**
- 接触一线 Data Agent 真实业务场景,从 0 到 1 参与产品建设
- 与资深算法 / 数据 / 工程团队深度协作,Mentor 一对一带教
- 弹性工作、技术分享、丰富的 LLM API 资源
职位描述
工作职责:
**基本要求**
- 2026 / 2027 届本科及以上在读,计算机、软件工程、人工智能、数据科学、统计学等相关专业
- 每周到岗 ≥ 4 天,可实习 3 个月以上
- 熟练掌握 Python;熟悉 SQL,了解数据仓库基本概念(维度建模、OLAP 等)
**加分项**
- 有 LLM Agent / RAG / Function Calling 相关项目经验(GitHub、Kaggle、论文、比赛皆可)
- 熟悉 LangChain / LlamaIndex / Claude Agent SDK 等任一 Agent 框架
- 熟悉 Hive / Spark / Presto / ClickHouse 等大数据引擎
- 熟悉前端(React/TypeScript)或具备全栈能力
- 有 Text2SQL、智能 BI、数据问答类产品经验
- 阅读过 ReAct、Reflexion…
招聘城市:北京,上海
…
1.多源数据的合成和处理,包括:egocentric video 数据、仿真数据、UMI 采集数据、真机遥操作数据等
2.具身智能系统的架构设计,Agent 系统、大小脑和 Monitor 等多层次结构
3.模型泛化性探索:无需额外训练实现跨本体多任务;基于少量演示数据作为上下文,增强模型能力;基于自动探索,在线学习新技能。
4.模型全流程,预训练、mid train、SFT、强化学习、部署和评测等
同时参与具身智能方向的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1.具身智能相关的仿真环境、资产、场景、任务自动化生成与重建(3D生成/场景理解)
2.仿真环境内的轨迹自动化生成方法(数据引擎/合成数据)
3.egocentric video 数据的有效使用
4.基于…
招聘城市:北京,上海
…1. 多源数据的合成和处理,包括:egocentric video 数据、仿真数据、UMI 采集数据、真机遥操作数据等
2. 具身智能系统的架构设计,Agent 系统、大小脑和 Monitor 等多层次结构
3. 模型泛化性探索:无需额外训练实现跨本体多任务;基于少量演示数据作为上下文,增强模型能力;基于自动探索,在线学习新技能。
4. 模型全流程,预训练、mid train、SFT、强化学习、部署和评测等
同时参与具身智能方向的前沿研究,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1. 具身智能模型、数据、训练方法和系统等相关的设计
2. 仿真环境内的轨迹自动化生成方法(数据引擎/合成数据)
3. egocentric video 数据的有效使用
4. 基于多模态大模型的泛化具…
招聘城市:北京
北京理想汽车有限公司
招聘信息
强化学习算法研究员
2026-02-1409:58:40
职位描述
职位描述:
1.负责面向自动驾驶与具身智能的强化学习算法研究与开发,包括Model-based/FreeRL、Online/OfflineRL等;
2.构建大规模分布式强化学习训练系统,推动RL算法在真实场景的规模化应用;
3.研究数据合成与评测技术,建立数据引擎与评测基准,实现realsimreal快速迭代闭环;
4.探索模仿学习、逆强化学习、ScalableOversight等技术,提升策略学习效率与泛化能力;
5.与世界模型团队协作,利用学习式仿真环境进行策略训练与验证,推动sim2real迁移;
6.参与前沿研究,发表顶会论文,推动强化学习在自动驾驶与具身智能领域的技术进步。
职位要求:
1.硕士及以上学历,机器学习、强化…