招聘城市:北京,杭州
岗位职责:
【业务介绍】
数据引擎是大数据Infra团队,提供大数据存储、计算、平台基础能力,支持EB级别数据的实时集成、开发加工、消费使用的全链路数据解决方案。
【职位描述】
1. 负责大数据计算引擎以及数据平台的研发工作,支撑公司内社区、电商以及商业化业务;
2. 面向PB级海量数据的解决方案设计,处理每日千亿级增量的用户行为数据;
3. 通过提供优秀的引擎和平台产品,配合数据产品及数据仓库团队,建设高效的数据研发体系,提供高效稳定的数据服务,降低数据的使用门槛,实现数据的最大价值。
任职要求:
1. 27年毕业同学,计算机相关专业,基础扎实,对新技术有强烈的学习热情
2. 有大数据相关框架/工具经验者优先,e.g. Hadoop…
招聘城市:北京,上海,杭州
岗位职责:
1、负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情…
招聘城市:北京,杭州
岗位职责:
1.负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路。
2.探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值。
3.跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、熟悉Java/Python语言
2、热爱技术研发,具备高度抽象设计能力和快速学习能力,注重代码质量,能够独立分析解决问题,责任心强
3、27届,能够实习6个月以上,每周出席4天及以上。
招聘城市:北京
…数据领域Agent和AIOps技术风险领域的前沿技术和应用场景,包括智能问答、推理分析、容量规划、数据治理、业务诊断、风险预测等,并将研究结果应用到数据平台和数据业务领域,不断推动服务能力升级。
2、整合多源异构数据来源,构建数据基座,结合传统AI算法和LLM,设计和实现Agent或传统AIOps架构。
3、解决算法工程化的问题,包括端到端应用算法解决方案、模型优化和在线模型更新、场景仿真实验和调优等。不断提升各应用场景的召回率和准确率。
任职要求:
1、计算机相关专业。
2、有大数据和技术风险领域的经验,深入原理并有相关真实场景的实践。
3、熟悉机器学习/深度学习算法(如 LSTM、GNN、异常检测算法等),熟练掌握数据…
招聘城市:北京,上海,杭州
岗位职责:
1、负责模型预训练、微调、部署及推理过程中的数据准备、模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情…
招聘城市:北京
岗位介绍:
职位描述
工作职责:
1.参与大规模多模态数据处理引擎开发,支撑万卡级训练数据供给
2.基于 Ray Data 构建分布式数据 Pipeline(清洗/过滤/标注)
3.参与 Lance 列式存储引擎和向量检索优化
4.设计数据质量评估模块(美学评分、去重、内容理解)
5.优化数据链路吞吐与延迟,解决大规模性能瓶颈
工作要求:
• CS相关专业优先;
• 熟悉 Python,有良好工程素养
• 了解分布式计算原理,有 Ray/Spark/Dask 经验优先
• 有多模态数据处理(视频/图片)经验优先
• 熟悉 Arrow/Parquet/Lance 等存储格式加分
• 熟悉 FFmpeg/OpenCV/Decord 加分
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学生,快来…
招聘城市:北京
岗位职责:
负责全公司机器学习基础设施的研发,包括大规模分布式训练架构、高性能推理服务、深度学习编译优化、GPU硬件加速、RDMA网络优化等,支撑公司所有机器学习相关业务,如:搜索、推荐、广告、图像、NLP、语音、自动驾驶等。
任职要求:
1.本科及以上学历;
2.具备良好的计算机基础素养和分析解决问题的能力,熟练掌握C++或Python;
3.学习能力强,对机器学习系统优化有技术热情,富有极客精神。
具备以下经验者优先
1.熟悉TensorFlow/PyTorch等深度框架代码的优先;
2.熟悉TVM/MLIR等编译优化技术的优先;
3.熟悉GPU、RDMA硬件架构,熟练使用CUDA、NCCL、Verbs编程的优先;
4.熟悉机器学习、深度学习算法的优先(欢迎算法背景同学转方向);
5.有分布式…
招聘城市:上海,北京,杭州
…以上,计算机、大数据、人工智能等相关专业,2027届应届毕业生,学业基础扎实;
3、编程能力:熟练掌握Java/C++/Python任一语言,编码功底良好,代码逻辑清晰;
4、核心素养:热爱分布式引擎底层研发与AGI数据方向,学习能力强,敢于攻坚复杂技术问题;
5、综合素质:沟通协作良好,做事踏实严谨,有意长期深耕大数据引擎与AGI基建方向。
优先加分项
1、有大模型AGI数据链路、大数据相关项目/实习/竞赛经历;
2、熟悉Spark核心原理(RDD、DAG、Shuffle等),掌握分布式计算基础,具备基础的问题排查与调优能力;
3、算法能力突出,具备海量数据处理、分布式架构攻坚经验者优先。
我们能提供
1、核心赛道成长:深耕AGI大模型数据引擎核心基建,掌握行业前沿稀缺技术;…
招聘城市:北京,上海
岗位职责:
负责全公司机器学习基础设施的研发,包括大规模分布式训练架构、高性能推理服务、深度学习编译优化、GPU硬件加速、RDMA网络优化等,支撑公司所有机器学习相关业务,如:搜索、推荐、广告、图像、NLP、语音、自动驾驶等。
任职要求:
1.本科及以上学历;
2.具备良好的计算机基础素养和分析解决问题的能力,熟练掌握C++或Python;
3.学习能力强,对机器学习系统优化有技术热情,富有极客精神。
具备以下经验者优先
1.熟悉TensorFlow/PyTorch等深度框架代码的优先;
2.熟悉TVM/MLIR等编译优化技术的优先;
3.熟悉GPU、RDMA硬件架构,熟练使用CUDA、NCCL、Verbs编程的优先;
4.熟悉机器学习、深度学习算法的优先(欢迎算法背景同学转方向);
5.有分布式…
招聘城市:北京
…团队氛围好、发展空间大,专业能力提升快
职位描述
工作职责:
1.设计与建设广告引擎在线架构和数据平台,承接百亿级流量&千万级物料,提升服务的性能和稳定性;
2.负责设计和实现易用&高效的广告检索架构,支撑算法&产品在多团队、多业务、多策略、多模型场景的高效迭代;
3.负责对广告检索系统进行极致的性能优化,持续提升在重数据、重计算、低延迟场景约束下广告检索系统的容量;
工作要求:
1.本科及以上学历;
2.扎实的编程基础,熟练掌握linux C/C++、数据结构、网络通信、多线程、常用算法等,具备独立编码落地能力;
3.有互联网公司推荐、广告或搜索相关场景下实习经历优先,有大规模数据处理及服务经验优先;
4…
招聘城市:北京
…团队氛围好、发展空间大,专业能力提升快
职位描述
工作职责:
1.设计与建设广告引擎在线架构和数据平台,承接百亿级流量&千万级物料,提升服务的性能和稳定性;
2.负责设计和实现易用&高效的广告检索架构,支撑算法&产品在多团队、多业务、多策略、多模型场景的高效迭代;
3.负责对广告检索系统进行极致的性能优化,持续提升在重数据、重计算、低延迟场景约束下广告检索系统的容量;
工作要求:
1.本科及以上学历;
2.扎实的编程基础,熟练掌握linux C/C++、数据结构、网络通信、多线程、常用算法等,具备独立编码落地能力;
3.有互联网公司推荐、广告或搜索相关场景下实习经历优先,有大规模数据处理及服务经验优先;
4…
招聘城市:北京
机器学习引擎工程师
更新时间:2026-03-26
工作地点:北京市
事业群:核心本地商业-业务研发平台
岗位职责
负责全公司机器学习基础设施的研发,包括大规模分布式训练架构、高性能推理服务、深度学习编译优化、GPU硬件加速、RDMA网络优化等,支撑公司所有机器学习相关业务,如:搜索、推荐、广告、图像、NLP、语音、自动驾驶等。
岗位基本要求
1.本科及以上学历;
2.具备良好的计算机基础素养和分析解决问题的能力,熟练掌握C++或Python;
3.学习能力强,对机器学习系统优化有技术热情,富有极客精神。
具备以下经验者优先
1.熟悉TensorFlow/PyTorch等深度框架代码的优先;
2.熟悉TVM/MLIR等编译优化技术的优先;
3.熟悉GPU、RDMA硬件架构,熟练使用CUDA、NCCL…
招聘城市:上海
…维护;
2、基于 Hive/Spark 开发离线数据处理任务,保障数据链路稳定产出;
3、负责数据质量监控与问题排查,包括任务异常分析与性能调优;
4、对接业务需求,梳理数据口径与指标定义,提供数据支持;
5、配合算法团队完成特征数据采集与加工;
6、探索实时流处理、数据湖等前沿方向在现有平台的适配性。
任职要求:
1、熟悉 Python/Java/Scala 等至少一门编程语言,有实际数据处理经验者优先;
2、了解 Hive、Spark、Kafka、HDFS 等大数据基础组件,有实践经验者优先;
3、熟悉 SQL,能独立编写复杂查询,具备数据分析与建模基础;
4、了解 Airflow、DataWorks 等任务调度系统,有使用经验者优先;
5、逻辑清晰,学习能力强,沟通顺畅,代码习惯良好,对数据质量有高标准
招聘城市:上海
…内核融合、混合精度训练、通信与计算重叠等高级优化技术,不断提升训练引擎效率。
2、推动自动化扩展、智能资源调度、跨架构设备兼容(NV GPU、GPGPU、XPU等)、AI系统可观测性等先进技术在公司模型训练平台落地;
3、跟踪并推动AI系统领域的最新技术趋势(如生成式推荐、AI编译优化、RDMA/NCCL通信计算并发等),持续保持平台业界领先优势。
任职要求:
1、熟悉Linux开发环境,熟练掌握C++/Python;
2、了解至少一种主流机器学习框架(如PyTorch/TensorFlow)的基本原理和使用;
3、对性能优化、并行计算、计算机体系结构有浓厚兴趣和基本理解;
4、具备扎实的数据结构和算法基础,良好的问题分析与解决能力;
5、积极主动,具备良好的沟通能力和团队协作精神…
招聘城市:上海
…部门介绍
商业技术部门涉及服务平台、检索引擎、算法策略、数据工程等多个项目组,从广告投放、检索引擎、模型策略、数据传输分发、数据统计等多个方面,打造哔哩哔哩一站式商业广告平台。
职位亮点
技术导向、团队氛围好、发展空间大,专业能力提升快
职位描述
工作职责:
1. 参与b站电商大数据体系的建设和研发;
2. 参与b站电商数据工程的设计和研发。
工作要求:
1.2026届获得本科及以上学历,计算机、数学、统计、数据科学与大数据技术等相关专业优先;
2.有强的动手能力和学习能力,熟悉一门数据处理语言,如SQL、JAVA、Python、C++、Perl等;
3.对数据敏感,掌握量化分析方法,善于从数据中发现问题,有参与过大数据处理、分析…
招聘城市:北京
岗位介绍:
职位描述
工作职责:
• 参与大模型训练/推理流水线性能分析与优化
• 对数据预处理、推理、后处理环节做 Profiling,消除瓶颈
• 设计 GPU 加速方案:CUDA Kernel 优化、算子融合、混合精度
• 优化数据加载链路(I/O、解码、预处理),减少 GPU 空闲
• 探索编译优化(torch.compile / TensorRT / Triton)落地
工作要求:
• CS/EE/数学相关专业在读;
• 熟悉 Python + PyTorch/JAX
• 了解 GPU 计算原理,有 CUDA 编程经验优先
• 有性能分析工具经验(Nsight/PyTorch Profiler)优先
• 有 C/C++ 基础,能读底层框架源码
• 熟悉 vLLM/TGI/TensorRT-LLM 加分
• 有 Triton(OpenAI)编程经验加分
网申须知
网申开始日期:2026-03-05 00:00
网申截止日期:2026-06-01 00:00
仅限 2026-09 至 2027-08 毕业的大学生,快来投递吧~
投递简历
招聘城市:北京
岗位介绍:
部门介绍
商业技术部门涉及服务平台、检索引擎、算法策略、数据工程等多个项目组,从广告投放、检索引擎、模型策略、数据传输分发、数据统计等多个方面,打造哔哩哔哩一站式商业广告平台。
职位亮点
技术导向、团队氛围好、发展空间大,专业能力提升快
职位描述
工作职责:
1、参与电商核心链路业务平台化架构升级,完成从需求设计、开发和上线整个周期内的工作
2、参与包括系统性能优化,稳定性保障,业务运行时基建等能力建设
工作要求:
1、2027届本科及以上学历在读,计算机、软件工程等相关专业优先
2、热爱计算机科学和互联网技术,擅长至少一门编程语言,包括但不仅限于:Java、C++、Python、Golang等
3、基础扎实,熟悉计算机系统结构、网络…
招聘城市:上海
…端到端数据流水线设计:负责设计、构建与优化面向大模型训练的超大规模多模态数据端到端处理流水线,覆盖数据获取、清洗、标注、质量验证到最终训练集生成的全过程。
高性能数据算子库开发:抽象和封装多模态数据(文本、图像、视频、音频)的通用处理逻辑,设计并实现高性能、可复用的数据算子库(如:图像解帧、语音识别、文本分词、质量过滤、数据增强等)。
训练数据Dataloader研发:深入跟进模型训练阶段,基于处理好的高质量数据集,研发与优化与PyTorch等训练框架无缝集成的高性能Dataloader,确保训练过程中数据读取与加载的效率,解决I/O瓶颈,极大提升GPU利用率。
流水线编排与效率提升:研发灵活的配置化流水线引擎…
招聘城市:北京
…介绍:
部门介绍
商业技术部门涉及服务平台、检索引擎、算法策略、数据工程等多个项目组,从广告投放、检索引擎、模型策略、数据传输分发、数据统计等多个方面,打造哔哩哔哩一站式商业广告平台。
职位亮点
技术导向、团队氛围好、发展空间大,专业能力提升快
职位描述
工作职责:
1.负责设计、研发和优化商业化模型推理服务和训练服务。
2.负责商业化广告相关模型业务的持续迭代。
3.负责商业化模型工程架构的持续迭代和发展。
工作要求:
1.2027届本科及以上学历在读,有c++开发经历,熟悉并了解常见的数据结构和算法。
2.熟悉多线程、高并发、缓存、锁等高性能在线服务技术。
3.熟悉常见的机器学习框架和推理引擎,如TensorFlow、TensorRT等…
招聘城市:上海
…大数据、人工智能、商业创想力、新产品模式等技术和产品手段,一起推动B站实现业务收益的快速提升,进入互联网商业价值平台的超跑赛道。如果你热爱商业,热爱技术,就快来加入我们吧。
职位描述
工作职责:
1.设计与建设广告引擎在线架构和数据平台,承接百亿级流量&千万级物料,提升服务的的性能和稳定性;
2.负责设计和实现易用&高效的广告检索架构,支撑算法&产品在多团队、多业务、多策略、多模型场景的高效迭代;
3.负责对广告检索系统进行极致的性能优化,持续提升在重数据、重计算、低延迟场景约束下广告检索系统的容量。
工作要求:
1.本科及以上学历;
2.扎实的编程基础,熟练掌握Java开发、数据…