招聘城市:上海
岗位职责:
1. 推动风控数据体系化建设,覆盖账号、行为、策略、模型等核心主题;
2. 设计统一的数据标准、分层规范与指标体系,推动跨业务线数据口径一致;
3. 负责风控领域数据建模与仓库开发,保障数据结构合理、性能高效、可扩展;
4. 构建可复用的风控数据资产,与风控策略、模型、产品团队协作,服务策略引擎、模型特征、风控报表等多场景;
5. 优化数据结构与ETL流程,提升任务性能与可维护性;
6. 持续挖掘风控数据价值,探索数据在风险识别、策略评估、智能决策中的应用;
7. 输出数据洞察,辅助发现新型风险模式与潜在风险点;
8. 参与数据平台工具研发,提高风控数据建设与运维效率。
任职要求:
1. 本科及以上学历…
招聘城市:北京
…为技术深度优化提供了最佳实践可能。这里有简单、讲逻辑、有爱的团队,更是一块理想的实战场地,舞台广阔,欢迎你来尽情施展。
岗位职责:
1.使用各类数据挖掘技术及机器学习算法,对海量用户数据进行多维度多场景下的挖掘与建模,精准刻画用户行为。
2.结合对业务理解,深入挖掘数据价值,并推动在业务场景下应用,拿到业务结果。
3.深入思考产品业务价值,参与制定及落实团队在技术、业务等多维度发展方向。
4.与其他团队密切合作,包括数据工程师、前后端工程师、产品经理等,实现高质量的产品和解决方案。
任职要求:
1.拥有计算机、电子、通信、数学、统计学或相关专业的本科及以上学历,具备3年及以上工作经验。…
招聘城市:深圳
岗位职责:
1.面向预训练、后训练数据管线,设计并实现高效的数据处理平台。单管线上,通过算子编排形成数据计算、存储、一体化符合大模型训练的管线平台,平台级别上,通过存储、计算优化实现平台产能提升;
2.计算方向,提升平台级别计算效率,通过海量数据、任务、资源、合理化系统设计,抽象,对各个可编排算子的合并、拆分,达成易用性和计算性能平衡。对热点的算子,考虑单点优化以及公共服务的方式达到平台级性能提升;
3.存储方向,构建服务于整个预训练和后训练的dataset,优化海量存储管理与访问方案(对象存储分层、冷热分层、缓存策略、数据压缩与列式格式优化、读写并发控制、成本与生命周期管理);
4.编写技术文档、最佳实践与性能评估报告…
招聘城市:北京,上海,深圳
岗位职责:
1、负责图片、点播、直播等业务的离线与实时数据仓库的构建;
2、负责数据模型的设计,ETL实施,ETL性能优化,ETL数据监控以及相关技术问题的解决;
3、理解多媒体的业务需求,负责多媒体指标体系建设与维护;
4、参与数据治理工作,提升数据易用性及数据质量。
任职要求:
1、熟悉数据仓库实施方法论、深入了解数据仓库体系,并支撑过实际业务场景;
2、熟练使用Hadoop及Hive,熟悉SQL、Java、Python等编程语言;
3、善于沟通,对业务敏感,能快速理解业务背景,具备优秀的技术与业务结合能力。
4、具备平台治理业务经验&实时数据体系建设经验优先。
招聘城市:深圳
岗位职责:
1.负责SSV相关产品数据工程工作,包含数据基建搭建、数据链路优化、数据工具平台建设与维护,支撑业务数据常态化产出;
2.搭建并完善产品数据体系与数据Pipeline,负责数据采集、加工、调度与质量治理,持续优化数据稳定性、准确性与产出效率;
3.定位数据链路及业务侧核心问题,支撑产品迭代、运营复盘及AB实验落地,为产品策略与业务优化提供稳定的数据底座支撑;
4.协助标准化数据口径、沉淀数据资产,利用AI工具辅助提升数据开发效率,落地自动化数据流程建设。
岗位要求:
1.本科及以上学历,计算机、数学、软件工程等相关专业,具备优秀的逻辑思维与工程落地sense;
2.3年以上数据开发、数据工程相关工作经验,熟悉数据仓库…
招聘城市:深圳
岗位职责:
1.负责AI金融数据库和MCP的规划和建设,推动大模型技术在金融AI助理、智能选基、智能投顾等金融核心场景的落地;
2.负责金融行业数据库、金融画像库的规划和建设,数据技术底座建设,保障数据质量与时效性;
3.负责金融量化策略的构建和开发,赋能用户的金融投资决策;
4.关注AI领域的前沿技术和发展趋势,探索AI在金融数据生产和投资决策能力构建上的应用。
岗位要求:
1.工作要求:;
2.本科或以上学历,计算机、软件、人工智能、数据科学、数学等相关专业;
3.扎实的编程功底,精通Python或Java,熟练掌握SQL及数据库编程;
4.熟悉大数据生态技术(Hadoop/Spark/flink/Hive),熟悉数仓开发和MySQL…
招聘城市:上海
岗位职责:
1.大模型训练数据构建:负责大语言模型训练数据的建设,针对通用AI任务、行业AI模型等,制定高质量的数据建设方案,并实现数据获取、数据清洗、数据验收、数据质量评测等;
2.大模型评测数据构建:追踪学术界、工业界的先进评测标准、评测方法、评测数据集,设计模型效果评测方案,构建高质量的评测数据集;
3.高质量数据生成算法研究:负责数据合成研究,利用各类智能模型、prompt工程等生成特定训练、评测数据,提升高质量数据的生产效能。
岗位要求:
1.教育背景:计算机视觉/自然语言处理/机器学习/人工智能等相关专业硕士及以上学历;
2.专业技能:熟悉大语言模型及其训练流程,熟悉PyTorch等框架,具有扎实的编程基础,熟悉Python等编程…
招聘城市:广州
岗位职责:
1.参与微信基础业务数仓搭建,涵盖实时、离线指标设计、数仓建设;
2.参与对内对外业务数据平台搭建,负责数据处理、对外提供;
3.参与数据pipeline的设计与优化。
岗位要求:
1.本科及以上学历,计算机科学或相关专业,计算机基础扎实;
2.有大数据开发经验,熟练掌握 SQL,具备良好的数据建模能力;
3.熟练掌握 Flink 实时任务开发及相关原理,熟悉 Spark 性能调优与任务优化;
4.熟悉业界主流查询引擎及原理(Presto/Impala/ClickHouse/Doris 等至少一种);
5.对数据湖技术(Iceberg/Hudi 等)有实践经验者优先;
6.具备业务数据 sense,能从数据中发现问题和机会;
7.热衷于 AI 技术,有 AI vibe coding 经验或大模型相关数据工程经验者优先…
招聘城市:上海
岗位职责:
1.负责王者荣耀世界以及周边相关应用的数据仓库开发、建设、治理等相关工作;支持业务相关的基础数据需求;
2.负责数据体系的系统性设计,搭建离线数据计算管线、实时数据处理管线、抽象数据模型,提升数据的复用性和数据质量;
3.负责数据看板展示相关能力开发,搭建DA看板、针对特定分析需求的数据展示、针对不同业务应用情景设计不同的数据消费管线;
4.对数据分析相关职能进行技术支持,为数据分析提供可靠的数据报表输出和数据展示体系;
5.使用科学的方法对数据管线的健康度和稳定性进行监控和预警,对偶发的数据健康问题进行处理。
岗位要求:
1.计算机相关专业本科以上学历,有大数据管线处理从业…
招聘城市:深圳
岗位职责:
1.负责一个核心业务方向(AI搜索/拟人助手/写作/语音等)的数据生产工作;
2.设计并搭建自动化数据合成Pipeline,实现高质量数据的规模化生产;
3.建立数据质量监控体系,科学评估数据分布、质量与丰富度;
4.构建高风险数据识别机制,合理分配自动化与人工标注的边界;
5.跟踪数据合成领域前沿进展,创新实践最新方法,持续优化数据生产效率与质量。
岗位要求:
1.Python编程能力扎实,能独立完成数据处理、Pipeline搭建等工作;
2.熟悉大模型能力边界,有Prompt Engineering实践经验;
3.对数据合成前沿方向有认知(如Self-Instruct、Evol-Instruct、RLAIF、合成数据质量评估等);
4.具备数据敏感度,能够从数据分布中发现问题并提出优化方案;
5.自驱力强…
招聘城市:深圳
岗位职责:
1.多模态数据管线建设:设计并实现面向大模型训练与推理的多模态数据处理与构建管线,覆盖图像、视频、音频、文本、3D 及多模态理解等数据类型,支撑预训练、后训练(SFT / RLHF / Preference)及评测数据构建;
2.大规模数据工程与系统建设:构建高可靠、可扩展的数据处理系统,支持 TB / PB 级数据规模,负责批处理与流式处理任务的工程实现,参与或主导分布式并行计算(CPU / GPU 混合)的工程落地;
3.数据质量与稳定性保障:建立数据校验与质量评估机制,覆盖数据完整性、一致性、分布异常与质量回归等场景,设计并推动数据处理链路的监控与异常治理;
4.数据资产化与标准化建设:推动多模态数据结构的标准化…
招聘城市:深圳
岗位职责:
1.负责AI金融数据库和MCP的规划和建设,推动大模型技术在金融AI助理、智能选基、智能投顾等金融核心场景的落地;
2.负责金融行业数据库、金融画像库的规划和建设,数据技术底座建设,保障数据质量与时效性;
3.负责金融量化策略的构建和开发,赋能用户的金融投资决策;
4.关注AI领域的前沿技术和发展趋势,探索AI在金融数据生产和投资决策能力构建上的应用。
岗位要求:
1.工作要求:;
2.本科或以上学历,计算机、软件、人工智能、数据科学、数学等相关专业;
3.扎实的编程功底,精通Python或Java,熟练掌握SQL及数据库编程;
4.熟悉大数据生态技术(Hadoop/Spark/flink/Hive),熟悉数仓开发和MySQL…
招聘城市:广州
岗位职责:
1.负责微信搜索业务数据研发相关工作,主导业务数据采集、业务实时与离线数仓的设计与研发;
2.与产品团队紧密协作,理解业务需求,提供数据支持,推动数据驱动的产品改进;
3.负责参与整体数据架构的设计与优化,提升系统性能和稳定性;
4.跟踪业界最新技术和动态,将其应用到实际项目中,提升整体数据服务能力。
岗位要求:
1.计算机科学或相关领域本科及以上学历;
2.具有2年以上大数据研发经验,包括实时、离线数据处理、数据建模、ETL开发与设计、数据治理等;
3.熟悉Hive、Iceberg、Spark、Flink的基本原理并熟练使用,至少有一种引擎的优化经验;
4.熟悉ClickHouse、Druid、Doris等OLAP引擎,至少有一种引擎的优化经验;
5…
招聘城市:深圳
…Image)、视频(Video)的高质量对齐管线,利用CLIP、BLIP等模型进行自动化打标(Captioning)与语义增强;
3.自动化渲染管线: 搭建基于Blender/Unity/Unreal的高性能批量渲染管线,将3D数据转化为多视角的2D图像/视频数据,用于模型训练;
4.合成数据生成(Synthetic Data):
-利用程序化生成(Procedural Generation)技术或游戏引擎,批量生成多样化的3D场景与物体,解决长尾数据稀缺问题;
-探索Sim-to-Real的数据增强策略,提升模型泛化能力;
5.团队管理与质量控制:
-组建并管理数据团队(包括数据工程师、3D技术美术TA、标注专员);
-建立自动化与人工相结合的数据质量评估体系(QA),制定SOP,确保持续向算法团队输送High-Quality Token。
岗位要求:
1. 专业背景:
计算机…
招聘城市:深圳
岗位职责:
1.负责文档数据处理的全链路工程实现,包括负责支持文档数据存储计算处理、解析、去重、质量筛选等数据处理环节;
2.有丰富的文档解析或大模型预训练数据处理经验、基于Agent的数据生产链路研发经验优先;
3.有多模态理解数据处理经验优先。
岗位要求:
1.硕士及以上学历,计算机视觉、自然语言处理或多模态方向背景优先;
2.熟练掌握深度学习框架(如PyTorch、TensorFlow),熟悉模型训练及数据处理经验,具备优秀的独立开发与分析调研能力;
3.能handle十亿量级的数据处理,对常用的数据工程技术如spark、hadoop、ray,文件存储系统有实践经验;
4.具备良好的团队协作能力,具备强烈的自我驱动力,能够独立完成系统分析与优化,落地…
招聘城市:广州
岗位职责:
1.负责微信基础功能的业务数据采集、实时与离线数仓设计与指标体系建设,提供及时、稳定、可信的数据支撑;
2.优化现有数据流程,提高数据处理效率和质量;
3.负责面向业务方的数据资产建设,沉淀清晰、稳定、可靠的公共数据模型和指标口径,完善数据说明与使用规范。
岗位要求:
1.2 年以上 PB 级大数据研发经验,精通 Hadoop 生态、Spark 调优及 Flink 实时开发;
2.熟悉实时/离线数据仓库体系建设,有数仓系统优化/数据治理相关经验优先;
3.熟悉 Doris/StarRocks 等 OLAP 引擎及 Hudi/Iceberg 湖仓技术,具备选型与落地能力;
4.学习能力强,具备良好的跨团队(产品/算法/后端)沟通与协同能力。
岗位介绍:
在腾讯,技术人解决问题的激情…
招聘城市:深圳
岗位职责:
1.评测体系搭建:构建覆盖感知、推理、操作、长时程任务的多层级仿真与真机评测体系,制定评测指标体系,主导自动评分与人评流水线的设计与落地,持续推动仿真-真机一致性验证;
2.跨本体泛化评测:推动跨本体(单臂/双臂、移动操作、灵巧手等)泛化能力评测方案的设计与实施,建立可复用的评测基准与对标机制;
3.数据采集策略:制定具身大模型预训练、后训练、RL 及评测全链路的数据采集方案,覆盖 ego-centric、UMI、遥操作等多模态数据源,确保数据的规模、质量与多样性;
4.数据标注与治理:建立数据标注与清洗流程,涵盖任务与场景多样性标注、任务语义标注、位姿定位标注等,构建全…
招聘城市:深圳
岗位职责:
1.面向世界模型(World Model)场景下多模态大模型的预训练与后训练数据需求,围绕2D视频数据与3D场景数据构建自动化、高效率的数据处理管线,覆盖数据采集、清洗、结构化、合成、质量评估与版本管理等环节,持续优化系统性能,保障管线的稳定性、可扩展性与可复用性;
2.设计并开发数据处理工具与自动化脚本,提升数据清洗、标注与合成效率,支撑数据规模化生产与迭代;
3.建立数据质量评估与自动化检测体系;
4.与算法研究团队深度协作,理解世界模型在视频预测、场景建模与交互推理等任务中的训练需求,制定针对性的多模态数据策略,持续挖掘高价值数据资源,推动以数据为核心驱动…
招聘城市:上海
岗位职责:
1.面向世界模型(World Model)场景下多模态大模型的预训练与后训练数据需求,围绕2D视频数据与3D场景数据构建自动化、高效率的数据处理管线,覆盖数据采集、清洗、结构化、合成、质量评估与版本管理等环节,持续优化系统性能,保障管线的稳定性、可扩展性与可复用性;
2.设计并开发数据处理工具与自动化脚本,提升数据清洗、标注与合成效率,支撑数据规模化生产与迭代;
3.建立数据质量评估与自动化检测体系;
4.与算法研究团队深度协作,理解世界模型在视频预测、场景建模与交互推理等任务中的训练需求,制定针对性的多模态数据策略,持续挖掘高价值数据资源,推动以数据为核心驱动…
招聘城市:深圳
岗位职责:
1.灵活支撑研究员对训练Infra的需求,实现GRPO这样的创新的强化学习训练Infra;同时用工程的方法深入业务搜集有价值的数据;
2.负责大语言模型后台服务架构设计、开发和维护工作;
3.负责配合研究院调整模型后训练训练框架的工作;
4.负责模型训练所需要的数据收集、处理、标注和评测工程支持等工作;
5.参与新技术调研及实际业务场落地,不断提升业务指标;
6.负责后台系统的性能优化、稳定性、流程建设和研效提升。
岗位要求:
1.大学本科及以上学历,计算机相关专业,相关工作经验3年以上;熟悉Linux操作系统,熟练掌握C/C++、Go、Python;具备扎实的网络编程经验,熟悉TCP/IP、HTTP、RESTful API等网络协议,能够…