招聘城市:深圳
岗位职责:
1.理解大模型训练数据需求,能够基于模型效果目标,形成高质量的数据交付目标与计划;
2.负责海外供应商开拓与建联,挖掘行业优质大模型数据资源,成数据资源拓展计划与策略,储备高质量数据资源;
3.负责海外数据采买与交付,参与优化采买交付流程,持续提升交付效率。
岗位要求:
1.本科及以上学历,英语可以作为工作语言,有海外工作经验优先;
2.具备2年相关领域工作经验,熟悉大语言模型、多模态模型训练数据需求,具有丰富的海外大模型数据供应商资源积累;
3.具备良好的沟通表达和团队协作能力,较强的自我驱动能力和目标导向感,抗压能力强。
招聘城市:北京
…制定大模型后训练分Topic数据策略,搭建数据质量评估体系与数据生产标准,针对性优化数据短板,提升模型训练效果;
2.全面管理数据合成、数据质检、数据标注、数据运营小组,负责团队搭建、流程制定、任务统筹与绩效管控,保障数据高效高质量交付;
3.协同算法、研发团队,对齐模型训练需求,落地数据优化方案,跟进数据-模型效果联动优化,推动数据生产智能化升级;
4.把控数据合规与安全,统筹数据项目进度与目标达成,定期复盘数据质量与团队效能。
岗位要求:
1.本科及以上学历,计算机、AI、数据科学、统计学等相关专业,大模型数据相关经验及创业经验优先;
2.精通大模型后训练数据逻辑,熟悉数据合成、标注、质检、运营全流程,具备分Topic数据策略规划与…
招聘城市:深圳
…保障模型能力清晰可理解、稳定可调用、过程可管理;
3.推动模型能力使用增长:面向司内业务构建分层服务机制,承接业务咨询、接入支持、问题反馈和使用体验优化,提升业务接入效率和服务满意度;并推进成长型业务的调用规模和业务渗透率;
4.建设运营指标与价值度量体系:关注模型调用、业务指标、用户反馈、问题闭环、资源使用等核心指标,定期输出运营分析和复盘,为模型服务优化、资源投入和业务增长提供依据;
5.扩大模型影响力:围绕模型发版节奏、能力矩阵和典型应用场景,策划宣发、能力介绍、案例沉淀和推广内容,扩大混元多模态大模型认知度和影响力;
6.建立用户反馈与模型优化的数据飞轮:收集和分析业务使用反馈、模型…
招聘城市:北京
…维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的协作能力;
5.具备业务、运营思维,有运营经验,关注业务效果和质量者优先…
招聘城市:北京
…数据接入平台的开发迭代和运维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的协作能力;
5.具备业务、运营思维,有运营…
招聘城市:北京
…重计算、序列并行、MoE 路由与专家并行的工程约束;
7.熟悉大模型研发全流程,理解各训练阶段的数据形态、资源特征与失败模式;具备在既有基础设施之上构建抽象层的经验,能说明能力边界的划分依据与取舍过程;
8.具备矩阵型组织中的技术决策与推动能力,以平台能力的实际使用规模与效率提升衡量交付成果。
加分项:
1.有万卡级训练集群建设或运营经验,或异构算力适配与统一调度经验;
2.有 RL 训练链路工程化经验,包括训推混部编排、权重同步、工具沙箱环境管理;
3.有大模型评测体系、数据血缘或元数据管理系统的建设经验;
4.主导过多平台整合、技术栈收敛或大规模系统迁移;
5…
招聘城市:北京
…分析 / 市场洞察相关经验,具备扎实的数据分析功底,有产品数据科学、计算社会科学或消费者洞察背景优先;
2.熟练使用 SQL、Python(Pandas 等),能独立完成数据提取、清洗、分析与可视化,有 AI / Coding Agent / 开发者工具 / SaaS 产品相关经验者优先;
3.具备敏锐的市场洞察力与需求分析能力,能从数据和用户反馈中提炼出有说服力的结论,有用户满意度指标体系(NPS / CSAT / 留存)搭建与运营经验;
4.有指标体系设计与数据看板建设经验,能够使用包括大模型在内的分析工具提升效率,具备独立检查报告可靠性与正确性的能力。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等…
招聘城市:北京
…大模型数据平台相关的产品策划;
2.围绕提高数据交付质量、效率目标,,以大模型为基础,探索产品化、可复制的产品能力,抽象方案,推动落地;
3.通过产品能力,提升大模型、智能体等产品能力在司内外的渗透、使用、口碑;
4.通过对需求的研究分析,持续优化和完善产品能力,提升大模型、智能体等产品的用户价值和商业价值。
岗位要求:
1.本科及以上学历、3年以上互联网产品运营工作经验,有大模型、智能体的产品策划经验更佳;
2.对大模型数据全流程熟悉,对数据价值有很好的理解;
3.对大模型热爱,有志于长期投入在该领域,有过切实的智能体、智能应用实践优先;
4.具有一定的用户访谈和数据…
招聘城市:北京
…大模型数据平台相关的产品策划;
2.围绕提高数据交付质量、效率目标,,以大模型为基础,探索产品化、可复制的产品能力,抽象方案,推动落地;
3.通过产品能力,提升大模型、智能体等产品能力在司内外的渗透、使用、口碑;
4.通过对需求的研究分析,持续优化和完善产品能力,提升大模型、智能体等产品的用户价值和商业价值。
岗位要求:
1.本科及以上学历、3年以上互联网产品运营工作经验,有大模型、智能体的产品策划经验更佳;
2.对大模型数据全流程熟悉,对数据价值有很好的理解;
3.对大模型热爱,有志于长期投入在该领域,有过切实的智能体、智能应用实践优先;
4.具有一定的用户访谈和数据…
招聘城市:深圳
…管理:对大模型BPO供应商管理模块具备资深经验,全面统筹人员、流程、交付及风控等核心环节。对供应商日常运营管理具备极高的敏锐度与深刻洞察,能够建立健康长效的供应商生态;
2.策略落地与闭环管理:作为业务线与供应商之间的核心枢纽,精准承接并传达上游在规则、质量、平台及流程等多维度的管理要求。推动供应商核心团队高效执行,有效跟进落地全流程,并完成严格的闭环检查与复盘;
3.风险预警与敏捷纠偏:通过监控供应商日常运营行为及交付指标数据,敏锐捕捉大盘数据的异常波动。主动识别潜在的交付与管理风险,第一时间介入进行流程辅导与管理干预,实现快速纠偏;
4.流程重塑与数据驱动:具备…
招聘城市:深圳
…负责数据的勘探,分析和挖掘,覆盖top的数据来源和渠道;
3.负责系统的建设,优化数据调度、抓取、解析、存储全栈流程;
4.帮助团队攻克各种数据开发技术难关,提升数据系统的效果与性能。
岗位要求:
1.出色的分析问题,解决问题能力,能从纷繁复杂的数据中分析出问题本质;
2.熟悉主流数据开发技术及框架工具;
3.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
4.熟悉常见数据对抗疯狂策略,并具备相关的实战经验;
5.熟悉传统机器学习模型、数据统计模型、熟悉使用一种或几种深度学习框架(如tensorflow、pytorch),熟悉hive/spark/flink/mr等分布式计算编程者更优;
6.加分项:逆向、混淆、脱壳、分布式、数据分析、数据挖掘;
7.有大模型数据开发…
招聘城市:北京
…制定针对复杂模型任务的数据标准,打通数据流转与模型迭代的闭环链路;
3.评测体系与场景验证:基于复杂交互场景构建科学的动态评测集,参与搭建前沿模型训练所需的底层验证与交互环境,持续驱动模型能力上限的突破。
岗位要求:
1.教育与背景:本科及以上学历(计算机、数学等理工科专业优先),具备 AI Agent、代码生成大模型或高难度逻辑推理数据/评测集构建相关经验;
2.工程编程能力:具备扎实的工程开发能力,熟练掌握 Python 等主流编程语言,能独立编写代码完成数据清洗、流水线搭建及自动化脚本开发,深入理解软件工程体系与规范;
3.底层认知与综合素养:具备良好的产品思维和极客精神,对 SFT/RLHF 等模型训练机制…
招聘城市:深圳
岗位职责:
1.负责大模型全量数据的向量化检索和向量化排重服务,实现实时向量化排重系统;
2.通过向量化检索性能的优化,提升文本排重的准确率和性能;
3.建立大模型数据清洗的反馈机制和反馈系统,提升全网数据抓取效率;
4.参与大模型的数据工程开发,为大模型提供基础数据。
岗位要求:
1.计算机相关专业,本科以上学历,3年以上架构经验;
2.精通C++/Go/Java中至少一门开发语言,熟悉常见的数据结构和算法;
3.熟悉分布式系统架构和实现,参与过大规模系统的设计研发工作,能承担大规模数据的架构设计;
4.有大模型经验者优先,对大模型和AGI充满激情。
招聘城市:深圳
岗位职责:
1.负责大规模网页数据的抓取、清洗及结构化存储,保障数据质量和时效性;
2.设计并优化分布式爬虫架构,提升系统并发能力和容错性,提升系统性能;
3.维护数据采集链路,协同系统数据分析团队完成数据交付与应用。
岗位要求:
1.计算机相关专业,本科以上学历,2年以上架构经验;
2.精通C++/Go/Java中至少一门开发语言,熟悉常见的数据结构和算法;
3.熟悉任务调度与性能优化,深入理解HTTP协议,能独立分析动态网页结构;
4.有分布式爬虫开发经验者优先。
招聘城市:深圳
岗位职责:
1.负责大模型标注的全流程管理,高效承接大模型文本、图片、视频等数据标注业务需求,包括但不限于项目规划、需求分析、进度把控、资源协调以及质量保障,确保项目按时交付并达到预期目标;
2.数据质量把控:负责数据质量把控,梳理并分析数据质量的问题,优化质控方案,能够反哺和迭代标注标准,提升标注质量;
3.团队协作:支持项目经理和产研团队的相关工作,理解项目需求、模型表现和相应的数据实验,协同产研提高模型质量。
岗位要求:
1.本科及以上学历,具有3年以上大模型标注相关项目管理经验,国内一线大模型团队经验者优先,计算机、统计学相关专业优先,其他专业领域背景者加分,如数学、英语、金法医…
招聘城市:北京
…建设大模型数据回流管线,负责数据的清洗和标准化;
2.负责混元大模型数据飞轮体系产品的落地,挖掘模型使用短板与业务痛点,搭建「使用-回流-迭代升级」的正向数据闭环;
3.开发数据透视、管理和交付平台,提升数据交付过程中的效率和质量;
4.与算法、训练和数据采购团队协作,提高各链路流程的效率。
岗位要求:
1.熟练使用 Python、Go 或 Java,具备后端或数据平台开发经验;
2.熟悉大规模日志处理、数据清洗、任务调度和常见存储组件;
3.熟悉网关、认证、RBAC 权限控制及企业内部系统开发;
4.了解大语言模型训练流程及训练数据特点;
5.熟悉腾讯内部基础设施、网关和权限配置者优先;
6.有大模型数据、Agent 轨迹或数据交付平台…
招聘城市:北京
…类专业数据源的挖掘、对接、测评与采买落地,覆盖预训练、SFT、多模态、代码、长文本等核心数据类型;
2.建立海外数据技术准入标准,从数据质量、稀缺性、重复噪声、场景适配性做专业评估,筛选真正对模型有效增益的高价值数据;
3.对齐预训练算法团队,根据模型能力短板,制定海外数据采买、补充、配比策略,精准支撑模型迭代;
4.负责外购数据的格式适配、清洗去重、质检、版本管理,无缝对接内部预训练数据工作流,实现规模化复用;
5.把控海外数据版权、隐私、跨境合规风险,搭建标准化海外数据准入与风控体系;
6.沉淀海外供应商资源池与数据资产体系,持续优化数据采买、测评、治理流程,构建长期数据壁垒。
岗位要求:
1.计算机、人工智能、大数据…
招聘城市:深圳
岗位职责:
1.负责大模型数据平台的AI能力建设,设计并实现基于Agent的服务框架,提升模型数据生命周期的管理效率;
2.搭建AI驱动的数据评测/标注平台,开发AI辅标、自动化质检及评测能力,持续提升各场景的准确性和效率;
3.开发多Agent协作系统,实现任务规划、工具调用及智能体间的通信机制,构建可控成规模的Agent应用平台。
岗位要求:
1.计算机相关专业本科及以上学历,有3年以上行业工作经验;
2.具备良好的逻辑思维能力,数据分析能力和团队协作精神;
3.熟练掌握至少一种编程语言(如:Python、Go等);
4.熟悉Langchain、LangGraph、AutoGen等Agent相关框架;
5.熟悉LLM、LVM、推理等相关大模型知识。
加分项:
1.有Agent实战…
招聘城市:北京
…将最新数据相关成果快速转化为业务价值。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历,具备大模型数据工程或模型训练实际项目经验;
2.深入理解 Transformer 架构及大语言模型训练原理,具备丰富的数据经验,能针对 LLM Alignment、RLHF等后训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 ReAct、Reflexion 等前沿 Agent 推理框架,能够深度剖析 Agent 运行轨迹,系统性优化其思维链质量、工具调用的鲁棒性及环境反馈准确性;
4.熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架,能高效利用模型能力解决数据链路难点;
5.在CCF-A顶会(NeurIPS, ICLR, ICML, ACL 等)有高质量论文发表,或在开源社区(如 HuggingFace、GitHub大模型相关…
招聘城市:北京
岗位职责:
1.负责腾讯混元大模型数据飞轮整体规划与落地,设计自动化、可自生长的数据迭代闭环,形成模型数据正向增长飞轮;
2.负责大模型数据平台、智能采样、难例挖掘、数据质检、正负样本管理等数据基建产品的需求设计与迭代落地;
3.联动算法、训练、评测、业务团队,针对推理、代码、长文本、Agent调用等核心场景,制定数据迭代策略,定向产出高质量增量数据,驱动模型效果迭代升级;
4.建立统一的大模型数据质量标准、流程规范与效率指标体系,优化数据清洗、蒸馏、精标全链路,提升模型迭代效率、降低迭代成本;
5.搭建模型幻觉、事实错误、逻辑偏差、安全风险等负样本数据闭环,持续优化模型对齐效果、稳定性与安全性;
6.结合腾讯元宝、行业解决…