牛大妈在社招职位搜索混元大模型数据渠道拓展 有 95 条结果

招聘城市:深圳
…负责数据的勘探,分析和挖掘,覆盖top的数据来源和渠道
3.负责系统的建设,优化数据调度、抓取、解析、存储全栈流程;
4.帮助团队攻克各种数据开发技术难关,提升数据系统的效果与性能。
岗位要求:
1.出色的分析问题,解决问题能力,能从纷繁复杂的数据中分析出问题本质;
2.熟悉主流数据开发技术及框架工具;
3.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
4.熟悉常见数据对抗疯狂策略,并具备相关的实战经验;
5.熟悉传统机器学习模型数据统计模型、熟悉使用一种或几种深度学习框架(如tensorflow、pytorch),熟悉hive/spark/flink/mr等分布式计算编程者更优;
6.加分项:逆向、混淆、脱壳、分布式、数据分析、数据挖掘;
7.有模型数据开发…
招聘城市:北京
岗位职责:
1.负责数据采集/蒸馏及相关系统和平台的开发迭代和运维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的…
招聘城市:北京
岗位职责:
1.负责数据接入平台的开发迭代和运维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的协作能力;
5.具备业务…
招聘城市:北京
…制定模型后训练分Topic数据策略,搭建数据质量评估体系与数据生产标准,针对性优化数据短板,提升模型训练效果;
2.全面管理数据合成、数据质检、数据标注、数据运营小组,负责团队搭建、流程制定、任务统筹与绩效管控,保障数据高效高质量交付;
3.协同算法、研发团队,对齐模型训练需求,落地数据优化方案,跟进数据-模型效果联动优化,推动数据生产智能化升级;
4.把控数据合规与安全,统筹数据项目进度与目标达成,定期复盘数据质量与团队效能。
岗位要求:
1.本科及以上学历,计算机、AI、数据科学、统计学等相关专业,模型数据相关经验及创业经验优先;
2.精通模型后训练数据逻辑,熟悉数据合成、标注、质检、运营全流程,具备分Topic数据策略规划与…
招聘城市:北京
模型数据平台相关的产品策划;
2.围绕提高数据交付质量、效率目标,,以模型为基础,探索产品化、可复制的产品能力,抽象方案,推动落地;
3.通过产品能力,提升模型、智能体等产品能力在司内外的渗透、使用、口碑;
4.通过对需求的研究分析,持续优化和完善产品能力,提升模型、智能体等产品的用户价值和商业价值。
岗位要求:
1.本科及以上学历、3年以上互联网产品运营工作经验,有模型、智能体的产品策划经验更佳;
2.对模型数据全流程熟悉,对数据价值有很好的理解;
3.对模型热爱,有志于长期投入在该领域,有过切实的智能体、智能应用实践优先;
4.具有一定的用户访谈和数据
招聘城市:深圳
岗位职责:
1.理解模型训练数据需求,能够基于模型效果目标,形成高质量的数据交付目标与计划;
2.负责海外供应商开拓与建联,挖掘行业优质模型数据资源,成数据资源拓展计划与策略,储备高质量数据资源;
3.负责海外数据采买与交付,参与优化采买交付流程,持续提升交付效率。
岗位要求:
1.本科及以上学历,英语可以作为工作语言,有海外工作经验优先;
2.具备2年相关领域工作经验,熟悉语言模型、多模态模型训练数据需求,具有丰富的海外模型数据供应商资源积累;
3.具备良好的沟通表达和团队协作能力,较强的自我驱动能力和目标导向感,抗压能力强。
招聘城市:北京
…制定针对复杂模型任务的数据标准,打通数据流转与模型迭代的闭环链路;
3.评测体系与场景验证:基于复杂交互场景构建科学的动态评测集,参与搭建前沿模型训练所需的底层验证与交互环境,持续驱动模型能力上限的突破。
岗位要求:
1.教育与背景:本科及以上学历(计算机、数学等理工科专业优先),具备 AI Agent、代码生成模型或高难度逻辑推理数据/评测集构建相关经验;
2.工程编程能力:具备扎实的工程开发能力,熟练掌握 Python 等主流编程语言,能独立编写代码完成数据清洗、流水线搭建及自动化脚本开发,深入理解软件工程体系与规范;
3.底层认知与综合素养:具备良好的产品思维和极客精神,对 SFT/RLHF 等模型训练机制…
招聘城市:深圳
岗位职责:
1.负责模型全量数据的向量化检索和向量化排重服务,实现实时向量化排重系统;
2.通过向量化检索性能的优化,提升文本排重的准确率和性能;
3.建立模型数据清洗的反馈机制和反馈系统,提升全网数据抓取效率;
4.参与模型数据工程开发,为模型提供基础数据
岗位要求:
1.计算机相关专业,本科以上学历,3年以上架构经验;
2.精通C++/Go/Java中至少一门开发语言,熟悉常见的数据结构和算法;
3.熟悉分布式系统架构和实现,参与过大规模系统的设计研发工作,能承担大规模数据的架构设计;
4.有模型经验者优先,对模型和AGI充满激情。
招聘城市:深圳
岗位职责:
1.负责大规模网页数据的抓取、清洗及结构化存储,保障数据质量和时效性;
2.设计并优化分布式爬虫架构,提升系统并发能力和容错性,提升系统性能;
3.维护数据采集链路,协同系统数据分析团队完成数据交付与应用。
岗位要求:
1.计算机相关专业,本科以上学历,2年以上架构经验;
2.精通C++/Go/Java中至少一门开发语言,熟悉常见的数据结构和算法;
3.熟悉任务调度与性能优化,深入理解HTTP协议,能独立分析动态网页结构;
4.有分布式爬虫开发经验者优先。
招聘城市:深圳
岗位职责:
1.负责模型标注的全流程管理,高效承接模型文本、图片、视频等数据标注业务需求,包括但不限于项目规划、需求分析、进度把控、资源协调以及质量保障,确保项目按时交付并达到预期目标;
2.数据质量把控:负责数据质量把控,梳理并分析数据质量的问题,优化质控方案,能够反哺和迭代标注标准,提升标注质量;
3.团队协作:支持项目经理和产研团队的相关工作,理解项目需求、模型表现和相应的数据实验,协同产研提高模型质量。
岗位要求:
1.本科及以上学历,具有3年以上模型标注相关项目管理经验,国内一线模型团队经验者优先,计算机、统计学相关专业优先,其他专业领域背景者加分,如数学、英语、金法医…
招聘城市:北京
模型数据平台相关的产品策划;
2.围绕提高数据交付质量、效率目标,,以模型为基础,探索产品化、可复制的产品能力,抽象方案,推动落地;
3.通过产品能力,提升模型、智能体等产品能力在司内外的渗透、使用、口碑;
4.通过对需求的研究分析,持续优化和完善产品能力,提升模型、智能体等产品的用户价值和商业价值。
岗位要求:
1.本科及以上学历、3年以上互联网产品运营工作经验,有模型、智能体的产品策划经验更佳;
2.对模型数据全流程熟悉,对数据价值有很好的理解;
3.对模型热爱,有志于长期投入在该领域,有过切实的智能体、智能应用实践优先;
4.具有一定的用户访谈和数据
招聘城市:北京
…建设模型数据回流管线,负责数据的清洗和标准化;
2.负责模型数据飞轮体系产品的落地,挖掘模型使用短板与业务痛点,搭建「使用-回流-迭代升级」的正向数据闭环;
3.开发数据透视、管理和交付平台,提升数据交付过程中的效率和质量;
4.与算法、训练和数据采购团队协作,提高各链路流程的效率。
岗位要求:
1.熟练使用 Python、Go 或 Java,具备后端或数据平台开发经验;
2.熟悉大规模日志处理、数据清洗、任务调度和常见存储组件;
3.熟悉网关、认证、RBAC 权限控制及企业内部系统开发;
4.了解语言模型训练流程及训练数据特点;
5.熟悉腾讯内部基础设施、网关和权限配置者优先;
6.有模型数据、Agent 轨迹或数据交付平台…
招聘城市:北京
…类专业数据源的挖掘、对接、测评与采买落地,覆盖预训练、SFT、多模态、代码、长文本等核心数据类型;
2.建立海外数据技术准入标准,从数据质量、稀缺性、重复噪声、场景适配性做专业评估,筛选真正对模型有效增益的高价值数据
3.对齐预训练算法团队,根据模型能力短板,制定海外数据采买、补充、配比策略,精准支撑模型迭代;
4.负责外购数据的格式适配、清洗去重、质检、版本管理,无缝对接内部预训练数据工作流,实现规模化复用;
5.把控海外数据版权、隐私、跨境合规风险,搭建标准化海外数据准入与风控体系;
6.沉淀海外供应商资源池与数据资产体系,持续优化数据采买、测评、治理流程,构建长期数据壁垒。
岗位要求:
1.计算机、人工智能、数据
招聘城市:深圳
岗位职责:
1.负责模型数据平台的AI能力建设,设计并实现基于Agent的服务框架,提升模型数据生命周期的管理效率;
2.搭建AI驱动的数据评测/标注平台,开发AI辅标、自动化质检及评测能力,持续提升各场景的准确性和效率;
3.开发多Agent协作系统,实现任务规划、工具调用及智能体间的通信机制,构建可控成规模的Agent应用平台。
岗位要求:
1.计算机相关专业本科及以上学历,有3年以上行业工作经验;
2.具备良好的逻辑思维能力,数据分析能力和团队协作精神;
3.熟练掌握至少一种编程语言(如:Python、Go等);
4.熟悉Langchain、LangGraph、AutoGen等Agent相关框架;
5.熟悉LLM、LVM、推理等相关模型知识。
加分项:
1.有Agent实战…
招聘城市:北京
…将最新数据相关成果快速转化为业务价值。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历,具备模型数据工程或模型训练实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据经验,能针对 LLM Alignment、RLHF等后训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 ReAct、Reflexion 等前沿 Agent 推理框架,能够深度剖析 Agent 运行轨迹,系统性优化其思维链质量、工具调用的鲁棒性及环境反馈准确性;
4.熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架,能高效利用模型能力解决数据链路难点;
5.在CCF-A顶会(NeurIPS, ICLR, ICML, ACL 等)有高质量论文发表,或在开源社区(如 HuggingFace、GitHub模型相关…
招聘城市:北京
岗位职责:
1.负责腾讯模型数据飞轮整体规划与落地,设计自动化、可自生长的数据迭代闭环,形成模型数据正向增长飞轮;
2.负责模型数据平台、智能采样、难例挖掘、数据质检、正负样本管理等数据基建产品的需求设计与迭代落地;
3.联动算法、训练、评测、业务团队,针对推理、代码、长文本、Agent调用等核心场景,制定数据迭代策略,定向产出高质量增量数据,驱动模型效果迭代升级;
4.建立统一的模型数据质量标准、流程规范与效率指标体系,优化数据清洗、蒸馏、精标全链路,提升模型迭代效率、降低迭代成本;
5.搭建模型幻觉、事实错误、逻辑偏差、安全风险等负样本数据闭环,持续优化模型对齐效果、稳定性与安全性;
6.结合腾讯元宝、行业解决…
招聘城市:北京
…LLM等实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据处理经验。能针对Code SFT、代码偏好对齐等后训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 CodeAct、SWE-agent、LATS、AlphaCode等前沿代码推理与自动化框架者优先;
4.熟练掌握 Python,善于利用 Cursor、Claude Code 等 AI 辅助工具提升数据生产与自动化分析效率。熟悉至少一门其他主流编程语言(C++/Java/Go等),熟悉Docker优先;
5.在前沿会议有高质量论文发表,或在开源社区有高影响力贡献者优先;
6.具备强烈的数据敏感度、技术热情和自驱力,能够从繁杂的代码与报错日志中洞察模型能力的边界,拥有优秀的跨团队(模型、评测…
招聘城市:深圳
…管理:对模型BPO供应商管理模块具备资深经验,全面统筹人员、流程、交付及风控等核心环节。对供应商日常运营管理具备极高的敏锐度与深刻洞察,能够建立健康长效的供应商生态;
2.策略落地与闭环管理:作为业务线与供应商之间的核心枢纽,精准承接并传达上游在规则、质量、平台及流程等多维度的管理要求。推动供应商核心团队高效执行,有效跟进落地全流程,并完成严格的闭环检查与复盘;
3.风险预警与敏捷纠偏:通过监控供应商日常运营行为及交付指标数据,敏锐捕捉大盘数据的异常波动。主动识别潜在的交付与管理风险,第一时间介入进行流程辅导与管理干预,实现快速纠偏;
4.流程重塑与数据驱动:具备…
招聘城市:深圳
…主动学习算法,降低数据标注工作量,提升标注数据质量​;
3.标注模型持续迭代与优化​:对模型进行持续调优,以适应不同项目的数据特点与标注需求,提高模型数据标注任务上的性能表现。​分析、评估模型/工具效果,提出针对性的改进策略,推动标注模型/工具的迭代升级。
岗位要求:
1.计算机或者相关专业硕士或者以上学历,2年以上推荐/广告/CV/NLP/RL相关工作经验,有模型调优化应用、评测经历者优先;
2.扎实的机器学习基础,能够熟练应用常用的机器学习模型解决实际的业务问题,有主流深度学习模型的项目(CV/NLP/推荐/广告/RL等均可)实践落地经验优先;
3.良好的逻辑思维能力, 数据分析能力,善于分析和解决问题…
招聘城市:深圳
…建立数据质量评估体系,评估标注数据准确性、完整性,输出质量报告,定位标注错误问题​;
2.标注模式对比分析与优化推动​:开展智能标注与人工标注的效率、准确率、成本等维度对比实验,深入分析两者在不同数据类型(文本、图像、音频、视频)、项目场景下的优劣势。通过对比形成分析报告;
3.标注优化推动​:依据对比分析结果,为标注团队提供优化建议。针对智能标注,协助优化模型,提升标注效果;针对人工标注,提出标注流程改进方案、规则优化建议并落地,持续推动标注效率与质量提升。并协助平台沉淀优化策略和方法。
岗位要求:
1.统计学、计算机、数据科学等相关专业本科及以上学历​;
2.熟练使用 Python 或 R 进行数据处理分析,精通 SQL 查询数据​…