牛大妈在社招职位搜索混元大语言数据工程师北京 深圳 有 40 条结果

招聘城市:深圳
…3.有多模态理解数据处理经验优先。
岗位要求:
1.硕士及以上学历,计算机视觉、自然语言处理或多模态方向背景优先;
2.熟练掌握深度学习框架(如PyTorch、TensorFlow),熟悉模型训练及数据处理经验,具备优秀的独立开发与分析调研能力;
3.能handle十亿量级的数据处理,对常用的数据工程技术如spark、hadoop、ray,文件存储系统有实践经验;
4.具备良好的团队协作能力,具备强烈的自我驱动力,能够独立完成系统分析与优化,落地模型应用;
5.有丰富的数据工程架构设计经验优先;有丰富的文档解析或模型预训练数据处理经验优先;
6.动手能力强,能熟练使用Agent及AI coding工具高效完成工作;有基于Agent的数据生产链路研发经验优先…
招聘城市:深圳
…1.负责语言模型后训练(Post-Training)阶段的核心技术研发,构建和优化高质量的奖励系统(Reward System),通过Reward Modeling (RM) 和强化学习(RL)算法持续提升模型在复杂指令遵循、逻辑推理及价值观对齐方面的能力;
2.深入研究和优化 RLHF等后训练算法,提升模型训练的稳定性和最终效果;
3.负责后训练阶段的数据合成与管理,设计高效的数据飞轮机制,利用SFT、Self-Instruct等技术合成高质量训练数据,并负责建立从用户反馈(User Feedback)到模型迭代的闭环信号建模体系;
4.负责后训练模型的全维度评测与分析,制定科学的评价指标,跟进前沿技术动态,将最新研究成果快速转化为业务价值。
岗位要求:
1.计算机科学/软件工程/人工智能…
招聘城市:北京
岗位职责:
1.负责数据采集/蒸馏及相关系统和平台的开发迭代和运维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的…
招聘城市:北京
岗位职责:
1.负责数据接入平台的开发迭代和运维;
2.负责数据接入/质检自动化Pipeline的设计,建设和维护;
3.负责团队内AI智能体、Skills、Mcp等工具开发,为团队业务及系统提升迭代效率;
4.帮助团队攻克各种技术难关,提升全渠道数据获取的效率、质量和能力。
岗位要求:
1.熟悉Python/Go/C++其中一种语言,具备扎实的编码能力;
2.熟悉司内的trpc框架、tke、智研等研效平台,有扎实的后台开发基础和运维经验;
3.对AI领域兴趣浓厚,积极拥抱最新技术,有自建智能体,workflow,openclaw等实践;
4.逻辑清晰,具备出色的分析和解决问题能力,认真负责,需求事项皆可高效落地,沟通顺畅,具备良好的协作能力;
5.具备业务…
招聘城市:北京
岗位职责:
1.负责语言模型(LLM)强化学习场景的智能体交互环境接入与平台化:对接自研/第三方/开源环境,制定接口与数据规范,建设验证与回归机制,保障可用性、兼容性与可复现性;
2.负责智能体环境数据自动生成与流水线自动化:建设模板化/参数化生成、依赖解析、镜像构建与发布、自动化评测与回归等端到端流水线,提升交付效率与稳定性;
3.负责智能体标注能力相关研发:围绕标注任务建模、标注数据/数据规范、版本管理与可追溯、质检与一致性校验等能力建设,并打通训练/评测链路。
岗位要求:
1.精通 Python,具备扎实的软件工程能力与系统设计能力,能在复杂系统中推进架构落地(模块化、测试、日志、性能…
招聘城市:北京
…职责:
1.深度参与模型后训练(包括 SFT、RL )及模型合版的研发和相关算法策略研究,提升模型泛化性、能力边界和上限;
2.后训练策略和生产范式的研究,探索更加敏捷、普适和可扩展的训练范式,提升训练和生产效率;
3.相关前沿后训练技术方向探索,包括但不限于 Reasoning/Agentic 能力增强和 Scaling, RL/OPD 等收敛性和可扩展性研究;
4.将研究成果转化为实际的模型能力或生产效率,并撰写高水平技术报告或论文,提升技术影响力。
岗位要求:
1.计算机科学、数学、人工智能等相关专业硕士及以上学历,具备良好的数理基础;
2.具备良好的工程实现能力,熟练使用 PyTroch、Megatraon、vLLM 等常见模型训练和推理框架…
招聘城市:北京
…的事实核查(Fact-checking)与结果校验机制,通过证据溯源、多源信息比对、结构化校验等手段,解决模型在专业场景中的幻觉与失真问题,确保生成结果的真实性、严谨性与可追溯性;
4.前沿技术转化:探索推理类模型在专业领域 Agent 的落地,包括基于过程监督的思维链(CoT)优化、面向专业任务反馈的强化学习(RL)策略,以及搜索、数据分析、文件处理等多工具协同能力的持续演进。
岗位要求:
1.背景要求:计算机、数学、统计学、法学、金融、医学信息等相关专业硕士及以上学历,2年以上NLP、搜索、知识工程或智能体相关经验,有模型落地经验者优先;
2.算法能力:深入理解 Transformer 和 LLM 训练流程,熟悉 RAG 技术栈,对检索、上下文处理…
招聘城市:北京
机器学习研发底座与LLMOps工程平台的架构设计、核心开发与全链路性能迭代。 负责平台核心架构设计与迭代开发,聚焦模型训练、推理、评估、数据多个核心场景,解决大规模训练、数据处理、评测等场景问题,持续提升模型训练稳定性与平台整体性能上限;
2.LLMOps工程体系迭代与研发效能升级:持续深耕并跟进业界AIGC、模型工程化前沿技术与落地实践,结合内部模型预训练、后训练、迭代、部署全流程诉求,持续优化平台技术方案与产品形态。聚焦平台易用性、自动化、标准化建设,降低模型研发与落地门槛,持续完善、升级、落地全链路LLMOps研发体系。
岗位要求:
1.本科及以上学历,具备扎实的AI工程化、模型研发底座技术功底…
招聘城市:深圳
岗位职责:
1.负责模型评测平台的架构设计与核心模块开发,支撑模型全生命周期的评测需求;
2.设计并优化评测任务调度、数据管理、结果分析等核心系统,保障平台稳定性与可扩展性;
3.构建自动化评测流水线,提升评测效率与研发迭代速度;
4.与算法、产品团队紧密协作,理解评测需求并转化为可落地的技术方案。
岗位要求:
1.本科及以上学历,计算机相关专业,5 年以上后端开发经验;
2.扎实的系统设计能力,有复杂业务系统或平台型产品的架构经验;
3.熟练掌握 Python/Go 等至少一门语言,熟悉常用框架与中间件;
4.熟悉分布式系统、任务调度、消息队列等技术,有高并发系统开发经验;
5.良好的沟通与协作…
招聘城市:深圳
岗位职责:
1.负责语言模型(LLM)代码理解和生成相关的技术研究,提升模型的代码基础能力;
2.跟进模型代码领域的前沿技术,将其应用于研发生产中,持续提升模型的代码能力;
3.负责模型的代码相关的数据构建、训练调优及评测迭代,推进模型技术在代码补全,Text2SQL,代码问答,代码Agent等业务场景落地。
岗位要求:
1.自然语言处理/机器学习/模式识别/人工智能/计算机等相关专业硕士以上学历;
2.在NLP、LLM、深度学习、强化学习方面有一定研究基础,熟悉主流模型和算法,并有一定的实践经验;
3.较强的工程实现能力,熟练掌握C/C++,Python等至少一种语言,有实际编程项目经验,熟悉DeepSpeed、Megatron等分布式训练…
招聘城市:北京
…跟踪 VLM 领域数据相关前沿研究(如预训练数据设计、模态融合策略),主导技术攻关与专利申请;输出可复用的数据处理算法组件与技术文档,建立团队数据算法基准体系。
岗位要求:
1.计算机科学、人工智能、自动化等相关专业硕士及以上学历,1年以上多模态模型或计算机视觉领域研发经验。​;
2.扎实的算法基础:精通深度学习、计算机视觉与自然语言处理核心理论,深入理解 Transformer 架构、模态对齐原理及多模态预训练机制。​;
3.工程能力突出:熟练掌握 Python 编程语言,精通 PyTorch 框架及 HuggingFace 生态,具备大规模数据处理(Spark/Flink)与分布式训练(DDP/FSDP/DeepSpeed)经验。​;
4.数据处理实战经验:具备 VLM 预训练数据构建全流程经验,熟悉图像去重…
招聘城市:北京
岗位职责:
1.负责语言模型训练与评测场景的智能体交互环境接入与平台化,对接自研、第三方和开源环境,制定接口与数据规范,建设验证与回归机制;
2.建设 Agent 框架的数据集能力,对 Pretrain / Posttrain / Eval 数据进行平台化管理,完善数据信息、题目内容、版本、来源、权限、质量状态和运行环境等能力;
3.推进数据集与框架能力协同设计,支持超长任务、复杂系统任务、多轮用户环境和环境依赖型数据集;
4.打通数据集、任务框架、沙盒环境、训练流程和评测结果之间的链路,提升数据使用的可追踪性、可复现性和交付效率。
岗位要求:
1.精通 Python,具备扎实的软件工程能力与系统设计能力,能在复杂系统中推进架构落地;
2.熟练掌握…
招聘城市:深圳
…扎实,深入理解前端工程化流程,熟练掌握工程构建、打包、部署等环节。至少熟练掌握一种主流前端框架(如React/Vue等),具备复杂中后台、配置化或平台型产品开发经验;
3.熟悉Node.js/Java/Go/Python中至少一种后端开发语言,具备独立承担服务端开发任务的能力,熟悉MySQL/Redis/MQ等常见基础组件;
4.具备组件化、配置化、平台化建设经验和抽象复用能力,熟悉AI Coding相关工具与研发范式;
5.具备良好的沟通协作能力与逻辑思维能力,能够独立负责项目或核心模块交付,责任心强;
6.有模型平台、AI平台、数据平台等相关研发经验者优先;有AI编程、代码生成、Agent应用等场景实践经验者优先。
岗位介绍:
作为一名前端开发工程,你…
招聘城市:深圳
模型一站式平台的全链路设计工作,覆盖模型训练、效果评测、服务部署、数据管理等核心场景,从设计策略到UX/UI关键设计方案完整产出。确保平台在高复杂度AI能力下仍保持清晰、高效、可理解的使用体验;
2.复杂工具型产品交互设计:独立承担平台核心功能模块的设计攻坚,包括训练任务监控看板、评测对比视图、任务流编排界面、配置化面板等复杂交互场景。产出用户旅程图、线框图、高保真原型及交互说明,从体验和视觉角度保障项目高质量落地;
3.设计体系建设与规范沉淀:参与或主导建立和维护产品设计系统,制定设计规范、搭建与维护设计组件库,确保设计语言的一致性,提升团队的设计与开发效率;
4.数据
招聘城市:深圳
岗位职责:
1.负责腾讯机器学习平台的设计与开发,包括:性能优化,持续提升训练性能,包括多机多卡大规模训练优化,数据交换优化等;
2.深入理解跟踪业界AIGC动态,优化平台技术方案,提升平台易用性,降低模型研发门槛,不断推进平台的LLMOps能力升级;
3.积极追踪业内AI动态,优化内部技术方案,改进产品性能,不断推进AI架构升级。
岗位要求:
1.熟练掌握TensorFlow、Pytorch、deepSpeed等主流深度学习框架中的一种或多种,并有具体的项目应用经验(包括但不限于模型训练优化、模型服务优化等经验);
2.熟练使用Java/Go/Python至少一种编程语言,良好的软件设计和开发能力;
3.具备owner意识,能主动推进项目进展,承担更多责任,具备团队协作意识…
招聘城市:北京
…​;
4.工程化落地与系统协作:搭建高高效后训练流水线,支持大规模数据并行处理、分布式训练(DDP/FSDP)与模型压缩部署;与产品、工程团队协作,打通 “后训练 - 评测 - 迭代” 闭环,适配不同场景下的 Agent 产品需求。​;
5.技术创新与沉淀:跟踪模型 Agent 领域前沿技术(如 LLM+Planning、Tool Learning、Multi-Agent Interaction),主导核心技术攻关与专利申请;输出可复用的后训练算法组件、技术文档与评测基准,推动团队技术能力沉淀。
岗位要求:
1.计算机科学、人工智能、机器学习等相关专业硕士及以上学历,1年以上模型后训练或 Agent 相关研发经验。​;
2.扎实的算法基础:精通深度学习、强化学习、自然语言处理核心理论,深入理解模型训练原理、Transformer 架构及 Agent…
招聘城市:深圳
…熟悉深度学习模型从训练到推理的全链路转化逻辑,具备模型训推一体化问题定位(如精度漂移、性能衰减)与优化经验者优先;
5.精通 CPU/GPU 异构计算架构下数据传输瓶颈(PCIe 带宽、内存墙、缓存利用率)分析方法;具备服务器端 AI 芯片(如 NVIDIA H100/A100、昇腾 910)推理性能调优经验,熟悉硬件特性与软件适配策略者优先;
6.精通分布式推理核心技术(张量并行、流水线并行、ZeRO 优化、动态负载均衡),熟悉分布式通信框架(NCCL、MPI)底层原理;主导过千亿级以上参数模型分布式推理系统部署、性能调优与稳定性保障,具备超大模型推理成本优化实践经验者优先。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决…
招聘城市:北京
…ASR、声学前处理、自然语言处理、多模态模型等AI系统的工程开发(包括训练工具和推理引擎的开发、优化、交付等);
2.负责AI系统最新算法的集成、工程化、实际场景效果验证、优化、上线;
3.负责AI相关业务、产品的工程支持,在效果和性能上更好的落地。
岗位要求:
1.本科及以上学历,计算机相关专业,本科毕业后有5年以上工作+学习的经验;
2.全面的计算机体系相关知识、基础扎实,有较好的数据结构基&算法基础,具备良好的思维逻辑;
3.精通c/c++/python语言,熟悉golang语言更佳;
4.优秀的分析与解决问题的能力,良好的沟通与团队合作能力;
5.具备一定的分布式系统、微服务架构、数据库技术、缓存技术、消息队列…
招聘城市:深圳
…相关专业本科及以上学历 ;
2.3年及以上Linux后台开发经验,熟悉系统运维的基础知识,能够排查实际问题;
3.精通GO,C++,JAVA和Python开发语言中的一种或多种,熟悉常见rpc框架;
4.熟悉Mysql,Redis等常见开源组件,Flink,Hadoop,Kafka等数据套件,掌握适用场景 ;
5.熟悉Triton服务化框架,熟悉常用的模型框架TensorFlow,PyTorch等;
6.具备owner意识,能主动推进项目进展,承担更多责任,具备团队协作意识,和良好的沟通能力。
岗位介绍:
在腾讯,后台开发工程不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将…
招聘城市:北京
…在集群环境下进行开发、部署、排障或性能优化的经验;
4.了解模型训练流程和基本原理,包括预训练、SFT、RLHF、强化学习训练或自动化评估中的至少一类;
5.具备良好的软件工程能力,重视模块化设计、测试、日志、性能和稳定性治理;
6.具备良好的问题分析及解决能力、沟通合作能力和 owner 意识,能高频承接算法团队需求并持续迭代。
加分项:
1.熟练使用 AI 编程工具,并理解其工作原理、适用边界和工程落地方式;
2.有 Agent 框架、AI Coding CLI、强化学习环境或评测框架经验;
3.有研发效能平台、Review / Debug / Monitor、实验结果分析、问题追踪或知识库工具建设经验;
4.具备跨语言协作能力,能借助 AI 工具阅读和维护 TypeScript / Rust / Go 代码。