牛大妈在社招职位搜索大模型数据工程 有 1000+ 条结果

小红书 模型数据工程

全职 北京,上海
招聘城市:北京,上海
数据可用性,助力模型预训练及微调。
关注高性能计算,优化数据处理任务的并发执行、计算资源管理,提升计算效率和存储利用率。
任职要求:
本科及以上学历,计算机科学、软件工程数据等相关专业,5 年以上大规模数据处理经验。
精通数据技术栈,包括但不限于:
计算框架:Hadoop、Spark、Flink、Ray 等,具备流批一体化数据处理经验。
存储系统:HBase、ClickHouse、Cassandra、Elasticsearch、Iceberg、Delta Lake 等,能够根据业务需求选择最优存储方案。
分布式消息队列:Kafka、Pulsar 等,优化大规模数据流传输。
ETL 及数据管道:精通 Airflow、KubeFlow 等数据编排工具,能够高效构建数据流转任务。
熟练掌握至少一种编程语言(Python、Java、Scala),具备良好的代码优化及系统调优能力。
深入理解数据

小红书(xiaohongshu) 模型数据工程

全职 北京,上海
招聘城市:北京,上海
…助力模型预训练及微调。
7、关注高性能计算,优化数据处理任务的并发执行、计算资源管理,提升计算效率和存储利用率。
任职要求:
-本科及以上学历,计算机科学、软件工程数据等相关专业,5 年以上大规模数据处理经验。
-精通数据技术栈,包括但不限于:
-计算框架:Hadoop、Spark、Flink、Ray 等,具备流批一体化数据处理经验。
-存储系统:HBase、ClickHouse、Cassandra、Elasticsearch、Iceberg、Delta Lake 等,能够根据业务需求选择最优存储方案。
-分布式消息队列:Kafka、Pulsar 等,优化大规模数据流传输。
-ETL 及数据管道:精通 Airflow、KubeFlow 等数据编排工具,能够高效构建数据流转任务。
-熟练掌握至少一种编程语言(Python、Java、Scala),具备良好的代码优化及系统调优能力。
-深入理解数据架构设计…
招聘城市:深圳
…提升模型泛化能力;
5.团队管理与质量控制:
-组建并管理数据团队(包括数据工程师、3D技术美术TA、标注专员);
-建立自动化与人工相结合的数据质量评估体系(QA),制定SOP,确保持续向算法团队输送High-Quality Token。
岗位要求:
1. 专业背景:
计算机、图形学、数学或相关专业本科及以上学历,3年以上相关技术开发经验;
2. 核心技能(必须):
3D数据处理能力: 深刻理解3D数据格式(如 glTF, OBJ, USD, PLY)及表征形式(Mesh, Point Cloud, Voxel, NeRF, Gaussian Splatting);
编程能力: 精通 Python,熟练掌握 Blender Python API (bpy) 或其他3D软件脚本开发,具备自动化处理海量3D模型的能力;
图形学基础: 熟悉渲染管线,了解PBR材质、光照、相机参数对数据的影响;
3. 模型认知…
招聘城市:上海
…ICC)等方法,有构建完整评测体系的经验;
4.熟练使用Python/PyTorch,具备扎实的工程实现能力,熟悉数据工程相关工具链(如Airflow、Spark、SQL等);
5.对游戏行业有浓厚兴趣,熟悉至少一种主流游戏品类,理解游戏NPC的设计逻辑与玩家体验诉求。
加分项:
1.有模型(LLM/VLM)在游戏、虚拟角色、对话系统等方向的评测或数据工程经验;
2.有强化学习、模仿学习、多智能体系统在NPC行为决策中的应用经验;
3.有游戏AI、叙事生成、角色扮演相关顶会论文(NeurIPS、ICML、ACL、AAAI、CHI等)或知名项目经验;
4.熟悉游戏引擎(Unity/Unreal)及游戏数据埋点体系,有游戏数据分析经验;
5.具备游戏策划或运营背景,对玩家心理与游戏体验设计有深刻…
招聘城市:上海
…软件工程、数学、电子信息、自动化等相关专业,本科及以上学历;
2.计算机基础扎实,熟练掌握Java/C++/Python语言中的一种,有服务端系统的开发经验;
3.熟练掌握文本、多模态等非结构化数据处理方法,熟悉数据清洗、特征提取和数据增强等技术;
4.熟悉分布式计算或数据处理框架,了解Ray、Spark、Hadoop、Flink相关技术栈;
5.聪明好学,有较强的自驱力和学习力,良好的沟通协作能力。
加分项:
1.有图片和视频等多媒体数据处理平台架构建设经验;
2.熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;
3.熟悉常见的模型推理框架(如vLLM、SGLang等)。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家…
招聘城市:深圳
…软件工程、数学、电子信息、自动化等相关专业,本科及以上学历;
2.计算机基础扎实,熟练掌握Java/C++/Python语言中的一种,有服务端系统的开发经验;
3.熟练掌握文本、多模态等非结构化数据处理方法,熟悉数据清洗、特征提取和数据增强等技术;
4.熟悉分布式计算或数据处理框架,了解Ray、Spark、Hadoop、Flink相关技术栈;
5.聪明好学,有较强的自驱力和学习力,良好的沟通协作能力。
加分项:
1.有图片和视频等多媒体数据处理平台架构建设经验;
2.熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;
3.熟悉常见的模型推理框架(如vLLM、SGLang等)。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家…
招聘城市:杭州
…软件工程、数学、电子信息、自动化等相关专业,本科及以上学历;
2.计算机基础扎实,熟练掌握Java/C++/Python语言中的一种,有服务端系统的开发经验;
3.熟练掌握文本、多模态等非结构化数据处理方法,熟悉数据清洗、特征提取和数据增强等技术;
4.熟悉分布式计算或数据处理框架,了解Ray、Spark、Hadoop、Flink相关技术栈;
5.聪明好学,有较强的自驱力和学习力,良好的沟通协作能力。
加分项:
1.有图片和视频等多媒体数据处理平台架构建设经验;
2.熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;
3.熟悉常见的模型推理框架(如vLLM、SGLang等)。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家…
招聘城市:北京
…软件工程、数学、电子信息、自动化等相关专业,本科及以上学历;
2.计算机基础扎实,熟练掌握Java/C++/Python语言中的一种,有服务端系统的开发经验;
3.熟练掌握文本、多模态等非结构化数据处理方法,熟悉数据清洗、特征提取和数据增强等技术;
4.熟悉分布式计算或数据处理框架,了解Ray、Spark、Hadoop、Flink相关技术栈;
5.聪明好学,有较强的自驱力和学习力,良好的沟通协作能力。
加分项:
1.有图片和视频等多媒体数据处理平台架构建设经验;
2.熟练使用AI Coding工具,熟悉CLI、Skills、Agent相关技术栈;
3.熟悉常见的模型推理框架(如vLLM、SGLang等)。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家…
招聘城市:深圳
岗位职责:
1.负责模型全量数据的向量化检索和向量化排重服务,实现实时向量化排重系统;
2.通过向量化检索性能的优化,提升文本排重的准确率和性能;
3.建立模型数据清洗的反馈机制和反馈系统,提升全网数据抓取效率;
4.参与模型数据工程开发,为模型提供基础数据
岗位要求:
1.计算机相关专业,本科以上学历,3年以上架构经验;
2.精通C++/Go/Java中至少一门开发语言,熟悉常见的数据结构和算法;
3.熟悉分布式系统架构和实现,参与过大规模系统的设计研发工作,能承担大规模数据的架构设计;
4.有模型经验者优先,对模型和AGI充满激情。

美团(meituan) 模型数据平台运营专家

全职 上海,北京
招聘城市:上海,北京
…程序化调度与多团队接入
协同并落地端到端自动化Pipeline,参与质检引擎、合成引擎的产品化设计
任职要求:
本科及以上,计算机/数据科学/AI/语言学相关专业优先
3年以上数据产品/数据运营/AI数据工程/标注评测平台运营相关经验
熟悉模型训练 / 评测数据生产全流程(SFT / DPO / RLHF),有实际落地经验
具备扎实的平台产品设计能力,能独立完成PRD撰写、流程设计、指标体系搭建
具备基础Python脚本能力,能配合研发推进自动化流程落地
岗位亮点:
紧跟人工智能行业进展,接触到前沿技术和行业趋势,磨练出对人工智能的独到见解;
参与模型应用的全流程体系,了解从理论到工程实践的全面技能;
与一流的人工智能团队合作,快速成长…
招聘城市:北京
…将最新数据相关成果快速转化为业务价值。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历,具备模型数据工程模型训练实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据经验,能针对 LLM Alignment、RLHF等后训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 ReAct、Reflexion 等前沿 Agent 推理框架,能够深度剖析 Agent 运行轨迹,系统性优化其思维链质量、工具调用的鲁棒性及环境反馈准确性;
4.熟练掌握 Python,熟悉 PyTorch/TensorFlow 等深度学习框架,能高效利用模型能力解决数据链路难点;
5.在CCF-A顶会(NeurIPS, ICLR, ICML, ACL 等)有高质量论文发表,或在开源社区(如 HuggingFace、GitHub模型相关…
招聘城市:深圳
…覆盖数据采集、清洗、结构化、合成、质量评估与版本管理等环节,持续优化系统性能,保障管线的稳定性、可扩展性与可复用性;
2.设计并开发数据处理工具与自动化脚本,提升数据清洗、标注与合成效率,支撑数据规模化生产与迭代;
3.建立数据质量评估与自动化检测体系;
4.与算法研究团队深度协作,理解世界模型在视频预测、场景建模与交互推理等任务中的训练需求,制定针对性的多模态数据策略,持续挖掘高价值数据资源,推动以数据为核心驱动的模型能力演进与迭代。
岗位要求:
1.人工智能、计算机科学、数学或相关专业,本科及以上学历;
2.具备模型训练数据的构建与管理经验,熟悉视频数据或三维数据的处理…
招聘城市:上海
…覆盖数据采集、清洗、结构化、合成、质量评估与版本管理等环节,持续优化系统性能,保障管线的稳定性、可扩展性与可复用性;
2.设计并开发数据处理工具与自动化脚本,提升数据清洗、标注与合成效率,支撑数据规模化生产与迭代;
3.建立数据质量评估与自动化检测体系;
4.与算法研究团队深度协作,理解世界模型在视频预测、场景建模与交互推理等任务中的训练需求,制定针对性的多模态数据策略,持续挖掘高价值数据资源,推动以数据为核心驱动的模型能力演进与迭代。
岗位要求:
1.人工智能、计算机科学、数学或相关专业,本科及以上学历;
2.具备模型训练数据的构建与管理经验,熟悉视频数据或三维数据的处理…
招聘城市:上海
…覆盖数据采集、清洗、结构化、合成、质量评估与版本管理等环节,持续优化系统性能,保障管线的稳定性、可扩展性与可复用性;
2.设计并开发数据处理工具与自动化脚本,提升数据清洗、标注与合成效率,支撑数据规模化生产与迭代;
3.建立数据质量评估与自动化检测体系;
4.与算法研究团队深度协作,理解世界模型在视频预测、场景建模与交互推理等任务中的训练需求,制定针对性的多模态数据策略,持续挖掘高价值数据资源,推动以数据为核心驱动的模型能力演进与迭代。
岗位要求:
1.人工智能、计算机科学、数学或相关专业,本科及以上学历;
2.具备模型训练数据的构建与管理经验,熟悉视频数据或三维数据的处理…
招聘城市:成都
…为模型提供多样化、低噪声、高信息密度的训练数据,驱动模型性能提升和业务落地;
2.参与构建科学的数据评估体系,量化数据对模型性能提升的影响,迭代优化数据生成策略;
3.研究探索新型数据处理/生成/评估技术,推动数据整体链路优化。
岗位要求:
1.计算机、数学等相关专业,硕士及以上学历,具备良好的计算机基础和数据基础;
2.掌握python及主流数据处理工具,熟悉数据质量评估及统计分析工具;
3.有完整的数据治理项目经验,包括数据清洗、版本控制、质量评估全流程,熟悉模型数据链路;2年以上数据处理/数据工程经验;
4.优秀的定义、分析、解决问题的能力,具备较强的学习、沟通协调能力;
5.有参与模型预训练数据pipeline构建经验相关…
招聘城市:北京
…计算机科学、软件工程、人工智能或相关专业硕士及以上学历,具备模型数据工程或Code LLM等实际项目经验;
2.深入理解 Transformer 架构及语言模型训练原理,具备丰富的数据处理经验。能针对Code SFT、代码偏好对齐等后训练场景,设计高标准数据方案,有项目实战经验;
3.深入实践过 CodeAct、SWE-agent、LATS、AlphaCode等前沿代码推理与自动化框架者优先;
4.熟练掌握 Python,善于利用 Cursor、Claude Code 等 AI 辅助工具提升数据生产与自动化分析效率。熟悉至少一门其他主流编程语言(C++/Java/Go等),熟悉Docker优先;
5.在前沿会议有高质量论文发表,或在开源社区有高影响力贡献者优先;
6.具备强烈的数据敏感度、技术热情和自驱力…
招聘城市:深圳
岗位职责:
1.对于互联网抓取数据、提供给模型训练/搜索等场景预料进行清洗,提升语料纯度。
岗位要求:
1.计算机相关专业优先,熟悉 python/c++编程语言;
2.有数据工程或相关领域的工作经验,具备一定的机器学习算法基础,了解NLP 类似bert等模型
3.熟练掌握数据技术栈,包括Hadoop、Spark等,有使用数据库(如SQL)和数据仓库的经验;
4.熟悉网页结构、有网页低质问题挖掘、或者模型数据清洗有经验者优先。
招聘城市:北京,上海
…推动模型技术迭代升级。
4. 前沿探索,保持对开源模型(如DeepSeek、Qwen等)及学术前沿的敏锐度,沉淀可复用的数据方法论,为团队提供中短期数据策略规划。
5. 与算法、技术团队合作开发数据工具链,主动发现问题,发起项目,管理数据生产团队,把控数据质量与项目进度,推动跨团队高效协作,确保数据按时高质交付。
6. 主导垂直领域语料体系的从0到1搭建(包括但不限于人文/学科/code等体系),能够定义各体系的质量标准,并设计可量化的评估指标。
任职要求:
1. 硕士及以上学历,计算机、计算语言学、数据科学、信息检索、NLP相关专业优先;有预训练语料处理、大规模数据工程经验者优先。
2. 1年以上模型预训练数据策略…

小红书 AI产品数据分析师

全职 北京,上海
招聘城市:北京,上海
数据,对用户行为挖掘及活跃用户分析,洞察体验与服务平台产品的问题并提出改进意见。
任职要求:
1、本科及以上学历,数理统计、计算机科学、数据、人工智能相关专业优先;
2、熟练掌握Hive,SQL,Excel,PPT,Python或R,Tableau、PowerBI等工具,熟悉统计分析模型,熟悉常见的模型架构与数据工程手段;
3、对数字敏感,具备良好的逻辑分析、系统性思维、结构化拆解能力,有清晰的分析方法论沉淀,具备准确定位分析解决问题能力;
4、具备模型数据工程/AI产品设计经验者优先,熟悉AI领域前沿技术,有能力推动AI技术在实际业务场景中的落地应用,并确保应用的可持续性和可扩展性;
5、熟练掌握数据挖掘技能,如数据预处理、特征工程
招聘城市:深圳
数据优化提升数据覆盖、质量、多样性需求,最终带来模型生成效果的持续提升;
5.带领并指导团队成员,制定工作计划、评审技术方案、把控交付质量。
岗位要求:
1.硕士及以上学历,计算机视觉、自然语言处理或多模态方向背景优先,5 年以上模型数据相关工作经验,有团队管理或技术 lead 经验;
2.熟练掌握深度学习框架(如PyTorch、TensorFlow),熟悉模型训练及数据处理经验,具备优秀的独立开发与分析调研能力;
3.具备大规模数据处理能力,熟悉 Spark/Ray/Flink 等分布式框架,有 TB/PB 级数据处理实践;
4.具备数据质量方法论:能定义质量标准、设计评估体系、建立自动化质量监控;
5.优秀的跨团队协作和推动能力,能将模型需求转化为数据工程