牛大妈在校招职位搜索AWS认证数据仓库专家 有 516 条结果

招聘城市:北京
…负责小红书集团整体基础数据建设(涵盖社区、电商、广告等业务方向),提供通用、稳定、丰富、高效的公共数据能力,提升数据支持业务的效率,探索数据的增量价值;
2、面向社区、电商、广告等业务方向,建设专题数据,提供丰富易用的数据服务,直接支持公司业务决策分析,赋能业务;
3、建设公司全站数据治理和管理体系,结合业务+元数据+技术,推进资源成本的优化,提高数据服务的数据质量,保障数据产出的稳定性。
任职要求:
1、2027届本科及以上学历在读,计算机、软件工程等相关专业优先;
2、熟悉数据仓库实施方法论、了解数据仓库体系;
3、会使用SQL,掌握Java、Python、R、Scala、C/C++中任意一门编程语言;
4、熟悉大数据架构,具备实时或离线数据研发能力…

美团(meituan) 大模型预训练数据算法专家

兼职 北京,上海
招聘城市:北京,上海
…大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.主导预训练数据全链路闭环建设,包括但不限于数据理解、数据处理、数据价值判定、多样性建设、数据实验以及…

美团(meituan) 多模态文档理解算法专家

兼职 北京,上海
招聘城市:北京,上海
…定位,通过打造人工智能、大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.负责百亿级别海量文档数据的解析与处理,包括但不限于复杂版面检测、文档元素识别…

美团(meituan) AI数据开发工程师

全职 北京,上海,成都,深圳
招聘城市:北京,上海,成都,深圳
岗位职责:
1. 数据仓库的建设、组织和管理,沉淀数据资产;
2. 数据建设过程的各项工具研发,如数据安全、数据质量、数据开发的工具链等;
3. 数据应用的研发,如商业智能、挖掘、分析报告、数据可视化等;
4. 探索大模型在数据开发场景的应用,如利用LLM辅助数据质量检测、智能数据血缘分析、自然语言查询数据(Text-to-SQL)等;
5. 其他服务于业务各环节的数据运营工作。
任职要求:
【岗位要求】
1. 计算机、信息技术相关专业本科及以上学历,对数据技术感兴趣;
2. 熟练掌握至少一种编程语言(包括但不限于Python、Java、C++等),熟练掌握算法数据结构;
3. 掌握数据库基本原理和知识,熟练使用SQL;
具备以下经验者优先:
1. 具备相关行业互联网公司…

美团 【实习】数仓开发

兼职 北京
招聘城市:北京
…大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.负责数据仓库的设计、开发和维护工作,保证数据仓库的高效运行。
2.参与数据仓库ETL流程的设计和开发…
招聘城市:上海,北京,杭州
…逻辑清晰,对数据敏感,具备问题拆解能力与动手执行力;每周可实习 4 天及以上,实习周期不少于 3 个月
加分项
- 有 LLM / Agent 相关项目实践经验(知识库构建、Agent 链路搭建、RAG 系统开发等)
- 了解知识图谱构建方法(实体识别、关系抽取、图数据库使用等)
- 有特征工程经验(面向 CTR / CVR / 推荐等场景的特征定义与生产)
- 有数据竞赛经历(Kaggle、天池等)
你能获得什么
1. 真实商业化场景:深度参与广告核心数仓,接触小红书商业化最核心的数据链路
2. AI × 数据工程复合能力:在 Agent 知识库、知识图谱、特征工程等前沿方向同时积累,远超传统数仓实习边界
3. 顶配带教:资深数仓专家 1v1 指导,系统提升数据+ AI…
招聘城市:北京
…通过打造人工智能、大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.行业信息调研:通过行业调研、信息收集、论文解读等方式为数据生产方案提供更多认知输入;…

美团 多模态文档理解算法专家

全职 北京
招聘城市:北京
【LongCat大模型人才校招】多模态文档理解算法专家
更新时间:2026-07-07
工作地点:北京市
事业群:核心本地商业-基础研发平台
岗位职责
【AI愿景】
美团龙猫基座大模型,不只聪明,更懂生活。从语言理解到全模态感知,从架构创新到极致推理,从海量预训练到亿级真实订单 —— 我们造的不仅是实验室里的“优等生”,更是活在大街小巷、三餐四季里的AI。 而我们想做的远不止于此 —— 让模型自己提出假设、训练自己、不断进化; 让一群智能体像团队一样分工协作、攻克复杂问题; 让 AI 走出屏幕,理解物理世界、走进真实场景。 这是我们正在冲刺的方向,也是你可以参与定义的未来。 加入我们,一起把智能带…
招聘城市:北京
…大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1. 参与HDFS等分布式存储系统的部署、监控与日常运维,协助设计数据存储策略,优化冷热数据分层存储方案…
招聘城市:北京,上海
…3.设计数据清洗、去重、校验、质量等保障机制,确保整体系统的效率,对数据缺失、异常、延迟等风险做到早发现、早恢复。
4.深入理解业务场景对数据的需求,协同算法、搜索、策略、数据平台等团队,将抓取能力与业务目标对齐,推动数据
任职要求:
1.熟悉Python和PyTorch等深度学习框架、具备扎实的操作系统、计算机网络、分布式系统、算法、数据结构、机器学习基础,对分类、排序等问题有一定理解。
2.有较强的工程实现和跨团队协作能力。
3.对网页质量识别、内容理解、信息抽取等方向有兴趣,有相关方向顶会论文、项目或实习经验优先。
【为什么是我们】
1.超大规模真实业务场景:面向海量、多源、动态变化的数据抓取与处理需求,能够在真实…
招聘城市:上海
…具备分布式数据处理基础知识者优先。
3.编程与脚本:至少掌握Python/Shell/Java中的一门语言,能够编写自动化脚本或参与工具开发。
4.数据仓库理论:理解数据仓库分层架构、维度建模方法论,有实际数据模型设计或ETL开发经验者优先(含实习或项目经历)。
业务与软性素质
1.对游戏业务有浓厚兴趣,能够快速理解游戏逻辑、用户生命周期及常见数据指标(如DAU、留存、LTV等)。
2.具备较强的逻辑思维、数据敏感度和沟通协作能力,能够主动发现问题并推动技术落地。
3.具备良好的学习能力和抗压能力,乐于探索新技术(如湖仓一体、实时计算、LLM在数据领域的应用等)。
加分项
1.有游戏行业实习经历,或熟悉游戏数据埋点…
招聘城市:上海
…跟进数据报表、指标的开发,核对数据准确性。
4. 梳理业务需求,整理数据开发相关文档。
5. 排查日常数据延迟、产出异常等简单问题。
6. 配合团队完成数据同步、分区优化等基础调优工作。
7. 学习数仓分层模型,参与简单维度表、事实表建设。
8. 对接业务方,理解基础数据需求并落地实现。
9. 维护数据任务调度,记录每日开发运维日志。
10. 主动学习大数据组件,配合完成组长分配的其他数据工作。
工作要求:
1. 本科在读,计算机、统计、大数据相关专业,全日制统招在校生,2027届及以后毕业。
2. 熟悉SQL基础,了解Hive、MySQL优先。
3. 逻辑清晰,细心耐心,具备基础问题排查能力。
4. 能连续实习6个月及以上,每周出勤5天以上。
5. 了解数据仓库基础…
招聘城市:北京
数据诊断和策略更新结合起来,形成面向基础模型持续迭代的数据飞轮。
6.研究并缓解预训练数据中的污染、偏差、重复、低质、隐私、安全和合规风险,提升数据策略的可靠性、可控性和可持续性。
【为什么是我们】
1.明确的技术判断:团队在原生多模态方向有非共识的长期投入,已发布 LongCat-Next 技术报告(离散自回归原生多模态),不是跟随式的能力补齐。
2.顶级资源支撑:5~6万卡计算集群,万亿参数文本基座已训练完成,多模态正在进行大规模上推验证——你将直接参与业界最前沿规模的多模态实验。
3.主线与探索并行:既承担多模态基座的核心交付工作,也推进下一代原生多模态架构的前沿探索,覆盖"数据→tokenizer→…
招聘城市:北京
…因果推断、数据挖掘、数理统计中的至少一个领域有深入研究经历;
2. 有比较强的学习与动手能力,对SQL、Python等数据分析和数据科学常用开发语言和工具有实践经验;
3. 对数据科学有热情,具有主人翁精神,沟通表达能力优秀,团队协作能力出色,可实习3个月以上;
4. 具有AB实验、时序预测、Data Science Agent、数据分析等经验者优先,可长期实习者优先。
岗位亮点:
1. 即时配送作为新兴行业,各个研究方向无论在学术界还是工业界都属于较新课题,具备较大的开创性和创新性,问题难度高,技术挑战大,非常适合人才发挥个人优势。
2. 本岗位通过数据创造业务价值,能够带来较大的工作成就感。同时能深度参与履约配送业务…

美团(meituan) 美团平台-数据开发工程师

兼职 北京,上海
招聘城市:北京,上海
…大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1.参与美团平台数据仓库及相关服务的研发工作
2. 参与实时、离线、流批一体数据仓库的建设,数据方案…

美团 数据开发工程师(实习)

兼职 北京
招聘城市:北京
…大数据、云计算、安全等核心技术能力,以及研发效能平台、企业应用平台等公共服务,为业务提供稳定安全、扩展易用、技术领先的平台技术和产品服务。
在这里,我们会参与到最前沿的技术研发和探索;能够接触超规模集群、海量数据,挑战高复杂业务场景,有机会与业界一流的工程师一起并肩前行。
在这里,我们有超强的技术氛围,持续向社区贡献业界实践,加速行业技术发展;我们有完善的互联网学习生态圈,重视底层逻辑和方法论,助力职业生涯的非线性成长。
真诚地邀请你,和我们一起驱动技术发展,创造行业价值。
岗位职责:
1. 参与美团平台数据仓库及相关服务的研发工作
2. 参与实时、离线、流批一体数据仓库的建设,数据方案…
招聘城市:北京,上海
数据质量是影响模型能力的最底层变量,这个方向持续重要且极富挑战,您在做"最核心的事”的同时,是在挖掘大金矿。
2. 超大规模数据工程实战 —— 万亿级网页、百亿级文档等您挖掘,您积累的系统设计和优化经验,具有极强的稀缺性与市场价值。
3. 学术与业务双驱动 —— 团队技术氛围浓厚,鼓励技术创新、突破以及成果转化;核心技术有机会在顶会发表,业务落地与学术产出双向驱动。
【岗位职责】
1.主导预训练数据全链路闭环建设,包括但不限于数据理解、数据处理、数据价值判定、多样性建设、数据实验以及评估方法和评估指标建设。
2.建立多维度预训练数据体系,包括质量、多样性、困惑度、有用性、复杂度等。
3.建立"数据
招聘城市:上海
岗位职责:
基于对分布式系统的理解与掌控,建设可靠、易用、高效、安全的大数据平台,为公司各个业务提供大规模数据存储与计算服务,将数据平台能力打造为公司战略优势。
任职要求:
1.本科及以上学历;
2.具有扎实的计算机工程和算法基础,熟练掌握Java或C++;
3.深入理解分布式系统原理,并有项目实践经验;
4.有主流大数据计算引擎(包括不限于Spark、Hive、Presto、Kylin、Druid等)的实际应用经验和原理了解优先,对开源项目有贡献者加分。
具备以下经验者优先
1.具有大规模HDFS/Hbase集群,或者其他分布式存储系统的设计、改造和实现落地经验;
2.具有大规模YARN集群,或者其他分布式资源管理系统的设计、改造和实现…
招聘城市:上海
岗位职责:
1. 协助开展 Hive/Spark SQL 开发,完成数据清洗、指标计算与分层建模
2. 跟进离线数据任务,做数据校验、日常问题排查与稳定性维护
3. 参与 SQL 优化、数据倾斜处理,支撑业务数据统计与复盘分析
4. 配合团队完成需求开发、自测上线等基础流程工作
任职要求:
5. 本科及以上在读,大数据、计算机、统计数学等相关专业
6. 熟练使用 SQL,掌握窗口函数、聚合关联等常用语法
7. 了解数仓分层基础概念,接触过 Hive、Spark 优先
8. 做事细心负责,具备良好逻辑思维与学习能力
加分项
风控数仓项目经验,大厂实习
实习收获
熟悉大厂数仓开发规范,积累真实业务调优、数据治理实战经验,团队带教成长快
招聘城市:北京,上海
…系统上限。
【为什么是我们】
1. 你的工作直接决定万亿大模型的效果天花板 —— 预训练数据质量是影响模型能力的最底层变量,这个方向持续重要且极富挑战,您在做"最核心的事”的同时,是在挖掘大金矿。
2. 超大规模数据工程实战打造业界领先的OCR能力 —— 百亿级文档等您挖掘,您积累的系统设计和优化经验,具有极强的稀缺性与市场价值;同时我们志向打造领先的开源OCR模型。
3. 学术与业务双驱动 —— 团队技术氛围浓厚,鼓励技术创新、突破以及成果转化;核心技术有机会在顶会发表,业务落地与学术产出双向驱动。
【岗位职责】
1.负责百亿级别海量文档数据的解析与处理,包括但不限于复杂版面检测、文档元素识别、长…