牛大妈在校招职位搜索AI模型工程师 有 1000+ 条结果

招聘城市:北京市海淀区
…1、设计和开发自然语言和多模态理解,多模态生成AI模型和Agent评测体系,评测方法和流程,开发评测所需要的工具,沙箱,脚手架;
2、设计和开发评测集,评测观测指标和打分标准,对评测集质量进行评估;
3、对评测结果进行系统分析,开发自动化打标,自动聚类算法,实现自动化分析。
岗位要求
1、教育背景:计算机科学、人工智能、数据科学、软件工程、统计数学等相关专业;
2、精通Python等编程语言,熟悉深度学习框架,具备软件工程和算法实现能力;
3、具备较强的学习力、自驱力、团队协同和责任意识;
4、具备语言/语音/多模态/空间智能相关模型训推、部署经验,掌握数据处理、分析或模型验证的相关方法和工具者优先…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1.参与大规模MoE模型的持续预训练(CPT):数据清洗与混合策略、训练调优与结果分析
2.参与RLVR/RLAIF强化学习训练流程:数据构建、reward shaping、训练调优
3.参与多语种机器翻译(MT)方向:语料处理、模型微调、评测
4.参与Long horizon agentic RL(长程智能体强化学习)方向:搭建复杂交互环境与任务流、多步骤推理轨迹(Trajectory)收集、Reward设计与策略网络优化
5.编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1. 深度学习基础扎实,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 迭代召回模型,提升个性化能力
2. 迭代相关性模型/Query意图模型,深入理解用户意图,平衡相关性和效率
3. 利用大语言模型技术,优化视频内容的多模态嵌入,深入理解视频内容信息,服务全链路算法模块
4. 优化点击率、各类转化率、时长模型效果,提升模型的个性化能力,优化准度
5. 优化全链路排序策略,更好的平衡多目标,提升搜索结果页质量以及长期目标
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1、计算机、数学、人工智能等相关专业;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、具备机器学习/深度学习理论基础,熟练掌握Tensorflow…
招聘城市:北京,上海
…职责:
核心职责:
参与AI平台大模型推理部署等流程及工具的研发建设,完善平台现有功能。
参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
任职要求:
计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项:
接触过Mesos、Yarn、Argo、Volcano 等云原生技术
熟悉大模型推理基本原理,拥有使用 vLLM/TensorRT…
招聘城市:上海

3、熟练掌握Python/C++/Java等至少一种编程语言,熟练掌握Tensorflow/Pytorch等至少一种主流深度学习框架;
4、了解大模型的经典结构和代码实现,熟悉大模型推理框架如vllm等,熟悉SFT/RAG/RLHF/DPO数据、训练和评估调优方法;
5、优秀的数理逻辑思维能力,优秀的发现、分析、解决问题的能力,对解决具有挑战性问题能长期专注并保持热情;
6、善于沟通和协作,工作积极主动,责任心强,自驱力强,能持续学习,具备良好的团队协作能力;
7、ACM/ICPC等比赛获奖或在多智能体、多模态大模型领域发表过论文、热门研发类开源项目有代码贡献、开源榜单打榜前十,可做为加分项。
网申须知
网申开始日期:2026-06…
招聘城市:北京,上海
…2、参与AI平台Quota管理模块的开发,实现多机房、多集群环境下的,各种异构计算资源的配额管理功能。
3、参与AI平台联邦调度能力的设计和开发,与下游云原生团队共同实现平台联邦和弹性部署能力。
任职要求:
1、计算机/软件工程相关专业在校生,熟悉Go/Python/Java至少一门语言
2、了解Linux系统及算法基础,熟悉MySQL/Redis等组件使用
3、了解 Kubernetes 架构和生态,有一定的云原生机器学习系统实践和开发经验;
具备快速学习能力,能持续跟踪AI基础设施技术动态
加分项
1、接触过Mesos、Yarn、Argo、Volcano 等云原生技术
2、熟悉大模型推理基本原理,拥有使用 vLLM/TensorRT-LLM等推理框架部署大模型的经验
3、有大规模集群在离线…
招聘城市:广州
人工智能研发工程(大模型优化)
不限
硕士研究生,本科生
1年以下
1万元以上
职位诱惑:五险一金,年终奖,双休,有年假
职位描述
Description
岗位价值:
深度参与大模型推理性能优化工作,推动AI产品算力和大模型解决方案的最佳落地,成为连接前沿AI技术与业务场景的关键力量。
您将负责:
-?分析大模型推理业务场景(如LLM、VLM等),设计高性能、低成本的模型构建方案并推动工程实现;
-?优化开源大模型(如DeepSeek、Llama、Qwen等),研究vLLM、SGLang等框架技术实现高效的加速推进系统;
-?对接融合算子与优化算子,保障功能完整与性能领先。
我们期待您:
-?研究生学历,计算机、人工智能相关专业;
-?熟练掌握C++/Python及Linux开发,熟悉PyTorch及…
招聘城市:上海
AI 框架适配调优:对接 PyTorch、TensorFlow、vLLM 等主流框架,完成训练 / 推理场景参数调优,实现计算与通信重叠,提升端到端任务性能
6、集群基准测试:使用行业标准压测工具完成集群算力、吞吐、时延基准测试,定位性能瓶颈并落地优化方案
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1、计算机、网络工程、电子信息、高性能计算、人工智能等相关专业;
2、熟悉 Linux 操作系统,掌握基础 Linux 命令,了解 Shell/Python 任意一种脚本语言,具备基础脚本编写能力;
3、了解计算机网络基础原理,熟悉 TCP/IP、二层 / 三层网络架构,有 RDMA、InfiniBand、RoCE 网络认知者优先;
4、了解 GPU、CUDA 基本概念,接触过分布式计算、高性能集群、AI 训练环境…

深圳稳顶聚芯技术有限公司 AI算法工程

全职 深圳,其它
招聘城市:深圳,其它
AI算法工程
不限
博士研究生,硕士研究生
1年以下
1万元以上
职位诱惑:五险一金,车贴,有年假,晋升快,交通方便
职位描述
Description
岗位职责:
1、根据设备开发需求,开发部署本地的深度学习模型
2、负责基于设备的业务搭建数据体系,包括业务数据结构定义、采集方案、数据自动化训练等;
3、负责AI算法模型调试,基于事件预测,提升设备内各运动系统的定位精度及各坐标系的转换精度。
岗位要求:
1、物理、计算机、统计学、数学、控制工程等相关专业;
2、精通至少一种深度学习框架;
3、掌握图像处理算法、图像分析或时序预测相关理论;
4、熟悉数据训练方法及模型优化。
企业信息
Company Info
深圳稳顶聚芯技术有限公司
行业…
招聘城市:北京
…招聘信息
模型研发工程(全职)
2026-02-1410:19:39
职位描述
岗位职责:
产品规划与设计:主导AI产品的需求分析、功能设计及路线图制定,并协调研发、设计团队确保端到端交付。
技术驱动与创新:持续跟踪大模型、AIGC等前沿技术趋势,探索其在客户体验、研发效能等领域的应用,通过数据驱动优化产品效果。
跨部门协作与客户管理:与算法、工程、运营团队紧密协作,并维护客户关系,收集反馈以迭代产品。
任职要求:
教育背景:计算机科学、人工智能、机器学习等相关专业985/211本科及以上学历。
工作经验:3-5年AI产品管理或解决方案经验,熟悉大模型技术及其应用场景,有B2B或智能平台经验者优先。
技术能力:需掌握大模型技术原理,了解…
招聘城市:北京,上海
岗位职责:
本岗位覆盖以下主要技术方向:
1.方向一:文本/多模态预训练
• 设计和优化千亿级参数大模型的分布式训练系统,支持文本基座预训练和原生多模态训练的正确性、性能和稳定性
• 负责训练框架核心模块(通信、调度、容错、Checkpoint、数据加载)的架构设计和性能优化,在同等硬件条件下持续提升训练吞吐
• 协同算法迭代和硬件演进,针对新模型架构(MoE、超长序列、多模态融合)快速完成训练适配和性能验证
• 作为工程Pipeline的上游起点,持续推进训练Infra的架构迭代方向
2.方向二:强化学习框架
• 构建并提升在线RL训练系统的性能和Scale能力,打通策略更新、环境交互、奖励建模的端到端训练流程
• 支持Chat/Thinking/Agentic以及未来多种RL范式…
招聘城市:上海
…职责:
1、音频相关大模型研发,包括音频理解(语音识别/翻译等),对话模型,音频生成(语音合成/音色克隆/音乐生成)等技术;
2、前沿语音技术跟进、行业动态和主流模型框架的调研,学术研究及相关论文发表;
3、数据生成,对话数据开源调研,数据链路清洗,数据管理
4、语音模型的后训练优化,sft,rl等后训练方法的具体实践和优化。
3、在B站视频理解、字幕、搜索及创作场景落地。
工作要求:
面向2027届海内外本硕博毕业生(2026年9月-2027年8月期间毕业)
1、计算机科学、人工智能等相关领域研究经验;
2、有语音大模型相关前沿技术研究及发表论文经验,理解多模态/生成式模型的原理,熟悉大模型底层技术,敢于挑战技术边界;
3…
招聘城市:北京
…建设;
2. 通过对模型进行全方面细致的评测,明确模型能力边界,对模型能力进行深入分析,产出围绕大模型的客观认知,从而为模型训练迭代提供指导意见;
3. 追踪大模型方向前沿进展,积极主动地学习和探索新的评测及分析的方法和技术;
4. 与各相关部门保持良好沟通,深度参与大模型训练及应用,为各大模型相关方提供评测及相关的模型分析支持,共同推动大模型的训练与应用。
任职要求:
1. 硕士及以上学历,计算机、数学、统计学或相关专业;
2. 熟悉Java/Python/C++等编程语言,良好的编码习惯和一定的工程能力;
3. 具有机器学习或深度学习算法的基础知识,熟练掌握自然语言处理或大模型相关算法和模型
4. 良好…
招聘城市:上海
…进行视频生成基座模型研发迭代,参与模型训练、调参、性能优化等核心环节。配合完成模型训练数据的构建和生成,确保训练数据的准确性和有效性。
3、沉淀技术文档,投稿领域的顶会顶刊
工作要求:
1、掌握生成式模型技术(扩散模型,自回归模型等)
2、了解视频生成基座模型的基本研发流程,了解针对视频生成的数据清洗链路和构建。
3、在计算机视觉一个或多个领域的研究和实践经验,包括但不限于以下方向:
a)图片/视频生成扩散模型
b)视觉自监督学习/表示学习/生成理解统一;
c)大规模视频生成训练经验、SFT或RLHF经验;
d)视频生成的数据清洗和构建。
4、具备扎实的算法功底与落地工程能力,实操动手能力突出…

深圳市和生创新技术有限公司 AI开发工程

全职 广东省深圳
招聘城市:广东省深圳
…场景。
参与 Agent 智能体、AI 助手、智能对话等系统的设计与开发。
2、大模型技术探索与应用
参与大模型相关技术研发,包括 Prompt Engineering、RAG 知识库、模型微调、工具调用等。
跟踪 AI 领域最新技术发展,并结合业务需求进行技术验证和优化。
3、AI数据与效果优化
参与 AI 数据集建设、测试用例设计和模型效果评测。
分析模型输出效果,持续优化 AI 应用体验。
4、团队协作与技术积累
与产品、硬件、嵌入式等团队协作,推动 AI 功能落地。
编写技术文档,沉淀开发经验和技术方案。
任职要求
1、基础要求
计算机、人工智能、软件工程、数学等相关专业,本科及以上学历。
熟悉 Python 编程,具备良好的算法基础和代码能力。
了解软件开发基础,具备一定的工程实践能力。
2…
招聘城市:上海
岗位介绍:
职位亮点
我们提供
- 参与核心大模型训练全流程的机会,相对充足的计算资源
- 海量真实的数据场景,亿级用户的真实反馈
- 支持发表高水平论文
职位描述
工作职责:
- 参与大规模MoE模型的持续预训练(CPT):数据清洗与混合策略、训练调优与结果分析
- 参与RLVR/RLAIF强化学习训练流程:数据构建、reward 分析、训练调优
- 参与多语种机器翻译(MT)方向:语料处理、模型微调、评测
- 编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
我们希望你
- 深度学习基础扎实,熟悉Transformer原理,熟悉当前主流LLM架构
- 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
- 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
- 有阅读论文与复现能力,能快速上手实验
- 良好的自我学习能力…

小红书 【2026校招】基座大模型算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…探索新一代大语言模型基座架构,完成扩散模型(diffusion model)在大语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期…
招聘城市:北京,上海
岗位职责:
模型AI Infrastructure团队专注于大语言模型领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责机器学习框架的研究与开发,服务于公司各个产品;
2、高效部署,优化NLP/多模态大模型核心业务模型
任职要求:
1、本科及以上学历,计算机等相关专业方向优先;
2、熟练掌握GPU CUDA编程;
3、熟练掌握Megatron/DeepSpeed/FSDP等框架的研发,熟练掌握模型并行分布式技术;
4、对大语言模型算法感兴趣,有机器学习算法知识背景;
5、追求技术极致,务实,渴望有自己的作品和代表作。
【加分项】
1、对于算子优化(CUDA…
招聘城市:北京,上海,杭州
模型和数据加速、数据集存储及管理,为大模型提供高效稳定的多模态数据预处理能力,构建高质量的AI数据迭代链路;
2、探索AI Native的多模数据存储格式,支持AI数据高效存储、读取和分析,提升数据的使用价值;
3、跟进LLM、多模态大模型的前沿发展,探索数据如何更好驱动模型迭代。
任职要求:
1、本科及以上学历,计算机等相关专业优先;
2、具有AI&Data引擎/数据/存储研发实习经验优先;
3、熟悉Python/Java,具备优秀的设计与编码能力,针对业务需求与问题,可快速设计与实现解决方案;
4、具备良好的沟通和团队协作能力,做事主动积极负责任,有技术热情和激情面对挑战;
5、加分项:熟悉大模型技术和产品生态,如Data-Juicer/Ray…
招聘城市:上海
…的全流程开发体系
-AI辅助的自动化大数据运维体系
-AI整合的内部答疑工具
2、为什么这个岗位特别
未来 5-10 年最重要的基础设施工程,一定既懂大数据底层,又懂 AI 怎么用、AI 怎么改造数据系统。这就是我们要找的人。
3、你将得到什么
-业务规模:万节点集群、上亿日活用户/EB 级数据处理能力
-AI 融合:参与 LLM × 数据湖、向量索引、AI Agent 数据系统的前沿探索
-真实问题:所有教科书没讲清楚的 corner case,都会在这里遇到
-技术影响力:你的代码会跑在数千个节点上,你的设计会影响成千上万的下游用户和 AI 应用
职位描述
工作职责:
方向 A:数据湖与湖仓一体(含 AI ×…