牛大妈在校招职位搜索基础模型 -预训练 有 649 条结果

招聘城市:北京
…自动化、数学、物理等相关专业;
2.好奇心驱动,对追求纯粹的技术有强烈热情,擅于迭代自我认知,不被惯性束缚,工作积极主动;
3.数理基础扎实,具备第一性思考的素养和出色的分析、解决问题的能力,能够自主探索可靠的解决方案;
4.具有良好的沟通协作能力,能够与团队融洽合作,一起探索新技术并快速试验想法,推进技术进步;
【加分项】
1.在强化学习、大模型训练、Agent 等一个或多个领域有较深入的研究和实践经验,主导过大影响力的项目;
2.或在 ICLR/ICML/NIPS/CVPR/ACL 等顶级会议上以一作身份发表过有影响力的学术论文;
3.在 CMO/NOI/CPhO/ACM 等竞赛中取得过优异成绩;
立即申请: zh***com[点击…
招聘城市:北京,上海
…场景。
你的工作内容
大规模对齐与强化学习: 研发并优化 SFT、RL(如GRPO 等)算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题。
推理模型(Reasoning)优化: 探索长链推理(CoT)、强化学习驱动的自反思与自进化机制,提升模型在的 System 2 思维能力。
Agentic RL 与Agency: 研发面向 Search Agent、Code Agent 和 Tool-use Agent 的强化学习方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力。
合成数据与模型进化: 探索高质量合成数据的生成与过滤技术,实现模型能力的自我循环与持续进化。
任职要求:
我们希望你具备:
背景: 计算机、数学等相关专业硕士/博士在读;深入理解 Transformer 架构及大模型训练全流程。
专业深耕: 在 Search(搜索)、Code…
招聘城市:北京,上海
…北京市海英人才等荣誉激励;
任职要求:
必备项:
1. 具备扎实的算法基础和工程实现能力,熟练使用 Python/C++,能够独立完成复杂系统设计、实验实现和问题定位。
2. 熟悉大语言模型、Agent、强化学习、代码生成、检索增强、训练/评测系统中的至少一个方向,并有真实项目经验。
3. 具备强研究能力和问题拆解能力,能够从开放问题中提出可验证假设,设计实验并推动结果落地。
4. 具备良好的沟通协作能力,能在高不确定性前沿方向中持续推进。
加分项:
1. 有 Coding Agent、AI Scientist、Deep Research、Multi-Agent、长期记忆系统、自动实验系统经验。
2. 有模型研发全链路经验,包括数据构造、Pre-training、Post-training、Reward Model、评测诊断或训练基础设施。
3. 在顶级会议/期刊发表…
招聘城市:北京
…科学地衡量这些前沿能力,已成为决定大模型能力天花板的核心挑战。我们诚邀对 Agent 评测有信念感的你,一同定义下一代 Agent 能力的标尺。
本岗位涉及的具体方向包括:
1.构建 Agent 全维度评测体系:设计横跨感知-规划-执行-反思完整闭环的评测维度框架,重点覆盖代码、办公、搜索等高价值场景。
2.面向真实用户体验的评测方案建设:当前许多Agent应用领域出现了Benchmark指标相对饱和,无法准确链接真实用户使用体验等问题,我们希望从用户实际使用场景出发,构建高度拟真的交互式评测方案,设计体现用户使用体验的评测指标,对齐训练优化方向与提升用户体验的目标。
3.基于线上回流日志的模型问题分析与评测验收:利用线上真实交互…
招聘城市:北京
…科学地衡量这些前沿能力,已成为决定大模型能力天花板的核心挑战。我们诚邀对 Agent 评测有信念感的你,一同定义下一代 Agent 能力的标尺。
本岗位涉及的具体方向包括:
1.构建 Agent 全维度评测体系:设计横跨感知-规划-执行-反思完整闭环的评测维度框架,重点覆盖代码、办公、搜索等高价值场景。
2.面向真实用户体验的评测方案建设:当前许多Agent应用领域出现了Benchmark指标相对饱和,无法准确链接真实用户使用体验等问题,我们希望从用户实际使用场景出发,构建高度拟真的交互式评测方案,设计体现用户使用体验的评测指标,对齐训练优化方向与提升用户体验的目标。
3.基于线上回流日志的模型问题分析与评测验收:利用线上真实交互…
招聘城市:深圳,其它
模型、Semantic ID、多模态表示学习等核心算法研发,提升模型的泛化能力和业务效果。
3.参与智能 Agent、AutoResearch、训练流程自动化等 AI 研发工具建设,提升算法研发效率。
4.跟踪前沿技术,并推动算法创新与业务落地。
任职要求
1.2027届应届毕业生,本科及以上学历,机器学习、统计相关专业、模式识别相关专业优先;
2.扎实掌握机器学习、深度学习基础知识,熟悉 Transformer、Representation Learning、Multi-task Learning、Contrastive Learning 等算法者优先。
3.熟悉 PyTorch、TensorFlow 等至少一种深度学习框架,具有良好的 Python/C++ 开发能力,熟悉 Linux 开发环境。
4.熟悉包括不限于NLP,CV,搜索,推荐,广告等机器学习领域一种或多种,具备较强的算法理解与实践能力。
5.对生成式模型、大语言模型、多模态模型
招聘城市:北京
…真实物理世界的下一代基座模型训练体系
uD83DuDD39 具身智能 ——专注VLA/WAM模型设计、具身世界模型构建及机器人运动控制,打造下一代通用具身智能系统
uD83DuDD39 Agent ——专注智能体基础设施与多智能体协作,涵盖自主科研、智能体自进化、搜索智能体及强化学习
uD83DuDD39 AI安全 ——聚焦大模型与AI系统的安全治理,围绕安全边界认知、红蓝对抗演练与对齐技术
uD83DuDD39 模型&智能体评测 ——专注于世界模型与智能体的评测方法研究,探索面向物理世界感知理解、交互执行、未来推演、自我进化及安全可靠的下一代评测体系
uD83DuDD39 编译器&算子 ——深耕AI编译栈与GPU内核优化,打通从算法模型到底层硬件的执行链路,实现大模型训推效能的极致释放…
招聘城市:深圳,其它
…具备良好的团队合作和沟通能?,能够与其他团队成员协作开发和调试软件程序,对前沿技术保有浓厚的兴趣。
企业简介
诺亦腾机器人(Noitom Robotics)是一家面向具身智能与人形机器人产业的数据公司,以“数据”为核心交付界面,为机器人企业、具身智能模型团队等提供高质量、可规模化的训练数据与相关基础设施能力。从数据基础设施这一底层环节切入,构建以数据获取、处理、交付与长期利用为核心的能力体系。从高精度,全模态的工厂采集(In-the-factory)数据到基于真实环境采集追求视觉泛化性的野采(In-the-wild)数据,诺亦腾机器人不断探索以人为中心的数据路径,以提升数据的泛化价值与长期…
招聘城市:北京,深圳
…提效工具,而是重塑全球业务运行方式的核心基础设施。团队将大模型、Agent、数据智能和算法能力深度结合,落地在智能客服、运营自动化、商家赋能、业务分析、研发提效等关键场景,推动公司从数据驱动走向 AI 原生的智能经营。
【你将参与】
1.Agent 系统:设计和实现面向境外外卖场景的先进 AI Agent系统(智能客服、智能审核、自动化运营),完成 Agent 框架搭建、工具链集成与多轮决策链路的工程落地
2.模型训练:参与业务场景的模型微调(SFT/RLHF/DPO),构建高质量训练数据集,设计奖励模型与评估体系,让基础模型在外卖场景(对话、推荐、审核、多语言)上表现超越通用模型
3.Agent × 模型协同:通过后训练提升 Agent 内核模型的工具调用准确率…
招聘城市:北京
算法工程师(机器学习&大模型算法)
10000元以上
jo***.cn[点击查看]
工作地域:北京市 职位类别:工程技术人员 学历要求:硕士研究生在学 招聘人数:15人
发布时间:2026-03-13
* 专业要求:
计算机、数学、人工智能等相关专业学历
* 职位描述:
岗位职责:
①使用机器学习、深度学习和大模型相关技术,开发和优化工业算法模型
②参与多模态大模型相关的训练、对齐、任务调优等研发工作,训练垂类大模型(LLama3,千问, Gemma);
③参与基于大模型训练开发与调优工作,包括但不限于基础模型的调研、指令微调、训练数据清洗、模式质量评估等;
④针对细分业务场景的数据处理、模型微调、prompt工程等,以适应场景并达成业务目标;
⑤研究和探索…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1.负责多模态视频大模型(Video LLM)及核心视频理解技术的研发与迭代,聚焦长视频、细粒度、音视频精细化理解方向,持续挑战多模态基础模型的技术边界;
2.紧密跟踪视频理解与多模态大模型领域最新进展,推动研究成果向业务转化,并在计算机视觉/AI顶级会议(如 CVPR、ICCV、ECCV、NeurIPS 等)发表高水平论文;
3.将视频理解技术工程化落地于 B站多模态视频数据引擎、智能搜索与推荐、二创高光素材提取及内容审核等核心场景,解决超长视频解析效率、多模态语义精准对齐、分布式大规模训练与推理性能等实际业务痛点,打造行业领先的视频解析大模型基建体系。
工作要求:
1.2027届应届…
招聘城市:上海
模型与 Agent 效果评测
●建设面向内容理解、多模态分类和 Agent 任务的评估集。
●从 Precision、Recall、F1、格式合规率、任务完成率和稳定性等维度评价模型效果。
●分析模型 bad case,区分数据质量、Prompt、基础模型训练策略、Reward 设计和工具调用等不同问题。
●设计固定评估集、回归集和对照实验,验证效果提升是否真实来自目标变量。
●关注训练指标与真实任务效果的一致性,不以 loss 下降或 reward 上升代替最终效果验证。
●对模型实验形成结构化结论,明确哪些方案有效、哪些无效,以及后续优化方向。
3. 算法流程平台化
●将数据构建、训练提交、模型推理、离线评测和结果分析流程沉淀为可复用的平台能力。
●建设自动化训练与评测流程…
…生招聘正式启动
公司名称: 阿里巴巴集团(阿里巴巴)
公司行业: 互联网,计算机软件/硬件/服务
公司标签: 世界500强,上市公司
公司简介: 通义实验室是阿里巴巴集团旗下专注于大模型技术研发的机构,负责基础模型体系的研究、训练与迭代,模型配套技术的增强;团队致力于推动模型能力的开源、生态建设及行业应用。其开源模型在全球社区中拥有广泛影响力,衍生模型数量与下载规模持续增长。
招聘摘要: 阿里巴巴集团旗下通义实验室现开展2027届实习生招聘,面向毕业时间在2026.11 - 2027.10的海内外应届毕业生。通义实验室专注于大模型技术研发,负责基础模型体系的研究、训练与迭代等工作,其开源模型在全球社区有广泛影响力…
招聘城市:上海
岗位介绍:
职位亮点
你将获得
1、一线 AI 项目落地实战经验,近距离接触模型工程化全流程
2、资深工程师 1 对 1 指导,快速提升技术实操能力
3、灵活办公氛围、行业竞争力实习薪资及餐补福利
职位描述
工作职责:
1、协助完成 AI 模型工程化相关落地工作,包括数据处理、模型训练辅助、部署测试等;
2、配合团队优化模型推理性能、调试工程问题,整理技术文档;
3、参与 AI 项目的基础研发支持,跟进业务场景下的模型应用效果。
工作要求:
1、计算机相关专业在读(本科及以上),熟悉 Python 编程;
2、了解 PyTorch/TensorFlow 等至少一种深度学习框架,有基础模型使用经验;
3、具备一定的工程思维,逻辑清晰,学习能力强;
4、每周可实习 3 天及以上,持续…
招聘城市:北京
…3.熟悉深度学习训练与推理框架,熟悉 GPU / SOC 架构与性能优化,具备 CUDA Kernel、算子优化、显存优化、编译加速或推理部署优化;
4.熟悉分布式训练体系与大规模集群优化,包括数据并行、模型并行、流水线并行、混合并行、多机通信优化及资源调度等方向;
5.熟悉自动驾驶算法体系,理解感知、预测、规划、端到端模型或世界模型等方向的核心技术架构与工程挑战;
6.具备优秀的跨团队协作与技术领导能力,能够主导复杂项目推进,并影响多团队技术方向与工程实践。
加分项:
1.有开源项目贡献、顶会论文或行业影响力成果;
2.有 AI Agent、自动化研发平台或 AI Native Workflow 建设经验。
【为什么是我们】
1.深度参与下一代自动驾驶基础模型(Foundation…
招聘城市:北京,上海,深圳
…美好。
团队介绍:
作为美团官方的视觉AI基础模型团队,负责数字世界和物理世界等本地生活全场景多模态技术的前沿探索和应用,在AIGC生成、虚拟人交互、多模态理解等领域持续沉淀行业领先的技术成果。
研究内容:
研究方向包括但不限于:
1. 高效率、低损失、高压缩比的图像视频VAE和tokenizer;
2. 图像、视频、音视频统一生成模型的架构、训练和推理探索,包括稀疏架构、大尺寸MoE、自回归生成等;
3. 功能模型,包括参考生成、长视频生成、流式实时视频生成、音视频生成等;
4.实时交互视频世界模型的长时空一致性、动态性和交互控制能力增强,以及在可交互视频、虚拟人实时交互场景的应用。
任职要求:
1.熟悉扩散模型、VAE…
招聘城市:北京
…3.熟悉深度学习训练与推理框架,熟悉 GPU / SOC 架构与性能优化,具备 CUDA Kernel、算子优化、显存优化、编译加速或推理部署优化;
4.熟悉分布式训练体系与大规模集群优化,包括数据并行、模型并行、流水线并行、混合并行、多机通信优化及资源调度等方向;
5.熟悉自动驾驶算法体系,理解感知、预测、规划、端到端模型或世界模型等方向的核心技术架构与工程挑战;
6.具备优秀的跨团队协作与技术领导能力,能够主导复杂项目推进,并影响多团队技术方向与工程实践。
加分项:
1.有开源项目贡献、顶会论文或行业影响力成果;
2.有 AI Agent、自动化研发平台或 AI Native Workflow 建设经验。
【为什么是我们】
1.深度参与下一代自动驾驶基础模型(Foundation…

上海人工智能实验室 人才专项

全职 上海
招聘城市:上海
上海AI实验室「星启人才计划」全球启动
上海人工智能实验室
网申时间:2025/11/12 ~ 2025/12/12
公司介绍:
上海人工智能实验室是一家专注于人工智能领域前沿技术研发的新型科研机构。实验室的核心定位是开展人工智能的基础理论、关键算法、平台体系及重大应用的研究与开发。其研究方向可能涵盖计算机视觉、自然语言处理、机器学习、多模态认知、AI for Science等。实验室通常汇聚了人工智能领域的科研人才,并设有计算与数据资源支持大规模的算法训练与实验。作为科研机构,其工作重心在于知识创造与技术突破,研究成果通过学术论文、开源项目、技术报告等形式进行发布。实验室的科研活动遵循学术研究的通用规范…

Dexmal原力灵机 27届校招

全职 北京
招聘城市:北京
…服务
公司简介: Dexmal原力灵机成立于2025年3月,是一家面向通用具身智能领域的科创企业。公司核心创始团队来自旷视科技,具备大规模基础模型训练、AI技术突破、AI机器人规模化落地与高可靠硬件量产四大能力,是行业极为稀缺的复合型研发团队。在模型基础设施、数据飞轮方向都是国内具身大模型的最典型代表。
公司福利: 极具竞争力的薪酬,多轮融资背书;与具身行业顶级科学家团队并肩,IVT带教,核心成员来自浙大、MIT等Top高校、AI原生团队;探索最前沿技术路线,依托具身行业最丰富的本体、最多样化的数据;深入真实场景,见证具身模型的每一个重要时刻;弹性工时,扁平化管理…
招聘城市:深圳
…自主适应的智能系统。研究重点包括数据稀缺和非平稳数据分布条件下的神经网络训练、持续学习、泛化能力提升与抗遗忘机制,并探索基于不确定性建模和自适应学习的高效训练框架,以提高人工智能模型在复杂动态环境中的泛化能力、鲁棒性、安全性和可靠性。此外,我长期关注基础模型的可信智能,围绕大语言模型、多模态大语言模型和扩散语言模型的安全性、可靠性与自适应推理开展研究,针对模型幻觉、自适应解码、高效推理以及模型安全等关键问题提出高效算法,为构建可信、高效、自适应的新一代基础模型提供理论基础与技术支撑。进一步地,我将前述理论应用于脑电信号分析任务,有效解决了该领域中普遍…