牛大妈在校招职位搜索Transformer 有 184 条结果

招聘城市:上海,杭州,北京
岗位职责:
本课题旨在通过优化Transformer模型中的KV缓存机制,解决处理长序列数据时遇到的计算和内存挑战,目标是减少资源消耗、降低延迟并提高效率。
研究方向包括设计高效的KV缓存管理策略、适应不同应用场景的缓存优化以及并行与分布式处理优化。预期将成果应用于自然语言处理、视频分析等领域,为处理超长序列数据提供更加高效和可扩展的解决方案。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先…
招聘城市:上海,杭州,北京
岗位职责:
本课题旨在通过优化Transformer模型中的KV缓存机制,解决处理长序列数据时遇到的计算和内存挑战,目标是减少资源消耗、降低延迟并提高效率。
研究方向包括设计高效的KV缓存管理策略、适应不同应用场景的缓存优化以及并行与分布式处理优化。预期将成果应用于自然语言处理、视频分析等领域,为处理超长序列数据提供更加高效和可扩展的解决方案。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先…
招聘城市:北京
岗位职责:
1.生成式广告大模型架构设计:基于前沿大模型(如时空Transformer、MLA、MoE等),设计适配广告场景的生成式决策框架,支持根据“用户行为、实时位置、商户出价”端到端生成最优的广告商家、展示创意、相应计费。
2.多阶段的训练范式设计:借鉴LLM的分阶段训练技术(如PT、SFT、RLHF等),设计“基于海量交互的 pre-training 和 基于业务目标的 post-training ”的分阶段训练范式,提升广告大模型效果。
3.广告大模型的Scaling规律探索:探索广告场景下,生成式大模型“算力->效果”的转化规律,驱动推广搜迭代范式实现由“人工设计迭代”到“算力堆叠迭代”的跃迁。
任职要求:
海内外高校在校本科生(大三及以上)、硕士生及博士生,且满足:
1…
招聘城市:北京,上海,杭州
岗位职责:
在搜索等实际线上业务中,推理速度限定了线上可用的模型大小以及可达效果,当前的基于transformer架构的大模型基座在推理速度上存在系统性瓶颈。本课题探索基于创新框架,如diffusion LLM和linear attention model的大模型基座范式,从数据、模型预训练、后训练、AI Infra、评测等方向探索模型效果极限。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、扎实的机器学习/深度学习理论基础,有大规模推荐系统、计算广告、搜索引擎等核心算法项目经验;
3、有LLM/MLLM等多模态理解技术背景,或大规模模型…
招聘城市:北京
…并实现基于Transformer变体、MoE 或 Linear-RNN的创新架构,通过大规模预训练与指令微调技术,构建具备强泛化能力的通用时序基础模型;
2.探索时间序列与表格、NLP等模态的交互、对齐问题;
3.聚焦复杂场景下的时序建模问题,解决长序列依赖、高频噪声干扰及多变量耦合等实际难题;4.探索 Agentic时间序列建模,在复杂建模问题上进行自适应时序建模工作流。
基本要求:
1.专业背景:国内985或海外重点高校,计算机、信号处理、自动化、人工智能等相关专业硕博,具备极强的模型算法设计和数学建模能力,对于深度学习和常用的机器学习技术有着深入理解,具备扎实的模型调优与Bad Case分析能力;
2.时序建模能力:深入理解 Transformer
招聘城市:北京
岗位职责:
【愿景】
成为本地生活领域虚拟服务解决方案的头部玩家,打造AI驱动的下一代智能直播基础设施。
【你将参与】
1.以人为中心的视频生成研究与应用:负责基于扩散模型/Transformer架构的人物视频生成算法研发,重点攻克人体姿态可控性、外观保真度、时序连贯性等核心难题,目标实现业界领先的生成质量,在数字人直播场景落地应用。
2.流式视频生成/动作生成技术探索:设计并实现低延迟流式推理框架,探索Token级增量生成、因果注意力机制等前沿方向,构建端到端生成低延迟解决方案,支撑实时交互场景落地。
3.多模态驱动的动作生成:研究基于文本/音频/姿态等多模态信号控制的人体动作生成算法,涵盖全身动作、手势、表情及唇型…
招聘城市:北京,上海,杭州
岗位职责:
在搜索等实际线上业务中,推理速度限定了线上可用的模型大小以及可达效果,当前的基于transformer架构的大模型基座在推理速度上存在系统性瓶颈。本课题探索基于创新框架,如diffusion LLM和linear attention model的大模型基座范式,从数据、模型预训练、后训练、AI Infra、评测等方向探索模型效果极限。
任职要求:
1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、扎实的编程能力和算法功底,熟练掌握Python/C++/Java等至少一种编程语言;
3、扎实的机器学习/深度学习理论基础,有大规模推荐系统、计算广告、搜索引擎等核心算法项目经验;
3、有LLM/MLLM等多模态理解技术背景,或大规模模型…
招聘城市:上海
算法工程师 30万元/年
2026-03-09 10:14:31发布
职位要求:
职位性质:全职
工作城市:上海市浦东新区
招聘人数:1
学历要求:博士
职位类别:其他专业技术人员
需求专业:计算机科学与技术
职位描述:
岗位职责
负责人工智能技术在金融领域的自然语言处理(NLP)与深度学习算法的研究工作;
任职资格
1、计算机科学相关专业,今年即将获得博士学位;
2、熟悉至少一种主流编程语言(JAVA/Python/C++);
3、有扎实的数学理论基础,熟深度学习(transformer等)、自然语言处理基本算法和概念,对 RAG、agent、functioncall、抽取,审核等有大量项目经验;
4、能够熟练运用tensorflow/Pytorch实现NLP模型;
5、具有大模型训练与推理经验者优先;
6、参与国家重点课题或国家重大项目者,及在…

小红书 服务器测试实习生

兼职 杭州
招聘城市:杭州
…1. 参与GPU硬件基准性能、通用CNN/RNN模型推理性能、LLM大语言模型推理性能的测试与优化工作。
2. 参与Deep Learning模型训练性能的测试与优化工作。
3. 参与将GPU性能测试SOP转化为脚本实现工作。
4. 跟踪业界前沿技术(如大模型、多模态、强化学习等),探索其在业务中的应用可能性。
任职要求:
1、教育背景:计算机、数学、统计学或相关专业硕士及以上在读,扎实的算法与数据结构基础。
2、技术能力:
- 熟悉机器学习/深度学习经典模型(如CNN、RNN、Transformer等),有TensorFlow/PyTorch等框架实战经验。
- 掌握模型性能优化方法(如量化、剪枝、蒸馏、ONNX转换等),能独立完成训练/推理链路压测与分析。
3、编程能力:熟练使用Python,或熟悉C++/Java,会使用Shell

小红书 【REDstar】商业广告算法工程师

全职 北京,上海
招聘城市:北京,上海
…客户实现 “心智占领-销售转化”双效增长,推动行业变革。
1、参与小红书广告全场景、全链路优化,包括召回/粗排/精排/混排/相关性各模块的整体优化,构建业界领先的下一代广告投放系统;
2、模型算法:负责搜推召回、粗排、精排等模块的CTR、CVR、LTR等模型优化工作,使用DIN、SIM、Transformer、Scaling、LRM等技术极致的提升模型效果,提升小红书广告收入;
3、出价算法:负责出价优化工作,包括转化出价、ROI出价、UBX自动化高维组合出价等相关产品的出价优化工作,使用PID等控制学理论、监督学习、强化学习等技术提升出价效果,提升小红书广告收入;
4、自动化算法:负责自动化投放优化工作,包括自动化新建计划、自动化关停计划…

小红书 计算机视觉算法实习生

兼职 上海
招聘城市:上海
…负责用户维度方向模型的训练和基础系统性能的优化
2.利用计算机视觉,自然语言,多模态等技术,从海量内容中识别风险用户与内容
3.跟踪行业最新动态,推进新算法的落地与应用
任职要求:
1.计算机、数学、电子工程或相关专业背景,硕士研究生或以上学历
2.具备优秀的编程能力,扎实的数据结构和算法能力
3.熟悉深度学习算法,如cnn/Transformer/CLIP等
4.精通常用的深度学习框架,如TensorFlow/PyTorch等
5.做事认真负责,有良好的沟通协调能力和自驱力,能够承受一定的工作压力
6.能够长期实习6个月及以上者优先
7.有计算机视觉相关经验者优先,面向但不限于:多模态大模型、人脸识别、通用目标检测…
…栈能力提供商,致力于智能时代生产力的构建,以数智化全栈能力驱动生产力革新,助力全球智能化升级,推动社会高效和可持续发展。
招聘职位有AI大模型实习生和智能硬件实习生。
AI大模型实习生岗位职责:参与大模型SFT/RLHF微调及数据工程,进行Prompt优化与模型评测分析,跟踪前沿论文,探索AIGC新玩法。岗位要求:熟悉Python/PyTorch/Transformer,热爱AI,有开源项目/论文优先,每周4天以上,实习3个月+。
智能硬件实习生岗位职责:参与智能硬件的原理图与PCB设计,与软件团队协同优化硬件接口,协助硬件选型、测试及生产技术支持。岗位要求:掌握常用硬件设计工具及调试设备,音频处理/AI硬件项目经验者优先,每周4天…

小红书 【2026校招】商业广告算法工程师

全职 北京,上海
招聘城市:北京,上海
…客户实现 “心智占领-销售转化”双效增长,推动行业变革。
1、参与小红书广告全场景、全链路优化,包括召回/粗排/精排/混排/相关性各模块的整体优化,构建业界领先的下一代广告投放系统;
2、模型算法:负责搜推召回、粗排、精排等模块的CTR、CVR、LTR等模型优化工作,使用DIN、SIM、Transformer、Scaling、LRM等技术极致的提升模型效果,提升小红书广告收入;
3、出价算法:负责出价优化工作,包括转化出价、ROI出价、UBX自动化高维组合出价等相关产品的出价优化工作,使用PID等控制学理论、监督学习、强化学习等技术提升出价效果,提升小红书广告收入;
4、自动化算法:负责自动化投放优化工作,包括自动化新建计划、自动化关停计划…
招聘城市:深圳,其它
…系统工程
岗位职责
1. 负责基于AI模型的云端地图(轻、高精)自动生成与更新算法研发与落地;
2. 基于Transformer等核心技术实现矢量拓扑地图自动化生成;
3. 建立与优化地图量产流程(训练/评测/部署),提升产线自动化率与效能;
4. 负责对生成的地图质量评测。
任职要求
1. 计算机、AI、图像处理、模式识别、机器学习、测绘地理信息等相关专业硕士及以上学历;
2. 具备良好的数学基础,熟悉Linux下代码开发;
3. 有VMA/MapTr/Bevformer/BevFusion/DETR/TopoNet等Transformer或端到端模型研发经验者优先;
4. 了解OpenDRIVE/Apollo OpenDRIVE/NDS等常见地图格式或图商自定义的地图格式,有地图工具链开发经验者优先;
5. 具有良好的沟通能力及团队合作精神…
招聘城市:深圳,其它
…端到端预测规划,达到复杂工况下的自动驾驶性能;
3、搭建评测方案和系统,负责算法的开发和优化。
任职要求:
1、硕士及以上学历,有决策规划、计算机视觉、模式识别等相关方向研究背景,具备扎实的理论基础;
2、熟悉当前端到端预测规划的主流模型范式,闭环验证方法以及多模态数据构建;
3、熟悉Pytorch训练框架,主流的CNN和Transformer网络结构和训练方法;
4、具备数据驱动思维,有较好的数据敏感性;
5、熟悉主流智驾方案ODD,有较好的主观评价能力;
6、掌握交互决策和三维规划概念,有相关开发经验更优;
7、代码经验丰富,良好的英文读写能力,在相关领域发表过学术论文者优先。
职位类别:计算机软、硬件/互联网…
招聘城市:北京,上海
岗位职责:
1、横评端侧开源 LLM(Gemma/Qwen/Phi/Llama),建立准确率 × 延迟 × 内存的 Pareto 基线
2、研究 Tool-Use 场景下的量化精度损失与补回方案(GPTQ/AWQ + LoRA 微调)
3、设计端云 Hybrid 路由策略:哪些意图端侧跑、哪些上云
4、构建端侧 Agent 评测 Benchmark
任职要求:
1、硕士/博士在读,熟悉 Transformer 架构与 LLM 推理流程
2、熟悉 PyTorch,了解 LiteRT / llama.cpp / ExecuTorch 等推理框架至少一种
3、有模型量化或蒸馏实践经验
4、加分:Android NDK 经验 · NPU 编程 · MLSys/MobiSys 发表
招聘城市:北京
…地域:北京市
职位类别:其他专业技术人员
学历要求:本科 / 硕士研究生 / 博士研究生
招聘人数:5人
发布时间:2026-05-09
* 专业要求:
【我们希望你具备】
计算机视觉、多模态大模型等相关领域的硕士或博士
扎实的深度学习开发基础能力:精通Python编程语言,熟悉Pytorch、Jax等深度学习开发框架,了解分布式训练(DDP/FSDP/DeepSpeed/Megatron 等)与常用训练加速手段
一定的VLM / VLA / 世界模型实践经验(满足其一即可,越多越好):
VLM:具备VLM Pretrain、 SFT、后训练(PPO、DPO、GRPO等)相关经验;熟悉 Transformer 系列结构(attention、KV cache、MoE、LoRA/Adapter 等),理解训练稳定性与 scaling 规律。
VLA:熟悉主流的VLA模型架构,如:OpenVLA、PI、GROOT等,有真机开发经验者优先
世界模型:具备latent dynamics、predictive coding…
招聘城市:上海
…模型微调、评测
4.参与生成式推荐基础模型方向:构建用户行为与内容特征序列数据、生成式任务设计与模型微调(SFT/RFT)、离线评测与线上效果分析
5.参与Agentic RL(智能体强化学习)方向:搭建复杂交互环境与任务流、多步骤推理轨迹(Trajectory)收集、Reward设计与策略网络优化
6.编写实验脚本、构建评测工具,支持模型上线前的质量验证
工作要求:
我们希望你:
1. 深度学习基础扎实,熟悉Transformer原理,熟悉当前主流LLM架构
2. 熟悉常见大模型训练框架(Megatron/DeepSpeed/Verl)
3. 有LLM相关项目经验:CPT、SFT、RL 任意方向即可
4. 有阅读论文与复现能力,能快速上手实验
5. 良好的自我学习能力和独立思考能力
加分项:
1. 有相关领域顶会论文,或拥有…
招聘城市:北京,上海,成都
…排→混排)因各阶段目标割裂、信息截断,存在系统性效率损耗。随着 LLM 表征能力与 Scaling 特性日趋成熟,以端到端生成式模型统一广告全链路决策已成为行业的核心探索方向。本岗位面向美团广告 OneModel 方向,核心任务是研究并落地端到端广告大模型,以统一大模型完成从用户行为信号到最终展示序列的全链路决策,最大化用户体验和平台收益。
【你将参与】
1.端到端广告大模型架构设计。基于 Causal Transformer、MLA、MoE 等架构技术,设计突破多级漏斗限制的端到端广告决策框架,支持融合用户行为序列与实时上下文、直接输出具备位置价值感知的展示序列;探索 Semantic ID、动态候选索引等广告生成式检索关键技术…
招聘城市:北京,上海
…商业生态,通过为平台客户和消费者提供符合其需求的多元、便捷、高效的商业产品和服务,帮助生态伙伴提高效率、优化经营、实现持续健康发展,推动本地商业数字化营销的发展,促进商业生态繁荣。
【你将参与】
1.生成式广告训练系统设计:基于前沿大模型(如Transformer、HSTU等),设计生成式推荐模型的分布式训练框架,优化数据/模型的高效并行处理和混合精度训练策略。
2.高性能推理引擎建设:既有大稀疏(Embedding),又有大稠密(LLM)的模型结构下,优化延迟、吞吐量和显存占用,支持千亿/万亿参数模型的实时推理需求。
3.低进度优化:基于结构化和非结构化模型进行低进度训推协同优化,从源头解决模型性能与精度的平衡难题。
4…