牛大妈在社招职位搜索hi lab大模型算法工程师-安全对齐 有 22 条结果

招聘城市:北京,上海
…发现多模态模型潜在的安全问题及被恶意误用的风险;
3、通过 SFT、RLHF、对抗训练等方法,提升模型对齐程度,使其能更好地被用于产品、服务人类;
4、探索 Agent 场景下模型具备执行代码、使用工具时,确保模型能忠实执行人类指令不被恶意使用的算法及系统策略;
5、与跨职能团队协作,以确保我们的产品符合最高安全标准;
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂…

小红书(xiaohongshu) 【hi lab】应用-模型算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…核心能力
5、安全评估与价值观对齐:搭建安全对齐机制、红队测试、越狱防御与自动化评测框架,量化模型幻觉、稳定性及价值观一致性,制定风险缓解策略,确保模型在开放场景中始终行为可控
6、跨职能落地:与产品、设计、人文训练及数据团队,把研究成果迅速推向真实场景,打造小红书下一代战略级 AI native 应用产品
任职要求:
任职资格:
1、硕士及以上学历,计算机等相关专业方向优先;
2、扎实机器学习与深度学习基础,熟练掌握PyTorch / JAX / TensorFlow等任一框架;
3、熟悉后训练常用技术(SFT、RLHF / DPO / RLAIF 等)或具备相关项目 / 竞赛 / 论文经验;
4、具备实验设计与问题定位能力,能独立分析模型在不同数据分布和任务场景下的表现;
5…
招聘城市:上海,北京,杭州
…建模,使模型能够跨会话记住用户偏好、持续学习而不遗忘核心能力
5、安全评估与价值观对齐:搭建安全对齐机制、红队测试、越狱防御与自动化评测框架,量化模型幻觉、稳定性及价值观一致性,制定风险缓解策略,确保模型在开放场景中始终行为可控
6、跨职能落地:与产品、设计、人文训练及数据团队,把研究成果迅速推向真实场景,打造小红书下一代战略级 AI native 应用产品
任职要求:
1、扎实机器学习与深度学习基础,熟练掌握 PyTorch / JAX / TensorFlow 等任一框架
2、熟悉后训练常用技术(SFT、RLHF / DPO / RLAIF 等)或具备相关项目 / 竞赛 / 论文经验
3、具备 实验设计与问题定位能力,能独立分析模型在不同数据分布和任务场景下的表现…
招聘城市:北京,上海,杭州
…编辑与用户意图对齐等方面的整体表现。
2、图像生成与编辑方向的对齐方法探索:深入研究图像生成模型(Text-to-Image / Image Editing 等)在真实使用场景中的失效模式,如语义偏移、指令遗漏、风格漂移、结构崩坏、幻觉生成等问题;探索并实践包括但不限于:
-SFT / Preference Learning / RL-based 方法在图像生成中的应用
-多模态 reward model 及 reward system 设计
-Spatial difusion model RL 算法设计及实验验证
-探索图像编辑能力与 agentic 能力结合,基于小红书的 deep research 能力,为用户在穿搭、家装场景等生活提供独特体验
-探索图像生成能力与 thinking with generated images 结合提升模型的推理能力
3、跨职能协作与能力落地:与产品、工程、评测及安全团队紧密合作,将对齐与…
招聘城市:北京,上海
…探索更有效的对齐技术,包括可扩展的人类监督方法等。设计并执行复杂的理解性实验,分析模型在不同数据分布和任务场景下的表现,发现并解决影响模型性能的关键问题。
3、跨职能协作:与产品、工程安全团队紧密合作,将研究成果有效落地,确保模型应用符合实际需求,并在关键技术上做到行业顶尖水平。
任职要求:
1、扎实的机器学习基础:具备扎实的机器学习理论基础,能够熟练使用至少一种深度学习框架(如 PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle),并具备在复杂应用场景下应用这些工具的实践经验。
2、对齐技术研究经验:深入理解监督学习、强化学习、表示学习等方法,并在至少一个 AI 领域有过研究经历或通过机器学习算法成功解决过…

小红书 【hi lab】Posttrain算法工程-RLHF

全职 北京,上海
招聘城市:北京,上海
…研究 Multi-Agent、Long-term Objective、Scalable Oversight 等方向下基于强化学习的对齐方法;
基于前沿方法对幻觉、推理、工具使用、安全等场景问题进行针对性优化,提升模型的应用价值。
任职要求:
岗位要求
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 对模型 RL 技术有极大热情
2. 有 ICML、ICLR…
招聘城市:北京,上海
…方法对多模态模型进行对齐
2.解决优化现有多模态模型 RLHF 中的训练效果、稳定性、Reward Hacking 等问题;
3.探索 RL 阶段 computaiton scaling 对模型能力提升的方法;
4.研究 Multi-Agent、Long-term Objective、Scalable Oversight 等方向下基于强化学习的对齐方法;
5.基于前沿方法对幻觉、推理、工具使用、安全等场景问题进行针对性优化,提升模型的应用价值。
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务…

长鑫存储 热招上鑫一些长鑫er的OOTD

全职 合肥,北京,上海,深圳,西安
招聘城市:合肥,北京,上海,深圳,西安
…Operations Engineer合肥J18558模型算法实习生Large Model Algorithm Trainee合肥J18514软件运维工程Software Operations Engineer合肥J18492IT桌面支持IT Desktop Support合肥J18487企业架构Enterprise Erchitecture合肥J18435IT资产管理专家IT Asset Management Expert合肥J18412ERP 解决方案工程(供应链方向)  ERP Solutions Engineer (Supply Chain Focus)合肥J18411应用系统运维工程(集团化办公) Application System Operation And Maintenance Engineer合肥J18410SAP ERP测试工程SAP ERP Test Engineer合肥J18407ABAP 开发工程ABAP Development Engineer合肥J18345数据运维工程Big Data Operation And Maintenance Engineer合肥J18341供应链计划产品经理Supply Chain Planning Product Manager合肥J18323专利评审技术专家Patent Review Technical Expert合肥J18263信息安全员Information Security Officer合肥J18185中级网络架构Network…
招聘城市:北京,上海
…使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。
4. 具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
加分项:
1. 有 ICML、ICLR、NeurIPS、ACL、CVPR、AAAI 等顶级学术会议发表过有影响力研究成果的优先。
2. 在 ACM/ICPC、NOI/IOI、Kaggle 等比赛获奖者优先。
3. 主导、参与过 AI 相关的有影响力的开源/闭源项目的优先。
4. 有 AI Alignment 相关研究或模型应用项目经历的优先。
招聘城市:北京,上海
…策略、模型能力、下游任务的全链路归因能力
建立并持续完善的数据质量、多样性、重复度、覆盖率等评估体系,分析和量化每个维度的影响
针对模型核心能力进行重点强化,包括不限于数学、推理、Code、Agent、ICL、OCR等
探索如何使用更少数据量,达到同样模型能力的策略,持续提升per token的通用能力训练效果
探索基于各类策略
任职要求:
模型方向充满兴趣,且能充分意识到数据对于模型能力的重要价值和数据侧的巨大空间
有很好的数据感觉,对人类文明积累下来的优质数据分布有很好的判断
有很好的NLP/多模态经验,在数据和算法方向上有深度的工作
工程能力强,有大规模数据处理的经验
招聘城市:北京,上海,杭州
…现有 Attention、NTP 等范式保持批判性思考,例如探索全新的
探索新架构、新目标函数、新训练范式在 Post-Training 中的可能性
参与从模型 → 推理过程 → 自学习环境(System-level Scaling)的演进
任职要求:
基础要求
扎实的机器学习 / 深度学习基础,对模型训练全流程有深入理解
熟悉至少一个方向:
强化学习(RL Scaling / RLAIF / Online RL 等)
多模态学习(尤其是视频、时序、感知建模)
Agent / 多智能体系统
良好的工程能力,能将研究想法落地为稳定系统
加分项
模型 Post-Training 或 MOE RL Scaling 实战经验
RL Algo & Infra co-design
对 Token 效率、推理效率、多尺度学习 等问题有深入思考
参与过 Agent 系统或复杂训练闭环的设计
有“系统思维”,不满足于单点指标提升
招聘城市:北京,上海,广州
…期待你除了算法外仍然是为出色的工程。期待你对技术有强烈的好奇心和开放心态,以未来几年 AI 技术的质变突破为目标。
岗位说明:你会负责下述至少一件事情
1.海量数据的处理:定性分析、定量评估数据质量,并给出 scalable 的改进方案,对数据采集和处理流程不断提出新的要求和改进方案。
2.模型的改进:在 Large Scale 上迭代并改进模型使其更加的高效(capacity per flops / improvement per flops),或者提升模型的 scale up 后的稳定性
3.研究并改进 Scale Law,随着模型的变化给出 Large Scale 上的技术选择(例如参数/数据比、不同超参数设置等)
4.多模态:研发多种模态作为输入/输出的 Large Scale 模型
任职要求:
1.良好…
招聘城市:北京,上海
…训练推理框架研发】
模型hi lab AI Infra团队专注于语言模型领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责机器学习框架的研究与开发,服务于公司各个产品;
2、高效部署,优化NLP/多模态模型核心业务模型
【轻量化】
机器学习系统团队需要将传统或者新型的轻量化算法工程有机结合起来进行加速,提高语言模型训练或者推理性能的同时,通过算法手段尽可能降低效果损失。候选人将在以下几个方向进行深入探索和落地:
1、量化方向:负责但不限于语言模型的低精度训练(FP8)…

小红书 Hi Lab-多模态算法工程-语音方向

全职 北京,上海
招聘城市:北京,上海
…在算力驱动的 AGI 和人文精神的烟火气交汇之处,我们真诚邀请对模型 Omni Model 有热情的同学加入,共同打造更具影响力的智能系统。你会成为团队的一员,并和其他同事协作,共同研发 SOTA 的 Omni Model。期待你以务实和客观的科学态度来推进技术的进展,不被过往经验裹挟、不被主观偏好影响。期待你除了算法外仍然是为出色的工程。期待你对技术有强烈的好奇心和开放心态。
区别于传统 ASR / TTS 级联技术,我们希望打造端到端的 Omni Model 在实时交互中释放模型的智力水平,彻底改变以 Chatbot 文字为主的人机交互界面
岗位说明:你会负责围绕模型 Omni Model 构建语音模态的…
招聘城市:北京,上海
…AI 以文字交互为主的形态,负责全模态模型(Omni Model)的后训练工作,主导音频与文本、视觉协同对齐的整体方案设计与落地,包括并不限于:
1、制定并迭代音频-文本-视觉对齐数据体系,与数据团队合作构建高质量、多样化、有审美的跨模态数据,并提升端到端模型的语音理解和表达能力。
2、基于 SOTA omni 基座模型,在语音、视觉、文本长序列混合后训练中,通过多种训练方法保证语音能力充分发挥的同时,又不削弱模型智商与图文表现。
3、构建语音质量与语义一致性的 Reward 模型;通过 RLHF/RLAIF/Self-Rewarding 以及 Session level RL 技术提升模型在实时对话中的语义、情绪理解能力,语音表达的自然度、逻辑一致性。
4、与工程
招聘城市:上海,北京
…不限于迭代标注策略、AI标注策略等,探究数据和模型性能的关系;
2、研发fine-grained reward modeling,对幻觉、推理、数学等场景进行针对性优化;
3、探索 PMP、Reference、Tool-Augmented、RM+CoT等对现有方法的改进,探索language-based RM以提高可解释性及鲁棒性;
4、研究Self-Rewarding、Self-Crituqing、Scalable Oversight等方向下的对齐技术,探索LLM booststrap的技术路径。
任职要求:
1. 具备扎实的机器学习基础,能熟练使用至少一种深度学习框架(e.g. PyTorch、Jax、TensorFlow、MindSpore、PaddlePaddle)。
2. 对监督学习、强化学习、表示学习等机器学习方法有深入理解并具备相关的实践经验。
3. 在 NLP/CV/RL 等至少一个 AI 领域中有过深入的研究经历,或通过机器学习算法解决过复杂业务场景问题。…

小红书 Hi Lab-多模态基模算法工程-生成理解统一

全职 北京,上海,广州
招聘城市:北京,上海,广州
…裹挟、不被主观偏好影响。期待你除了算法外仍然是为出色的工程。期待你对技术有强烈的好奇心和开放心态,以未来几年 AI 技术的质变突破为目标。
岗位说明:你会负责下述至少一件事情
1.海量的多模态数据处理:定性分析、定量评估数据质量,并给出 scalable 的改进方案,协助搭建多模态的数据流程;
2.搭建多模态的模型架构,在多种技术方案中找到 trade off 的关键,搭建更高效且可扩展的模型框架
3.研究并改进多模态模型的 Scale Law,随着模型的变化给出 Large Scale 上的技术选择(例如参数/数据比、不同超参数设置等)
任职要求:
1.良好的 pytorch / python 技术栈,具备熟练的阅读代码和编写代码的能力…
招聘城市:北京,上海
岗位职责:
【关于我们】
Hi Lab 是小红书核心AI 实验室,点点作为新一代生活场景AI搜索助手,正依托Hi Lab的前沿模型能力,构建“全网真实经验 + 小红书海量笔记”的智能交互体验。
我们正在打造高效、可靠的Agent层与工具链路,让AI真正懂用户、懂生活、懂小红书生态,成为年轻人日常的“超级生活搭子”。
加入我们,你将深度参与AI Agent从0到1的工程化建设,与顶尖算法团队一起推动模型在搜索、多模态、生活场景的极致落地!
【岗位职责】
- 设计并构建模型与应用间的通用Agent层,支持多模型智能路由、动态Workflow编排与自动工具调用;
- 深度优化Function Call、ReAct、Plan-Execute等执行机制,建设高可扩展的模块…

小红书(xiaohongshu) 模型推理服务架构工程-hi lab

全职 北京,上海,广州
招聘城市:北京,上海,广州
岗位职责:
职位描述
团队专注于模型机器学习系统领域的前沿技术研究和落地,提供高性能、高可靠、可扩展的机器学习系统、丰富的异构计算资源和极致的端到端的机器学习服务体验,为公司提供核心技术能力和服务。
1、负责模型推理服务的研究与开发,服务于公司各个产品;
2、负责端到端解决模型预训练、微调对齐阶段的工程算法问题,为结果负责
任职要求:
1、熟练掌握Linux环境下的C/C++、Python语言;
2、具备扎实的计算机科学功底和编程能力,熟悉常见算法和数据结构,具有良好的编程习惯;
3、能够熟练使用至少一种主流的机器学习框架(TensorFlow / PyTorch等),熟悉框架内部实现;
4、熟悉Transformer模型及其应用场景
5、熟悉…
招聘城市:北京,上海
…3、优化模型调用链上下文管理与执行效率;
4、与算法与服务端协作,建设任务调度、RAG 服务与 Tool 编排框架;
5、推动 AI 工程体系标准化与自动化,建设可配置、可调试的开发工具与可视化平台。
任职要求:
1、熟悉 Function Call / Agent / ReAct / Tool 调用机制与模型应用架构;
2、精通 Java / Go / Python 等后端语言,具备服务化开发与异步通信框架(SSE / gRPC / MQ)经验;
3、熟悉分布式任务调度、Workflow 编排或服务编排框架设计;
4、理解模型上下文管理、缓存与资源复用机制;
5、有强烈的 Owner 意识与系统设计思维,能独立承担复杂模块建设与技术演进;
6、善于跨团队协作,具备良好的沟通能力与技术抽象能力;
7、对 AI 工程体系建设、Agent…