牛大妈在校招职位搜索REDstar智能客服算法工程师LLM Agent方向 有 3 条结果

招聘城市:北京,上海,杭州
…核心算法研发,包括意图理解、多轮对话状态跟踪、任务规划与工具调用(Function Calling / Tool Use)、检索增强生成(RAG)、精排与回复生成,面向复杂客服场景进行模型微调(SFT)、蒸馏、强化学习(RLHF / RLAIF / GRPO 等);
2、独立负责从需求分析、Agent 架构设计(如 ReAct、Plan-and-Execute、Multi-Agent 协作)到模型训练部署的全流程,包括高质量数据构造与清洗、Prompt / Context 工程、模型训练、离线评估体系(Rubric / LLM-as-Judge)搭建、AB 测试及线上服务效果优化;
3、持续跟踪并深入研究大模型与 Agent 领域前沿进展,如 MoE 架构、长上下文与记忆机制、推理加速(投机解码 / KV Cache 优化)、复杂推理(CoT / 慢思考类模型)、Agentic RL、多模态对话、Agent 评测基准等,主导或参与 Agent智能客服的创新方向

小红书 【REDstar】NLP与多模态算法工程

全职 北京,上海,杭州
招聘城市:北京,上海,杭州
…推动NLP和大模型算法在社区业务中的落地,负责基础NLP相关算法研发;
2、参与智能客服算法开发,探索agent框架在客服业务中的应用;
3、参与翻译算法和海外多语言策略开发,探索大模型在多语言环境中的应用;
4、参与小红书生成式搜索相关算法和系统研发,通过最新的生成式AI等技术,打造新一代智能化搜索引擎;
5、探索大模型预训练、文本理解、多模态理解、多模态推理等多个前沿方向在业务中的前瞻应用。
任职要求:
1、本科及以上学历,计算机等相关专业;
2、扎实的NLP和机器学习理论基础,熟悉预训练、LLM,文本理解,多模态理解等相关算法,有搜索问答,大模型,NLP中台相关场景的业务实践…
招聘城市:北京,上海,杭州
岗位职责:
LLM Post-training方向
本岗位侧重于提升大语言模型的“核心大脑”能力。你将通过先进的 Post-training 技术,让模型在Reasoning、Agentic以及人类意图对齐上达到业界顶尖水平,通过Scaling Post-training来提升大模型智能水平的上限,支撑小红书所有业务场景,包括且不限于搜索、广告、推荐、电商、客服及国际化等核心场景。
你的工作内容:
1、Agentic RL 与Agency: 研发面向 Work Agent、Code Agent、Search Agent 和 Tool-use Agent 的SFT与RL方案,提升模型在开放环境中的任务拆解、工具调用及闭环执行能力;
2、大规模对齐与强化学习: 研发并优化 SFT、RL(如GRPO 等)、OPD等算法,构建高精度的 Reward Model,解决模型在复杂指令下的对齐问题;
3、推理模型…