牛大妈在社招职位搜索元宝-大模型评测产品经理 有 19 条结果

招聘城市:深圳
…构建评测指标体系与自动化评测流程,推动评测体系标准化、模块化、可扩展化;
2.Benchmark 研究与落地:跟踪国内外前沿模型评测方法与 Benchmark,研究其评测维度与自动化机制;复现与改造高质量评测集,结合业务场景定制评测任务,确保评测的真实性与可复现性;
3.模型效果分析与策略优化:定期对不同版本模型进行系统评测与对比,输出详细分析报告,识别模型优势与薄弱点;针对记忆、写作、语音、多模态(VLM)等专项能力,设计细粒度评测指标与分析策略,支撑模型迭代方向;
4.用户数据分析与体验优化:持续监测与分析真实用户交互数据,挖掘模型表现的 badcase 与典型问题;与算法及产品团队协作,将用户侧问题转化为可量化…
招聘城市:北京
…构建评测指标体系与自动化评测流程,推动评测体系标准化、模块化、可扩展化;
2.Benchmark 研究与落地:跟踪国内外前沿模型评测方法与 Benchmark,研究其评测维度与自动化机制;复现与改造高质量评测集,结合业务场景定制评测任务,确保评测的真实性与可复现性;
3.模型效果分析与策略优化:定期对不同版本模型进行系统评测与对比,输出详细分析报告,识别模型优势与薄弱点;针对记忆、写作、语音、多模态(VLM)等专项能力,设计细粒度评测指标与分析策略,支撑模型迭代方向;
4.用户数据分析与体验优化:持续监测与分析真实用户交互数据,挖掘模型表现的 badcase 与典型问题;与算法及产品团队协作,将用户侧问题转化为可量化…
招聘城市:深圳
…教育技术等相关专业背景,具备一定的数据分析能力优先;
2.具备模型通用/垂直行业评测体系设计+执行经验,有实操过自动化评估项目优先;
3.熟悉模型的基本原理,尤其是在教育领域的应用,能够理解生成内容的质量要求和评测方法;
4.执行力强,细致,能从用户行为和数据细节发现新问题,并提出建议解法;
5.良好的沟通和协调能力,能够与多个职能部门紧密合作。
岗位介绍:
“用户为本,科技向善”,是写在每位腾讯产品人心中的一句箴言。在互联网浪潮中,大众的生活已被深刻地改变,如何为用户创造价值、创造怎样的价值,需要每位产品人花费更长时间去体会与探索。在这里,你将与同样关注细节…
招聘城市:北京
…业务的产品评测工作,牵引产品迭代优化;
2.针对具体的评测方向,设计科学地、可衡量的、可迭代的评测体系,构建评测集合,执行并验收评测任务质量;
3.利用模型能力探索自动化评测体系建设,并在具体评测方向落地。
岗位要求:
1.具备模型通用/垂直行业评测体系设计+执行经验,有实操过自动化评估项目优先;
2.热爱钻研新事物,有强烈好奇心和探索欲;
3.执行力强,细致,能从用户行为和数据细节发现新问题,并提出建议解法。
岗位介绍:
“用户为本,科技向善”,是写在每位腾讯产品人心中的一句箴言。在互联网浪潮中,大众的生活已被深刻地改变,如何为用户创造价值、创造怎样的价值,需要每位产品人…
招聘城市:深圳
…用户调研等手段,挖掘教育产品用户的需求与痛点,优化模型的生成内容与互动体验;
5.跨部门协作与项目推进: 与研发、数据科学、教育专家等团队密切协作,确保AI的质量标准和优化方案能够高效落地。
岗位要求:
1.本科及以上学历,计算机科学、人工智能、教育技术等相关专业背景优先;
2.3年以上AI产品经理经验,尤其是在模型、NLP、智能问答等领域有相关策略产品经验者优先;
3.熟悉模型的基本原理,尤其是在教育领域的应用,能够理解生成内容的质量要求和评测方法;
4.强大的数据分析能力,能够通过量化指标和用户反馈,识别问题并提出优化方案;
5.有较强的战略思维和产品规划能力,能够根据行业需求…
招聘城市:北京
…全面负责元宝各核心场景下 AIGC 的端到端效果优化,定义并持续提升生成内容的准确性、丰富度及逻辑性;
2.策略驱动与协同: 深入业务细节,通过精细化的数据分析定位模型短板;与算法、工程及策划团队紧密协作,制定针对性的模型训练和Prompt 优化方案,确保业务目标达成;
3.能力抽象与演进: 实时洞察全球 AIGC 领域动态,能够快速识别高价值技术方向,将其抽象为具体的能力维度和评估标准,驱动模型效果迭代进化;
4.闭环体系建设: 搭建并完善 AIGC 效果的评估体系(包括自动化评测与人工评测),建立高效的数据回流闭环,确保策略迭代的有据可依。
岗位要求:
1.背景要求: 具备 1 年以上策略产品或 AI 相关产品经验…
招聘城市:深圳
…全面负责元宝各核心场景下 AIGC 的端到端效果优化,定义并持续提升生成内容的准确性、丰富度及逻辑性;
2.策略驱动与协同: 深入业务细节,通过精细化的数据分析定位模型短板;与算法、工程及策划团队紧密协作,制定针对性的模型训练和Prompt 优化方案,确保业务目标达成;
3.能力抽象与演进: 实时洞察全球 AIGC 领域动态,能够快速识别高价值技术方向,将其抽象为具体的能力维度和评估标准,驱动模型效果迭代进化;
4.闭环体系建设: 搭建并完善 AIGC 效果的评估体系(包括自动化评测与人工评测),建立高效的数据回流闭环,确保策略迭代的有据可依。
岗位要求:
1.背景要求: 具备 1 年以上策略产品或 AI 相关产品经验…
招聘城市:北京
…设计和模型效果,从 0 到 1、从 1 到 N 推动核心能力落地;
2.参与定义元宝在VLM方向上的长期产品形态,从大量数据中抽象出用户需求,和在VLM场景下的亮点功能,推动VLM在用户生活中解决实际问题;
3.为用户体验与模型效果的最终结果负责,直接影响大规模用户的真实写作与工作效率,与算法、数据、评测团队深度协作,共同定义效果目标、评测体系与优化路径,形成可持续演进的产品闭环;
4.将模型能力沉淀为长期可复用的产品能力,把Prompt、Workflow、Agent等能力转化为稳定、可扩展的产品机制,推动能力在多个VLM场景中持续复用和放大。
岗位要求:
1.本科及以上学历,3 年及以上产品经理经验…
招聘城市:深圳
…设计和模型效果,从 0 到 1、从 1 到 N 推动核心能力落地;
2.参与定义元宝在VLM方向上的长期产品形态,从大量数据中抽象出用户需求,和在VLM场景下的亮点功能,推动VLM在用户生活中解决实际问题;
3.为用户体验与模型效果的最终结果负责,直接影响大规模用户的真实写作与工作效率,与算法、数据、评测团队深度协作,共同定义效果目标、评测体系与优化路径,形成可持续演进的产品闭环;
4.将模型能力沉淀为长期可复用的产品能力,把Prompt、Workflow、Agent等能力转化为稳定、可扩展的产品机制,推动能力在多个VLM场景中持续复用和放大。
岗位要求:
1.本科及以上学历,3 年及以上产品经理经验…
招聘城市:北京
…管理等数据基建产品的需求设计与迭代落地;
3.联动算法、训练、评测、业务团队,针对推理、代码、长文本、Agent调用等核心场景,制定数据迭代策略,定向产出高质量增量数据,驱动模型效果迭代升级;
4.建立统一的模型数据质量标准、流程规范与效率指标体系,优化数据清洗、蒸馏、精标全链路,提升模型迭代效率、降低迭代成本;
5.搭建模型幻觉、事实错误、逻辑偏差、安全风险等负样本数据闭环,持续优化模型对齐效果、稳定性与安全性;
6.结合腾讯元宝、行业解决方案等业务场景,沉淀垂类数据迭代方案,支撑模型规模化落地与商业化;
7.跟进行业前沿数据迭代技术,结合混元模型架构特性持续优化数据飞轮体系,沉淀可复用的模型数据迭代方法论…

腾讯 元宝-AI搜索产品经理

全职 北京
招聘城市:北京
岗位职责:
1.负责元宝AI搜索产品规划和建设,包括需求分析、功能设计、迭代优化及效果评估,打造智能搜索体验;
2.分析用户行为数据与反馈,挖掘搜索场景痛点,设计元宝特色的AI搜索核心功能;
3.探索AI模型前沿技术在搜索场景的应用,设计创新功能;
4.构建AI搜索效果评估体系,通评估评测、用户调研等方式验证功能效果,持续优化搜索体验与商业价值;
5.跨部门协同模型团队,协调技术、数据、设计、运营等团队,推动产品功能高效交付,确保技术方案与业务目标对齐。
岗位要求:
1.本科及以上学历,计算机、人工智能、信息科学等相关专业优先;
2.有3年以上搜索/推荐/模型策略产品经验优先;
3.熟悉模型及其应用,有生成式AI应用实践经验;
4…
招聘城市:深圳
元宝客户端相关功能的产品交互设计,完成与腾讯生态内相关AI应用、Agent能力的合作场景落地;
2.挖掘客户端真实场景下用户对 AI 产品的真实诉求,并优化客户端用户产品路径,做深做透,提升用户使用率;
3.深度理解模型等相关技术发展和能力边界,并在产品功能的设计中定义模型效果理想态,完成评测、效果优化等工作;
4.结合腾讯生态优势,通过生态的力量共建垂直用户场景,落地有差异化竞争力的AI场景解决方案;
5.岗位可 base 深圳/北京。
岗位要求:
1.有C端AI APP产品策划经验,能够主动挖掘用户需求,定义产品功能,持续推动产品优化;
2.了解模型相关基本机制和概念,能够配合策略产品完成模型
招聘城市:北京
岗位职责:
1.负责从模型策略、架构设计、交互逻辑等提升端到端的语音效果和影响力;
2.协同算法团队、工程团队、评测团队,从产品视角提出功能优化方向,确保产品体验和用户口碑在市场中处于领先位置;
3.深入挖掘用户需求并提出产品策略,协同交互和设计团队,推动产品创新。
岗位要求:
1.了解LLM等技术原理和语音技术发展趋势,了解如何提升模型产品的效果;
2.日常高频使用AI模型语音类AI产品,对产品效果敏感,对AI产品效果有判断力;
3.对AI有很强的信念感和好奇心,能适应快节奏的工作方式,沟通协作能力强;
4.具备敏锐的数据洞察力,能够从海量数据中提取有价值信息,驱动产品决策。
岗位…
招聘城市:深圳
岗位职责:
1.负责从模型策略、架构设计、交互逻辑等提升端到端的语音效果和影响力;
2.协同算法团队、工程团队、评测团队,从产品视角提出功能优化方向,确保产品体验和用户口碑在市场中处于领先位置;
3.深入挖掘用户需求并提出产品策略,协同交互和设计团队,推动产品创新。
岗位要求:
1.了解LLM等技术原理和语音技术发展趋势,了解如何提升模型产品的效果;
2.日常高频使用AI模型语音类AI产品,对产品效果敏感,对AI产品效果有判断力;
3.对AI有很强的信念感和好奇心,能适应快节奏的工作方式,沟通协作能力强;
4.具备敏锐的数据洞察力,能够从海量数据中提取有价值信息,驱动产品决策。
岗位…
招聘城市:深圳
…了解前沿的方法和工具,不断引入新的评测方式,持续提升评测工作的效能和科学性;
4.协同相关安全团队,对齐评测标准、评测数据,持续提升评测工作的全面性。
岗位要求:
1.具备3年以上内容安全、红蓝对抗等攻防经验,有模型评测或分析工作经验优先;
2.对数据敏感,擅长数据分析、有较强的逻辑思维能力、具备良好的总结归纳能力,能够驱动不同团队达成目标;
3.具备较强的自驱力和执行力,渴望学习新知识,乐于接受挑战,具备良好的跨团队沟通能力。
岗位介绍:
相信你与所有腾讯安全人一样,都认为抵抗邪恶是一件极其热血的事。希望你与我们一起,守护用户的安全,守护产品的安全,守护科技向善的不变…
招聘城市:北京
…了解前沿的方法和工具,不断引入新的评测方式,持续提升评测工作的效能和科学性;
4.协同相关安全团队,对齐评测标准、评测数据,持续提升评测工作的全面性。
岗位要求:
1.具备3年以上内容安全、红蓝对抗等攻防经验,有模型评测或分析工作经验优先;
2.对数据敏感,擅长数据分析、有较强的逻辑思维能力、具备良好的总结归纳能力,能够驱动不同团队达成目标;
3.具备较强的自驱力和执行力,渴望学习新知识,乐于接受挑战,具备良好的跨团队沟通能力。
岗位介绍:
相信你与所有腾讯安全人一样,都认为抵抗邪恶是一件极其热血的事。希望你与我们一起,守护用户的安全,守护产品的安全,守护科技向善的不变…
招聘城市:深圳
…了解前沿的方法和工具,不断引入新的评测方式,持续提升评测工作的效能和科学性;
4.协同相关安全团队,对齐评测标准、评测数据,持续提升评测工作的全面性。
岗位要求:
1.具备3年以上内容安全、红蓝对抗等攻防经验,有模型评测或分析工作经验优先;
2.对数据敏感,擅长数据分析、有较强的逻辑思维能力、具备良好的总结归纳能力,能够驱动不同团队达成目标;
3.具备较强的自驱力和执行力,渴望学习新知识,乐于接受挑战,具备良好的跨团队沟通能力。
岗位介绍:
相信你与所有腾讯安全人一样,都认为抵抗邪恶是一件极其热血的事。希望你与我们一起,守护用户的安全,守护产品的安全,守护科技向善的不变…
招聘城市:北京
…多模态模型在教育领域能力提升,优化元宝教育应用效果,包括但不限于:CPT、SFT、Reward设计与RL训练等;
2.应用模型技术,设计并优化教育场景AI Agent的核心能力,例如思路规划、Memory机制、工具调用以及多Agent协作,推动Agent技术在教育领域的应用;
3.基于教育领域模型应用特点,构建精准的模型自动评测能力,持续优化模型领域评测集与评测效果;
4.主导算法从需求分析、方案设计、数据处理、模型训练评估与上线的全流程,确保算法高效、稳定地服务于产品
岗位要求:
1.理解LLM和VLM的在教育领域的前沿应用技术,对AI+教育行业应用有浓厚的兴趣,有解题、批改、AI Tutor等应用落地经验者优先;
2.熟悉模型训练优化…

美团(meituan) C 端 AI 应用产品

全职 北京
招聘城市:北京
…会话深度等核心指标
持续关注行业创新趋势,保持敏锐的需求洞察并制定相关产品演进策略
任职要求:
2年+AI C端产品经验,有头部C端AI交互类产品(豆包/文小言/元宝/Kimi等)核心功能落地经验优先
对用户和需求有较为成熟的认知,积极乐观且有韧性对产品有品味、有想法、有热情,对产品体验细心敏感
能定义清楚对于模型效果的预期和标准,能够持续推动技术团队做好能力规划和方向把控。
至少在某一个领域如Agent、社区、社交、创作工具等,对用户和需求有较为成熟的认知
有深度思考和自我迭代的习惯,能够积极主动发现问题和解决问题
岗位亮点:
和行业内一流的模型技术研发团队紧密合作…