招聘城市:北京,上海
…等维度定位问题,推动优化建议进入产品、算法和研发流程。
12、探索基于评测信号的 Agent 自进化能力,将线上反馈、执行轨迹、评测结果和归因结论转化为可验证的 Prompt、Context、Tool、知识及流程优化建议,并建立自动生成、沙箱验证、回归评测和人工确认机制。
13、制定 AI 评测数据、指标、协议和平台接入标准,推动不同业务场景复用统一评测能力,同时保留业务自定义指标与规则的扩展空间。
任职要求:
1、本科及以上学历,计算机、软件工程、人工智能、数据科学等相关专业,具备5年以上后端、数据平台、质量平台或分布式系统研发经验。
2、主导或深度参与过评测平台、实验平台、数据平台、质量平台或大规模任务执行系统的架构设计。
3、熟练掌握 Python、Java…
招聘城市:广州
…自动化评测流水线,支持对话质量、任务完成率、安全性等多维度评测;
2.评测模型开发:基于 LLM 构建自动评测模型(如 Model-as-Judge),实现对 Agent 输出质量的自动化打分与分析;
3.评测平台建设:参与评测平台的架构设计与开发,支持评测任务管理、数据管理、结果可视化等功能;
4.数据处理与分析:构建评测数据集,开发数据清洗、标注管理、统计分析等配套工具;
5.持续优化:跟踪业界前沿评测方法,持续优化评测效率和准确性。
岗位要求:
1.本科及以上学历,计算机科学、人工智能、软件工程等相关专业,3 年以上开发经验;
2.熟悉 Python/Nextjs,熟悉至少一门后端语言(Go/Java/C++),熟悉 Linux 环境及常用中间件(MySQL/Redis/消息队列等);
3.热衷于 AI…
招聘城市:北京
…场景进行适配与创新;
4.从无到有参与产品AI评测算法、评测标准和评测流程制定,构建评测集、评测执行器,推进评测刚才体系建设。
岗位要求:
1.本科及以上学历,计算机科学、软件工程、人工智能或相关专业;
2.熟练掌握 Python,具备脚本开发与数据处理能力;熟悉业界主流LLM评测基准与方法论(HumanEval、SWE-bench、MMLU、GSM8K等);
3.了解大语言模型的基本原理(Transformer架构、预训练、微调、RLHF、推理优化等)。有主流深度学习框架(PyTorch / TensorFlow / JAX)的实践经验者优先;
4.具备Agen开发或测试经验,了解ReAct、Function Calling、Tool Use、Planning等核心概念;
5.有评测平台或自动化测试框架的开发经验者优先;具备数据分析能力,能从评测数据中提炼有价值的洞察。…
招聘城市:成都
…语言特性,熟悉JVM平台;熟悉Java常用框架;掌握Spring、SpringMVC、mybatis、Redis、Prometheus等知识,能够灵活运用;3、熟练运用设计模式、架构原则构建高内聚、低耦合的模块化系统,能通过抽象和封装提升代码复用性;4、熟悉Linux操作系统, 能熟练编写shell脚本;5、熟练使用AI编程助手或AI原生IDE提高编码效率;6、擅长协作,乐于分享,具备强烈的自驱力。加分项:1、熟悉至少一款主流的国产数据库,例如DM、PostgreSQL、Kingbase等;2、熟悉任意一种数据库的备份恢复,有过相关产品的开发经验;3、对分布式存储软件有一定了解。 Golang开发工程师 工作地点:成都岗位职责:1、负责公司核心产品的特性需求分析、设计、研发与迭代优化;2、参与软件架构设计…
招聘城市:深圳
…平台稳定性与可扩展性;
3.构建自动化评测流水线,提升评测效率与研发迭代速度;
4.与算法、产品团队紧密协作,理解评测需求并转化为可落地的技术方案。
岗位要求:
1.本科及以上学历,计算机相关专业,5 年以上后端开发经验;
2.扎实的系统设计能力,有复杂业务系统或平台型产品的架构经验;
3.熟练掌握 Python/Go 等至少一门语言,熟悉常用框架与中间件;
4.熟悉分布式系统、任务调度、消息队列等技术,有高并发系统开发经验;
5.良好的沟通与协作能力,能够推动跨团队合作。
加分项:
1.有 MLOps/LLMOps 平台建设经验,熟悉模型训练、推理、评估等流程;
2.熟悉大模型评测方法论,了解主流 Benchmark 与评估框架;
3.对 AI…
招聘城市:北京,上海
…可靠性架构,建立容量评估、全链路压测、限流、熔断、降级、容灾和故障恢复机制,持续优化首 Token 延迟、TP99、吞吐量和调用成功率。
8、负责 AI 应用成本架构与预算管理,结合业务流量、模型路由、输入输出 Token、调用频次和工具链路建立成本测算模型,核算单次请求、会话及任务成本,建设成本归因、预算预警和持续优化机制。
9、建设 Agent 全链路可观测体系,统一 Trace、日志和指标,支持模型调用、Prompt、上下文、工具参数、状态流转、Token 消耗、调用成本和异常原因的追踪与审计。
10、设计多渠道应用适配机制,屏蔽不同产品入口、交互协议和数据格式差异,保证 Agent 核心能力在多端、多页面和多业务场景下的一致性与可扩展性。
11、与评测平台团队…
招聘城市:北京
…开放以及追求卓越的工程师文化,一方面通过系统和技术体系的持续迭代升级,帮助业务高质量增长;另一方面,密切关注前沿技术趋势变化,积极创新技术能力,为业务未来发展创造新的可能性。期待优秀的你加入我们,在夯实专业、深耕平台的基础上与业务携手同行,一起用技术 “帮大家吃得更好,生活更好”。
岗位职责:
1.负责AI Agent评测体系的产品化建设,面向Agent设计科学、可扩展的评测方法与产品流程;
2.数据闭环与模型策略驱动:将评测数据转化为模型迭代的策略输入,建立"评测→归因→策略建议→效果验证"的数据驱动闭环,推动 Agent 能力持续提升形成飞轮。
3.平台型评测产品建设:面向不同业务方的 Agent 评测诉求,设计…
招聘城市:北京,上海
…的资深架构师,负责小红书内容安全平台的架构规划与落地实施工作。您将主导关键系统的技术选型与设计,构建高可用、高扩展的技术体系,支撑百亿级内容审核规模下的风险域决策与实时响应。
岗位职责:
1. 审核体系架构设计:负责百亿级内容安全审核平台整体架构设计与演进,覆盖文本/图片/音视频/直播/评论/私信等场景。推动&落地目标审核架构。
2. 智能审核模式探索与落地:设计并落地面向审核的 Agent 框架,推动 Agent 与传统审核能力融合:规则引擎、关键词、黑样本库、相似检索、风控对抗;建立“智能运营”能力:自动聚类新风险、自动生成规则/策略草案、自动回归与效果评估。
3. 策略工程与决策编排
4. 建立数据闭环与评测体系…
招聘城市:北京,上海
…的资深架构师,负责小红书内容安全平台的架构规划与落地实施工作。您将主导关键系统的技术选型与设计,构建高可用、高扩展的技术体系,支撑百亿级内容审核规模下的风险域决策与实时响应。
岗位职责:
1. 审核体系架构设计:负责百亿级内容安全审核平台整体架构设计与演进,覆盖文本/图片/音视频/直播/评论/私信等场景。推动&落地目标审核架构。
2. 智能审核模式探索与落地:设计并落地面向审核的 Agent 框架,推动 Agent 与传统审核能力融合:规则引擎、关键词、黑样本库、相似检索、风控对抗;建立“智能运营”能力:自动聚类新风险、自动生成规则/策略草案、自动回归与效果评估。
3. 策略工程与决策编排
4. 建立数据闭环与评测体系…
招聘城市:深圳
…测试平台开发经验者优先;
5.具备优秀的问题分析、归因及解决能力,能独立承担技术方案设计并推动落地;
6.对AI技术有浓厚兴趣,了解大模型、RAG、智能体(Agent)等基本原理,有AI产品评测或工程化相关经验者优先。
加分项:
1.具备全栈开发能力,熟悉现代前端技术栈(如React、Vue等),能独立完成前后端联调开发;
2.是深度开发者工具用户,对IDE、代码版本管理、持续集成等开发工具链有深刻理解和实践经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构…
招聘城市:北京
…测试平台开发经验者优先;
5.具备优秀的问题分析、归因及解决能力,能独立承担技术方案设计并推动落地;
6.对AI技术有浓厚兴趣,了解大模型、RAG、智能体(Agent)等基本原理,有AI产品评测或工程化相关经验者优先。
加分项:
1.具备全栈开发能力,熟悉现代前端技术栈(如React、Vue等),能独立完成前后端联调开发;
2.是深度开发者工具用户,对IDE、代码版本管理、持续集成等开发工具链有深刻理解和实践经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构…
招聘城市:深圳
…高准确率的智能化质量保障方案;
3.具备 Test Harness Engineering 或 Agent 评测体系设计经验,熟悉 Agent 核心架构(Planning / Tool Calling / Memory / Reflection),有大型项目中的实际落地经历;
4.精通 Python,熟练 Go 或 Java;熟悉分布式高并发架构,具备中间件或分布式系统的实际排障经验;对自动化测试体系有深刻理解,能驱动测试流程的 AI 化变革;
5.具备强烈自驱力与跨团队技术影响力,能捕捉前沿技术并转化为生产力,推动部门级 AI 测试能力升级,能主导从 0 到 1 的 AI 测试体系搭建。
加分项:
1.有从 0 到 1 搭建 AI 测试体系或 Test Harness 平台的完整经历,并在业务线实现规模化落地的优先考虑。
岗位介绍:
在…
招聘城市:北京
部门介绍:
公司事务平台负责构建公司的公共战略体系,助力业务可持续发展及公司对外影响力的提升。通过内外部风险管理,确保公司合规发展;通过深耕公共战略,推动内外良好沟通,连接公司发展与社会期待,助力业务高质量发展;通过管理社会责任议题、公益投入等,助力公司创造更多社会价值;同时为公司提供行政、采购等基础服务。我们坚持“懂业务、拿结果,勇担当、善协同,不唯上、只唯真”的工作理念,期待具有公共战略素养、了解公司治理逻辑的你加入!
岗位职责:
岗位概述
负责法务场景下AI产品的规划、设计与落地,聚焦合同审查、法律咨询分流、制度问答、风险识别等场景,结合大模型、RAG等技术推动法律能力产品化。
核心职责
产品设计:识别…
招聘城市:北京,上海
…Computer Use Agent、Multi-Agent 自主协作等前沿方向的技术选型与落地。
任职要求:
1、计算机 / AI 相关本科及以上,5年以上后端或 AI 平台架构经验。
2、精通 Python / Java / Go 至少一门,有大规模分布式系统设计经验。
3、有 Agent 系统的线上交付经验,熟悉上下文工程、Harness、长任务调度、长记忆管理等核心工程问题。
4、能主导复杂技术项目,具备跨团队推动能力。
加分项
1、从0到1搭建过 Agent 平台、评测体系或运行时治理系统。
2、有大型 Agent 系统在生产、研发或运维场景的落地经验,且取得可量化的业务成效。
3、能根据业务场景做合理的架构决策,平衡成本、性能与可靠性。
4、在 Agent 安全或多模态 / Code Agent…
招聘城市:深圳
…以测试架构师视角制定AI驱动的测试策略,覆盖文档编辑、多人协作、数据同步、权限管理等核心场景的质量保障;
2.设计并落地AI辅助测试方案,利用大模型能力实现复杂文档操作场景的测试用例自动生成、UI自动化生成与执行、端到端自动化生成与执行、兼容性测试覆盖等,大幅提升协同办公产品的测试效率;
3.构建腾讯文档智能测试平台,集成AI Agent能力实现文档格式兼容性验证、多端一致性校验、协作冲突检测、性能回归等测试场景的自动化与无人化;
4.建设文档类产品专属的测试评测体系,包括渲染正确性评估、富文本编辑覆盖度分析、协作一致性模型验证等,利用AI视觉理解与文本对比能力提升测试精准度…
招聘城市:深圳
岗位职责:
1.负责 WorkBuddy 开放生态的平台架构设计与研发,建设智能体与外部系统的连接能力,包括且不限于Agent/Skill/Connector/资料库等核心模块的开放能力;
2.设计并实现面向第三方开发者的SDK、API、文档示例、调试工具和开发者工作台;建设插件/Skill等不同智能体应用的安全规范、审核机制、版本管理、灰度发布和生态治理策略;
3.建设WorkBuddy Skill、专家等生态应用的评测机制,包括评测标准设计、测试集、完成度与安全性评估、效果分析,搭建自动化评测流程与质量准入体系,保障生态能力可用、可持续进化;
4.持续关注 AI Agent、MCP、Skill、A2A 等方向的前沿技术,并能转化为生态平台能力。
岗位要求:
1.计算机相关专业本科及以上…
招聘城市:深圳
岗位职责:
1.负责腾讯大数据在Data+AI、Agent开发评测平台等应用领域的前端开发;
2.负责前端团队组件库&工具库构建和优化,利用ai编程工具提升团队开发质量和效率。
岗位要求:
1.优秀的 hands on 能力,并能指导团队其他全栈成员的前端工作,解决技术难点;
2.精通React/Vue3+TypeScript技术栈,有大型前端项目和复杂组件库开发经验;
3.深入理解Webpack/Vite构建原理,有微前端实战经验;
4.对高并发、高可用、一致性架构有深入的理解与实践经验,具备大型复杂系统变更治理经验;
5.具备PC WEB开发经验,熟悉各端调试工具与方法,有性能优化实践经验;
6.熟悉git等代码管理工具、前端开发IDE、联调测试工具、AI编程工具;
7…
招聘城市:深圳
…测试工作落地和问题闭环;
5.精通至少一门编程语言,具备扎实的编码基础。
加分项:
1.有从0到1搭建AI自动化评测基准平台的实战经验;
2.工作中独立开发过Agent应用,并达到提效预期;
3.熟悉小游戏功能,对游戏领域有浓厚兴趣;
4.具备良好的数据分析能力,能通过评测数据提炼产品质量趋势,反推Agent策略的迭代;
5.有丰富的跨领域合作经验,能够快速理解不同业务场景下的评测需求。
岗位介绍:
在腾讯,优秀的技术质量管理,保证腾讯每一个的产品与服务能更加稳定、顺畅、安心地被用户使用和体验。与技艺高超的同事们一同深化对架构设计、数据和产品的理解,在美好向善的世界里,成为一块闪耀的基石。
招聘城市:北京
…训练流程和评测结果之间的链路,提升数据使用的可追踪性、可复现性和交付效率。
岗位要求:
1.精通 Python,具备扎实的软件工程能力与系统设计能力,能在复杂系统中推进架构落地;
2.熟练掌握 Docker 容器化交付体系,理解镜像构建优化、依赖隔离、网络/存储、制品/镜像仓库等能力,并能设计可复现的环境交付流程;
3.熟悉 Kubernetes 使用与排障,能在集群环境下完成部署治理、资源配置和稳定性问题定位;
4.有后端服务、数据平台、任务平台、机器学习平台或评测平台相关研发经验;
5.理解数据集管理中的版本、元信息、质量校验、权限、可追踪性和自动化流程,具备良好的数据建模能力;
6.具备强问题分析与闭环能力,能高效利用 AI…
招聘城市:北京,上海
…AI 评测等方向的梯队建设;
- 推动团队文化建设,打造务实、自驱、开放、追求卓越的工程师团队。
2. 面向业务的 Agent 工具建设
- 深入了解点评各业务团队的工作流程和痛点;
- 设计和建设面向业务团队的通用 Agent 交互平台,支持低代码/无代码创建、调试、部署 AI Agent,让非技术同学也能轻松使用 AI 能力;
- 建设各类AI agent应用层能力。
3. 业务工作流程识别与 AI 提效
- 深度与业务、产品、运营高频共创,系统性梳理各团队的核心工作流程;
- 识别适合 AI 介入的环节,评估提效潜力和实施路径;
- 结合公司内部 AI 工具和外部 AI 能力,设计并落地提效方案;
- 推动“人用工具 → 工具找人”的主动服务型产品能力转变。
4. Agentic 架构与技术…