牛大妈在社招职位搜索可观测性技术研发-rednote 有 89 条结果

招聘城市:新加坡
岗位职责:
主要职责:
负责观测体系的研发工作,围绕指标、日志、追踪、性能剖析四大支柱,开展全栈领域的基础能力建设。
负责监控平台、全链路追踪、日志服务、计算引擎(流式分析、实时告警、时序检测等)、告警、eBPF等相关技术架构及产品设计。
保障观测基础服务在高并发环境下的高性能与高可用,并推动相关技术与产品的持续优化迭代。
落地AI基础设施观测、AI应用观测、以及“观测AI+”等前沿技术方向,提升AI场景的稳定,并优化传统观测产品的使用体验和效率。
Key Responsibilities:
Lead the development of observability systems, building foundational capabilities across the full technology stack based on the four pillars: Metrics, Logging, Tracing, and Profiling.
Design and architect observability-related…

小红书 观测技术研发-基础技术

全职 上海,杭州
招聘城市:上海,杭州
…负责观测体系研发工作,围绕 Metrics、Logging、Tracing、Profiling 四大支柱,从全栈领域展开观测基础能力建设;
负责监控平台、全链路追踪、日志服务、计算引擎(流式分析、实时告警、时序检测等)、告警、eBPF 等观测相关技术架构及产品设计;
保障观测相关基础服务,在高并发环境下的高性能、高可用,推动技术、产品持续优化迭代;
落地 AI Infra 观测、AI 应用观测观测 AI+ 等相关技术,提高 AI 场景稳定以及传统观测产品使用体验和效率。
任职要求:
全日制统招本科及以上学历,3 年及以上计算机相关工作经验;
精通 Java 或 Go 语言,熟悉并发编程、分布式系统、性能优化等,有扎实的编程基础;
熟悉云原生观测体系的相关产品及…

小红书(xiaohongshu) 观测技术研发-国际化

全职 新加坡,美国
招聘城市:新加坡,美国
岗位职责:
1、负责观测体系研发工作,围绕 Metrics、Logging、Tracing、Profiling 四大支柱,从全栈领域展开观测基础能力建设;
2、负责监控平台、全链路追踪、日志服务、计算引擎(流式分析、实时告警、时序检测等)、告警、eBPF 等观测相关技术架构及产品设计;
3、保障观测相关基础服务,在高并发环境下的高性能、高可用,推动技术、产品持续优化迭代,支撑国内和海外观测架构设计、数据合规、基建稳定保障等工作;
4、落地 AI Infra 观测、AI 应用观测观测 AI+ 等相关技术,提高 AI 场景稳定以及传统观测产品使用体验和效率。
任职要求:
1、全日制统招本科及以上学历,3 年及以上计算机相关工作经验;
2、精通 Java 或 Go 语言,熟悉…
招聘城市:上海,杭州
…发展趋势,探索前沿算法和技术在运维场景的落地与应用。
任职要求:
本科及以上学历,计算机或相关专业,2年及以上后端开发或算法相关工作经验。
熟练掌握 Python 或 Java 其中一种开发语言,具备扎实的编程基础和良好的工程实践能力。
熟悉常见的机器学习算法(如分类、聚类、回归、决策树等),具备扎实的概率统计知识。
有AIOps相关领域经验者优先,如熟悉时序异常检测、预测、关联分析、根因定位等算法,并有实际落地经验。
熟悉云原生观测技术体系者优先,如对 Prometheus、ELK、OpenTelemetry、SkyWalking 等有实践经验。
具备优秀的分析和解决问题能力,善于沟通与团队协作,有强烈的责任心和技术热情,能够承受一定的工作压力…
招聘城市:北京
…5.对于在该领域有突出项目经验或技术见解的优秀候选人,我们非常欢迎,并适当放宽工作年限要求。
加分项:
1.拥有硕士或博士学位,或在海外知名院校有相关教育背景;
2.拥有在大型云平台(如AWS, Azure, GCP)上构建和运维大规模分布式系统的经验;
3.具备AIOps、观测(Observability)、SRE或相关领域的实践经验;
4.熟悉主流开源观测技术栈(如OpenTelemetry, Prometheus等);
5.拥有海外知名科技公司、研究机构相关岗位的工作或实习经历者优先;
6.有高质量的开源项目贡献或技术博客。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让…

美团(meituan) Agent 开发工程师

全职 北京
招聘城市:北京
…领域前沿进展,将有价值的技术方案引入团队任职要求
任职要求:
1. 本科及以上学历,计算机相关专业,3年以上后端或 AI 工程开发经验
2. 扎实的工程基础,熟悉 Python / Java / Go 至少一门,能写出高质量、维护的代码
3. 有 LLM 应用开发实际经验,熟悉 OpenAI / Anthropic / 主流开源模型的 API 使用,了解 Function Calling、Tool Use 机制
4. 有 Agent 框架开发或使用经验(LangGraph、AutoGen、CrewAI、或自研框架),理解 ReAct / Plan-and-Execute 等 Agent 范式
5. 熟悉 RAG 系统设计,包括向量检索、知识库构建、上下文管理等
6. 有生产级 AI 系统落地经验,了解 Prompt 版本管理、Trace/Log 观测、评估体系建设等工程实践
岗位亮点:
1. 参与前沿AI Agent技术研发,推动智能化应用落地…

美团(meituan) 网络架构师

全职 北京
招聘城市:北京
…设计、技术评审和架构规划工作;
3.熟悉企业网络高可用、网络安全、访问控制、认证准入等相关技术,具备大型企业网络建设或优化经验;
4.了解主流公有云网络架构,熟悉SD-WAN等企业网络发展方向者优先;
5.了解企业级无线网络架构设计原则、无线认证及终端接入体系,有大型企业无线网络规划经验者优先;
6.具备自动化运维、网络观测、AIOps等相关实践经验者优先,熟悉Python、API调用、Zabbix、ELK等工具者优先;
7.对AI在网络领域的应用保持持续关注,具备利用AI工具提升设计、分析、运维效率的意识和实践经验者优先;
8.具备良好的英文沟通能力、文档编写能力和跨团队协作能力,能够独立推动复杂项目和技术方案落地…
招聘城市:北京
、缓存一致、元数据同步、跨节点事务处理等核心难题。
优化远程数据访问(Remote Data Access)性能,包括RDMA、零拷贝、智能预取、数据本地调度等。
探索新型存储介质(如NVMe SSD、持久内存PMem)在存算分离架构中的高效利用。
产品与平台化建设
参与或主导数据库产品(如自研云原生数据库、HTAP系统、分布式数据库)的架构演进,推动存算分离能力产品化。
构建存算分离架构下的监控、诊断、运维平台,提升系统观测与稳定
技术生态与协作
与基础设施团队(网络、存储、云平台)紧密协作,优化底层资源调度与数据流动效率。
跟踪国内外主流存算分离数据库(如Snowflake、Google BigQuery、AWS Aurora、TiDB Cloud、OceanBase等)的技术

美团(meituan) CodeAgent AI工程师

全职 北京,上海
招聘城市:北京,上海
…含执行反馈奖励)把任务成功率提上去
工程方向:建代码执行沙盒(隔离、编排、并发调度),啃构建加速和依赖缓存,做运行时观测和失败诊断回放
评测方向:建贴近真实的评测集和 benchmark,做端到端质检和效果度量,搭"采集—清洗—标注—反哺训练"的数据闭环
任职要求:
- 本科及以上学历,计算机相关专业
- 工程 / 算法基础扎实,至少一门主力语言用得熟(Python / Go / Java / TypeScript 等)
- 做过从 0 到 1 交付复杂系统或模型的完整项目,能独立扛下一个模块的设计和落地
- 对 Code Agent / LLM 应用有真实理解,能快速跟进并复现前沿工作
岗位亮点:
- 算法、工程、评测三条线不设墙,想钻深一条也行,想做复合型也行
-…

美团(meituan) CatPaw FDE 工程师(Forward Deployed Engineer)

全职 北京,上海,成都
招聘城市:北京,上海,成都
…case,把一次可用做成长期稳定可用,完成客户侧交付与培训。
4、沉淀通用能力。 把客户现场发现的共性需求与失效模式,提炼为复用的组件、模板与最佳实践,回流到 CatPaw 产品 Roadmap,降低下一个客户的落地成本。
任职要求:
1、计算机相关专业本科及以上,扎实的工程基础。熟练掌握至少一种主流技术栈(Java/Spring Boot、Go、Python 或 React/TypeScript),熟悉微服务、API 设计、分布式系统,对稳定、性能和观测有实际经验。能独立完成从需求拆解到上线治理的全流程。
2、对大模型应用有真实动手经验,理解 Prompt 工程、Function Calling、RAG、Agent 编排、上下文管理等核心概念,有实际落地案例。
3、具备将业务语言翻译为技术方案的能力,能…
招聘城市:深圳
…全栈研发经验;
2.计算机基础扎实,熟悉数据结构、算法、网络、操作系统及常用设计模式;
3.熟练掌握 JavaScript / TypeScript、HTML / CSS,熟悉 React、Vue 等至少一种主流前端框架;
4.熟悉 Node.js,并掌握 Go、Java、C++、Python、Rust 等至少一种服务端语言;
5.具备服务端及系统设计能力,理解 API、存储、缓存、并发、观测技术体系;
6.了解客户端、跨端或 Hybrid 开发模式,具备复杂 Web 应用研发经验;
7.重视代码质量、架构设计和工程效率,具备良好的沟通协作能力;
8.能熟练使用 AI 工具辅助研发,对 AI Agent、上下文工程及智能体工作流有一定实践。
加分项:
1.具备以下任一经验优先:;
2.富文本编辑器、在线文档、Sheet、PPT、PDF、白板、流程图或脑图研发
招聘城市:北京
…Agent 轨迹)的工程接入;了解主流推理引擎的工程实现与适配;
8.制定技术规范与研发流程,建立工程设计评审、发布门禁、故障复盘与值班机制,为整体工程质量负责。
岗位要求:
1.计算机、软件工程、人工智能等相关专业本科及以上学历,5 年以上软件研发经验;
2.主导过大型 AI 平台、机器学习平台或数据平台从架构定义到规模化落地的完整过程,所建系统被平台之外的多个团队长期使用;
3.熟悉 Kubernetes 及云原生生态,理解 Volcano、Ray 等批量与 gang scheduling 系统的调度模型与适用边界;熟悉并行文件系统的 IO 特征与观测体系;
4.具备大规模数据存储与处理经验,熟悉对象存储、并行文件系统与 HDFS 的适用场景,掌握 Spark 或 Ray…

腾讯(tencent) 高级前端工程师

全职 深圳
招聘城市:深圳
观测平台、低代码平台或 AI/Agent 平台等;
2.具备设计系统、组件库或内部 UI Kit 建设经验,能将视觉规范与交互模式转化为复用技术能力;
3.熟悉 Tailwind CSS、Radix UI、React Aria、shadcn/ui、Framer Motion、Storybook 等现代前端工具链优先。
岗位介绍:
作为一名前端开发工程师,你需要在快速变化的技术世界中保持一贯的敏锐与好奇,同时懂得如何将项目落地,给用户创造更多惊喜。你将与产品团队、客户端团队紧密合作,一同打造极致的用户体验。随着技术视野的不断拓宽,公司将会与你一同成长,个人职业的更多可能亦被打开。
部门介绍:
研发管理部,建设公司代码托管协作平台“工蜂”;构筑研发协作与项目管理平台TAPD…
招聘城市:北京,上海
…业务增长提供保障,并获得快速的成长与提升。
【岗位职责】
1、负责小红书搜广推业务线的机器学习训练框架的研发与迭代,核心支持公司所有相关业务场景;
2、深入参与分布式训练、自动并行化、参数服务器、特征样本流水线等系统底层功能的创新设计与优化,实现软硬件协同的极致训练效率;
3、跨团队合作,与公司算法部门深度协同,针对关键项目开展算法与系统的联合优化,推动解决实际业务挑战;
4、推动自动化扩展、智能资源调度、跨架构设备兼容(NV GPU、GPGPU、XPU等)、AI系统观测等先进技术在公司模型训练平台落地;
5、跟踪并推动AI系统领域的最新技术趋势(如生成式推荐、AI编译优化、RDMA/NCCL通信计算…
招聘城市:北京,上海
…与代码评审,推动工程规范、稳定治理与技术沉淀。
任职要求:
任职要求
1. 本科及以上学历,计算机相关专业,3年及以上后端/平台研发经验;具备内容安全/风控/审核/反作弊/网关治理等领域经验优先。
2. 扎实的后端基础:网络、并发、分布式、性能优化、故障排查;具备高可用架构设计经验。
3. 熟练掌握至少一种主流后端语言:Go/Java/Python,具备良好的工程化与编码能力。
4. 有实际的业务接入与平台建设经验:API 设计、SDK 设计、鉴权与权限、限流熔断降级、幂等、重试、异步回调等。
5. 熟悉微服务与中间件:RPC/HTTP、服务发现、配置中心、消息队列(Kafka/RocketMQ)、缓存(Redis)、数据库(MySQL/ES)。
6. 具备观测与稳定经验:链路追踪、日志规范…
招聘城市:深圳
…核心产品能力,实现端到端智能闭环。
岗位要求:
1.经验与素养:计算机本科及以上,2年以上云计算、大数据或观测研发经验;精通Java/ Golang/ Rust/ C++至少一种后端语言,深入理解 Linux 底层与分布式设计;
2.领域技术纵深:熟练掌握观测与大数据生态技术(如存储类 ClickHouse、VM、InfluxDB,计算类 Flink、Spark 等),有开源社区贡献者优先;
3.运维领域深刻认知:理解观测本质,具备多源异构数据语义关联与拓扑对齐的全局视野;认知传统运维痛点(告警风暴、配置地狱等),能准确识别哪些场景适合AI提效(如RCA、智能巡检),哪些场景须坚守确定规则;
4.AI原生交付能力:工程落地:熟练掌握大模型API、Prompt 工程及…
招聘城市:深圳

1.负责DataBuddy整体Agent运行框架的设计、开发与技术演进,并构建Agent整体的观测体系、评测体系;
2.深度结合AI能力,建设AI原生的数据智能平台,探索和落地GenAI+大数据的融合场景;
3.负责Agent运行框架、上下文工程、记忆、agent自进化等模块,优化DataBuddy的效果、执行效率;
4.负责DataBuddy底层图谱构建,并构建知识挖掘体系。
岗位要求:
1.具有扎实的基础知识、系统功底和编程能力,熟练掌握至少一门面向对象编程语言(Java/Python//GO),具备优秀的算法实现和代码优化能力;
2.具备 Data Infra/AI Infra方向的从业经验,参与过一定规模的相关项目研发和运维优先;
3.了解 Data+AI 方向最新前沿动态,了解业界新技术和新方案;
4.具备良好的…
招聘城市:广州
…平台底层数据架构优化与演进,构建高可用的线上数据应用;
2.协同业务团队制定数据标准,构建端到端链路观测体系,推动数据质量持续提升;
3.完善数据基础设施,构建高可靠数据管道,与AI系统深度整合,打造数据飞轮,持续驱动短剧等新兴业务增长,提升变现效率;
4.洞察业务挑战,高效应用现有工具并积极探索新技术应用,持续优化流程、提升效率、解决关键问题。
岗位要求:
1.精通 Java / Python / C++ / Go 中至少一门编程语言,具备扎实的工程素养;
2.深入理解大数据处理/分析工具与框架,如 Spark, Flink, Iceberg, ClickHouse, StarRocks 等,拥有大规模分布式数据处理与实时计算经验;
3.对大数据领域前沿技术充满好奇,具备持续学习与创新的驱动力;
4…
招聘城市:北京
岗位职责:
1. 主导搜索增强服务的长期技术规划与演进路线,设计具备前瞻的下一代搜索架构,支撑日均十亿级以上的高并发场景。负责制定系统观测体系、容灾多活方案及自动化运维平台,确保系统稳定达到SLA≥99.995%,实现跨地域的毫秒级响应能力 ;
2.领导构建灵活、扩展的搜索与排序框架,负责技术难题攻关,培养高级工程师,通过代码评审、技术培训提升团队整体技术水平 ;
3.深入理解业务需求,主导跨部门(算法、产品、引擎团队)的技术方案设计与协同推进,确保技术架构与业务目标高度一致。抽象通用中间件和平台能力,构建支持多业务场景的混合排序与检索体系,推动技术成果的平台化和组件化复用;
4.主导…
招聘城市:深圳
…智能化演进;
5.参与多模态集群统一管控平面的建设,提升整体运维效率与观测
6.探索 AI/ML 技术在调度优化、异常识别、根因分析等场景的工程化落地。
岗位要求:
1.3 年以上分布式系统、云原生基础设施或数据库内核研发经验;
2.深入理解分布式调度系统原理,有 Kubernetes 调度器、云数据库管控系统或大规模资源管理平台(如 Yarn、Mesos)的开发经验;
3.有元数据管理、分布式 KV 存储(如 etcd、TiKV)或 Catalog 系统的设计与开发经验;
4.熟悉负载预测、容量规划或在线资源优化相关方向,有实际工程落地经验;
5.对分布式系统有深入理解,熟悉 Raft / Paxos 协议及一致模型,具备扎实的系统编程能力(C++ / Go / Rust);…