招聘城市:北京
…Python、C++等;能够独立完成模块的设计和开发,快速定位并修复代码缺陷;熟悉并能遵守软件研发流程,有一定的软件架构设计经验;熟练掌握常见编程工具的使用。
3.个人素质:具备良好的沟通协作能力与团队意识,有较强的研发工作热情与责任心,能适应快节奏的开发环境;具备良好的问题分析与解决能力,有较强的逻辑思维与学习能力。
4.具有以下情形之一者优先:
(1)具有AI辅助编程实践经验,能结合AI工具提升开发效率与代码质量;
(2)具有DevOps相关建设经验,熟悉监控、自动化等运维工具。
A02. 测试开发工程师
岗位职责:
1.负责接口测试、功能测试、性能测试等自动化测试开发,提升测试效能,缩短测试周期,降低人工测试…
招聘城市:上海
…有一定组网实践经验;(4)熟悉JAVA、Python等一种以上主流开发语言,能编写自动化运维脚本。 3 .系统管理岗 岗位职责: (1)负责收集、统筹协调园区管理相关系统的需求调研、立项和采购相关工作;(2)负责改进和优化园区管理相关系统功能,包括新增硬件、功能等;(3)负责发现、跟进和解决园区管理相关系统问题事件;(4)完成上级领导安排的其他工作。 岗位要求: (1)本科及以上学历,计算机、自动化等专业;(2)有相同或相似行业实习经验者优先。 4 .暖通工程师 岗位职责: (1)负责管理数据中心暖通设备和冷源群控等系统监控平台,参与监控室二线值班;(2)负责数据中心暖通系统及配套基础设施运维工作,包括系统部署实施、巡检、故障处置等…
招聘城市:上海
…分布式系统设计、资源调度算法、Kubernetes平台开发
参与大规模集群性能调优、故障定位与自动化运维
自动计费与租户隔离
AI应用 与AI agent(智能体) + workflow的开发
教育背景
计算机科学、电子工程、自动化、信息安全等相关专业
在以下方向有研究或实习经历者优先:分布式系统、云计算、操作系统、网络协议、GPU加速、AI基础设施等
技术能力
具备扎实的计算机系统基础(操作系统、网络、编译原理、存储)
熟悉 Linux 环境和主流编程语言(Go / Python / java 至少一种)
理解 Kubernetes 生态,有 CNI、CSI、调度器等源码阅读或开发经验更佳
对 GPU 调度 / 网络通信(RDMA / InfiniBand / RoCE)有兴趣或项目经验者优先
具备利用AI工具拆解,解决复杂问题的能力
职位类别:计算机软、硬件…
招聘城市:上海
…系统运维,建设服务器自动化运维方案,参与相关工具、系统设计与开发,提高服务器硬件与系统运维效率
2.参与服务器硬件的测试评估、软硬件性能优化以及新硬件相关技术的研究与引入
工作要求:
1.2027届应届毕业生,计算机或相关专业本科或以上学历,对服务器硬件与系统有浓厚的兴趣。
2.熟悉X86平台架构,有良好、全面的计算机软硬件知识,对CPU、内存、储存、GPU等相关硬件和技术有较深入的研究。
3.熟悉Linux操作系统基本原理并熟练掌握常见Linux发行版,能够解决库依赖、驱动兼容性、硬件兼容性问题;熟悉HTTP、DNS、TCP等基础网络协议。
4.熟练运用脚本语言(Python/Shell)完成日常运维自动化…
招聘城市:上海
…硬件与系统运维,建设服务器自动化运维方案,参与相关工具、系统设计与开发,提高服务器硬件与系统运维效率;
2、参与服务器硬件的测试评估、软硬件性能优化以及新硬件相关技术的研究与引入 。
工作要求:
1、计算机或相关专业本科或以上学历,对服务器硬件与系统有浓厚的兴趣。
2、熟悉X86平台架构,有良好、全面的计算机软硬件知识,对CPU、内存、储存、GPU等相关硬件和技术有较深入的研究。
3、熟悉Linux操作系统基本原理并熟练掌握常见Linux发行版,能够解决库依赖、驱动兼容性、硬件兼容性问题;熟悉HTTP、DNS、TCP等基础网络协议;
4、熟练运用脚本语言(Python/Shell)完成日常运维自动化任务或工具…
招聘城市:上海
…有一定组网实践经验;
(4)熟悉JAVA、Python等一种以上主流开发语言,能编写自动化运维脚本。
3 .系统管理岗
岗位职责:
(1)负责收集、统筹协调园区管理相关系统的需求调研、立项和采购相关工作;
(2)负责改进和优化园区管理相关系统功能,包括新增硬件、功能等;
(3)负责发现、跟进和解决园区管理相关系统问题事件;
(4)完成上级领导安排的其他工作。
岗位要求:
(1)本科及以上学历,计算机、自动化等专业;
(2)有相同或相似行业实习经验者优先。
4 .暖通工程师
岗位职责:
(1)负责管理数据中心暖通设备和冷源群控等系统监控平台,参与监控室二线值班;
(2)负责数据中心暖通系统及配套基础设施运维工作,包括系统部署实施、巡检、故障处置等…
招聘城市:广州
…熟悉 CI/CD 流程; 6、有自动化运维平台、调度系统开发经验; 7、掌握 Python语言,能够编写自动化脚本或辅助工具。
单位简介
广州南天电脑系统有限公司(以下简称“广州南天”)于1992年成立,是云南南天电子信息产业股份有限公司(股票代码000948)控股的专业子公司,公司具有二十多年建设金融行业和国家部分重点行业信息化工程的丰富经验,以软件业务、集成服务业务、产品服务业务、智慧城市业务、创新业务等五大板块业务为主体,积极布局云业务和数据智能业务,发展智慧党建和智慧教育业务,为客户提供贯穿IT建设全生命周期的“一站式”数字化服务。公司现有员工1000余人。
公司地址:广州市天河区中山大道天河软件园(科韵园区…
招聘城市:上海
…Python等脚本语言,具备良好的代码编写习惯和自动化运维能力; 3.熟悉主流云计算平台(如AWS、Azure、Google Cloud)和容器化技术(如Docker、Kubernetes);了解分布式计算框架(如Spark、Hadoop)和深度学习框架(如TensorFlow、PyTorch); 4.有大规模AI模型训练和推理系统运维经验;熟悉AI模型加速技术(如TensorRT、ONNX);有DevOps实践经验,熟悉CI/CD流程;具备相关认证(如AWS Certified DevOps Engineer、CKA等)。满足上述条件者,优先考虑; 5.具有较好的文档撰写能力、语言表达能力; 6.身心健康,具有较强的主观能动性,能接受挑战,具备良好团队合作能力。
岗位职责
1.负责智能运维相关系统的建设和优化,确保系统的高可用性和稳定性; 2.负责运维数据…
招聘城市:上海
…版本升级、环境标准化工作;
2.基于 Prometheus、Grafana、DCGM 等工具搭建集群监控大盘,输出性能报表、故障分析报告与优化方案;
3.编写 Shell/Python 自动化脚本、运维 SOP、故障处理手册,沉淀技术知识库;
4.协同算法、平台、网络团队,联动定位集群全链路问题,保障大模型训练、分布式任务稳定运行;
5.跟踪 GPU 集群、RDMA 网络、分布式通信前沿技术,持续优化集群架构与运行效率。
职位描述
工作职责:
面向高性能 GPU 大卡集群、AI 训练 / 推理集群,聚焦集群全栈性能优化、网络异常检测、服务器故障定位,支撑大模型训练、分布式算力业务稳定高效运行
团队通用职责:
1、参与大规模 GPU 集群日常压测、基线梳理、运维保障,配合完成集群扩容、版本升级、环境标准化工作
2、基于…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
面向高性能 GPU 大卡集群、AI 训推集群,聚焦集群全栈性能优化、网络异常检测、服务器故障定位,支撑大模型训练、分布式算力业务稳定高效运行
团队职责:
1、参与大规模 GPU 集群日常压测、基线梳理、运维保障,配合完成集群扩容、版本升级、环境标准化工作
2、基于 Prometheus、Grafana、DCGM 等搭建集群监控大盘,输出性能报表与优化方案
3、编写 Shell/Python 自动化脚本、运维 SOP、故障处理手册,沉淀知识库
4、协同算法、平台、网络团队,联动定位集群全链路问题,保障大模型训练、分布式任务稳定运行
5、跟踪 GPU 集群、RDMA 网络、分布式通信前沿技术,持续优化集群架构与效率
岗位职责:
聚焦 RoCEv2/InfiniBand RDMA 无损网络,专职网络异常排查、故障…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
面向高性能 GPU 大卡集群、AI 训练 / 推理集群,聚焦集群全栈性能优化、网络异常检测、服务器故障定位,支撑大模型训练、分布式算力业务稳定高效运行
团队通用职责:
1、参与大规模 GPU 集群日常压测、基线梳理、运维保障,配合完成集群扩容、版本升级、环境标准化工作;
2、基于 Prometheus、Grafana、DCGM 等工具搭建集群监控大盘,输出性能报表、故障分析报告与优化方案;
3、编写 Shell/Python 自动化脚本、运维 SOP、故障处理手册,沉淀技术知识库;
4、协同算法、平台、网络团队,联动定位集群全链路问题,保障大模型训练、分布式任务稳定运行;
5、跟踪 GPU 集群、RDMA 网络、分布式通信前沿技术,持续优化集群架构与运行效率。
岗位具体职责:
聚焦 GPU 服务…
招聘城市:上海
…分布式算力业务稳定高效运行
团队通用职责:
1、参与大规模 GPU 集群日常压测、基线梳理、运维保障,配合完成集群扩容、版本升级、环境标准化工作
2、基于 Prometheus、Grafana、DCGM 等工具搭建集群监控大盘,输出性能报表、故障分析报告与优化方案
3、编写 Shell/Python 自动化脚本、运维 SOP、故障处理手册,沉淀技术知识库
4、协同算法、平台、网络团队,联动定位集群全链路问题,保障大模型训练、分布式任务稳定运行
5、跟踪 GPU 集群、RDMA 网络、分布式通信前沿技术,持续优化集群架构与运行效率
岗位具体职责:
聚焦硬件、驱动、通信库、调度、框架全维度性能优化,提升集群算力利用率与任务吞吐,细分具体工作内容:
1、负责 GPU 硬件栈调优:完成 GPU 驱动、CUDA、cuDNN…
招聘城市:北京
…负责AI平台、GPU算力集群的日常部署、运维与故障排查,保障系统稳定运行;2. 搭建监控体系,优化系统性能,降低资源成本;3. 开发简单自动化运维工具,协助算法团队解决生产环境问题;4. 编写基础运维文档,沉淀实践经验。
岗位要求:
1. 本科及以上,计算机、软件工程、人工智能等相关专业;2. 精通Linux运维,熟悉Docker、K8s基础,掌握Python/Go任一脚本语言;3. 了解AI框架(TensorFlow/PyTorch)、GPU特性及大模型基础流程;4. 学习能力强,有责任心,具备基础沟通协作能力。
投递说明:
网申→测评→笔试→技术面试→HR 面试→Offer。
其他描述:
1. 工作以技术运维为主,部分场景需值守,项目期可能加班;2. 校招流程:网申→测评→…
招聘城市:郑州
…运维服务工程师
岗位职责:①负责服务器、网络设备等IT基础设施的日常维护和管理;②保障业务系统的稳定运行,及时处理系统故障和问题;③进行数据备份和恢复工作,确保数据的安全和完整;④开展运维服务工作,保障客户业务稳定运行;⑤参与项目实施工作,保障项目上线与验收;⑥制定和完善IT运维管理制度和流程,提高运维效率。
任职要求:①本科及以上学历,人工智能、计算机类等相关专业;②具备1-2年以上运维经验,熟悉服务器、网络设备等IT基础设施的运维工作;③掌握Shell/Python开发语言至少一种,具备编写自动化运维脚本的能力;④掌握国产操作系统和Linux命令,能进行运维…
招聘城市:北京,上海,武汉,其它
…及常用命令,能编写Shell/Python脚本;
3、了解Docker/Kubernetes或Prometheus等监控工具者优先;
4、对AI智能体(Agent)自动处理运维场景有强烈兴趣。
?
(二)测试开发工程师
工作职责
1、根据测试需求进行功能测试、集成测试、回归测试并编写测试报告;
2、参与自动化测试平台的开发与维护,编写测试脚本;
3、协助训练AI识别业务流程Bug,提升测试覆盖率和效率。
任职资格
1、计算机相关专业,2027届本科/硕士;
2、掌握Python/Java至少一种,了解Pytest/JUnit等测试框架;
3、对AI辅助测试(如自动生成用例、智能分析)有好奇心;
4、细致耐心,能通过日志、抓包工具定位问题。
?
(三)算法工程师
工作职责
1、参与AIOps(智能运维)场景下的算法研发,包括异常…
招聘城市:上海
…模态数据的清洗、标注、增强、特征提取、向量化与可视化;探索跨模态数据的对齐、融合与联合分析技术。
3. 参与平台架构演进,构建面向 AI-Native 的 Data Agent 基础设施,探索智能调度、自动修复、自适应优化等能力,推动数据平台从"工具化"向"智能化"演进,重新定义数据平台的交互与运维范式。
4. 关注平台研发效能与开发者体验,设计标准化的 API/SDK、可观测性体系及自动化运维工具,降低业务接入成本,提升平台易用性。
工作要求:
1. 计算机、软件工程、大数据、人工智能等相关专业,本科及以上学历;
2. 熟练掌握 Go / Python / Java至少一门后端开发语言,具备良好代码风格,了解基础数据结构、计算机网络、操作系统知识。
3. 了解分布式系统…
招聘城市:上海
…模态数据的清洗、标注、增强、特征提取、向量化与可视化;探索跨模态数据的对齐、融合与联合分析技术。
3. 参与平台架构演进,构建面向 AI-Native 的 Data Agent 基础设施,探索智能调度、自动修复、自适应优化等能力,推动数据平台从"工具化"向"智能化"演进,重新定义数据平台的交互与运维范式。
4. 关注平台研发效能与开发者体验,设计标准化的 API/SDK、可观测性体系及自动化运维工具,降低业务接入成本,提升平台易用性。
工作要求:
1. 计算机、软件工程、大数据、人工智能等相关专业,本科及以上学历;
2. 熟练掌握 Go / Python / Java至少一门后端开发语言,具备良好代码风格,了解基础数据结构、计算机网络、操作系统知识。
3. 了解分布式系统…
招聘城市:广州
…Web应用开发等);或精通网络自动化运维(如UNIX/Linux系统管理、SDN、网络自动化部署等);或具备云计算技术应用能力(如云服务平台、虚拟化与容器技术、OpenStack云平台及中间件应用);
(3)同等条件下,持有中级及以上职称、双师型资质,拥有丰富的项目实践经验和较强的工程实践能力,或兼具网络与安全复合技术背景者优先录用。
3.大数据管理与应用专业招聘要求:
(1)硕士及以上学位,博士及有教学经验或行业工作经验者优先;
(2)研究方向或实践经历应与大数据采集、处理、分析、建模、商业智能应用、决策支持等领域高度契合;熟练掌握Python、SQL及主流数据分析与机器学习框架,能够承担专业核心课程的教学与实践…
招聘城市:广州
…教师 网络工程、网络安全、云计算技术 熟悉路由交换网络工程,网络攻防,自动化运维,云计算,虚拟化,人工智能等领域技术;中级以上职称或企业行业工作经验丰富者优先。
计算机应用技术教师 计算机科学与技术、软件工程、人工智能与大数据等相关专业 熟悉系统部署与运维、程序设计语言(C/Java/Python)、鸿蒙应用开发、大数据技术、嵌入式系统等领域技术;中级以上职称或企业行业工作经验丰富者优先。
人工智能技术应用教师 人工智能科学与技术、计算机科学与技术(AI方向)、数据科学与大数据技术、模式识别与智能系统、机器人工程、智能科学与技术等相关专业 熟悉系统部署与运维、程序设计语言(C/Java/Python)、鸿蒙应用开发、大数据技术…
招聘城市:广州
…Web应用开发等);或精通网络自动化运维(如UNIX/Linux系统管理、SDN、网络自动化部署等);或具备云计算技术应用能力(如云服务平台、虚拟化与容器技术、OpenStack云平台及中间件应用);
(3)同等条件下,持有中级及以上职称、双师型资质,拥有丰富的项目实践经验和较强的工程实践能力,或兼具网络与安全复合技术背景者优先录用。
3.大数据管理与应用专业招聘要求:
(1)硕士及以上学位,博士及有教学经验或行业工作经验者优先;
(2)研究方向或实践经历应与大数据采集、处理、分析、建模、商业智能应用、决策支持等领域高度契合;熟练掌握Python、SQL及主流数据分析与机器学习框架,能够承担专业核心课程的教学与实践…