招聘城市:深圳
…实施全球人才引进和培养计划,解决重大经济社会应用问题,以促进社会进步和经济发展。
岗位需求
序号
中心
岗位
招聘人数
学历要求
专业要求
岗位职责
任职要求
1
优化与工程计算研究中心
系统研发工程师(AIInfra)
1
本科及以上
计算机科学技术或人工智能或软件类
1.智算集群资源调度平台架构与研发:基于Kubernetes构建面向大规模智算集群(千卡规模)的资源调度平台;设计并实现GPU/NPU异构资源调度策略,支持算力分时复用、拓扑感知调度、弹性配额管理;开发节能调度算法,基于负载预测的动态功耗控制、基于利用率感知的节点启停策略;实现多维度调度,支持CPU/内存/显存/网络带宽/存储IO等多资源维度的综合调度决策;设计高可用…
招聘城市:其它
广州华夏汇海科技有限公司
android工程师
薪资:3K-5K/月
工作地点:广东省 佛山市
学历:大专及以上
发布时间:2025年12月11日
职位描述
岗位职责:
负责公司android系统的维护和开发工作。
岗位要求:
任职要求
1、熟练掌握Java或Kotlin编程语言,有较好的代码阅读能力和理解能力,熟悉C++更佳。
2、熟练掌握并能够灵活应用Android四大组件,对Android的基础架构、组件、数据存储、性能优化、内存优化等有一定了解
3、精通Android网络编程、多线程,熟悉TCP/UDP、HTTP协议。
4、熟悉JSON、XML数据解析
5、了解MVP、MVVM等项目架构。
6、熟悉常用第三方框架的使用,如:Netty、OkHttp、Retrofit、Gson、RxJava、RxAndroid等
7、有Android与硬件交互经验。
7、有音视频、多媒体…
招聘城市:上海
…的加入,与理想汽车一起成长、分享收获。通过人工智能技术去改变物理世界的效率和体验,造福我们服务的每一个家庭,以及家庭里的每一位成员。
【本岗位的主要工作内容】
1.参与自动驾驶、计算机视觉(CV)、大语言模型(LLM)等AI模型的性能加速工作,协助优化模型训练与推理效率,探索底层硬件与算法的适配方案;
2.协助分析深度学习模型在训练、推理过程中的性能瓶颈,参与CPU/GPU资源调度、内存优化、并行计算效率提升等相关工作;
3.学习并应用深度学习框架(TensorFlow/PyTorch)的性能优化技术,包括计算图优化、算子加速、低精度计算等;
4.跟踪AI系统加速领域的前沿技术(如AI编译器、分布式训练框架),参与技术调研与原型验证;
5…
招聘城市:北京,深圳,其它
…数据存储、性能优化、稳定性治理等方向;
5. 探索并落地 AI 技术在移动端场景中的应用,包括 AI Assistant、智能搜索、智能推荐、智能创作等功能;
6. 利用 AI Coding、智能测试等工具提升研发效率,持续优化开发流程与工程质量;
7. 持续关注 Android、AI Application 及移动互联网前沿技术发展,推动创新技术落地。
任职要求
1. 2027届本科及以上学历,计算机科学、软件工程、人工智能等相关专业;
2. 扎实掌握数据结构、算法、操作系统、计算机网络等计算机基础知识;
3. 熟悉 Java、Kotlin、C/C++ 等至少一种编程语言;
4. 熟悉 Android 开发基础知识,了解 Android Framework、组件化开发及常见设计模式;
5. 了解客户端性能优化相关技术,包括启动优化、内存优化、网络优化及稳定性治理;
6…
招聘城市:深圳,其它
…搭建、优化及维护,确保软件开发的自动化流程能快速、准确、可靠的构建;
4、负责后端故障诊断和维护活动,包括软件维护、疑难问题解决等。
任职资格
1、计算机、软件工程、通信工程、电子工程、自动化、机电一体化、光电工程、微电子、仪器仪表、测控技术、机械电子等相关专业;
2、热爱编程,基础扎实,熟悉C/C++或Python/JAVA/JS等编程语言,熟悉 Linux、RTOS 等嵌入式操作系统优先,熟悉问题排查和解决方法,有较强的故障处理能力,对数据结构、算法有一定了解;
3、熟悉CI/CD工具和技术,熟悉Jenkins、Gitlab、Git等,熟悉自动化软件构建、测试和部署;
4、熟悉 WebGL、Three.js 等图形渲染技术,有工业数据可视化、3D模型展示等相关经验者,了解内存优化…
招聘城市:北京,上海
岗位职责:
简介:参与面向大模型训练/推理的高性能计算与系统优化工作,可根据个人背景和研究兴趣选择以下方向之一深入推进:
1、面向GPU/NPU 等多硬件平台的算子开发与极致性能优化(CUDA/Cutlass/TileLang)。
2、跟踪前沿模型算法并完成高性能工程落地,深入框架层开展算子融合、内存/通信优化、流水编排等系统级性能调优。
3、探索基于大模型的高性能 Kernel 自动合成技术,参考 LLM-driven Kernel Generation 范式,研究高效 GPU/NPU Kernel 的端到端自动生成与迭代优化方法。
4、基于DSL(如 Triton、TVM TIR、Halide 等)的编译优化与自动调优技术研究。
5、多硬件后端(NVIDIA/国产芯片)的统一算子库建设与迁移适配。
任职要求:
1、GPU编程:写过…
招聘城市:北京,上海
岗位职责:
方向一:面向Agent RL的LLM分布式后训练系统
1.多模态与超长上下文训练优化:针对万级以上超长序列(Long Context)及多模态输入,研究高效的上下文并行(CP/SP)、序列并行策略及分布式通信拓扑,优化内存足迹,支撑长文本与复杂多模态后训练。
2.计算资源弹性调度与容错容灾:研究超大规模集群下的弹性训练技术(Elastic Training),实现节点动态加入/退出、无感故障自动恢复(Fault Tolerance)与训练超参数自动寻优,提升集群算力有效利用率(MFU)。
3.Agent RL算法基础设施:构建面向Agent强化学习的高效Rollout引擎、多模型(Policy/Value/Reward/Reference)多阶段流水线编排及动态负载均衡机制;设计并建设支持高并发、低延迟的工具…
招聘城市:上海
…探索多模态特征的早期/晚期融合机制。
2、自监督预训练:利用海量无标注仿真与真实场景数据,设计掩码预测(Masked Modeling)等自监督任务,训练模型的特征提取与物理常识理解能力。
3、表征质量验证:设计线性探测(Linear Probing)任务,验证隐特征是否充分解耦并包含了位置、速度、几何形状等关键物理信息。
4、端侧部署与优化:将训练好的 PyTorch 模型转换为 TensorRT 或 ONNX 格式,针对车载边缘计算平台进行算力与内存占用优化,满足 30Hz 以上的实时推理需求。
任职要求
1、人工智能、计算机视觉、自动化等相关专业硕士及以上学历。
2、代码底盘:精通 Python 与 PyTorch,具备扎实的深度学习网络手写能力,熟悉分布式训练(DDP)。
3、算法前沿:深入理解…
招聘城市:上海
…开发和优化,构建从深度学习框架到NPU硬件的完整编译流水线
· 实现神经网络计算图的优化、算子融合、自动调度和代码生成
· 开发针对特定NPU架构的优化算法,包括内存布局优化、指令调度、并行化策略等
性能优化与调优
· 分析并解决神经网络模型在NPU上的性能瓶颈,提出优化方案
· 构建性能分析工具和性能模型,指导编译器优化方向
· 实现自动调优框架,针对不同网络结构自动搜索最优编译策略
软硬件协同设计
· 与硬件团队紧密合作,参与NPU指令集架构和微架构设计
· 基于硬件特性和约束开发编译器优化,提升计算单元与带宽利用率
· 构建硬件抽象层和编程模型,简化上层应用与编译器对接
工具链生态建设
· 开发和维护完整…
招聘城市:上海
…建设,输出可复现的实验结论与版本对比报告。
4.与软件/硬件/系统团队协作完成算法上机与性能优化:推理加速、内存/时延优化、接口联调与异常定位,保障在设备端长期稳定运行。
5.跟踪行业与学术进展,将可落地的新方法应用到量测/检测场景,并推动产品化交付。
任职要求
1.计算机、电子、自动化、数学等相关专业,硕士优先(优秀本科且有对口项目可放宽)。
2.熟练使用PyTorch/TensorFlow之一,具备从数据到训练到评测的完整项目经验;在检测/分割/异常检测/信号处理至少一个方向有深入实践。
3.熟练Python,具备良好工程能力(Linux、Git、可复现实验、文档与问题定位能力);有C++经验更佳。
4.具备扎实的数学与算法基础(概率统计、优化、线代…
招聘城市:上海
…模型,探索多模态特征的早期/晚期融合机制。
2、自监督预训练:利用海量无标注仿真与真实场景数据,设计掩码预测(MaskedModeling)等自监督任务,训练模型的特征提取与物理常识理解能力。
3、表征质量验证:设计线性探测(LinearProbing)任务,验证隐特征是否充分解耦并包含了位置、速度、几何形状等关键物理信息。
4、端侧部署与优化:将训练好的PyTorch模型转换为TensorRT或ONNX格式,针对车载边缘计算平台进行算力与内存占用优化,满足30Hz以上的实时推理需求。
任职要求:
1、人工智能、计算机视觉、自动化等相关专业硕士及以上学历。
2、代码底盘:精通Python与PyTorch,具备扎实的深度学习网络手写能力,熟悉分布式训练(DDP)。
3、算法前沿:深入理解Transformer…
招聘城市:上海
…分布式框架相关的开发经验;
联系人:高静
手机:15666090553
岗位二:C++量化开发工程师(全职+实习)
岗位职责:
1.低延迟系统开发
开发并优化高频交易和做市系统的核心组件,使用现代C++17/20编写高性能、低延时代码,减少微/纳秒及延迟
优化内存管理、锁-free编程、SIMD指令集加速
2.量化模型池落地
将量化研究员开发的阿尔法模型、执行算法转化为生产级C++代码,与量化团队协作,实现统计套利、趋势跟踪等策略的系统化执行
3系统架构与优化
设计分布式系统架构,处理TB级实施市场数据Level2/逐笔行情
使用linux内核调优提升网络吞吐量
4.风险管理与监控
实现实时风控模块,构建Pnl计算引擎和实时监控仪表盘。…
招聘城市:广州
…5. 熟悉 msyql数据库, 有 mongodb或leveldb 等数据库经验更优;6. 熟悉网络编程,有多进程或多线程实战经验。 联系人:张老师电话:13544489381邮箱:94526868@
8 游戏主程序 1 1、负责游戏项目整体程序架构设计与开发,客户端(Unity前端)及服务端(轻量后端)的全部技术实现。2、高效完成核心玩法系统、UI交互、网络同步等功能的开发与迭代,保障项目进度。3、针对大众低端机进行深度性能优化(内存、渲染、加载效率等),确保流畅体验。4、负责游戏全平台的上架、SDK接入、打包与发布流程。5、熟练使用AI工具辅助研发,提升开发效率。6、主动总结技术方案,以易懂的方式为团队讲解技术逻辑与实现方式。7、在团队内部分享开发经验,帮助提升团队整体技术意识…
招聘城市:上海,杭州,北京
岗位职责:
本课题旨在通过优化Transformer模型中的KV缓存机制,解决处理长序列数据时遇到的计算和内存挑战,目标是减少资源消耗、降低延迟并提高效率。
研究方向包括设计高效的KV缓存管理策略、适应不同应用场景的缓存优化以及并行与分布式处理优化。预期将成果应用于自然语言处理、视频分析等领域,为处理超长序列数据提供更加高效和可扩展的解决方案。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先…
招聘城市:北京,上海
…内存/功耗)。
3.探索端云协同架构设计,实现智能路由、本地缓存、增量更新等机制,提升用户体验。
4.参与端智能应用场景创新(如离线AI助手、实时代码补全、本地隐私计算等),快速构建MVP验证。
5.输出技术方案与实验报告,沉淀端智能最佳实践与工具链。
任职要求:
1.在读研究生及以上(本科高年级优秀者亦可考虑),计算机、人工智能、移动计算相关专业。
2.论文要求:
在 AI系统/移动计算/模型压缩 相关会议或期刊发表或投稿论文(MLSys/EuroSys/MobiSys/MobiCom/CVPR/ICCV等),或有相关研究经历。
或在 On-device AI/Model Compression/Efficient Inference 方向有深入研究(需提供技术报告或开源项目)。
3.熟悉至少一种移动端开发技术栈(Android/iOS/Flutter/React Native),有端侧性能优化经验…
招聘城市:上海,杭州,北京
岗位职责:
本课题旨在通过优化Transformer模型中的KV缓存机制,解决处理长序列数据时遇到的计算和内存挑战,目标是减少资源消耗、降低延迟并提高效率。
研究方向包括设计高效的KV缓存管理策略、适应不同应用场景的缓存优化以及并行与分布式处理优化。预期将成果应用于自然语言处理、视频分析等领域,为处理超长序列数据提供更加高效和可扩展的解决方案。
任职要求:
1、不限年级,本科及以上在读,人工智能/计算机/软件工程等相关专业优先;
2、优秀的代码能力,熟练掌握至少一门编程语言,包括但不限于Python/C/C++/Java/Go等其中一门开发语言;
3、有分布式系统/数据库系统/云原生等相关技术的研究和开发经验优先…
招聘城市:北京,上海
…模型创新;
3、持续优化训推基础设施:自研 Embedding 高速存储、特征 DSL 引擎、弹性调度与服务化推理框架,实现 10x 级性能提升;
4、跟踪 LLM / Agent 最新进展,将其工程化落地到搜索、广告、推荐及智能体业务,定义行业新标准。
任职要求:
1、计算机及相关专业本科以上学历,具备高性能系统或 AI Infra 研发经验;
2、精通 C/C++,具备扎实的系统底层能力(内存、并发、网络),代码风格优雅,热衷技术分享;
3、深入理解至少一种主流训练/推理框架(XDL、TFRA、DeepRec、TorchRec、DeepSpeed、veRL、Megatron 等),对其执行模型与性能瓶颈有源码级洞察;
4、熟悉 TensorFlow Serving、TensorRT、OpenXLA、ONNX Runtime 等推理后端,具备大模型量化、编译优化与线上 A/B 调优实战经验;
5、了解推荐…
招聘城市:北京
…数据结构和算法基础,具备良好的编程习惯;
2、有至少一款非Nvidia GPU的异构计算芯片适配大模型训练、推理框架的相关经验,包括但不限于AI框架适配、模型移植、性能优化或算子开发;
3、熟悉至少一种主流的机器学习框架(PyTorch/PaddlePaddle/TensorFlow等),对框架内部实现有一定了解;
4、具备大型深度学习模型(尤其是大语言模型LLM或多模态模型)的训练或推理优化实践经验,能独立解决功能研发及性能优化问题。
加分项:
1、深入理解AI芯片(GPU/NPU)的硬件架构(如Tensor Core、内存 hierarchy)及其软件栈(如CUDA/OpenCL, ROCm, CANN);具备使用性能分析工具(如Nsight Systems/Compute, Ascend Profiler)的经验;
2、熟悉常见的并行计算模型(如SIMT、SPMD)和并行编程范式(如MPI…
招聘城市:北京,上海
…模型创新;
3、持续优化训推基础设施:自研 Embedding 高速存储、特征 DSL 引擎、弹性调度与服务化推理框架,实现 10x 级性能提升;
4、跟踪 LLM / Agent 最新进展,将其工程化落地到搜索、广告、推荐及智能体业务,定义行业新标准。
任职要求:
1、计算机及相关专业本科以上学历,具备高性能系统或 AI Infra 研发经验;
2、精通 C/C++,具备扎实的系统底层能力(内存、并发、网络),代码风格优雅,热衷技术分享;
3、深入理解至少一种主流训练/推理框架(XDL、TFRA、DeepRec、TorchRec、DeepSpeed、veRL、Megatron 等),对其执行模型与性能瓶颈有源码级洞察;
4、熟悉 TensorFlow Serving、TensorRT、OpenXLA、ONNX Runtime 等推理后端,具备大模型量化、编译优化与线上 A/B 调优实战经验;
5、了解推荐…
招聘城市:北京,上海
…低比特量化与软硬件协同优化 等方向,构建统一的跨范式推理优化框架。
研究目标是在保证生成质量前提下,实现满足不同 SLO 的低时延、高吞吐与低成本推理,为大模型在智能问答、代码生成、Agent 与多模态服务中的规模化部署提供理论与工程支撑。
任职要求:
1、计算机及相关专业本科以上学历,具备高性能系统或 AI Infra 研发经验;
2、精通 C/C++,具备扎实的系统底层能力(内存、并发、网络),代码风格优雅,热衷技术分享;
3、深入理解至少一种主流训练/推理框架(XDL、TFRA、DeepRec、TorchRec、DeepSpeed、veRL、Megatron 等),对其执行模型与性能瓶颈有源码级洞察;
4、熟悉 TensorFlow Serving、TensorRT、OpenXLA、ONNX Runtime 等推理后端,具备大模型量化、编译优化与线上…