招聘城市:深圳
…研究模型对生成内容的理解能力,解析语义、对象、关系、空间结构;
2.实现生成视频的状态跟踪与一致性建模;
3.探索"生成-理解一体化"模型架构;
4.研究"动作输入→视频输出"的因果一致性控制与物理约束;
5.研究混合架构,实现实时交互式生成的低延迟反馈;
6.与 Agent/RL 团队协作,推动"生成→理解→控制→反馈"端到端闭环;
7.在游戏场景中验证可控交互能力,主导评测体系建立;
8.持续跟进业界相关工作,形成自有技术路线。
岗位要求:
1.AI 相关博士,方向覆盖视频理解/视频预测/强化学习/多模态生成与理解;
2.深度理解视频生成与理解两类模型的内部机制,熟悉扩散模型原理;
3.有交互式视频生成或可控视频生成相关研究经历…
招聘城市:深圳
…研究高压缩比视频 Tokenizer,推进多分辨率、多帧率统一建模能力;
4.主导千亿/万亿 token 级别视频预训练,定义 data mixture 与 curriculum learning 策略;
5.探索 Scaling Law,输出科学的 scale-up 路径,持续提升模型关键能力;
6.跟踪业界 SOTA,主导对比实验,输出技术路线决策与论文发表。
岗位要求:
1.AI 相关博士,有顶会一作论文;
2.精通扩散模型与自回归生成的原理与工程实现;
3.有视频/图像生成模型从零训练经验,精通 PyTorch 及大规模分布式训练;
4.深度理解 Video VAE/Tokenizer 的设计取舍,3年以上相关研究经验;
5.有视频生成或扩散模型相关方向论文;
6.有业界核心产品研发经验或最新技术实战经验者优先;
7.主导过端到端视频…
招聘城市:深圳
…自动导出引擎数据:GBuffer、语义分割、3D primitives、相机参数、optical flow 等,输出多视角同步采集数据;
4.优化批量渲染效率,建立合成资产复用机制,降低单条视频成本;
5.跟踪业界合成数据做法,探索 sim2real domain randomization 在视频生成中的应用。
岗位要求:
1.硕士及以上学历,图形学、游戏开发或 3D 视觉方向;
2.精通 UE5/Unity,能进行 Blueprint/C++/脚本级别开发;
3.熟悉渲染管线,理解 GBuffer 数据结构;
4.有批量化数据生成或 PCG 经验,熟练使用 Python/PyTorch;
5.熟悉 USD/Houdini/Omniverse,有可微渲染使用经验者优先;
6.有图形学、Diffusion 或 3D 视觉相关方向顶会论文者优先。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习…
招聘城市:深圳
岗位职责:
1.设计多模态可控生成框架,支持键盘/手柄/轨迹/语音等多种输入;
2.研究稀疏控制信号下的高保真生成,探索条件控制范式在视频域的拓展;
3.实现轨迹控制、相机控制、运动控制、姿态控制的解耦与组合;
4.针对不同游戏类型设计专用控制模块;
5.研发多人协同操控视频生成能力,实现低延迟响应与帧间状态保持;
6.与引擎/Agent 团队协作,定义可控信号的标准化接口;
7.推动可控生成与 RL 后训练的联合优化。
岗位要求:
1.AI 相关博士,计算机视觉/深度学习方向;
2.精通条件生成模型及多人多通道操控技术,熟悉扩散模型原理;
3.有相机控制、轨迹控制、姿态控制相关项目经验;
4.理解游戏引擎的输入输出逻辑与帧同步机制…
招聘城市:深圳
岗位职责:
1.推动基于Diffusion的视频模型推理时效率优化;
2.针对消费级显卡优化推理 pipeline,目标实现端侧高效生成;
3.设计高并发推理服务,实现多模型路由与灰度发布;
4.建设端到端超低延迟管线,融合硬件加速编解码;
5.研发高效视频编码配置,适配实时流媒体协议;
6.跟踪最新加速方法,探索投机式扩散采样与训推一体优化。
岗位要求:
1.硕士及以上学历,图形学、游戏开发或 3D 视觉方向;
2.精通 UE5/Unity,能进行 Blueprint/C++/脚本级别开发;
3.熟悉渲染管线,理解 GBuffer 数据结构;
4.有批量化数据生成或 PCG 经验,熟练使用 Python/PyTorch;
5.熟悉 USD/Houdini/Omniverse,有可微渲染使用经验者优先;
6.有图形学、Diffusion 或 3D 视觉相关方向顶…
招聘城市:深圳
…在语音理解、语音生成及实时语音交互方面的能力;
4.与研究和工程团队跨职能协作,推动项目从原型验证到生产落地。
岗位要求:
1.计算机科学、电子工程、信号处理或相关领域博士学位;
2.具备扎实的语音/音频处理基础,熟悉现代生成模型(如扩散模型、流匹配、自回归模型、基于编解码器的方法等);
3.具有将大语言模型扩展至语音/音频模态的实际经验(如语音分词器、多模态适配器、语音-文本联合训练等);有全双工或流式语音对话系统及实时交互建模经验者优先;
4.熟练使用 Python 及深度学习框架(如 PyTorch);有分布式训练经验者优先;
5.在顶级学术会议发表过论文(如 ICML、NeurIPS、ICLR、ACL、ICASSP、Interspeech 等)。
加分项:
1.有代码生成…
招聘城市:北京
…生成效率等上的问题,探索生成模型的突破性技术;
2.从事图像/音视频/多模态/3D视觉领域算法模型的训练和研发,应用于腾讯视频相关的内容创作和用户体验提升;
3.结合自有产品和业务需求,从生成模型迭代、可控模块研发,性能加速等方面优化模型,解决面向业务场景的应用和落地时的关键算法问题,并最终有效改善用户体验和生产效能,协助算法的产品化落地。
岗位要求:
1.计算机、人工智能、数学等相关专业的全日制本科(优先),研究生及以上学历;
2.具有扎实的计算机视觉或机器学习算法基础,有相关方向顶级论文者优先;
3.熟练掌握机器学习和深度学习的基本原理,熟悉常见的生成模型组件和框架,包括…
招聘城市:深圳
岗位职责:
1.负责构建基于大语言模型的 Agent 系统,并持续迭代优化其核心性能;
2.联动游戏策划与研发团队,推动 LLM 智能体在在线游戏环境中的工程落地,兼顾低延迟、低成本与高品质的玩家互动体验;
3.紧跟 LLM 在推理、规划、工具使用及记忆机制等方向的前沿技术发展,并针对游戏 Agent 场景进行定制化适配。
岗位要求:
1.扎实的机器学习与统计模型基础,深耕 NLP 相关领域并有成熟的项目经验;
2.具备优秀的编程能力,掌握至少一种编程语言,代码功底扎实,熟练使用常用算法与数据结构;
3.有AI、NLP顶会(如 NeurIPS, ICML, ICLR, ACL, EMNLP 等)顶刊学术成果发表者优先。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的…
招聘城市:北京
…视频的"AI感"、时序细节一致性、画质细节等关键问题;
3.探索并落地生成内容的精细化控制方案,提升模型输出的艺术表现力与商业可用性;
4.紧跟学术界与工业界最新研究进展,快速复现并评估 SOTA 算法,结合影视业务场景进行创新性改进,推动前沿技术向生产力转化;
5.与产品、工程、内容创作团队紧密协作,将算法能力转化为实际产品功能。
岗位要求:
1.计算机科学、人工智能或相关专业硕士及以上学历;
2.精通 Python,熟练掌握 PyTorch等深度学习框架,comfyui的使用,具备优秀的代码能力和工程实现能力;
3.具备扎实的深度学习基础,对diffusion、强化学习等AI技术有深刻的理解;
4.熟悉HunyuanVideo、wan2.2/2.5、SkyReels V2等视频生成…
招聘城市:深圳
岗位职责:
1.参与Coding方向的大模型算法研发,构建能够理解复杂代码任务,完成游戏场景软件工程任务的智能体系统;
2.提升Code Agent在代码能力、指令遵循、长程任务执行等方向上的核心能力;
3.参与大模型预训练与后训练优化,包括但不限于数据构建、SFT、RL算法、Reward设计,持续提升模型Coding能力;
4.构建面向游戏场景的评测体系与数据闭环,包括Benchmark、数据回流和针对性能力优化。
岗位要求:
1.硕士及以上学历,优秀的代码能力、精通常用数据结构和算法;
2.扎实的深度学习算法基础,熟悉深度学习框架和分布式训练推理加速;
3.出色的问题分析和解决能力,能深入解决大模型训练和应用存在的问题;
4.责任心强,良好的…
招聘城市:北京
…语言模型或相关方向具有研究或研发经验;
3.熟悉 Transformer、LLM、VLM 等模型架构,对多模态模型训练及后训练方法有较深入理解;
4.具备较强的算法研究、实验分析与工程实现能力,能够独立推动研究问题从定义到落地;
5.对多模态基础模型及视频智能方向有强烈兴趣,具备持续探索前沿问题的研究热情。
加分项:
1.有大规模 VLM / Video-LMM 训练或后训练经验;
2.有 SFT、RLHF、PPO、GRPO 等强化学习或大模型对齐经验;
3.在 CVPR、ICCV、ECCV、NeurIPS、ICLR、ACL、EMNLP 等顶级会议发表过相关工作;
4.有高质量开源项目、大规模视频数据建设或多模态评测体系经验;
5.有 Agentic Vision、长视频理解或多模态复杂推理相关研究经验…
招聘城市:深圳
岗位职责:
1.负责内容解析、质量权威性计算、领域分类、摘要抽取等内容理解模型的调研、设计和开发工作,构建财经、科技等垂直行业优质内容库;
2.针对搜索、AI问答等场景的业务目标、用户反馈问题进行拆解,设计优化内容理解特征、模型,提升业务效果;
3.跟进国内外LLM、RAG相关的前沿技术,结合搜索、AI问答等业务进行落地。
岗位要求:
1.信息检索、人工智能、计算机、自然语言处理等相关方向的硕士及以上学历;
2.优秀的算法和编程能力,熟悉python/go/C++等编程语言和至少一种深度学习框架(PyTorch/TensorFlow等;
3.具备搜索、推荐、LLM相关业务领域一年以上的研究和实践经验,在ACM、KDD、AAAI等学术会议或期刊以第一作者发表过论文者优先…
招聘城市:深圳
…4.能清晰了解模型的能力边界与局限,具备务实的技术验证能力与产品判断力;
5.具备较强的跨团队沟通与项目推进能力,能够与算法、引擎团队高效协作完成目标对齐与问题闭环;
6.对 AI 原生玩法、智能体、生成式内容等方向有强烈兴趣,具备较强的学习能力与主动探索精神。
加分项:
1.有 AI Agent、世界模拟、开放世界、沙盒、UGC、动态叙事相关经验;
2.参与过游戏生成、3D / 视频生成、智能 NPC、AI Companion 等项目;
3.有论文、技术博客、公开演讲或开源作品等技术影响力沉淀;
4.具备一定技术理解能力,能够理解模型基础原理与工程实现约束;
5.有复杂玩法系统或创作工具的设计经验,关注体验落地与长期迭代价值…
招聘城市:北京
岗位职责:
1.负责内容解析、质量权威性计算、领域分类、摘要抽取等内容理解模型的调研、设计和开发工作,构建财经、科技等垂直行业优质内容库;
2.针对搜索、AI问答等场景的业务目标、用户反馈问题进行拆解,设计优化内容理解特征、模型,提升业务效果;
3.跟进国内外LLM、RAG相关的前沿技术,结合搜索、AI问答等业务进行落地。
岗位要求:
1.信息检索、人工智能、计算机、自然语言处理等相关方向的硕士及以上学历;
2.优秀的算法和编程能力,熟悉python/go/C++等编程语言和至少一种深度学习框架(PyTorch/TensorFlow等;
3.具备搜索、推荐、LLM相关业务领域一年以上的研究和实践经验,在ACM、KDD、AAAI等学术会议或期刊以第一作者发表过论文者优先…
招聘城市:上海
…组织一致性校准,管理批次节奏与产能。
4.Agentic Flow 与成品内容创作
●持续做真实内容,反哺训练过程。
工作要求:
【我们在找的你】
1.对内容题材有过大量实践和创作经验。
你在熟知某个内容题材,包括但不限于:
●短剧、漫剧、动态漫、影视短片、动画 / ACG、广告与电商素材、知识科普与教程、泛娱乐内容。
岗位类型包括不限于:
●编导、导演、执行导演、AI 短剧/漫剧导演、后期剪辑、特效、摄影
●动画导演、分镜师、原画师、CG 美术
●声音设计、配乐、编曲、混音、拟音、音频后期
●内容创作者 / UP 主
2.熟悉 AI 内容工作流与工具链
●有 AI 模型的实际使用经验,用过多款视频/图像生成模型(Seedance / Kling / Vidu 等)与工具(即梦 / LibTV…
招聘城市:北京,上海
…人物/物体语义理解
5. 实现智能切片能力:从直播流/点播视频中自动定位高光片段,支持实时和离线两种模式
6. 将内容理解能力接入产品链路,包括直播封面、运营挖掘工具、创作者笔记诊断报告等
评测与工程
7. 构建流式视频评测体系,与人工标注对比,持续提升模型精度
8. 优化端到端推理延迟、显存占用和吞吐量,满足实时性要求
任职要求:
基础要求:
- 计算机、电子工程、自动化等相关专业硕士及以上学历
- 扎实的深度学习基础,熟悉 Transformer 架构、注意力机制、位置编码等核心技术
- 熟练掌握 PyTorch,具备独立复现/改进论文的能力
- 良好的代码工程能力,有大规模分布式训练经验优先
专业方向(满足其中一项即可):
- 有视频理解相关研究或工程经验(VideoLLM…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 构建高性能音视频理解 Pipeline,负责各类理解模型的推理、训练和持续优化。
2. 持续优化 Caption、Tag、PE、QA、Quality Assessment 等理解能力,提高数据生产质量。
3. 优化 CPU/GPU 推理效率,包括模型部署、Batching、Quantization、TensorRT、ONNX 等。
4. 持续优化各类专家模型,包括但不限于:
- Motion Detection
- Shot/Scene Cut Detection
- Artifact Detection
- Audio-Visual Sync
- OCR
- ASR
- Speaker Detection
- Quality Assessment
5. 与生成模型团队共同设计自动化数据生产 Pipeline,提升整体数据质量和处理效率。
工作要求:
任职要求
1. 熟悉 Transformer、Vision Transformer、多模态模型基础。
2. 熟悉 Qwen VL、Gemma、Gemini、SeedVL 等理解模型。
3. 熟悉 TensorRT、ONNX Runtime、CUDA Optimization。
4. 熟悉 FFmpeg、OpenCV、CUDA Video Codec。
5. 有千万级以上视频 Pipeline 经验。
我们希望你:
1. 不…
招聘城市:深圳
岗位职责:
1.负责内容解析、质量权威性计算、领域分类、摘要抽取等内容理解模型的调研、设计和开发工作,构建财经、科技等垂直行业优质内容库;
2.针对搜索、AI问答等场景的业务目标、用户反馈问题进行拆解,设计优化内容理解特征、模型,提升业务效果;
3.跟进国内外LLM、RAG相关的前沿技术,结合搜索、AI问答等业务进行落地。
岗位要求:
1.信息检索、人工智能、计算机、自然语言处理等相关方向的硕士及以上学历;
2.优秀的算法和编程能力,熟悉python/go/C++等编程语言和至少一种深度学习框架(PyTorch/TensorFlow等;
3.具备搜索、推荐、LLM相关业务领域一年以上的研究和实践经验,在ACM、KDD、AAAI等学术会议或期刊以第一作者发表过论文者优先…
招聘城市:上海
…条件参考生成、图像/视频/音频生成与编辑、视频超分、插帧补帧、人物形象一致性、多镜头融合、音画同步等核心技术模块。
4. 具备扎实的算法研究与迭代能力,擅长拆解多模态生成核心算法难题,可独立设计实验方案、分析算法case、提炼优化思路,持续完成模型算法效果迭代升级。
5. 可独立全权负责核心算法方向,覆盖算法问题定义、模型架构与算法方案设计、数据算法闭环、评测算法指标体系搭建、模型训练调优、算法效果验证与迭代全流程。
加分项
1. 具备大规模多模态生成模型完整训练、迭代及工业落地经验。
2. 熟悉CUDA/Triton、DeepSpeed、FSDP、Megatron、Ray、Slurm等高性能训练、推理及集群调度工具。
3. 拥有高质量AI开源项目、顶会论文、音视频生成优质…
招聘城市:深圳
…扎实的美术功底与独特创意,打造真正触动人心的视觉体验。这里有成熟的技术支持、丰富的项目机会,你的作品将随国民级游戏走进亿万玩家视野。加入我们,让艺术真正“玩”出价值。
部门介绍:
光子工作室群,一个对游戏狂热的全球知名开发团队,在全球10余个国家和地区研发布局,旗下包括《和平精英》《PUBG Moblie》《欢乐斗地主》《最强NBA》等超出50款端手游产品。多款产品曾获得超过15个奖项荣誉,其中,《PUBG Mobile》上线一周内登顶105个国家和地区App Store榜首。
光子为每位员工量身定制成长舞台,针对游戏策划有武林师徒项目、针对开发有程序精品课、针对美术有大咖沙龙;如果你怀抱游戏初心,可以借光子的大平台孵化…