招聘城市:北京
…的通用视觉生成能力。主要工作包括但不限于:
1. 视觉全模态生成基座模型:设计和优化适用于图像、视频、音视频等多模态场景的统一生成基座模型架构;开展多模态、多任务联合训练与对齐(如图文、视听、动作等),提升模型的通用性与泛化能力;针对不同应用场景(如图像视频内容生成与编辑等)进行模型能力扩展与定制化优化。
2. 高效图像/视频Autoencoder与Tokenizer:研发高效压缩比、低失真度的图像/视频Autoencoder、Tokenizer 等表征模型,支持大规模训练与高吞吐推理;探索适用于长视频、多视角视频等场景的结构化表征方式(如时空Token、分层编码等),平衡压缩率与生成质量。
3. 高效生成与下一代生成架构探索:研究和实现高效的生成范式…
招聘城市:深圳
岗位职责:
负责微信视觉基座模型的核心技术研发与业务落地,构建统一的视觉理解与解析能力,支持在微信C端及视频号、公众号、微信小店等业务场景中的规模化应用。
岗位要求:
1.深度参与过业界主流视觉基础模型或多模态大模型的研发工作,系统理解整体技术架构与训练方法。
2.精通大规模模型训练范式,包括预训练(Pretraining)、监督微调(SFT)、多任务联合训练、蒸馏训练、后训练(如 RLHF/DPO 等),理解训练稳定性及效率优化方法。
3.熟悉视觉核心任务中的一种或多种,包括目标检测、分割、图片理解或视觉语言模型(VLM)等方向,熟悉 VLM for Grounding。
4.具备大规模数据构建与治理经验,熟悉自动标注、弱监督学习、数据蒸馏等…
招聘城市:北京,上海
…小红书下一代基座模型与 AI native 应用的构建中,通过多模
1、理解生成一体的对齐与优化(Post-Train):参与多模态大模型的 post-training 与对齐研究,围绕「理解 → 规划 → 生成」的一体化链路,提升模型在复杂指令理解、规划与工具调用、语义一致性、生成可控性、多轮编辑与用户意图对齐等方面的整体表现。
2、图像生成与编辑方向的对齐方法探索:深入研究图像生成模型(Text-to-Image / Image Editing 等)在真实使用场景中的失效模式,如语义偏移、指令遗漏、风格漂移、结构崩坏、幻觉生成等问题;探索并实践包括但不限于:
-SFT / Preference Learning / RL-based 方法在图像生成中的应用
-多模态 reward model 及 reward system 设计
-Spatial difusion model RL 算法设计及实验…
招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
岗位职责:
1.基座大模型(LLM)推理能力和通用能力的核心技术研发,包括数学推理、代码、逻辑推理、知识推理、创作、多轮对话、问答、翻译等任务的算法研发、优化,突破模型智力上限;
2.提升基座大模型在复杂场景的高阶处理能力,如多轮交互(复杂指令遵循、多轮对话、角色扮演等)、Agent 能力( 融合“思考模式”与“非思考模式”,实现自主、精准的函数与工具调用);
3.跟踪前沿技术,参与前沿算法研究,如研发更高效的强化学习(RL)训练算法、探索自适应思考深度的模型优化算法、探索提升思维链的 “智能密度” 的方法等,推动研究成果在业务场景的落地应用;
4.对于探索前沿技术有很好的热情,具备独立探索前沿技术的能力,有良好的团队协作和沟通能力…
招聘城市:北京
…核心算法研发,围绕“视觉输入—代码理解—代码生成—执行验证”完整链路,持续提升模型从界面、图表、文档、图像等视觉信息中理解结构并生成高质量代码的能力;
2.建设高质量数据体系:负责 Visual2Code 训练数据的设计、构建与迭代,包括真实数据挖掘、自动化数据合成、难度分层、质量过滤及数据配比等,建立覆盖多场景、多语言、多任务形态的数据生产与数据飞轮体系;
3.推进模型与算法创新:深入探索 Visual2Code 场景下的 SFT、强化学习、代码执行反馈、Verifier/Reward Model 等后训练方法,研究视觉理解、代码推理与执行反馈之间的协同机制,持续提升模型在复杂任务中的正确率、泛化能力与稳定性;
4.强化复杂视觉编程能力:聚焦视觉结构解析、布局理解、图表/文档理解、视觉逻辑…
招聘城市:上海
岗位职责:
1.负责视频生成技术研发,提出和实现最前沿的算法,推动相关算法在工业界和学术界的领先;
2.负责推动视频生成技术在实际应用领域的性能优化和落地,整体应用效果达到行业领先水平。
岗位要求:
1.计算机相关专业,硕士及以上学历;
2.有作为核心成员参与研发过行业内具有知名度及领先性的视频生成模型;
3.技术应用视野好,有作为负责人或核心推动生视频技术应用落地,达成行业标杆案例的经历;
4.在视频生成或编辑领域有发表过代表性工作,有发表在顶刊顶会的高引论文;
5.思维活跃,能快速学习新知识,对技术研发富有激情。
岗位介绍:
渴望为世界带来新意的人,早已对…
招聘城市:北京
岗位职责:
1.主导后训练研发体系:负责多模态大语言模型(VLM)的后训练(Post-training)全流程算法研发,深入探索 SFT 及强化学习对齐算法(如 RLHF、PPO、GRPO 等),持续逼近并提升视觉基座模型的能力上限;
2.攻坚视觉基础感知:致力于优化模型底层的视觉感知、细粒度理解与空间感知能力。前瞻性地探索包括“带图思考”在内的 Visual Agent 解决方案,赋予模型更深层次的物理世界理解与执行能力;
3.提高大模型可靠性:致力于大幅度降低多模态大模型幻觉。深入探究幻觉产生的本质,建设完善的幻觉检测链路,实施精细化的数据清洗策略,并主导研发基于强化学习的幻觉消除(Hallucination Removal)方案;
4.赋能用户交互场景:面向真实用户场景…
招聘城市:北京
…生成效率等上的问题,探索生成模型的突破性技术;
2.从事图像/音视频/多模态/3D视觉领域算法模型的训练和研发,应用于腾讯视频相关的内容创作和用户体验提升;
3.结合自有产品和业务需求,从生成模型迭代、可控模块研发,性能加速等方面优化模型,解决面向业务场景的应用和落地时的关键算法问题,并最终有效改善用户体验和生产效能,协助算法的产品化落地。
岗位要求:
1.计算机、人工智能、数学等相关专业的全日制本科(优先),研究生及以上学历;
2.具有扎实的计算机视觉或机器学习算法基础,有相关方向顶级论文者优先;
3.熟练掌握机器学习和深度学习的基本原理,熟悉常见的生成模型组件和框架,包括…
招聘城市:北京
…负责视觉算法的研发,与各类技术专家一起,探索计算机视觉、AIGC、多模态、人工智能等前沿技术;
2.结合业务场景,设计并预研简洁的技术方案;
3.推动前沿技术落地到地图多个产品,呈现一流的数字地图服务体验。
岗位要求:
1.硕士及以上学历,三年及以上工作经验,有较好的数学基础;
2.熟悉模式识别、机器学习理论基础,掌握计算机视觉领域内常用算法,在计算机视觉、AIGC、多模态、深度学习等专业领域有较深入的研究;
3.有较好的代码能力,熟练掌握C、C++、Python中的一种,熟悉linux下开发;
4.有端到端大模型经验者优先;在计算机视觉国际顶尖会议或期刊上发表过论文者优先;在计算机视觉知名竞赛…
招聘城市:深圳
岗位职责:
1.探索研究多模态理解、生成式、强化学习等前沿技术;
2.负责世界模型相关核心算法的研发与落地,包括但不限于视频生成、视频预测、视频编辑等方向;
3.探索面向游戏世界场景的新一代视频生成技术,构建具备可交互性、可编辑性、物理一致性和时空一致性的世界模型。
岗位要求:
1.人工智能、计算机科学、数学或相关专业,硕士及以上学历, 3+相关工作经验;
2.熟练掌握 PyTorch 等主流深度学习框架,具备扎实的编程能力与工程实现能力;能够高质量复现前沿论文,并推动算法从研究原型到工程实现;
3.深入理解 Diffusion Models、GANs、VAEs、Flow-based Models 等,具备图像生成或视频生成相关研究或实践经验;
4.有大规模 GPU 集群上的…
招聘城市:北京
…研发基于视觉大模型的AIGC算法,实现地图要素(尤其是建筑)的模型超分、风格化生成、材质替换与色彩增强;
2.利用文生图/图生图大模型,结合地理信息,为批量建筑自动生成符合语义、光照一致性的风格化纹理与材质;
3.针对特定风格(如卡通渲染、赛博朋克、水墨风)进行定向优化,实现城市级规模的一键换肤;
4.推动技术在产品中落地,解决生成内容的几何一致性、视觉舒适度与性能开销等挑战。
岗位要求:
1.本科及以上学历,工作经验5年以上,熟练掌握Python、PyTorch,具备扎实的CV/DL基础;
2.拥有使用Diffusion Model、GAN等生成模型进行图像生成、风格迁移、纹理合成的实际项目经验;
3.对3D计算机视觉和神经…
招聘城市:北京
…研发基于视觉大模型的AIGC算法,实现地图要素(尤其是建筑)的模型超分、风格化生成、材质替换与色彩增强;
2.利用文生图/图生图大模型,结合地理信息,为批量建筑自动生成符合语义、光照一致性的风格化纹理与材质;
3.针对特定风格(如卡通渲染、赛博朋克、水墨风)进行定向优化,实现城市级规模的一键换肤;
4.推动技术在产品中落地,解决生成内容的几何一致性、视觉舒适度与性能开销等挑战。
岗位要求:
1.本科及以上学历,工作经验5年以上,熟练掌握Python、PyTorch,具备扎实的CV/DL基础;
2.拥有使用Diffusion Model、GAN等生成模型进行图像生成、风格迁移、纹理合成的实际项目经验;
3.对3D计算机视觉和神经…
招聘城市:深圳
岗位职责:
1.作为视觉领域的专家,与其它模态研究者共同参与创新的原生多模态大模型研究,包括创新模型架构、“2D+时间”和“3D+时间”大模型建模等;
2.探索对真实物理世界进行理解和生成、多模态推理及自进化持续学习的大模型;
3.关注学术界和行业最新研究动态,参与国际会议、研讨会,与全球顶级团队交流合作;
4.将研究成果向社区发布或技术转移至内部产品部门。
岗位要求:
1.计算机科学、人工智能、计算机视觉、机器学习或相关领域的硕士或博士学位;
2.具备相关领域研究经验,熟悉主流技术,如在顶级会议或期刊发表过相关论文;
3.熟悉有关领域主流开源工具和框架,有匹配研究需要的工程能力;
4…
招聘城市:北京
…研发基于视觉大模型的AIGC算法,实现地图要素(尤其是建筑)的模型超分、风格化生成、材质替换与色彩增强;
2.利用文生图/图生图大模型,结合地理信息,为批量建筑自动生成符合语义、光照一致性的风格化纹理与材质;
3.针对特定风格(如卡通渲染、赛博朋克、水墨风)进行定向优化,实现城市级规模的一键换肤;
4.推动技术在产品中落地,解决生成内容的几何一致性、视觉舒适度与性能开销等挑战。
岗位要求:
1.本科及以上学历,工作经验5年以上,熟练掌握Python、PyTorch,具备扎实的CV/DL基础;
2.拥有使用Diffusion Model、GAN等生成模型进行图像生成、风格迁移、纹理合成的实际项目经验;
3.对3D计算机视觉和神经…
招聘城市:北京,上海
…实现自动化、智能化的视觉内容布局生成(如杂志、UI界面等);
3. 结合各业务场景下相关技术问题进行分析、算法设计,推动算法在工业级场景的部署与应用,沉淀在业界有影响力工作;
任职要求:
1. 计算机、数学、自动化、控制等相关专业;
2. 扎实的数学和算法基础:概率统计、数值优化等算法;
3. 扎实的编程基础:熟悉Pytorch、TensorFlow、MXNet等其中的一种或以上;
4. 了解前沿的Diffusion、LLM、VLLM算法,包括不限于StableDiffusion、Flux、Llama、QwenVL等;
5. 关注多模态生成领域的业界最新动态,如Midjourney、Runway、Recraft、可灵、即梦等;
6. 在CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、AAAI、ACL、EMNLP等顶级学术会议上发表论文者优先;
7. 有图文排版预估生成、中文场景文生…
招聘城市:深圳
岗位职责:
1.围绕图片生成丶视频生成等AIGC应用场景,探索与研究多模态理解丶多模态生成丶计算机视觉丶扩散模型等前沿技术,并形成可落地解决方案;
2.负责生图丶生视频算法的工程化与产品化落地,包括模型训练丶推理优化丶服务部署和在线迭代;
3.针对业务需求进行模型定制和能力改造,如风格化生成和角色一致性等;
4.跟踪多模态大模型与生成式AI领域的前沿进展(如新型扩散架构丶视频生成模型丶控制条件丶数据合成与对齐手段等),完成技术调研与评估,并推动在内部业务中的试点与落地。
岗位要求:
1.计算机科学或人工智能相关专业,硕士及以上学历;
2.3年…
招聘城市:深圳
岗位职责:
1.负责世界模型(World Model)相关核心算法的研发与落地,包括但不限于视频生成、视频预测、视频编辑等方向;
2.探索面向游戏世界场景的新一代视频生成技术,构建具备可交互性、可编辑性、物理一致性和时空一致性的世界模型。
岗位要求:
1.教育背景:人工智能、计算机科学、数学或相关专业,硕士及以上学历,博士优先;
2.编程能力:熟练掌握 PyTorch 等主流深度学习框架,具备扎实的编程能力与工程实现能力;能够高质量复现前沿论文,并推动算法从研究原型到工程实现;
3.满足以下任意一种技术栈要求:(1)生成模型:深入理解Diffusion Models, GANs, VAEs, Flow-based Models等,具备图像生成或视频生成相关研究或实践经验;(2)模型训练:有大规模 GPU…
招聘城市:深圳
…的质量和性能问题;
5.跟踪前沿技术(时空注意力、VAE优化、长视频生成等),在业务中落地创新方案。
岗位要求:
1.有工业界领先视频生成模型的预训练或后训练经验,实际交付过业务可用模型;
2.精通Diffusion Models、DiT架构,熟悉视频VAE;有大规模模型训练经验(分布式训练、混合精度、显存优化等);
3.熟练掌握SFT、RLHF等技术,有实际提升模型质量的成功案例;
4.熟悉PyTorch,有处理大规模视频数据的经验,能够解决训练稳定性、收敛速度等工程问题;
5.理解视频生成的业务场景和评估指标,能够平衡模型质量、训练成本和推理效率,快速迭代交付。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习…
招聘城市:广州
岗位职责:
1.计算机相关专业,熟悉深度学习、文生图生成式大模型;
2.对各种开源的大模型框架有了解,同时有预训练、多模态、生成等技术的真实落地经验并有深刻理解;
3.在NLP、机器学习等领域顶级学术会议发表过高质量文章,有ACM、kaggle等比赛获奖经历优先;
4.对搜索业务、多模态业务感兴趣,对技术工作有热情,具有较强的责任心和自驱力。
岗位要求:
1.参与微信表情搜索生成式模型研发,文生文,文生图方向;
2.基于开源模型微调、蒸馏,基于业务数据的基座与训练等。
岗位介绍:
渴望为世界带来新意的人,早已对描绘未来的“热词”不陌生——人工智能、机器学习、数据科学等等。腾讯…