招聘城市:北京
…
3.跟踪Omni全模态模型、语音处理、LLM领域的前沿技术与研究成果(如NeurIPS、ICLR、ICASSP等顶会论文),结合业务需求开展技术预研与创新,将前沿技术落地到模型架构设计与对齐模块优化中,形成可复用的技术方案与工程化能力;
4.与工程、产品等跨团队协作,明确技术需求,推动模型架构方案的工程化落地,配合完成模型部署、性能调优及问题排查,支撑业务场景的规模化应用;沉淀模型架构设计文档、对齐技术规范及算法优化手册,保障技术可传承、可复用。
岗位要求:
1.熟悉Omni全模态模型的核心原理与架构设计,深刻理解端到端原生统一架构的设计逻辑,熟悉主流Omni模型(如Qwen3.5-Omni等)的架构特点与优化思路,具备…
招聘城市:深圳
岗位职责:
1.负责AI伙伴场景全模态大模型的架构设计、训练与落地,交付支持文本/语音/视觉输入、文本/语音输出的实时多模态对话模型,效果对标业界先进;
2.基于端到端全模态架构,设计并优化实时双流式推理范式下的多模态编解码器、跨模态融合方法与训练策略;
3.通过模态对齐训练、SFT、RL等后训练技术提升交互质量,重点优化语音自然度与情感、视觉理解的时序准确性、复杂指令遵循性,解决多模态对齐难题;
4.在实时多模态陪伴业务场景中落地模型并持续优化效果。
岗位要求:
1.具备工业界领先的全模态或音视频对话模型实际研发经验(如语音助手、实时视频理解与交互);
2.对数据理解深入,有大规…
招聘城市:北京,上海
…语言模型的重塑,突破逐个token预测的方式,实现高效的推理模式,探索全新scaling law;
2、实现大模型训练的数据清洗、合成和评估;设计和实现大模型训练的AI Infra框架。
任职要求:
1、本科及以上学历,计算机、人工智能和数学等相关专业,博士研究生优先;
2、熟练掌握扩散模型设计和使用技巧,在知名大模型公司/团队从事图像或视频生成者优先,有多模态/OMNI大模型理解&生成统一框架经验者优先;
3、有丰富的大模型预训练和后训练数据处理经验,熟练掌握数据收集、数据清洗、数据去重和数据合成等流程,能针对数据质量制定出评估指标和方法,在知名大模型公司/团队长期从事数据技术者优先;
4、MoE/Dense模型训练…
招聘城市:上海
岗位职责:
1.参与Omni原生多模态大模型的研发,包括训练数据的设计和构造,基础模型算法的设计和迭代,进行大规模SFT和RL训练调优等;
2.持续跟进业界最新的多模态大模型算法、强化学习算法,探索原生多模态模型、理解生成一体化模型的研发落地。
岗位要求:
1.计算机、人工智能等相关专业硕士以上学历;
2.有大规模强化学习、多模态理解基模研发相关经验者优先;
3.具有扎实的深度学习算法基础,熟悉深度学习框架和分布式训练推理加速,有实操经验者优先;
4.在多模态/CV/NLP等领域顶级会议(期刊)发表过论文、主导/参与业界知名的开源项目者优先;
5.具备极强的学习能力和技术追求,良好的…
招聘城市:北京
…指令微调或模型评测流程;
3.有 ASR 工程实践经验,熟悉 CTC、AED、Transducer、流式 ASR、动态 chunk、热词增强、ITN、VAD 等相关技术优先;
4.熟悉 PyTorch、Megatron、DeepSpeed、FSDP、vLLM 等训练或推理框架中的一种或多种,具备大规模训练/推理优化经验优先;
5.具备较强的工程实现能力和问题定位能力,能够独立完成从数据、训练、评测到部署的完整闭环;
6.有良好的沟通协作能力,能与工程、产品、数据团队共同推动复杂语音能力落地。
加分项:
1.有音频大模型、语音对话大模型、Omni 模型、SpeechLLM、AudioLLM 相关研发经验;
2.有大规模 ASR 系统、同声传译、全双工语音交互、端到端语音对话系统落地经验;
3.熟悉 Qwen、Whisper、FunASR、Paraformer、SenseVoice、CosyVoice、Qwen-Audio/Qwen-Omni 等模型或开源…
招聘城市:北京,上海
…的 AGI 和人文精神的烟火气交汇之处,我们真诚邀请对大模型 Omni Model 有热情的同学加入,共同打造更具影响力的智能系统。你会成为团队的一员,并和其他同事协作,共同研发 SOTA 的 Omni Model。期待你以务实和客观的科学态度来推进技术的进展,不被过往经验裹挟、不被主观偏好影响。期待你除了算法外仍然是为出色的工程师。期待你对技术有强烈的好奇心和开放心态。
区别于传统 ASR / TTS 级联技术,我们希望打造端到端的 Omni Model 在实时交互中释放大模型的智力水平,彻底改变以 Chatbot 文字为主的人机交互界面
岗位说明:你会负责围绕大模型 Omni Model 构建语音模态的相关研究工作,包括…
招聘城市:北京,上海
…模型的语音理解和表达能力。
2、基于 SOTA omni 基座模型,在语音、视觉、文本长序列混合后训练中,通过多种训练方法保证语音能力充分发挥的同时,又不削弱模型智商与图文表现。
3、构建语音质量与语义一致性的 Reward 模型;通过 RLHF/RLAIF/Self-Rewarding 以及 Session level RL 技术提升模型在实时对话中的语义、情绪理解能力,语音表达的自然度、逻辑一致性。
4、与工程、产品团队协同,把实验成果快速迁移到线上服务,并探索基于线上用户的语音交互反馈实现在线 RL 迭代提升。
任职要求:
1、有极强的问题分析和解决能力,开放心态,善于学习;
2、有语音领域相关经验,在某一方向有过较深入的研究和一线经验;对大模型…
招聘城市:上海
…以上学历。
2. 具备扎实的机器学习、深度学习和 Transformer 基础,熟练使用 PyTorch 等主流框架。
3. 熟悉多模态基础模型,对视觉编码、跨模态对齐、时序建模和语言建模有深入理解。
4. 具有以下至少一个方向的研发经验:
- Omni Model、VLM 或多模态理解基础模型;
- VLM / LLM 预训练或后训练;
- 视频理解、视频 Caption 或视频推理;
- Reward Model、偏好对齐或强化学习;
- 视频生成或图像生成基础模型;
- 多模态 Agent、工具调用或任务规划。
5. 熟悉基础模型的数据构建、分布式训练、推理优化和模型评估流程。
6. 具备良好的工程能力、自驱力和协作能力,能够独立推进算法研发与实验迭代。
加分项
- 参与过大规模 VLM / LLM 的预训练或后训练。
- 具有多模态 SFT、RLHF、DPO、GRPO…
招聘城市:北京
…7.具备较强的实验设计、问题定位和跨团队协作能力。
加分项:
1.有全双工语音对话基础模型从零到一预训练经验;
2.同时具备音频理解和音频生成模型预训练经验;
3.有大规模音频数据、十亿参数以上模型或 MoE 模型训练经验;
4.有语音 Tokenizer、长音频建模、流式模型或多模态统一建模经验;
5.在语音、音频或多模态方向发表过高质量论文,或有相关模型上线经验。
岗位介绍:
在腾讯,后台开发工程师不仅是“又快又稳”的问题解决专家,更是生态共创者。你将与技术团队一同沉淀优质代码,让它成为我们共有的宝贵资产。在不同的业务场景和技术发展阶段,你的架构思维也将帮助更多协作团队拓展新…
招聘城市:深圳
…算子性能与模型部署优化中
2. 对当前常见的开源 AIGC 模型和框架,如 HunyuanVideo、Wan、LTX、ComfyUI 等,有推理调优经验
3. 熟悉 Linux 系统与分布式环境部署调试,熟悉 Python 开发
4. 具有良好的沟通能力,能够与算法侧、业务侧顺畅协作
5. 愿意探索和尝试新技术,对 AI 落地应用与提效有热情与愿景
加分项:
1. 有国产 GPU / NPU 加速卡上 AIGC 大模型的部署优化经验,有 Triton、CUDA 等的算子开发与调优经验
2. 了解 Sglang Diffusion、VLLM Omni、LightX2V 等 AIGC 推理框架
3. 对自回归视频生成模型、扩散语言模型、视觉统一理解生成模型有优化经验,了解 AIGC 大模型的业界动态与趋势
4. 有 AI Agent 提效的工程化落地…
招聘城市:北京
…1.跟踪业界最新的语音生成算法研究,探索下一代语音、音频生成新范式,拓展语音生成边界能力;
2.探索多模态语音大模型的前沿技术,结合文本、语音、视觉等技术提升语音交互体验;
3.负责语音大模型的技术研发工作,推动模型性能提升与创新应用。
岗位要求:
1.计算机科学、人工智能、电子工程、信号处理等相关专业硕士、博士研究生;
2.掌握语音大模型、语音合成、语音识别、音频生成、语音转换、语音Codec等一项或多项研究和开发经验;
3.熟悉主流对话大模型(如GPT4o、GLM-4-Voice、Qwen2.5-Omni、Voila等),有相关项目实践经验者优先;
4.熟练掌握PyTorch等深度学习框架,有大模型训练框架Megatron/Deepspeed实践经验者优先;
5.熟悉大模型相关结构设计及原理…