招聘城市:上海
…模型训练与优化、在线服务部署到效果评估与迭代,确保技术方案在真实业务场景中高效落地。
3、协同产品、安全运营、审核、合规等多团队,将算法能力转化为可解释、可运营、可追溯的风险治理策略,支撑平台内容生态的健康可持续发展。
工作要求:
1、ASR 与文本:熟悉语音识别全流程,掌握 Transformer/BERT 等架构,能独立完成敏感文本分类模型的训练与调优。
2、音频特征与安全识别:熟悉语种识别、声纹、音频指纹及色情音频识别技术,有相关算法落地经验。
3、大模型能力:熟悉主流音频/文本大模型架构,有 Prompt Engineering 或 LoRA/P-Tuning 微调经验。
4、熟练使用sql;熟练使用AI agent能力者优先
5、加分项:有实时音频流处理项目经验;有大规模模型…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、 参与公司内容安全相关的AI算法设计与研发、并进行业务工程落地部署,岗位专注于内容理解大模型、多模态检索模型两个方向。
2、 参与相关学术研究并落地应用前沿技术。
工作要求:
1、有VLM/LLM学术、工业界SOTA、多模态检索的理论背景和实践经验;熟悉深度学习、机器学习算法,有数据挖掘、数据增强等经验。
2、熟练使用sql;熟练使用AI agent能力者优先
3、具备基本的后端服务开发知识。
4、具备比较强的论文复现能力,以及比较好的论文阅读习惯。
5、 加分项:a. 在nlp/cv领域的国际会议/期刊上一作发表论文、或相关国际比赛获奖;b. B站深度用户。
投递简历
招聘城市:上海
…一位对多模态大模型充满热情的资深算法工程师,你将深度参与B站视频理解大模型的研发与落地。作为团队的核心技术骨干,你将负责从数据构建、模型训练到效果评估的全链路关键模块设计,推动模型能力在业务场景中的持续突破。
职位描述
工作职责:
1. 负责B站视频内容理解、互动内容(评论/弹幕)理解、用户建模等方向的学术研究与技术突破,跟踪领域前沿动态,主导核心技术选型与关键难题攻克,提升团队核心技术竞争力。
2. 基于已有多模态大模型(VLM、MLLM),结合站内海量数据,开展post-pretraining/continued pretraining等前沿技术研究,构建适配业务场景、高效统一的下一代模型架构或技术方案。
3. 深耕多模态大模型相关核心技术研发…
招聘城市:上海
…学习在语音大模型场景中的应用,推动多模态技术的深度融合;
4、深入研究端到端语音实时交互技术,解决跨语言理解、翻译与合成的关键问题,优化语音输入到多模态输出的全链路效果。
工作要求:
1、计算机科学、人工智能等相关领域博士学历;
2、拥有语音技术领域的研究或工作经验,熟悉多模态理解和生成原理,对大模型底层技术有深入理解,敢于挑战技术边界;
3、在ACM等相关编程竞赛中有突出表现或在GitHub上有影响力的开源项目,曾在InterSpeech、ICASSP等顶级会议上发表论文者优先考虑;
3、对端到端语音交互技术有深刻理解,跨语言语音处理技术有实际研究和开发背景,熟悉相关模型和技术…
招聘城市:北京
岗位职责:
1.研发具备通用能力的端到端语音大模型,包括多语种语音识别、语音合成、声纹识别、副语言信息理解等;
2.推动上述语音技术与团队内部大语言模型 (LLM) 的深度融合,参与设计和实现智能语音交互系统架构;
3.在微信AI探索业务中,基于微信场景数据提供技术解决方案,探索业界前沿技术在业务中的落地与指标优化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、数字信号处理或相关领域的专业背景;
2.深入理解语音音频信号处理、声学建模、语言模型和大模型架构;
3.在语音合成、语音识别、声纹识别中至少一个领域有深入研究和扎实的实践经验;熟悉多个领域者优先;
4.有实际推动大模型在语音识别、合成…
招聘城市:北京
岗位职责:
1.研发具备通用能力的端到端语音大模型,包括多语种语音识别、语音合成、声纹识别、副语言信息理解等;
2.推动上述语音技术与团队内部大语言模型 (LLM) 的深度融合,参与设计和实现智能语音交互系统架构;
3.在微信AI探索业务中,基于微信场景数据提供技术解决方案,探索业界前沿技术在业务中的落地与指标优化。
岗位要求:
1.硕士或博士学位,机器学习、人工智能、数字信号处理或相关领域的专业背景;
2.深入理解语音音频信号处理、声学建模、语言模型和大模型架构;
3.在语音合成、语音识别、声纹识别中至少一个领域有深入研究和扎实的实践经验;熟悉多个领域者优先;
4.有实际推动大模型在语音识别、合成…
招聘城市:北京
…算法研发,包括 声学模型、声码器、Voice Cloning 等;
3.推动语音合成技术在实时对话、客服、社交、教育等业务场景中的落地与优化;
4.负责大规模语音数据处理与训练体系建设,包括数据清洗、评测、训练;
5.跟踪语音生成领域前沿技术,包括 Flow Matching、 DiTAR、DiT、多模态语音生成等方向。
岗位要求:
1.计算机、人工智能、通信等相关专业,3年+ TTS方向工作经验,硕士及以上学历;
2.熟悉 TTS 基础理论与主流模型,包括 FastSpeech、VITS、CosyVoice 等;
3.精通 Python,熟悉 Linux 与深度学习框架,如 PyTorch 或 TensorFlow;
4.具备语音大模型训练、多语种 TTS 或大规模语音数据处理经验优先;
5.熟练使用 AI Coding 工具或 Coding Agent 辅助研发,具备通过 AI 工具提升代码开发、实验迭代、问题排查和工程…
招聘城市:北京
…算法研发,包括 声学模型、声码器、Voice Cloning 等;
3.推动语音合成技术在实时对话、客服、社交、教育等业务场景中的落地与优化;
4.负责大规模语音数据处理与训练体系建设,包括数据清洗、评测、训练;
5.跟踪语音生成领域前沿技术,包括 Flow Matching、 DiTAR、DiT、多模态语音生成等方向。
岗位要求:
1.计算机、人工智能、通信等相关专业,3年+ TTS方向工作经验,硕士及以上学历;
2.熟悉 TTS 基础理论与主流模型,包括 FastSpeech、VITS、CosyVoice 等;
3.精通 Python,熟悉 Linux 与深度学习框架,如 PyTorch 或 TensorFlow;
4.具备语音大模型训练、多语种 TTS 或大规模语音数据处理经验优先;
5.熟练使用 AI Coding 工具或 Coding Agent 辅助研发,具备通过 AI 工具提升代码开发、实验迭代、问题排查和工程…
招聘城市:上海
…用大模型与算法能力,深度服务内容创作与社区互动;也用技术驱动商业增长、产品体验与效率革新。没有空泛概念,只做真实可感的落地;不搞复杂套路,只和热爱技术、喜欢内容的伙伴一起,把创意变成产品,把专业变成影响力。我们希望你 High Agency:有好奇心,想象力,打破常规的勇气。热招岗位技术类:AI Agent 全栈研发工程师、大模型平台开发工程师(调度/训练/agent)、直播AI Agent全栈研发工程师、资深算法工程师(多模态视频生成/视频理解方向)、语音大模型算法工程师、游戏算法工程师(大模型方向)、高级LLM/VLM算法工程师(内容安全/机审方向)、搜索/推荐/游戏安全算法工程师、资深AI Infra工程师(推理/训练)、大模型…
招聘城市:深圳
…负责大模型后训练全流程建设,包括但不限于 SFT、Preference Learning / RL、数据构建、数据编排、评测体系设计与效果迭代;
3.负责多模态交互能力建设,结合语音、文本、图像等模态,设计轻量级模型路由、模态分流与协同推理方案,兼顾效果、延迟与设备功耗;
4.参与大模型算法前沿研究,结合业务需求推动创新方案落地,沉淀可复用的方法论、平台能力和技术成果,形成内部核心竞争力。
岗位要求:
1.计算机、人工智能、自动化、数学等相关专业硕士及以上学历,基础扎实,具备优秀的算法分析与工程实现能力;
2.熟悉大语言模型训练与后训练流程,具备 SFT、DPO / PPO / RLHF / RLAIF 等至少一个方向的实际经验,能够独立完成数据、训练、评测、调优闭环;
3.在模型高效…
招聘城市:深圳
…1.负责语音/音频大模型研发,包括语音对话(语音交互/音视频对话)、音频理解(ASR/音频caption)、音频生成(TTS/视频配音)等模型研发;
2.负责语音/音频大模型的预训练、后训练、强化学习(文本和音频强化)相关的数据和算法工作;
3.负责语音对话/音频理解/音频生成的模型开源以及产品落地(比如语音对话产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化、语音合成在播报/闲聊/游戏/社交等场景的优化)。
岗位要求:
1.有语音对话、语音合成、语音识别、音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/Megatron/DeepSpeed等模型训练框架,有…
招聘城市:深圳
岗位职责:
1.负责语音/音频大模型研发,包括音频理解(ASR/音频caption)、音视频理解等模型研发;
2.负责预训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视频多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:北京
…多模态理解等任务,研发业界领先的多模态大模型;
2.持续跟进业界最新的多模态大模型算法,参与多模态大模型的设计、训练、调优及评测工作,并推进多模态大模型在业务场景的应用落地。
岗位要求:
1.计算机科学、机器学习、人工智能、应用数学等相关专业,硕士及以上学历;
2.在多模态理解相关领域(包括自然语言处理、计算机视觉、语音理解/生成等)有扎实的研究基础,熟悉一个或多个模态领域的主流模型和算法,如CLIP、LLAVA、VALL-E等;
3.熟悉深度学习框架,如TensorFlow或Pytorch;了解分布式训练框架,如Deepspeed和Meatron-LM等,并有一定的多机多卡分布式训练经验;
4.较强的工程实现能力,熟练掌握C…
招聘城市:深圳
岗位职责:
1.负责AI伙伴场景全模态大模型的架构设计、训练与落地,交付支持文本/语音/视觉输入、文本/语音输出的实时多模态对话模型,效果对标业界先进;
2.基于端到端全模态架构,设计并优化实时双流式推理范式下的多模态编解码器、跨模态融合方法与训练策略;
3.通过模态对齐训练、SFT、RL等后训练技术提升交互质量,重点优化语音自然度与情感、视觉理解的时序准确性、复杂指令遵循性,解决多模态对齐难题;
4.在实时多模态陪伴业务场景中落地模型并持续优化效果。
岗位要求:
1.具备工业界领先的全模态或音视频对话模型实际研发经验(如语音助手、实时视频理解与交互);
2.对数据理解深入,有大规…
招聘城市:北京,上海
…语音能够增强理解;
具备多模态输入的推理能力,模型能够无偏地利用 context 中不同模态的信息进行高质量的结构化推理,解决复杂问题。
视觉生成基础
具备高质量多模态输入的图片生成模型,提升真实感、一致性和复杂度;
具备强可控与可编辑的能力,支持多种控制方式并保持编辑前后的一致性;
探索 Diffusion 理论,在生成效率和效果上追求 10x 提升的架构创新。
音频生成基础
具备高质量多模态输入的音频生成模型,包括人声、哼唱、音乐、General Audio;
具备强可控和可编辑的能力,支持对音色/风格/情绪/语速等多种维度及其复合要求进行可控编辑;
探索端到端统一表征,追求 learnability / quality / compression 的极致 trade-off 优化。
生成与理解统一模型…
招聘城市:北京,上海,杭州
…人文训练师及数据团队,把研究成果迅速推向真实场景,打造小红书下一代战略级 AI native 应用产品
任职要求:
任职资格:
1、硕士及以上学历,计算机等相关专业方向优先;
2、扎实机器学习与深度学习基础,熟练掌握PyTorch / JAX / TensorFlow等任一框架;
3、熟悉后训练常用技术(SFT、RLHF / DPO / RLAIF 等)或具备相关项目 / 竞赛 / 论文经验;
4、具备实验设计与问题定位能力,能独立分析大模型在不同数据分布和任务场景下的表现;
5、善于沟通和团队协作,乐于在快速迭代中分享想法、推动落地。
【加分项】
1、有深度参与贡献的顶会(ICML / NeurIPS / ICLR / ACL / CVPR 等)论文;
2、ACM-ICPC、NOI/IOI、Kaggle 等竞赛奖项;
3、参与过开源 / 闭源大模型的 Alignment / Post-Training…
招聘城市:成都
…的算法设计与优化;
3.探索音频大模型在企业办公场景的创新应用,推动模型训练、微调及端侧部署落地;
4.跟进语音/音频领域前沿技术进展(Whisper、SpeechGPT 等),持续提升核心指标与用户体验;
5.与客户端、后台团队协作,完成算法从原型验证到工程化落地的全链路交付。
岗位要求:
1.计算机、信号处理、电子工程等相关专业,硕士及以上学历,3年以上语音/音频算法开发经验;
2.熟悉 ASR、TTS、声纹识别、说话人分离等至少一个方向的核心算法原理与工程实现;
3.熟练使用 PyTorch/TensorFlow 等深度学习框架,具备模型训练、微调(SFT)、强化学习(RLHF/DPO)等实践经验;
4.具备音频信号处理基础,熟悉特征提取、降噪、回声消除等前处理技术;
5.对音频/语音领域…
招聘城市:北京
岗位职责:
1.负责语音识别大模型研发,提高噪声/小声/远场/口音/方言等复杂声学条件下识别鲁棒性;
2.负责语音识别语音-文本多模态大模型的研发,融合领域知识,用户行为与实时信息,提高大模型的上下文建模与逻辑推理能力;
3.负责语音识别大模型预训练,后训练、强化学习相关的数据和算法工作。
岗位要求:
1.有语音识别、语音合成、语音文本多模态、大语言模型(预训练、微调、强化学习和推理优化)等相关经验者优先;
2.优秀的代码能力、数据结构和算法功底,熟练掌握Python或C/C++,熟悉Pytorch/DeepSpeed等模型训练框架;
3.在相关顶级会议或期刊(如NeurIPS/ICLR/ICML/ACL/CVPR/ICASSP/INTERSPEECH等)有论文发表者优先;
4.具备扎实的数学和…
…移动电源、星巴克保温杯中选择一份奖品,礼品共限量10份,按推荐简历顺序结算。招聘职位:大模型算法工程师任职资格:硕士及以上学历,计算机相关专业,3年以上相关经验;熟悉常用机器学习和深度学习图像处理算法,掌握最新SOTA实现,熟练使用任一种深度学习开源框架,能独立负责算法的设计、研发、优化等工作;熟悉Python、C/C++等编程语言,具有出色的代码实现能力;有大语言模型、多模态大模型、视觉语言模型等相关经验者优先。岗位职责:负责多模态大模型领域的研究和算法、模型开发工作;监控场景图像视频分析算法开发,开展场所、装备等目标检测及特征提取、跟踪、识别的算法研究;负责语音/声音降噪相关的算法模块的研发、优化、测试…
招聘城市:北京,上海,广州,杭州,深圳
…厂热招职位放送-算法专场
公司名称: 滴滴出行科技有限公司(滴滴)
公司行业: 互联网
公司标签: 民企,高新技术企业
公司简介: 滴滴出行是全球领先的移动出行平台,提供网约车、出租车、顺风车、共享单车、代驾、货运、金融等多元化服务。公司致力于通过科技创新提升出行效率与体验,推动智慧交通发展。
招聘摘要: 滴滴出行科技有限公司 - 小桔“职位闪送”算法专场 社会招聘公告滴滴出行诚邀算法精英加入!本次“小桔‘职位闪送’算法专场”聚焦前沿技术方向,开放数十个高价值算法岗位,覆盖大模型、AI应用、风控、感知、国际化等多个核心领域。一、招聘岗位(部分列举)高级算法工程师(国际化定价团队、安治算法等)(高级)算法专家-供给策略资深语音/反欺诈…