牛大妈在社招职位搜索bilibili-音视频理解算法工程师 有 1000+ 条结果

招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 构建高性能音视理解 Pipeline,负责各类理解模型的推理、训练和持续优化。
2. 持续优化 Caption、Tag、PE、QA、Quality Assessment 等理解能力,提高数据生产质量。
3. 优化 CPU/GPU 推理效率,包括模型部署、Batching、Quantization、TensorRT、ONNX 等。
4. 持续优化各类专家模型,包括但不限于:
- Motion Detection
- Shot/Scene Cut Detection
- Artifact Detection
- Audio-Visual Sync
- OCR
- ASR
- Speaker Detection
- Quality Assessment
5. 与生成模型团队共同设计自动化数据生产 Pipeline,提升整体数据质量和处理效率。
工作要求:
任职要求
1. 熟悉 Transformer、Vision Transformer、多模态模型基础。
2. 熟悉 Qwen VL、Gemma、Gemini、SeedVL 等理解模型。
3. 熟悉 TensorRT、ONNX Runtime、CUDA Optimization。
4. 熟悉 FFmpeg、OpenCV、CUDA Video Codec。
5. 有千万级以上视频 Pipeline 经验。
我们希望你:
1. 不…
招聘城市:上海
工程化能力,保障数据供给的时效性与稳定性。
4. 设计并持续优化数据质量标准与监控体系,关注多模态、AIGC等前沿方向,结合业务场景探索音视数据采集与生产新模式。
工作要求:
任职要求:
1. 本科及以上学历,计算机、大数据、人工智能等相关专业者优先。
2. 具备扎实的Python/Go编程功底,精通Scrapy、Playwright、Selenium等主流框架。
3. 深入理解HTTP/HTTPS、WebSocket等网络协议,熟悉FFmpeg等音视处理工具。
4. 具备良好的数据合规意识,了解相关的法律边界,能够在保证数据安全的前提下高效完成采集任务。
加分项:
1. 有视频生成、多模态大模型数据工程或AI数据中台开发经验者优先。
2. 熟悉大模型数据清洗标准,了解如何使用Prompt工程
招聘城市:上海
生成算法效果落地与规模化最优迭代。
4. 自主设计系统性算法对照实验,深度复盘实验失败案例、定位算法缺陷与瓶颈,针对性优化模型生成精度、画面连贯性、音画一致性等核心指标,持续迭代升级生成算法能力。
工作要求:
任职要求
1. 本科及以上学历,计算机、人工智能、深度学习、多媒体技术等相关专业,具备扎实的深度学习、多模态生成技术功底。
2. 熟练掌握PyTorch框架及分布式训练技术,具备Diffusion model、MOE、VAE、SFT、RLHF、模型蒸馏中至少两项核心技术的落地实践经验。
3. 具备音视生成相关算法经验,精通多条件参考生成、图像/视频/音频生成与编辑、视频超分、插帧补帧、人物形象一致性、多镜头融合、音画同步等核心技术模块。
4. 具备扎实的算法
招聘城市:上海
…性能瓶颈(包括计算、通信、存储等),实施针对性优化,提升训练吞吐、稳定性与可扩展性。
3. 持续跟踪并集成业界前沿的训练优化技术(如 MoE、异步RL、LoRA RL、Agentic RL 等)。
工作要求:
1. 本科及以上学历,计算机相关专业,2年以上工作经验。
2. 熟悉 Python/C++ 中至少一种编程语言,具备扎实的工程基础。
3. 深入理解自然语言处理、计算机视觉或多模态算法,熟悉主流的 DiT(Diffusion Transformer) 与 VLM(Vision-Language Model) 模型架构,具备分布式训练(如 FSDP、DeepSpeed、Megatron 等)实战经验。
4. 熟悉常见强化学习训练算法(如 GRPO、DAPO 等)及训练框架(如 verl),熟悉异步强化学习范式。
5. 有相关领域开源项目贡献经验者优先。
6. 具备大规模训练实操经验者优先。
投递简历
招聘城市:上海
岗位介绍:
职位描述
工作职责:
【这个岗位在做什么】
我们在给视频生成基模建立评测能力:定义“什么是好视频内容”的标准,定义模型审美和及格线,你在创作过程里攒下的那些经验和直觉,在这里变成能被算法接住的输入和需求。
如果你现在做的是内容创意,这个岗位的区别是:你不只是模型的使用者,你也是标准的制定者,参与下一代模型能力的迭代。
【你会做什么】
1.Benchmark 出题与人工评测
●按能力维度构造题目,例如如何考察角色一致性、多镜头连贯、口型对齐、运镜、文字渲染、物理合理性、音画关系等等;定义评分维度、评分细则、并进行评价,输出结构化的报告。
2.把创作者需求翻译成模型…
招聘城市:上海
…与算法、数据、平台紧密配合,打造一套高效的训练生态,推动训练成本优化。
工作要求:
工作要求
1. 精通C++、Rust、Python等任意一门语言,C++更佳,具备良好的系统设计与工程实现能力。
2. 熟悉Megatron、DeepSpeed、PyTorch、FSDP等一种或者多种训练框架的底层原理。
3. 有真实GPU训练任务调优经验,解决过训练中出现过的慢节点、机器故障、网络拥塞等问题。
4. 在大规模训练任务中,有过算子调优、精度验证、CUDA优化、训练策略优化(ZeRO/TP/PP/DP/EP)等经验。
5. 有RDMA网络、高性能存储、NCCL通讯等方面的经验,熟悉Linux系统编程。
加分项
1. 社区开源训推框架贡献者,包括但不限于Megatron、DeepSpeed、SGLang、vLLM等;
2. 有大规模音视生成与理解
招聘城市:上海
…跨模态对齐、时序建模和语言建模有深入理解
4. 具有以下至少一个方向的研发经验:
- Omni Model、VLM 或多模态理解基础模型;
- VLM / LLM 预训练或后训练;
- 视频理解、视频 Caption 或视频推理;
- Reward Model、偏好对齐或强化学习;
- 视频生成或图像生成基础模型;
- 多模态 Agent、工具调用或任务规划。
5. 熟悉基础模型的数据构建、分布式训练、推理优化和模型评估流程。
6. 具备良好的工程能力、自驱力和协作能力,能够独立推进算法研发与实验迭代。
加分项
- 参与过大规模 VLM / LLM 的预训练或后训练。
- 具有多模态 SFT、RLHF、DPO、GRPO、RLAIF 或 Reward Model 经验。
- 具有视频生成、Diffusion 或 Flow Matching 相关经验。
- 具有长视频理解音视联合建模或多模态推理经验。
- 具有…
招聘城市:上海
…模型充满热情的资深算法工程,你将深度参与B站视频理解大模型的研发与落地。作为团队的核心技术骨干,你将负责从数据构建、模型训练到效果评估的全链路关键模块设计,推动模型能力在业务场景中的持续突破。
职位描述
工作职责:
1. 负责B站视频内容理解、互动内容(评论/弹幕)理解、用户建模等方向的学术研究与技术突破,跟踪领域前沿动态,主导核心技术选型与关键难题攻克,提升团队核心技术竞争力。
2. 基于已有多模态大模型(VLM、MLLM),结合站内海量数据,开展post-pretraining/continued pretraining等前沿技术研究,构建适配业务场景、高效统一的下一代模型架构或技术方案。
3. 深耕多模态大模型相关核心技术研发,重点探索视频内容理解
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1、 参与公司内容安全相关的AI算法设计与研发、并进行业务工程落地部署,岗位专注于内容理解大模型、多模态检索模型两个方向。
2、 参与相关学术研究并落地应用前沿技术。
工作要求:
1、有VLM/LLM学术、工业界SOTA、多模态检索的理论背景和实践经验;熟悉深度学习、机器学习算法,有数据挖掘、数据增强等经验。
2、熟练使用sql;熟练使用AI agent能力者优先
3、具备基本的后端服务开发知识。
4、具备比较强的论文复现能力,以及比较好的论文阅读习惯。
5、 加分项:a. 在nlp/cv领域的国际会议/期刊上一作发表论文、或相关国际比赛获奖;b. B站深度用户。
投递简历
招聘城市:上海
…暴力、敏感言论、涉政等违规内容的音频内容安全审核的核心算法开发
2、主导算法流程闭环:从数据标注策略制定、模型训练与优化、在线服务部署到效果评估与迭代,确保技术方案在真实业务场景中高效落地。
3、协同产品、安全运营、审核、合规等多团队,将算法能力转化为可解释、可运营、可追溯的风险治理策略,支撑平台内容生态的健康可持续发展。
工作要求:
1、ASR 与文本:熟悉语音识别全流程,掌握 Transformer/BERT 等架构,能独立完成敏感文本分类模型的训练与调优。
2、音频特征与安全识别:熟悉语种识别、声纹、音频指纹及色情音频识别技术,有相关算法落地经验。
3、大模型能力:熟悉主流音频/文本大模型架构,有 Prompt Engineering 或 LoRA/P-Tuning…
招聘城市:上海
…应用,推动多模态技术的深度融合;
4、深入研究端到端语音实时交互技术,解决跨语言理解、翻译与合成的关键问题,优化语音输入到多模态输出的全链路效果。
工作要求:
1、计算机科学、人工智能等相关领域博士学历;
2、拥有语音技术领域的研究或工作经验,熟悉多模态理解和生成原理,对大模型底层技术有深入理解,敢于挑战技术边界;
3、在ACM等相关编程竞赛中有突出表现或在GitHub上有影响力的开源项目,曾在InterSpeech、ICASSP等顶级会议上发表论文者优先考虑;
3、对端到端语音交互技术有深刻理解,跨语言语音处理技术有实际研究和开发背景,熟悉相关模型和技术栈者优先。
4、熟练使用AI agent…
招聘城市:深圳
岗位职责:
1.负责语音/音频大模型研发,包括音频理解(ASR/音频caption)、音视理解等模型研发;
2.负责预训练、后训练、强化学习(文本和音频强化)相关的数据、算法、评测工作;
3.负责音频理解/ASR模型开源以及产品落地(比如产品全链路端到端优化、音频理解在噪音/口音/远场/音效音乐场景的优化)。
岗位要求:
1.有语音识别、音频理解、音乐理解等相关经验者优先;
2.有音视多模态、大语言模型(预训练、微调、强化学习)等相关经验者优先;
3.优秀的代码能力、数据结构和算法功底,熟练掌握Python,熟悉Pytorch/Megatron/FSDP等模型训练框架、熟悉SLIME/VERL等RL框架优先;
4.有ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
5.在相关顶级会议…
招聘城市:北京,上海
…者笔记诊断报告等
评测与工程
7. 构建流式视频评测体系,与人工标注对比,持续提升模型精度
8. 优化端到端推理延迟、显存占用和吞吐量,满足实时性要求
任职要求:
基础要求:
- 计算机、电子工程、自动化等相关专业硕士及以上学历
- 扎实的深度学习基础,熟悉 Transformer 架构、注意力机制、位置编码等核心技术
- 熟练掌握 PyTorch,具备独立复现/改进论文的能力
- 良好的代码工程能力,有大规模分布式训练经验优先
专业方向(满足其中一项即可):
- 有视频理解相关研究或工程经验(VideoLLM、MLLM、Video QA、时序建模等),能独立跟进前沿工作
- 有长上下文/高效推理相关经验(KV Cache 优化、序列并行、量化、蒸馏等)
- 有在线视频理解或流式系统相关经验,了解实时推理系统架构…

小红书(xiaohongshu) 多媒体算法工程

全职 北京,上海,深圳
招聘城市:北京,上海,深圳
岗位职责:
1. 音视核心技术方向算法研发,包括:视频增强处理、音视编解码、创新视觉技术、音频音效算法以及传输算法
2. 面向短视频、直播、RTC、3D互动内容等场景,完成算法设计及工程化落地,优化内容消费流畅度、清晰度、音频纯净度、交互体验等关键指标,提升用户核心体验;
3. 参与算法评测体系搭建(包括视频增强效果、编码效率、音效质量评估等),保障算法的实现质量。
任职要求:
1. 1~8年音视相关算法研究经验;
2. 扎实的算法基础,熟悉音视处理、常见多媒体协议、网络传输技术等;
3. 熟悉FFMPEG、WebRTC等开源项目经验优先,具备并行计算开发及调优经验优先;
4. 核心技能(满足1-2项重点方向):视频增强与编解码、AIGC视觉生产、实时渲染、音频信号处理…
音视生成基础模型团队,正在致力于打造下一代多模态大模型,深耕音视生成与理解、基建与平台、多模态Agent、评测与内容、Agentic Data全链路,攻坚多模态内容生成领域的核心命题,驱动数据与模型相互迭代的增长飞轮。团队向全球热爱多模态AI的探索者发出邀约,一同探寻视听世界的数字奥秘,重新定义高价值音视内容的生产范式,用技术重塑内容创作,与亿万创作者共生。
招聘摘要: bilibili音视基础模型团队现面向全球进行社招、校招和实习招聘。团队致力于打造下一代多模态大模型,深耕音视生成与理解、基建与平台、多模态Agent、评测与内容、Agentic Data全链路。热招岗位包括音视生成算法工程音视
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 深入理解B站内容生态与外语内容市场,通过数据分析、用户调研、前沿技术理解等方式,找到最适合B站内容和生态的落地翻译场景和翻译策略,优化海外用户消费体验,对海外用户留存、活跃度及内容消费指标负责。
2. 负责AI翻译能力的持续建设与迭代,与AI团队深度协作,明确模型优化方向与业务目标,降低内容跨语言文化传播壁垒,精准传递UP主创作意图,提升跨语言内容消费体验。
3. 以社区共创价值出发,构建AI翻译工具能力,拓展应用场景边界、打造应用亮点,持续提升效果
工作要求:
1. B站资深用户,至少5年及以上产品经理经验,有AI产品相关经验优先。
2. 长期关注海内外互联网内容和…
招聘城市:上海
…和规范开展。
3.负责对接项目线上、线下宣发及衍生的执行和跟进,保证推广效果达到目标,活动落地顺利。
工作要求:
1.有一定广播剧相关经历,熟悉国内各大配音工作室和CV等;对配音、动画、PV、歌曲领域有一定了解,有画师、编剧、后期、PV资源。
2.有一定的项目经验或活动统筹经验,具有判断能力和把控能力;有想法、有见解、有审美能力;擅长与人沟通,综合能力强。
3.对于市场有敏感度,能及时把控当下主流渠道的流行趋势及用户喜好(B站、微博)。
4.能够在较大的工作压力下完成工作目标,分析问题及解决问题能力强,具有极强的时间管理能力和项目管理能力,善于沟通及把握机会。
投递简历
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 负责 B站国际化 AI 内容生态相关产品探索,深入理解内容生产、消费、讨论和学习场景,结合AI能力与B站内容生态特点,设计适合用户理解、使用和沉淀的产品能力。
2. 与 AI、算法、研发、内容、运营等团队协作,探索 AI 能力在内容生态中的落地场景和产品形态。
工作要求:
1. 5 年及以上产品经理经验,有 AI 产品、Agent、内容消费、知识学习、创作工具、工作流工具或社区产品经验优先。
2. 对 AI 技术发展高度敏感,熟悉大模型、Agent、Prompt、工作流、AI 工具生态,有原型验证或从 0 到 1 产品经验优先。
3. 理解内容平台和社区生态,具备强探索能力、抽象能力、用户洞察和跨团队推进能力,能在不确定场景…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
1. 深入理解B站内容生态与外语内容市场,通过数据分析、用户调研、前沿技术理解等方式,找到最适合B站内容和生态的落地翻译场景和翻译策略,优化海外用户消费体验,对海外用户留存、活跃度及内容消费指标负责。
2. 负责AI翻译能力的持续建设与迭代,与AI团队深度协作,明确模型优化方向与业务目标,降低内容跨语言文化传播壁垒,精准传递UP主创作意图,提升跨语言内容消费体验。
3. 以社区共创价值出发,构建AI翻译工具能力,拓展应用场景边界、打造应用亮点,持续提升效果。
工作要求:
1. B站资深用户,至少5年及以上产品经理经验,有AI产品相关经验优先。
2. 长期关注海内外互联网内容和…
招聘城市:上海
岗位介绍:
职位描述
工作职责:
核心职责
●人群判断:在科技、财商、心理领域,持续识别"塔尖型"人物——学术地位过硬的专家/学者,或有传播能力的媒体人、行业意见领袖
●邀约与建联:主导或参与目标人物的接触、说服、入驻推动,能讲清楚"为什么B站"“为什么现在”,去功利感地建立长期信任关系
●内容适配判断:与入驻名师共创内容形态(对谈、锐评、AI热点解读等),不追求大而全的选题矩阵,需找准1-2个能代表其专业身份的爆点
●业务判断:能完整描述业务逻辑,能对一次邀约、一次内容合作,给出清晰合理的业务判断(为什么找TA→怎么谈的→内容怎么落地→带来了什么)
工作要求:
任职要求
●对科技or财商or…