招聘城市:北京
…模型在复杂场景下的理解、识别和交互能力;
3.负责大模型训练与微调工作,包括预训练、SFT、偏好优化、多模态对齐、音频 encoder 与 LLM 融合等方向探索;
4.推进 ASR 工程化落地,包括流式识别、实时上屏、上下文增强、热词/专有词优化、长语音识别、端侧/云侧推理等能力建设;
5.跟进语音与多模态大模型前沿技术,结合业务场景完成技术选型、效果优化和线上落地。
岗位要求:
1.具备扎实的机器学习、深度学习和语音信号处理基础,熟悉 ASR、音频理解或语音对话相关技术;
2.有大模型训练经验,熟悉 LLM / 多模态大模型的预训练、SFT、RLHF/DPO/PPO、指令微调或模型评测流程;
3.有 ASR 工程实践经验,熟悉 CTC、AED、Transducer、流式 ASR…
…模型在复杂场景下的理解、识别和交互能力;
3.负责大模型训练与微调工作,包括预训练、SFT、偏好优化、多模态对齐、音频 encoder 与 LLM 融合等方向探索;
4.推进 ASR 工程化落地,包括流式识别、实时上屏、上下文增强、热词/专有词优化、长语音识别、端侧/云侧推理等能力建设;
5.跟进语音与多模态大模型前沿技术,结合业务场景完成技术选型、效果优化和线上落地。
岗位要求:
1.具备扎实的机器学习、深度学习和语音信号处理基础,熟悉 ASR、音频理解或语音对话相关技术;
2.有大模型训练经验,熟悉 LLM / 多模态大模型的预训练、SFT、RLHF/DPO/PPO、指令微调或模型评测流程;
3.有 ASR 工程实践经验,熟悉 CTC、AED、Transducer、流式 ASR…