拓达教育 Touchdown Education 拓达求职支持办公室Career Support Office touchdown.org.cn ↗
JobFinder为留学生筛选身份匹配的岗位

语音识别算法工程师-(深圳/南京)实习

vivo · 中国 · 7月30日 · 1个月前
评分
89
发布日期
7月30日 (1个月前)
内推
暂无
公司规模
10k+
行业
硬件电子

岗位描述

1、语音识别技术研发:设计并优化基于LLM的语音识别大模型,解决发音模糊、方言&口音、噪声环境(如会议室回声、环境杂音)、上下文幻觉的识别难题,提升识别准确率与响应速度;

2、说话人日志技术突破:研发前沿大模型说话人日志方案,突破角色分离效果上限;

3、流式识别技术预研:研发低延迟高精度流式识别大模型方案,解决低延迟识别不准确的问题;

4、技术调研与创新:关注语音技术领域前沿动态(如 ICASSP、INTERSPEECH顶会成果),调研行业先进方案,推动新技术(如多模态语音识别、语音对话)在业务中的试点与应用。

1、硕士及以上在读,计算机科学与技术、电子信息工程、自动化、人工智能、声学等相关专业,至少实习3个月,每周出勤5天;

2、掌握语音交互基础:了解信号处理等声学技术,了解语义VAD、打断检测、语音识别、合成、对话等前沿语音技术;

3、精通模型与算法:熟练使用PyTorch深度学习框架,深入掌握LLM ASR、LLM等前沿算法;

4、软技能要求:具备良好的问题分析与解决能力,能快速定位技术瓶颈;有较强的跨团队沟通能力,可高效协同产品、开发团队推进项目;对技术有热情,具备自主学习与创新意识;

5、加分项:

(1)有顶会(ICASSP/INTERSPEECH/NeurIPS/ICML 等)论文发表;

(2)精通实时语音交互系统研发;

(3)具备大规模语音数据处理(数据清洗、标注、增强)的实战经验;

(4)掌握多模态技术(如Qwen3 Omni),语音对话或熟悉前沿语音技术项目(如Qwen3 ASR/FireRedASR/Kaldi/K2等)。

加入我的投递 →