岗位描述(节选)
团队介绍
负责医疗语音大模型的研发和应用,覆盖语音前端DSP、3A、VAD、ASR、TTS等核心技术方向,并持续探索原生多模态等前沿技术方案,推动语音与多模态能力在医疗场景中的技术突破。
聚焦医疗健康领域核心场景,打造行业领先的AI产品,包括泛医疗助手、医护办事等应用,提升医疗行业用户体验与服务效率,助力支付宝医疗健康迈向智能化新时代。
研究和跟踪语音智能、大模型、多模态等前沿技术发展,探索AI助力医疗普惠、医疗服务智能化的新范式。
职位描述
负责医疗语音大模型及相关语音能力的评测体系建设,围绕S2T/ASR/TTS、语音通话、数字人、医疗语音交互等场景,设计评测方案、构建评测标准并持续优化。
结合业务目标与模型能力,定义核心评测指标,包括但不限于识别准确率、延迟、稳定性、自然度、可懂度、鲁棒性、安全合规性、医疗场景可用性等,并建立可量化、可追踪的评测机制。
负责搭建语音大模型离线评测、在……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。