音视频·2026年6月19日语音识别系统介绍自动语音识别(ASR)的基本原理与技术演进,涵盖语音分帧、时频分析、频谱与语谱图、Filter Bank、Log-Mel、MFCC 等声学表示,以及模板匹配、DTW、HMM-GMM、DNN-HMM、CTC、Attention、Transformer 和 Conformer 等典型识别方法与模型。0 字 · 1 分钟
音视频·2025年3月10日技术选型与部署从工程落地角度比较 Web 语音系统的主要技术方案,涵盖浏览器原生语音能力、开源语音模型、云语音服务,以及浏览器端、本地服务、云端服务和混合部署方式,并结合实时性、准确率、成本、隐私、资源需求与开发复杂度分析不同方案的适用场景。0 字 · 1 分钟
音视频·2023年2月28日语义理解与任务处理介绍语音识别结果进入业务系统后的理解与执行过程,涵盖用户意图识别、实体与槽位提取、上下文与多轮对话管理、任务路由、业务接口调用,以及大语言模型、检索增强和工具调用在现代语音交互系统中的作用与实现方式。0 字 · 1 分钟