模型配置与 VAD 加速器
8大阵营 / 13款模型
综合王:阿里开源多语言识别模型,支持中英日韩粤语,自带情绪标签与笑声、背景事件检测。
0.50
实时录音与音频输入
00:00
点击麦克风开始录音,再次点击停止并识别
📁 拖拽本地音频文件到此处 (WAV / MP3 / M4A / FLAC) 或 点击浏览
识别结果 (Transcription):
等待音频输入...
音频总时长
--
有效语音: --
VAD 拦截与跳过
--
VAD耗时: --
ASR 纯推理耗时
--
全链路: --
实时率 (RTF)
--
越低性能越快
云函数常驻内存
--
1024MB 红线安全