AIM ASR 是一个面向会议、访谈、培训、媒体资料和业务录音的语音内容处理平台。系统基于 FunASR 构建,将以下两项能力作为同等重要、相互独立的核心功能: 实时转写:通过 WebSocket 持续接收麦克风或音频设备的实时音频流,边说边显示文字,并可使用 2pass 模式对流式结果进行校正。 上传音视频转文字:通过 REST API 上传已有音频或视频文件,以后台任务方式完成媒体转换、整文件识别、说话人分段、声纹匹配、翻译和结果整理。 两条链路共用会议管理、热词、说话人声纹库、翻译、会议纪要、Word/PDF 导出和资料归档能力,但使用不同的传输协议、任务状态、模型实例和处理参数。上传识别不是实时转写的“文件输入模式”,
-
Updated
Jul 10, 2026 - Python