当前最新版本:v2.5.5,已经上传到pypi,有需要的同学可以下载安装来体验一下。 安装:pip install oddasr运行:oddasrDemo: http://localhost:9002 默认启动只支持2路实时转写,再加1路离线转写。可通过自行修改配置文件中的最大实例数来放大。 自定义配置启动 项目地址:https://github.com/oddmeta/oddasr文档地址:https://oddmeta.net/docs/oddasr/ 一、本次更新的亮点 本周的核心工作集中在说话人分离(Speaker Diarization)的配置化与请求级可控上,同时围绕实时转写首字时延 / 返回速度、低配硬件可运行性、Web 前端体验做了多处优化,并修复了 WebSocket 在 HTTPS 环境下的兼容性问题。 这个版本里主要是这几个功能: 二、新功能(Feat) 下面是更新的具体的新功能。 1. 说话人分离 4 个核心参数落地 新增 preset_spk_num / max_num_spks / merge_thr / spk_mode 四参数,打通了 配置文件 → 离线转写 API → Web 前端 的完整链路。 参数 默认值 作用 对应 FunASR 内部机制 preset_spk_num 0 […]
说话人分离
1 post