# 本地模型目录;服务启动时不会自动下载模型权重。 MODEL_DIR=models # CAM++ 模型不在 model_manifest.json 默认目录时,可用此项指定其他本地路径。 # CAM_MODEL_PATH=iic/speech_campplus_sv_zh-cn_16k-common # FunASR 流式 ASR 与 VAD 模型。 FUNASR_ASR_MODEL=paraformer-zh-streaming FUNASR_VAD_MODEL=fsmn-vad # Contextual 模型在 2-pass 最终识别时应用本会话热词,和流式首遍共享 GPU。 FUNASR_HOTWORD_ASR_MODEL=paraformer-zh-contextual FUNASR_HOTWORD_ASR_MODEL_REVISION=v2.0.4 FUNASR_DEVICE=cuda:0 FUNASR_VAD_DEVICE=cpu # FunASR 原生 WebSocket 服务使用的 CPU 工作线程数。 FUNASR_NCPU=4 # VAD 结束语音段前等待的静音时长:句子模式为 800 毫秒,段落模式默认保留 5 秒。 FUNASR_VAD_MAX_END_SILENCE_MS=800 FUNASR_VAD_PARAGRAPH_MAX_END_SILENCE_MS=5000 # 提高此阈值会过滤更多环境噪声,也可能漏掉较轻的语音。 FUNASR_VAD_SPEECH_NOISE_THRES=0.6 # FunASR Runtime WebSocket 流式与热词最终识别参数。 FUNASR_CHUNK_SIZE=0,10,5 FUNASR_CHUNK_INTERVAL=10 FUNASR_ENCODER_LOOK_BACK=4 FUNASR_DECODER_LOOK_BACK=1 FUNASR_FINALIZE_TIMEOUT_SECONDS=300 FUNASR_NATIVE_WS_HOST=127.0.0.1 FUNASR_NATIVE_WS_PORT=10095 # CAM++ 说话人聚类和会话身份参数。 FUNASR_SPEAKER_WINDOW_MS=1500 FUNASR_SPEAKER_HOP_MS=750 FUNASR_SPEAKER_BATCH_SIZE=16 FUNASR_SPEAKER_HISTORY_CHUNKS=128 FUNASR_SPEAKER_MATCH_THRESHOLD=0.6 FUNASR_SPEAKER_MERGE_THRESHOLD=0.78 FUNASR_MAX_SPEAKERS=15 FUNASR_SPEAKER_MIN_SEGMENT_MS=3000 # CAM++ 为必需模型。若需将 GPU 留给 ASR,可将 AUXILIARY_DEVICE 设为 cpu。 AUXILIARY_SERVICE_URL=http://127.0.0.1:8010 AUXILIARY_DEVICE=cuda:0 AUXILIARY_PRELOAD_KINDS=speaker_verification # 标点模型为可选模型,默认在 CPU 上运行。 FUNASR_PUNC_DEVICE=cpu # 前后端分别启动;前端会将 /ws 和 /api/stop 请求转发给后端。 FRONTEND_HOST=127.0.0.1 FRONTEND_PORT=8080 BACKEND_INTERNAL_URL=http://127.0.0.1:8082 WEB_HOST=0.0.0.0 WEB_PORT=8082 WEB_DISPLAY_HOST=127.0.0.1