53 lines
1.8 KiB
Bash
53 lines
1.8 KiB
Bash
# 本地模型目录;服务启动时不会自动下载模型权重。
|
||
MODEL_DIR=models
|
||
# CAM++ 模型不在 model_manifest.json 默认目录时,可用此项指定其他本地路径。
|
||
# CAM_MODEL_PATH=iic/speech_campplus_sv_zh-cn_16k-common
|
||
|
||
# FunASR 流式 ASR 与 VAD 模型。
|
||
FUNASR_ASR_MODEL=paraformer-zh-streaming
|
||
FUNASR_VAD_MODEL=fsmn-vad
|
||
FUNASR_DEVICE=cuda:0
|
||
FUNASR_VAD_DEVICE=cpu
|
||
# FunASR 原生 WebSocket 服务使用的 CPU 工作线程数。
|
||
FUNASR_NCPU=4
|
||
|
||
# VAD 结束语音段前等待的静音时长:句子模式为 800 毫秒,段落模式默认保留 5 秒。
|
||
FUNASR_VAD_MAX_END_SILENCE_MS=800
|
||
FUNASR_VAD_PARAGRAPH_MAX_END_SILENCE_MS=5000
|
||
# 提高此阈值会过滤更多环境噪声,也可能漏掉较轻的语音。
|
||
FUNASR_VAD_SPEECH_NOISE_THRES=0.6
|
||
|
||
# FunASR 原生 WebSocket 流式识别参数。
|
||
FUNASR_CHUNK_SIZE=0,10,5
|
||
FUNASR_CHUNK_INTERVAL=10
|
||
FUNASR_ENCODER_LOOK_BACK=4
|
||
FUNASR_DECODER_LOOK_BACK=1
|
||
FUNASR_FINALIZE_TIMEOUT_SECONDS=300
|
||
FUNASR_NATIVE_WS_HOST=127.0.0.1
|
||
FUNASR_NATIVE_WS_PORT=10095
|
||
|
||
# CAM++ 说话人聚类和会话身份参数。
|
||
FUNASR_SPEAKER_WINDOW_MS=1500
|
||
FUNASR_SPEAKER_HOP_MS=750
|
||
FUNASR_SPEAKER_BATCH_SIZE=16
|
||
FUNASR_SPEAKER_HISTORY_CHUNKS=128
|
||
FUNASR_SPEAKER_MATCH_THRESHOLD=0.6
|
||
FUNASR_SPEAKER_MERGE_THRESHOLD=0.78
|
||
FUNASR_MAX_SPEAKERS=15
|
||
FUNASR_SPEAKER_MIN_SEGMENT_MS=3000
|
||
|
||
# CAM++ 为必需模型。若需将 GPU 留给 ASR,可将 AUXILIARY_DEVICE 设为 cpu。
|
||
AUXILIARY_SERVICE_URL=http://127.0.0.1:8010
|
||
AUXILIARY_DEVICE=cuda:0
|
||
AUXILIARY_PRELOAD_KINDS=speaker_verification
|
||
# 标点模型为可选模型,默认在 CPU 上运行。
|
||
FUNASR_PUNC_DEVICE=cpu
|
||
|
||
# 前后端分别启动;前端会将 /ws 和 /api/stop 请求转发给后端。
|
||
FRONTEND_HOST=127.0.0.1
|
||
FRONTEND_PORT=8080
|
||
BACKEND_INTERNAL_URL=http://127.0.0.1:8082
|
||
WEB_HOST=0.0.0.0
|
||
WEB_PORT=8082
|
||
WEB_DISPLAY_HOST=127.0.0.1
|