ASR-demo/.env.example

56 lines
2.0 KiB
Bash
Raw Blame History

This file contains ambiguous Unicode characters!

This file contains ambiguous Unicode characters that may be confused with others in your current locale. If your use case is intentional and legitimate, you can safely ignore this warning. Use the Escape button to highlight these characters.

# 本地模型目录;服务启动时不会自动下载模型权重。
MODEL_DIR=models
# CAM++ 模型不在 model_manifest.json 默认目录时,可用此项指定其他本地路径。
# CAM_MODEL_PATH=iic/speech_campplus_sv_zh-cn_16k-common
# FunASR 流式 ASR 与 VAD 模型。
FUNASR_ASR_MODEL=paraformer-zh-streaming
FUNASR_VAD_MODEL=fsmn-vad
# Contextual 模型在 2-pass 最终识别时应用本会话热词,和流式首遍共享 GPU。
FUNASR_HOTWORD_ASR_MODEL=paraformer-zh-contextual
FUNASR_HOTWORD_ASR_MODEL_REVISION=v2.0.4
FUNASR_DEVICE=cuda:0
FUNASR_VAD_DEVICE=cpu
# FunASR 原生 WebSocket 服务使用的 CPU 工作线程数。
FUNASR_NCPU=4
# VAD 结束语音段前等待的静音时长:句子模式为 800 毫秒,段落模式默认保留 5 秒。
FUNASR_VAD_MAX_END_SILENCE_MS=800
FUNASR_VAD_PARAGRAPH_MAX_END_SILENCE_MS=5000
# 提高此阈值会过滤更多环境噪声,也可能漏掉较轻的语音。
FUNASR_VAD_SPEECH_NOISE_THRES=0.6
# FunASR Runtime WebSocket 流式与热词最终识别参数。
FUNASR_CHUNK_SIZE=0,10,5
FUNASR_CHUNK_INTERVAL=10
FUNASR_ENCODER_LOOK_BACK=4
FUNASR_DECODER_LOOK_BACK=1
FUNASR_FINALIZE_TIMEOUT_SECONDS=300
FUNASR_NATIVE_WS_HOST=127.0.0.1
FUNASR_NATIVE_WS_PORT=10095
# CAM++ 说话人聚类和会话身份参数。
FUNASR_SPEAKER_WINDOW_MS=1500
FUNASR_SPEAKER_HOP_MS=750
FUNASR_SPEAKER_BATCH_SIZE=16
FUNASR_SPEAKER_HISTORY_CHUNKS=128
FUNASR_SPEAKER_MATCH_THRESHOLD=0.6
FUNASR_SPEAKER_MERGE_THRESHOLD=0.78
FUNASR_MAX_SPEAKERS=15
FUNASR_SPEAKER_MIN_SEGMENT_MS=3000
# CAM++ 为必需模型。若需将 GPU 留给 ASR,可将 AUXILIARY_DEVICE 设为 cpu。
AUXILIARY_SERVICE_URL=http://127.0.0.1:8010
AUXILIARY_DEVICE=cuda:0
AUXILIARY_PRELOAD_KINDS=speaker_verification
# 标点模型为可选模型,默认在 CPU 上运行。
FUNASR_PUNC_DEVICE=cpu
# 前后端分别启动;前端会将 /ws 和 /api/stop 请求转发给后端。
FRONTEND_HOST=127.0.0.1
FRONTEND_PORT=8080
BACKEND_INTERNAL_URL=http://127.0.0.1:8082
WEB_HOST=0.0.0.0
WEB_PORT=8082
WEB_DISPLAY_HOST=127.0.0.1