162 lines
8.0 KiB
Bash
162 lines
8.0 KiB
Bash
# Qwen3-ASR 环境变量覆盖示例
|
||
# 复制为 .env 后,只取消你需要修改的项的注释即可。
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 仅在需要 API Key 鉴权时开启。
|
||
# -----------------------------------------------------------------------------
|
||
# API_KEY=your_api_key_here
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# Docker / 部署入口配置。
|
||
# -----------------------------------------------------------------------------
|
||
# NGINX_PORT:宿主机暴露的 Nginx 端口。
|
||
# NGINX_PORT=17003
|
||
# ASR_IMAGE:离线包或自定义部署时使用的镜像标签。
|
||
# ASR_IMAGE=unis/qwen3-asr:gpu-latest
|
||
# ASR_VISIBLE_DEVICES:统一可见卡编号配置,多个用逗号分隔;程序会按当前 accelerator 自动映射到底层变量。
|
||
# ASR_VISIBLE_DEVICES=0
|
||
# METAX_DRI_DEVICE:沐曦 / MuXi 需要映射的 DRI 设备路径。
|
||
# METAX_DRI_DEVICE=/dev/dri
|
||
# METAX_MXSMI_PATH:沐曦 / MuXi 的 mx-smi 工具路径。
|
||
# METAX_MXSMI_PATH=/opt/mxdriver/bin/mx-smi
|
||
# METAX_PRIVILEGED:沐曦 / MuXi 容器是否以 privileged 方式运行。
|
||
# METAX_PRIVILEGED=false
|
||
# ILUVATAR_USR_SRC:天数 / Iluvatar 容器内 usr/src 挂载路径。
|
||
# ILUVATAR_USR_SRC=/usr/src
|
||
# ILUVATAR_LIB_MODULES:天数 / Iluvatar 容器内模块目录挂载路径。
|
||
# ILUVATAR_LIB_MODULES=/lib/modules
|
||
# ILUVATAR_DEV:天数 / Iluvatar 设备目录挂载路径。
|
||
# ILUVATAR_DEV=/dev
|
||
# ILUVATAR_HOME:天数 / Iluvatar 主目录挂载路径。
|
||
# ILUVATAR_HOME=/home
|
||
# ILUVATAR_DATA:天数 / Iluvatar 数据目录挂载路径。
|
||
# ILUVATAR_DATA=/data
|
||
# MTHREADS_DEV:摩尔线程 / Moore Threads 设备目录挂载路径。
|
||
# MTHREADS_DEV=/dev
|
||
# MTHREADS_USR_SRC:摩尔线程 / Moore Threads 容器内 usr/src 挂载路径。
|
||
# MTHREADS_USR_SRC=/usr/src
|
||
# MTHREADS_LIB_MODULES:摩尔线程 / Moore Threads 容器内模块目录挂载路径。
|
||
# MTHREADS_LIB_MODULES=/lib/modules
|
||
# MTHREADS_HOME:摩尔线程 / Moore Threads 主目录挂载路径。
|
||
# MTHREADS_HOME=/home
|
||
# MTHREADS_DATA:摩尔线程 / Moore Threads 数据目录挂载路径。
|
||
# MTHREADS_DATA=/data
|
||
# MODEL_STORAGE_DIR:模型宿主机挂载目录。
|
||
# MODEL_STORAGE_DIR=/opt/dep/asr/models
|
||
# DATA_STORAGE_DIR:业务数据宿主机挂载目录。
|
||
# DATA_STORAGE_DIR=/opt/dep/asr/data
|
||
# NGINX_RATE_LIMIT_RPS:Nginx 全局限流,单位为每秒请求数。
|
||
# NGINX_RATE_LIMIT_RPS=0
|
||
# NGINX_RATE_LIMIT_BURST:Nginx 全局突发限流额度,0 表示自动按 RPS 处理。
|
||
# NGINX_RATE_LIMIT_BURST=0
|
||
# ASR_DEPLOY_TOPOLOGY:部署拓扑,isolated=每卡一个实例,sharded=单实例多卡分片,auto=优先 sharded 失败回退 isolated。
|
||
# ASR_DEPLOY_TOPOLOGY=isolated
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 运行时模型选择。
|
||
# 留空 QWEN3_ASR_MODEL 时会自动选择。
|
||
# 支持值:qwen3-asr-0.6b、qwen3-asr-1.7b
|
||
# -----------------------------------------------------------------------------
|
||
# ACCELERATOR:加速后端类型,常见值有 auto、cpu、nvidia、metax、iluvatar、mthreads。
|
||
# ACCELERATOR=auto
|
||
# DEVICE:具体运行设备,常见值有 auto、cpu、cuda:0。
|
||
# DEVICE=auto
|
||
# QWEN3_ASR_MODEL:手动指定离线识别模型,留空则自动挑选。
|
||
QWEN3_ASR_MODEL=qwen3-asr-0.6b
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 模型下载 / 缓存行为。
|
||
# 在 Docker Compose 中,默认宿主机挂载目录是 /opt/dep/asr/models。
|
||
# 实际模型目录通常位于:
|
||
# /opt/dep/asr/models/Qwen
|
||
# /opt/dep/asr/models/iic
|
||
# /opt/dep/asr/models/damo
|
||
# -----------------------------------------------------------------------------
|
||
# MODELS_DIR:项目主模型目录。
|
||
# MODELS_DIR=/opt/dep/asr/models
|
||
# MODELSCOPE_CACHE:ModelScope 缓存根目录,下面会生成 models/{publisher}/{model}。
|
||
# MODELSCOPE_CACHE=/opt/dep/asr
|
||
# MODELSCOPE_PATH:ModelScope 实际模型目录,建议保持在 models 目录下。
|
||
# MODELSCOPE_PATH=/opt/dep/asr/models
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 说话人注册 / pgvector 数据库配置。
|
||
# 表结构与 Model-Test-New 保持一致:speakers(id, name, user_id, embedding)。
|
||
# -----------------------------------------------------------------------------
|
||
# SPEAKER_DB_ENABLED:是否启用说话人库与 pgvector 检索。
|
||
# SPEAKER_DB_ENABLED=true
|
||
# DB_HOST:PostgreSQL 主机地址。
|
||
# DB_HOST=127.0.0.1
|
||
# DB_PORT:PostgreSQL 端口。
|
||
# DB_PORT=5432
|
||
# DB_USER:PostgreSQL 用户名。
|
||
# DB_USER=postgres
|
||
# DB_PASSWORD:PostgreSQL 密码。
|
||
# DB_PASSWORD=postgres
|
||
# DB_NAME:PostgreSQL 数据库名。
|
||
# DB_NAME=asr_db
|
||
# SV_MODEL:说话人识别模型。
|
||
# SV_MODEL=iic/speech_campplus_sv_zh-cn_16k-common
|
||
# SV_THRESHOLD:说话人相似度阈值,越大越严格。
|
||
# SV_THRESHOLD=0.6
|
||
# TEMP_DIR:临时文件目录。
|
||
# TEMP_DIR=/opt/dep/asr/data/temp
|
||
# LOG_FILE:日志文件路径。
|
||
# LOG_FILE=/opt/dep/asr/data/logs/qwen3-asr.log
|
||
# TASK_STATE_DIR:任务状态持久化目录。
|
||
# TASK_STATE_DIR=/opt/dep/asr/data/tasks
|
||
# TASK_RETENTION_HOURS:任务结果保留时间,单位小时。
|
||
# TASK_RETENTION_HOURS=24
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# CPU Rust 后端覆盖配置。
|
||
# 一般不需要改;自动检测会检查 vendor/qwenasr/target/{release,debug}。
|
||
# -----------------------------------------------------------------------------
|
||
# QWENASR_LIBRARY_PATH:手动指定 libqwen_asr.so 的绝对路径。
|
||
# QWENASR_LIBRARY_PATH=/absolute/path/to/libqwen_asr.so
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 调优参数。除非你在做特定瓶颈测试,否则建议保持默认。
|
||
# -----------------------------------------------------------------------------
|
||
# REALTIME_STREAM_CHUNK_SEC:Qwen 流式解码间隔;0.6 秒参考 FunASR 每 10 个 60ms 音频帧解码一次。
|
||
# Qwen 每次解码会复用累计音频,缩短该值会降低显示延迟,也会增加推理开销。
|
||
# REALTIME_STREAM_CHUNK_SEC=0.6
|
||
# REALTIME_STREAM_MAX_PENDING_CHUNKS:Qwen 流式状态保留的待修订块数。
|
||
# REALTIME_STREAM_MAX_PENDING_CHUNKS=3
|
||
# REALTIME_ENABLE_VAD:启用 FSMN-VAD 流式端点和气泡时间边界。
|
||
# REALTIME_ENABLE_VAD=true
|
||
# REALTIME_VAD_CHUNK_MS:每次送入 FSMN-VAD 的音频块长度;参考 FunASR 示例使用 200ms。
|
||
# REALTIME_VAD_CHUNK_MS=200
|
||
# REALTIME_VAD_PRE_ROLL_MS:检测到语音起点时保留的前置音频,避免切掉首字。
|
||
# REALTIME_VAD_PRE_ROLL_MS=600
|
||
# ASR_BATCH_SIZE:批处理大小,表示一次并行推理的片段数。
|
||
# ASR_BATCH_SIZE=4
|
||
# ASR_ENABLE_WORD_TIMESTAMPS:是否启用字词级时间戳。
|
||
# ASR_ENABLE_WORD_TIMESTAMPS=false
|
||
# MAX_SEGMENT_SEC:离线 ASR 单段最大时长,单位秒。
|
||
# MAX_SEGMENT_SEC=60
|
||
# QWEN_RUST_CPU_WORKERS:Qwen Rust CPU 后端 worker 数。
|
||
# QWEN_RUST_CPU_WORKERS=4
|
||
# QWEN_RUST_ASR_CONCURRENCY:Qwen Rust ASR 并发数,0 通常表示自动。
|
||
# QWEN_RUST_ASR_CONCURRENCY=0
|
||
# QWEN_RUST_ALIGN_CONCURRENCY:Qwen Rust 对齐并发数,0 通常表示自动。
|
||
# QWEN_RUST_ALIGN_CONCURRENCY=0
|
||
# QWEN_GPU_MEMORY_UTILIZATION:GPU 显存使用比例。
|
||
# QWEN_GPU_MEMORY_UTILIZATION=0.9
|
||
# QWEN_VLLM_ENFORCE_EAGER:是否强制 vLLM eager 执行;国产卡/稳定优先建议 true,NVIDIA 性能测试可设 false。
|
||
# QWEN_VLLM_ENFORCE_EAGER=true
|
||
# QWEN_FORCE_ALIGNER_GPU_MEMORY_UTILIZATION:forced aligner 预留的显存比例。
|
||
# QWEN_FORCE_ALIGNER_GPU_MEMORY_UTILIZATION=0.15
|
||
# ASR_ENABLE_NEARFIELD_FILTER:是否启用近场/远场过滤。
|
||
# ASR_ENABLE_NEARFIELD_FILTER=true
|
||
# ASR_NEARFIELD_RMS_THRESHOLD:近场判断的 RMS 能量阈值。
|
||
# ASR_NEARFIELD_RMS_THRESHOLD=0.01
|
||
|
||
# -----------------------------------------------------------------------------
|
||
# 仅用于本地开发调试。
|
||
# -----------------------------------------------------------------------------
|
||
# LOG_LEVEL:日志级别。
|
||
# LOG_LEVEL=INFO
|
||
# FUNASR_STARTUP_UI:FunASR 启动界面模式。
|
||
# FUNASR_STARTUP_UI=auto
|