默认:FunASR paraformer-zh + fsmn-vad + ct-punc。
JKINCO_ASR_MODEL_DIR 指向已有模型目录,跳过重复下载。默认:Ollama qwen2.5:7b-instruct。
| 硬件 | 推荐模型 | 体验 |
|---|---|---|
| 8GB 内存 | qwen2.5:3b / qwen3:4b |
可用,生成偏慢 |
| 16GB 内存 | qwen2.5:7b-instruct |
推荐默认 |
| 32GB 内存 / 8GB+ 显存 | qwen2.5:14b / qwen3:8b |
质量明显更好 |
| 64GB 内存 / 24GB+ 显存 | qwen2.5:32b |
接近商用质量 |
换模型:
OLLAMA_MODEL=qwen2.5:14b docker compose up -d
# 或手动模式
ollama pull qwen2.5:14b
也可以接入任意 OpenAI 兼容端点(vLLM、llama.cpp server、LM Studio),
只需在 .env 修改:
LLM_BASE_URL=http://127.0.0.1:8000/v1/chat/completions
LLM_MODEL_NAME=your-model-name
JKINCO_ASR_EXTRA_TERMS,顿号分隔;