JKinco Listen · 筑听(开源本地版)

本地模型指南

语音识别(ASR)

默认:FunASR paraformer-zh + fsmn-vad + ct-punc

大模型(LLM)

默认:Ollama qwen2.5:7b-instruct

硬件 推荐模型 体验
8GB 内存 qwen2.5:3b / qwen3:4b 可用,生成偏慢
16GB 内存 qwen2.5:7b-instruct 推荐默认
32GB 内存 / 8GB+ 显存 qwen2.5:14b / qwen3:8b 质量明显更好
64GB 内存 / 24GB+ 显存 qwen2.5:32b 接近商用质量

换模型:

OLLAMA_MODEL=qwen2.5:14b docker compose up -d
# 或手动模式
ollama pull qwen2.5:14b

也可以接入任意 OpenAI 兼容端点(vLLM、llama.cpp server、LM Studio), 只需在 .env 修改:

LLM_BASE_URL=http://127.0.0.1:8000/v1/chat/completions
LLM_MODEL_NAME=your-model-name

质量建议