关键词唤醒词(KWS)
配置
~/.zapmomo/settings.toml 的 [kws] 段配置项
配置
可在 ~/.zapmomo/settings.toml 中添加 [kws] 段覆盖默认值(全部可选):
[kws]
model_dir = "/path/to/model" # 模型目录(支持 ${env.VAR})
provider = "cpu" # 推理后端,默认 cpu
num_threads = 4 # 推理线程数,默认 2
chunk_size = 3200 # 每次喂给模型的采样数(@16k),默认 3200
sample_rate = 16000 # 模型输入采样率,默认 16000
keywords_score = 1.0 # 关键词 boosting 分数
keywords_threshold = 0.25 # 触发阈值:越大越不容易误触发(0.15~0.5)
encoder = "encoder-...-chunk-16-left-64.int8.onnx" # 模型目录内带 int8 变体可选
decoder = "decoder-...-chunk-16-left-64.onnx"
joiner = "joiner-...-chunk-16-left-64.onnx"
tokens = "tokens.txt"
keywords_file = "/path/to/keywords.txt" # 自定义关键词文件
debug = false默认文件名自动探测
encoder / decoder / joiner / keywords_file 未显式配置时,程序按 model_dir 内容自动探测:
- onnx 文件优先取默认名(zh-en 的 epoch-13 系列),不存在时扫目录内
{encoder,decoder,joiner}-*chunk-16*.onnx(排除.int8量化变体)按文件名排序取第一个; - 关键词文件按候选链探测:
test_wavs/keywords.txt(zh-en)→test_wavs/test_keywords.txt(wenetspeech / gigaspeech)→test_keywords.txt→keywords.txt; - 显式配置始终优先;在 GUI 中「切换模型」会自动重置这些文件级覆盖,交回自动探测。