语音识别踩坑记录

本来想在原来的语音识别的基础上增加本地扩展本地词典,

采用的语音识别是Vosk识别器,模型是 vosk-model-small-cn-0.22

cs 复制代码
// 初始化Vosk识别器
if (recognizer == null)
{
    using (Model model = new Model(modelPath))
    {
        string grammar = @"{""root"": [""你好"", ""退出"", ""电视剧"", ""我有一个朋友"", {""早上好"" : 0.5}]}";
        recognizer = new VoskRecognizer(model, 16000.0f, grammar);
        //recognizer = new VoskRecognizer(model, 16000.0f);

    }
}

注释掉的是原来能用的创建对象,但是增加了词典后直接报内存错误。

经过搜索

解决 System.AccessViolationException 内存错误的逐步指南


🔍 原因分析

此错误通常由 非托管内存操作越界 引起,常见于 Vosk 等依赖本地库的调用场景。可能触发条件:

  1. 1.模型文件损坏 或路径错误
  2. 2.音频数据格式 不匹配(采样率/位深度)
  3. 3.对象生命周期管理 不当导致提前释放资源
  4. 4.跨线程访问 非托管代码未同步

✅ 解决方案步骤

    1. 验证模型完整性
    • 重新下载模型(推荐使用 Vosk 中文模型 0.22
    • 确认解压后目录结构完整(应有 am, conf, graph 等子目录)
    • 代码中绝对路径访问:
    复制代码
      string modelPath = @"D:\models\vosk-model-cn-0.22"; // 避免中文和空格
      Model model = new Model(modelPath);

结论:

本来想弄小模型 vosk-model-small-cn-0.22 40m的语音识别,但这个小模型的功能局限性强,不能增加本地词典。

还是得下载1.5G的vosk-model-cn-0.22 模型。

相关推荐
Niuguangshuo11 小时前
论文解读:Deep Speech 2,工业级英中端到端 ASR 系统报告
算法·音视频·语音识别
星野云联AIoT技术洞察12 小时前
RK3588 边缘 AI 盒子适合什么工业视觉场景
计算机视觉·边缘计算·rk3588·语音识别·图像识别·边缘网关·边缘计算盒子
Niuguangshuo12 小时前
论文解读:Qwen2-Audio,阿里的通用音频语言模型
算法·音视频·语音识别
Niuguangshuo15 小时前
论文解读:w2v-BERT,把 wav2vec 2.0 和 BERT 合成一根管子的语音 SSL
算法·音视频·语音识别
2601_9605544715 小时前
开会不用手写纪要|飞书妙记、讯飞听见、通义听悟、智在记录测评
语音识别
Niuguangshuo16 小时前
论文解读:Paraformer,非自回归中文 ASR 的并行 Transformer
算法·音视频·语音识别
VIP_CQCRE17 小时前
用 Ace Data Cloud 快速接入 OpenAI 语音识别:一行 base_url 改造,让音频转文字更简单
ai·openai·api·语音识别·acedatacloud
smartpi_ai19 小时前
离线语音模块能当麦克风用吗?识别与录音的两套逻辑、“150 条“的词数语义与中英文切换固件的两条路径
嵌入式硬件·语音识别
糖糖单片机设计2 天前
基于STM32的远程宠物自动投喂系统
人工智能·stm32·51单片机·语音识别·智能硬件
smartpi_ai2 天前
CI-73T 的三个串口怎么分?下载口固定的引脚账本、词条 150 条的“词数“口径与硬 PWM 控舵机的性能边界
单片机·嵌入式硬件·语音识别