语音识别 (ASR)

目标

集成 Paraformer 模型,WAV 音频精准转写为带标点文本。

实现

基于 Eclipse RCP 技术框架开发,企业级应用的技术。
核心组件

  • 前端框架:Eclipse SWT(Standard Widget Toolkit)
  • 推理后端:ONNX Runtime
  • 语音识别模型:Paraformer 等 ONNX 编码器-解码器
  • 语音活动检测:VAD 模型(Silero VAD)
  • 标点恢复模型:基于 BART 的中文标点预测模型(punctuation-zh-bart)

语音识别 (ASR)


应用下载

相关推荐
还不秃顶的计科生10 分钟前
具身智能论文学习1:PaLM: Scaling Language Modeling with Pathways
人工智能·语言模型·palm
qq_4542450313 分钟前
Agent数据价值分类存储原则
大数据·人工智能·分类
怪奇云呼军14 分钟前
从声音特征到 CRM 回流:闪电智能 Voice Agent 沟通策略自适应系统 v1 实战
android·人工智能·python·音视频·语音识别
Python私教14 分钟前
AI 并行编码的 Worktree 生命周期:创建、隔离与安全回收
人工智能·git
ZhengEnCi26 分钟前
什么是 SFT 监督微调:大模型从只会续写到会听话的关键一步
人工智能
桃西西呀40 分钟前
你的 AI Agent 真的会做题吗?Harbor评测框架帮你测评
人工智能
Python私教44 分钟前
AI Agent 可观测性实战:从 correlationId 到失败时间线
人工智能·后端
Dave1205461 小时前
AI Agent学习 Day14:LangGraph进阶 —— 条件分支、Tool Node与Memory持久化
人工智能·学习
乱世刀疤1 小时前
深度 | 美国AI开始攻击真人
人工智能
qq_25294131681 小时前
列车车轮缺陷智能检测数据集:800张图像、4大类别,助力铁路安全运维
运维·人工智能·安全·yolo·目标检测·计算机视觉·视觉检测