whisper-v3模型部署环境执行

1. 安装whisperV3

  1. github git clone https://github.com/openai/whisper.git
  2. pip install -U openai-whisper
  3. pip install setuptools-rust
    这些都没有安装 但是github下载的版本是能执行成功的
  4. pip install accelerate
  5. pip install soundfile
  6. pip install librosa
  7. pip install torchaudio

requirements.txt

复制代码
numba
numpy
torch
tqdm
more-itertools
tiktoken
triton>=2.0.0,<3;platform_machine=="x86_64" and sys_platform=="linux" or sys_platform=="linux2"

github官方版本

要进到whisper目录里面, 执行脚本要和whisper/whisper目录同级。这样就执行成功了。

py 复制代码
import whisper

model = whisper.load_model("base")
result = model.transcribe("audio.mp3")
print(result["text"])

遇到的名词解释

1. 大模型的弱标签

在大模型中,弱标签(Weak Labels)通常指的是相对于强标签(Strong Labels)而言的标签类型。强标签是指对每个样本都有明确、准确的标签,可以直接用于训练模型的监督学习任务。而弱标签则指的是对样本的标签信息不够准确或完整,可能存在噪声、不确定性或模糊性。

弱标签可以是多种形式,常见的包括但不限于:

  1. 部分标签(Partial Labels):只对样本的部分特征或属性进行标记,而不是对整个样本进行标记。
  2. 噪声标签(Noisy Labels):由于标注过程中的错误或不确定性而产生的标签。
  3. 不确定标签(Uncertain Labels):对于某些样本标签的确定性不高,存在一定程度的不确定性。
  4. 模糊标签(Ambiguous Labels):标签含义不明确或模糊,可能存在多种解释或理解。

在使用弱标签进行训练时,通常需要采取一些特殊的处理方法来处理标签的不确定性和噪声,以提高模型的鲁棒性和泛化能力。这包括使用弱标签推理(Weak Label Inference)、噪声过滤(Noise Filtering)、半监督学习(Semi-Supervised Learning)等技术来充分利用弱标签信息进行模型训练。

参考文档

论文: https://cdn.openai.com/papers/whisper.pdf

whisper-v3 model-card https://huggingface.co/openai/whisper-large-v3

知乎胡儿 v3介绍 https://zhuanlan.zhihu.com/p/662906303

安装参考 https://zhuanlan.zhihu.com/p/666969310

github https://github.com/openai/whisper/blob/main/model-card.md

根据官方文档安装就可以了 https://github.com/openai/whisper/blob/main/README.md

官网 https://openai.com/research/whisper

相关推荐
2301_8092047015 小时前
JavaScript中严格模式use-strict对引擎解析的辅助.txt
jvm·数据库·python
zjy2777715 小时前
mysql如何选择合适的索引类型_mysql索引设计实战
jvm·数据库·python
Aaswk15 小时前
Java Lambda 表达式与流处理
java·开发语言·python
万邦科技Lafite15 小时前
京东item_get接口实战案例:实时商品价格监控全流程解析
java·开发语言·数据库·python·开放api·淘宝开放平台
Cyber4K16 小时前
【Python专项】进阶语法-系统资源监控与数据采集(1)
开发语言·python·php
苍煜17 小时前
Java开发IO零基础吃透:BIO、NIO、同步异步、阻塞非阻塞
java·python·nio
AllData公司负责人18 小时前
通过Postgresql同步到Doris,全视角演示AllData数据中台核心功能效果,涵盖:数据入湖仓,数据同步,数据处理,数据服务,BI可视化驾驶舱
java·大数据·数据库·数据仓库·人工智能·python·postgresql
Flittly19 小时前
【LangGraph新手村系列】(5)时间旅行:浏览历史、分叉时间线与修改过去
python·langchain
2301_7820404520 小时前
CSS Flex布局中如何实现导航栏与Logo的左右分布_利用justify-content- space-between
jvm·数据库·python
yaoxin52112320 小时前
400. Java 文件操作基础 - 使用 Buffered Stream I/O 读取文本文件
java·开发语言·python