SenseVoice 音频转文字&情绪识别 - python 实现

具体代码实现如下:

python 复制代码
from funasr import AutoModel
from funasr.utils.postprocess_utils import rich_transcription_postprocess

path_audio = "emo/happy.mp3"# 音频文件
# 加载模型
model_dir = "iic/SenseVoiceSmall"
model = AutoModel(
    model=model_dir,
    trust_remote_code=True,
    remote_code="./model.py",
    vad_model="fsmn-vad",
    vad_kwargs={"max_single_segment_time": 30000},
    device="cuda:0",
    cache_dir = "./ckpt"
)
# 模型预测识别
res = model.generate(
    input=path_audio,
    cache={},
    language="auto",  # "zn", "en", "yue", "ja", "ko", "nospeech"
    use_itn=True,
    batch_size_s=60,
    merge_vad=True,  #
    merge_length_s=15,
)
# text = rich_transcription_postprocess(res[0]["text"])
print("音频文件:{}".format(path_audio))
print("识别预测结果:{}".format(res[0]["text"]))

脚本运行log如下:

python 复制代码
音频文件:emo/happy.mp3
识别预测结果:<|zh|><|HAPPY|><|Speech|><|withitn|>你好,见到你很高兴。

​​​

助力快速掌握数据集的信息和使用方式。

数据可以如此美好!

相关推荐
Niuguangshuo3 分钟前
Python 设计模式:迭代模式
java·python·设计模式
窦再兴7 分钟前
CentOS7 安装 LLaMA-Factory
人工智能·conda·llama-factory
黎茗Dawn8 分钟前
第15周:注意力汇聚:Nadaraya-Watson 核回归
人工智能·数据挖掘·回归
夏天里的肥宅水16 分钟前
Windows连接服务器Ubuntu_MobaXterm
运维·服务器·ubuntu
千汇数据的老司机17 分钟前
未来已来:探索AI驱动的HMI设计新方向
人工智能
科技热点圈17 分钟前
AI设计再现新引擎,科技创新又添新动能——广东省首家行业AI设计工程中心获批成立
人工智能·科技
gaog2zh21 分钟前
0201线性回归-机器学习-人工智能
人工智能·机器学习·线性回归
Cxzzzzzzzzzz30 分钟前
Supervisor的安装和使用
运维·后端·python·centos
Z字小熊饼干爱吃保安43 分钟前
LVS-----DR模式
linux·运维·服务器·网络·nginx·lvs
Z字小熊饼干爱吃保安1 小时前
Keepalive+LVS+Nginx+NFS高可用项目
运维·服务器·nginx·自动化·lvs·高可用