python音频转文字调用baidu

python音频转文字调用的是百度智能云的接口,因业务需求会涉及比较多数字,所以这里做了数字的处理,可根据自己的需求修改。

python 复制代码
from flask import Flask, request, jsonify
import requests

from flask_limiter import Limiter

app = Flask(__name__)
limiter = Limiter(app)  # 初始化限流扩展

API_KEY = ""    #百度智能云上获取
SECRET_KEY = ""

import re
from cn2an import an2cn, transform

def replace_chinese_numbers(text):
    # 使用正则表达式匹配句子中的中文数字
    chinese_numbers = re.findall(r'[零一二三四五六七八九十百千万]+', text)
    
    # 遍历匹配到的中文数字,逐一替换为阿拉伯数字
    for chinese_number in chinese_numbers:
        arabic_number = transform(chinese_number, 'cn2an')
        text = text.replace(chinese_number, arabic_number)

    return text


@app.route('/transcribe', methods=['POST'])
@limiter.limit("5 per second")  # 设置限流规则为最多同时 5 个请求
def transcribe_audio():
    audio_data = request.data
    access_token = get_access_token()
    if not access_token:
        return jsonify({"error": "Error getting access token"}), 500

    url = "https://vop.baidu.com/server_api"

    headers = {
        'Content-Type': 'audio/pcm; rate=16000',  # 设置正确的 Content-Type
        'Accept': 'application/json',
    }

    params = {
        "cuid": "your_unique_id",  # 替换为你的用户唯一标识,随便写
        "token": access_token,
    }

    response = requests.post(url, headers=headers, params=params, data=audio_data)
    if response.status_code == 200:
        try:
            result = response.json()
            if "result" in result:
                transcript = result["result"][0]
                cleaned_transcript = replace_chinese_numbers(transcript)
                print(cleaned_transcript)
                return jsonify({"transcript": cleaned_transcript})
            else:
                return jsonify({"error": "No transcription found in the response"}), 500
        except UserWarning as warning:
            # 如果出现 UserWarning 异常,返回未处理的 transcript
            warnings.warn(str(warning))
            return jsonify({"transcript": transcript})
    else:
        return jsonify({"error": "Error in transcription request"}), 500

        
def get_access_token():
    url = "https://aip.baidubce.com/oauth/2.0/token"
    params = {"grant_type": "client_credentials", "client_id": API_KEY, "client_secret": SECRET_KEY}
    response = requests.post(url, params=params)

    if response.status_code == 200:
        access_token = response.json().get("access_token")
        return access_token
    else:
        print("Error getting access token:", response.text)
        return None

if __name__ == '__main__':
    app.run(host='0.0.0.0', port=16258)
相关推荐
故乡de云11 小时前
AWS 添加付款方式失败排查清单:卡片、银行风控与账号状态逐项定位
开发语言·php
其美杰布-富贵-李11 小时前
Spring Boot 依赖注入说明文档
java·spring boot·python
J_yyy11 小时前
【Qt核心组件类框架】
开发语言·qt
运维行者_11 小时前
如何查看每个IP的带宽使用情况?NetFlow 技术实战指南
开发语言·网络·分布式·后端·架构·带宽
梦想的初衷~11 小时前
植被遥感反演与数据同化算法体系教程:从PROSAIL前向模拟到作物估产
人工智能·python·机器学习·作物模型·遥感数据同化·prosail·植被参数反演
LadenKiller11 小时前
近期AI协作写量化规则,要按阶段安排任务
人工智能·python
天天进步201511 小时前
Python全栈项目--基于深度学习的图像超分辨率系统
开发语言·python·深度学习
音视频牛哥11 小时前
SmartMediaKit macOS版RTSP/RTMP低延迟播放器:技术架构、核心能力与应用实践
音视频·低延迟rtsp播放器·macos直播播放器·macos rtsp播放器·macos rtmp播放器·rtsp播放器mac版·rtmp播放器mac版
ellenwan202612 小时前
近期AI协作量化实现,先补规则清晰度和流程完整性
人工智能·python
小小晓.12 小时前
C++小白记:C风格字符串和数组用法
c语言·开发语言·c++