简单记录阿里云语音识别API调用方法

本文分享了作者在课程设计中使用阿里云语音识别API的经历,包括遇到的问题、解决方案及代码调整过程。通过修改官方提供的SDK,实现了语音文件的识别。


Author:qyan.li

Date:2022.5.15

Topic:简单记录阿里云语音识别API调用


一、写在前面:

       ~~~~~~       最近的课程设计需要语音识别算法,但由于自己实现能力不够,只能借助于现成的API资源,目前国内比较成熟的包括百度云,阿里云,科大讯飞等等。由于百度云自己之前使用过,无法免费调用,故此次转到阿里云API尝试。

       ~~~~~~       本篇博文主要记录自己在阿里云API调用中遇到的问题及解决方案。但是需要提醒的是,下述的方案可以保证大家能够使用阿里云API,但肯定不是最优甚至正确的方案,也希望有大佬可以贡献下思路和调用方法。

二、代码展示:

       ~~~~~~       废话不多说,先上代码,方便大家参考使用,至于为什么这么改,后面会详细说,修改代码操作包含以下三步:

  • 首先,在下载下的SDK文件夹下新建CodeTest.py文件,并将下面的代码拷贝至文件中,保存

    # -*- coding = utf-8 -*-
    
    import time
    import threading
    import sys
    import nls
    
    ## 阿里云语音识别调用规范(此处信息更换为个人)
    URL="********"
    AKID="*******"
    AKKEY="*********"
    APPKEY="*******"
    
    class TestSr:
        def __init__(self,test_file):
            self.__test_file = test_file
       
       ## 读取音频文件内容,存放在self.__data中
        def loadfile(self, filename):
            with open(filename, "rb") as f:
                self.__data = f.read()
        
        def getResult(self):
            self.loadfile(self.__test_file)
            ## type == str而非dict,因此需按照字符串格式进行内容提取
            return self.__test_run().split('"')[-4]
    
        def __test_run(self):
            sr = nls.NlsSpeechRecognizer(
                        url=URL,
                        akid=AKID,
                        aksecret=AKKEY,
                        appkey=APPKEY
                    )
            r = sr.start(aformat="pcm", ex={
         
         
评论 4
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值