Author:qyan.li
Date:2022.5.15
Topic:简单记录阿里云语音识别
API调用
一、写在前面:
~~~~~~ 最近的课程设计需要语音识别算法,但由于自己实现能力不够,只能借助于现成的API资源,目前国内比较成熟的包括百度云,阿里云,科大讯飞等等。由于百度云自己之前使用过,无法免费调用,故此次转到阿里云API尝试。
~~~~~~ 本篇博文主要记录自己在阿里云API调用中遇到的问题及解决方案。但是需要提醒的是,下述的方案可以保证大家能够使用阿里云API,但肯定不是最优甚至正确的方案,也希望有大佬可以贡献下思路和调用方法。
二、代码展示:
~~~~~~ 废话不多说,先上代码,方便大家参考使用,至于为什么这么改,后面会详细说,修改代码操作包含以下三步:
-
首先,在下载下的
SDK文件夹下新建CodeTest.py文件,并将下面的代码拷贝至文件中,保存# -*- coding = utf-8 -*- import time import threading import sys import nls ## 阿里云语音识别调用规范(此处信息更换为个人) URL="********" AKID="*******" AKKEY="*********" APPKEY="*******" class TestSr: def __init__(self,test_file): self.__test_file = test_file ## 读取音频文件内容,存放在self.__data中 def loadfile(self, filename): with open(filename, "rb") as f: self.__data = f.read() def getResult(self): self.loadfile(self.__test_file) ## type == str而非dict,因此需按照字符串格式进行内容提取 return self.__test_run().split('"')[-4] def __test_run(self): sr = nls.NlsSpeechRecognizer( url=URL, akid=AKID, aksecret=AKKEY, appkey=APPKEY ) r = sr.start(aformat="pcm", ex={

本文分享了作者在课程设计中使用阿里云语音识别API的经历,包括遇到的问题、解决方案及代码调整过程。通过修改官方提供的SDK,实现了语音文件的识别。

2403

被折叠的 条评论
为什么被折叠?



