通过Python的speech_recognition库将音频文件转为文字
前言
大家好,我是空空star,本篇给大家分享一下通过Python的speech_recognition库将音频文件转为文字。
上一篇已经介绍了相关的库speech_recognition
。
Python-语音转文字相关库介绍
一、音频准备
这里我们通过gTTS先生成一段音频,gTTS相关的介绍可以看博主之前写的博客。
通过Python的gtts库将文字转为音频
from gtts import gTTS
local = '/Users/kkstar/Downloads/video/'
text = '大家好,我是空空star,本篇给大家分享一下音频转文字,这是通过speech_recognition转换的文字。'
language = "zh-cn"
tts = gTTS(text=text, lang=language)
tts.save(local+"audio_gtts_0509.mp3")
二、音频声音
音频转文字_0509
三、格式转换
mp3转为wav。
这里不能只改后缀,需要用音频转换工具转换下。
audio_gtts_0509.mp3->audio_gtts_0509.wav
四、音频转文字
1.引入库
import speech_recognition as sr
import speech_recognition as sr
2.定义音频路径
local = '/Users/kkstar/Downloads/video/'
3.创建一个Recognizer对象
r = sr.Recognizer()
4.打开音频文件,将音频文件读入Recognizer对象
音频文件必须是wav的格式
# 打开音频文件
with sr.AudioFile(local+'audio_gtts_0509.wav') as source:
# 将音频文件读入Recognizer对象
audio = r.record(source)
5.尝试使用Google Web API将语音转换为文字
try:
text = r.recognize_google(audio, language='zh-CN')
print('转换结果:', text)
except sr.UnknownValueError:
print('无法识别语音')
except sr.RequestError as e:
print('无法连接到Google Web API. {0}'.format(e))
6.转换结果
转换结果: 大家好我是空空Store本篇给大家分享一下音频转文字这是通过Keep下划线recognition转换的文字
Process finished with exit code 0
总结
recognize_google
: recognize_google() 是Google提供的一种语音识别API,可以识别音频文件或麦克风录制的语音,并将其转换为文本。在Python中,可以使用SpeechRecognition库中的recognize_google()方法来调用该API。
到此这篇关于通过Python的speech_recognition库将音频文件转为文字的文章就介绍到这了,更多相关Python音频文件转为文字内容请搜索编程网以前的文章或继续浏览下面的相关文章希望大家以后多多支持编程网!
免责声明:
① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。
② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341