您现在的位置是:首页 > 技术教程 正文

通过Python的speech_recognition库将音频文件转为文字

admin 阅读: 2024-03-22
后台-插件-广告管理-内容页头部广告(手机)

文章目录

  • 前言
  • 一、音频准备
  • 二、音频声音
  • 三、格式转换
  • 四、音频转文字
    • 1.引入库
    • 2.定义音频路径
    • 3.创建一个Recognizer对象
    • 4.打开音频文件,将音频文件读入Recognizer对象
    • 5.尝试使用Google Web API将语音转换为文字
    • 6.转换结果
  • 总结


前言

大家好,我是空空star,本篇给大家分享一下通过Python的speech_recognition库将音频文件转为文字。
上一篇已经介绍了相关的库speech_recognition。

通过Python的speech_recognition库将音频文件转为文字

Python-语音转文字相关库介绍


一、音频准备

这里我们通过gTTS先生成一段音频,gTTS相关的介绍可以看博主之前写的博客。

通过Python的gtts库将文字转为音频

from gtts import gTTS local = '/Users/kkstar/Downloads/video/' text = '大家好,我是空空star,本篇给大家分享一下音频转文字,这是通过speech_recognition转换的文字。' language = "zh-cn" tts = gTTS(text=text, lang=language) tts.save(local+"audio_gtts_0509.mp3")
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6

二、音频声音

音频转文字_0509

三、格式转换

mp3转为wav。
这里不能只改后缀,需要用音频转换工具转换下。
audio_gtts_0509.mp3->audio_gtts_0509.wav

四、音频转文字

1.引入库

import speech_recognition as sr
  • 1

2.定义音频路径

local = '/Users/kkstar/Downloads/video/'
  • 1

3.创建一个Recognizer对象

r = sr.Recognizer()
  • 1

4.打开音频文件,将音频文件读入Recognizer对象

音频文件必须是wav的格式

# 打开音频文件 with sr.AudioFile(local+'audio_gtts_0509.wav') as source: # 将音频文件读入Recognizer对象 audio = r.record(source)
  • 1
  • 2
  • 3
  • 4

5.尝试使用Google Web API将语音转换为文字

try:
text = r.recognize_google(audio, language=‘zh-CN’)
print(‘转换结果:’, text)
except sr.UnknownValueError:
print(‘无法识别语音’)
except sr.RequestError as e:
print(‘无法连接到Google Web API. {0}’.format(e))

6.转换结果

转换结果: 大家好我是空空Store本篇给大家分享一下音频转文字这是通过Keep下划线recognition转换的文字
Process finished with exit code 0


总结

recognize_google: recognize_google() 是Google提供的一种语音识别API,可以识别音频文件或麦克风录制的语音,并将其转换为文本。在Python中,可以使用SpeechRecognition库中的recognize_google()方法来调用该API。

标签:
声明

1.本站遵循行业规范,任何转载的稿件都会明确标注作者和来源;2.本站的原创文章,请转载时务必注明文章作者和来源,不尊重原创的行为我们将追究责任;3.作者投稿可能会经我们编辑修改或补充。

在线投稿:投稿 站长QQ:1888636

后台-插件-广告管理-内容页尾部广告(手机)
关注我们

扫一扫关注我们,了解最新精彩内容

搜索