通过Python的speech_recognition库将音频文件转为文字

通过Python的speech_recognition库将音频文件转为文字 2023-09-18 841

前言

一、音频准备

这里我们通过gTTS先生成一段音频，gTTS相关的介绍可以看博主之前写的博客。

from gtts import gTTS
local = /Users/kkstar/Downloads/video/
text = 大家好，我是空空star，本篇给大家分享一下音频转文字，这是通过speech_recognition转换的文字。
language = "zh-cn"
tts = gTTS(text=text, lang=language)
tts.save(local+"audio_gtts_0509.mp3")

二、音频声音

音频转文字_0509

三、格式转换

mp3转为wav。这里不能只改后缀，需要用音频转换工具转换下。 audio_gtts_0509.mp3->audio_gtts_0509.wav

四、音频转文字

1.引入库

import speech_recognition as sr

2.定义音频路径

local = /Users/kkstar/Downloads/video/

3.创建一个Recognizer对象

r = sr.Recognizer()

4.打开音频文件，将音频文件读入Recognizer对象

音频文件必须是wav的格式

# 打开音频文件
with sr.AudioFile(local+audio_gtts_0509.wav) as source:
    # 将音频文件读入Recognizer对象
    audio = r.record(source)

5.尝试使用Google Web API将语音转换为文字

try: text = r.recognize_google(audio, language=‘zh-CN’) print(‘转换结果：’, text) except sr.UnknownValueError: print(‘无法识别语音’) except sr.RequestError as e: print(‘无法连接到Google Web API. {0}’.format(e))

6.转换结果

转换结果：大家好我是空空Store本篇给大家分享一下音频转文字这是通过Keep下划线recognition转换的文字 Process finished with exit code 0

总结

recognize_google： recognize_google() 是Google提供的一种语音识别API，可以识别音频文件或麦克风录制的语音，并将其转换为文本。在Python中，可以使用SpeechRecognition库中的recognize_google()方法来调用该API。

免费搭建微信查券返利机器人来轻松赚佣金

文章来自:IT技术分享网
分享地址:http://www.5ityx.cn/cate112/368701.html

上一篇： JS实现多线程数据分片下载

下一篇：「译文」用ChatGPT助力SEO工作

通过Python的speech_recognition库将音频文件转为文字

前言

一、音频准备

二、音频声音

三、格式转换

四、音频转文字

1.引入库

2.定义音频路径

3.创建一个Recognizer对象

4.打开音频文件，将音频文件读入Recognizer对象

5.尝试使用Google Web API将语音转换为文字

6.转换结果

总结

通过Python的speech_recognition库将音频文件转为文字 相关内容

聚合标签

通过Python的speech_recognition库将音频文件转为文字相关内容