日本综合一区二区|亚洲中文天堂综合|日韩欧美自拍一区|男女精品天堂一区|欧美自拍第6页亚洲成人精品一区|亚洲黄色天堂一区二区成人|超碰91偷拍第一页|日韩av夜夜嗨中文字幕|久久蜜综合视频官网|精美人妻一区二区三区

RELATEED CONSULTING
相關(guān)咨詢
選擇下列產(chǎn)品馬上在線溝通
服務(wù)時(shí)間:8:30-17:00
你可能遇到了下面的問(wèn)題
關(guān)閉右側(cè)工具欄

新聞中心

這里有您想知道的互聯(lián)網(wǎng)營(yíng)銷解決方案
Python只需要三十行代碼,打造一款簡(jiǎn)單的人工語(yǔ)音對(duì)話

??

1876年,亞歷山大·格雷厄姆·貝爾(Alexander Graham Bell)發(fā)明了一種電報(bào)機(jī),可以通過(guò)電線傳輸音頻。托馬斯·愛迪生(Thomas Edison)于1877年發(fā)明了留聲機(jī),這是第一臺(tái)記錄聲音并播放聲音的機(jī)器。

最早的語(yǔ)音識(shí)別軟件之一是由Bells Labs在1952年編寫的,只能識(shí)別數(shù)字。1985年,IBM發(fā)布了使用“隱馬爾可夫模型”的軟件,該軟件可識(shí)別1000多個(gè)單詞。

幾年前,一個(gè)replace("?","")代碼價(jià)值一個(gè)億

如今,在Python中Tensorflow,Keras,Librosa,Kaldi和語(yǔ)音轉(zhuǎn)文本API等多種工具使語(yǔ)音計(jì)算變得更加容易。

今天,我使用gtts和speech_recognition,教大家如何通過(guò)三十行代碼,打造一款簡(jiǎn)單的人工語(yǔ)音對(duì)話。思路就是將語(yǔ)音變成文本,然后文本變成語(yǔ)音。

gtts

gtts是將文字轉(zhuǎn)化為語(yǔ)音,但是需要在虛擬網(wǎng)絡(luò)下使用。這個(gè)因?yàn)橐庸雀璺?wù)器。

具體gtts的官方文檔:

下面,讓我們看一段簡(jiǎn)單的的代碼

from gtts import gTTS

def speak(audioString):
print(audioString)
tts = gTTS(text=audioString, lang='en')
tts.save("audio.mp3")
os.system("audio.mp3")

speak("Hi Runsen, what can I do for you?")

執(zhí)行上面的代碼,就可以生成一個(gè)mp3文件,播放就可以聽到了Hi Runsen, what can I do for you?。這個(gè)MP3會(huì)自動(dòng)彈出來(lái)的。

speech_recognition

speech_recognition用于執(zhí)行語(yǔ)音識(shí)別的庫(kù),支持在線和離線的多個(gè)引擎和API。

speech_recognition具體官方文檔

安裝speech_recognition可以會(huì)出現(xiàn)錯(cuò)誤,對(duì)此解決的方法是通過(guò)該網(wǎng)址安裝對(duì)應(yīng)的whl包

在官方文檔中提供了具體的識(shí)別來(lái)自麥克風(fēng)的語(yǔ)音輸入的代碼

??

下面就是 speech_recognition 用麥克風(fēng)記錄下你的話,這里我使用的是 recognize_google,speech_recognition 提供了很多的類似的接口。

import time
import speech_recognition as sr

# 錄下來(lái)你講的話
def recordAudio():
# 用麥克風(fēng)記錄下你的話
print("開始麥克風(fēng)記錄下你的話")
r = sr.Recognizer()
with sr.Microphone() as source:
audio = r.listen(source)
data = ""
try:
data = r.recognize_google(audio)
print("You said: " + data)
except sr.UnknownValueError:
print("Google Speech Recognition could not understand audio")
except sr.RequestError as e:
print("Could not request results from Google Speech Recognition service; {0}".format(e))
return data

if __name__ == '__main__':
time.sleep(2)
while True:
data = recordAudio()
print(data)

下面是我亂說(shuō)的英語(yǔ)

??

對(duì)話

上面,我們實(shí)現(xiàn)了用麥克風(fēng)記錄下你的話,并且得到了對(duì)應(yīng)的文本,那么下一步就是字符串的文本操作了,比如說(shuō)how are you,那回答"I am fine”,然后將"I am fine”通過(guò)gtts是將文字轉(zhuǎn)化為語(yǔ)音

# @Author:Runsen
# -*- coding: UTF-8 -*-
import speech_recognition as sr
from time import ctime
import time
import os
from gtts import gTTS


# 講出來(lái)AI的話
def speak(audioString):
print(audioString)
tts = gTTS(text=audioString, lang='en')
tts.save("audio.mp3")
os.system("audio.mp3")


# 錄下來(lái)你講的話
def recordAudio():
# 用麥克風(fēng)記錄下你的話
r = sr.Recognizer()
with sr.Microphone() as source:
audio = r.listen(source)

data = ""
try:
data = r.recognize_google(audio)
print("You said: " + data)
except sr.UnknownValueError:
print("Google Speech Recognition could not understand audio")
except sr.RequestError as e:
print("Could not request results from Google Speech Recognition service; {0}".format(e))

return data


# 自帶的對(duì)話技能(邏輯代碼:rules)
def jarvis():
while True:
data = recordAudio()
print(data)
if "how are you" in data:
speak("I am fine")
if "time" in data:
speak(ctime())
if "where is" in data:
data = data.split(" ")
location = data[2]
speak("Hold on Runsen, I will show you where " + location + " is.")
# 打開谷歌地址
os.system("open -a Safari https://www.google.com/maps/place/" + location + "/&")

if "bye" in data:
speak("bye bye")
break


if __name__ == '__main__':
# 初始化
time.sleep(2)
speak("Hi Runsen, what can I do for you?")

# 跑起
jarvis()

 ??

當(dāng)我說(shuō)how are you?會(huì)彈出I am fine的mp3

??

當(dāng)我說(shuō)where is Chiana?會(huì)彈出Hold on Runsen, I will show you where China is.的MP3

??

同樣也會(huì)彈出China的谷歌地圖

本項(xiàng)目對(duì)應(yīng)的Github

??https://github.com/MaoliRUNsen/Simple-intelligent-voice-dialogue??


網(wǎng)站名稱:Python只需要三十行代碼,打造一款簡(jiǎn)單的人工語(yǔ)音對(duì)話
鏈接URL:http://www.dlmjj.cn/article/cdhccdj.html