语音识别代码
更多
以下是一个使用Python实现中文语音识别的简单示例代码,使用主流的SpeechRecognition库和百度AI开放平台的API:
前置要求:
- 安装必要库:
pip install SpeechRecognition PyAudio - 注册百度AI开放平台,创建语音识别应用,获取API Key和Secret Key
完整代码示例:
import speech_recognition as sr
from aip import AipSpeech
# 配置百度API (替换为你的密钥)
APP_ID = '你的AppID'
API_KEY = '你的API_KEY'
SECRET_KEY = '你的SECRET_KEY'
client = AipSpeech(APP_ID, API_KEY, SECRET_KEY)
def record_audio():
"""录制音频并保存为WAV文件"""
r = sr.Recognizer()
with sr.Microphone() as source:
print("请开始说话...")
audio = r.listen(source)
print("录音结束")
# 保存录音
with open("audio.wav", "wb") as f:
f.write(audio.get_wav_data())
return "audio.wav"
def baidu_asr(file_path):
"""调用百度API进行语音识别"""
with open(file_path, 'rb') as f:
audio_data = f.read()
# 参数配置(中文普通话)
result = client.asr(audio_data, 'wav', 16000, {
'dev_pid': 1537 # 1537表示普通话(支持英文),更多语种见文档
})
if 'result' in result:
return result['result'][0]
else:
return "识别失败:" + str(result)
if __name__ == '__main__':
# 步骤1:录制音频
audio_file = record_audio()
# 步骤2:语音识别
text = baidu_asr(audio_file)
print(f"识别结果:{text}")
备选方案(使用离线库):
如果希望离线识别,可使用vosk库:
# 安装:pip install vosk sounddevice
import sounddevice as sd
import queue
from vosk import Model, KaldiRecognizer
# 下载中文模型:https://alphacephei.com/vosk/models
model = Model("vosk-model-cn-0.22") # 中文小模型路径
samplerate = 16000
device = 0 # 麦克风设备ID
q = queue.Queue()
def callback(indata, frames, time, status):
q.put(bytes(indata))
with sd.RawInputStream(samplerate=samplerate, device=device,
dtype='int16', channels=1, callback=callback):
print("请说话... (按Ctrl+C停止)")
rec = KaldiRecognizer(model, samplerate)
while True:
data = q.get()
if rec.AcceptWaveform(data):
text = rec.Result()[14:-3] # 提取识别结果
if text: print("识别结果:", text)
注意事项:
- 百度API版需要联网,但有免费额度(200次/天)
- 离线版(VOSK)需下载约1.8G的中文模型
- 确保麦克风可用(Windows可能需要管理员权限)
- 安静环境识别效果更佳
- 专业场景建议使用阿里云/讯飞等商业API
NRK220X语音识别模块语音芯片语音ic数据资料
NRK2202语音识别模块为广州九芯电子自主研发的一款模块,无须外围元件,直接对接外部,集成了一颗高性能、低成本的离线语音
资料下载
九芯电子语音IC
2021-10-22 10:59:30
结合MFCC和特征的语音情感识别方法
在语音情感识别中提取梅尔频率倒谱系数(MFC℃)会丢失谱特征信息,导致情感识别准确率较低。为此,提出一种结合MFCC和语谱图特征的
资料下载
佚名
2021-06-11 11:02:16
基于改进长短时记忆网络的儿童语音情感识别模型
为实现不同儿童情感需求状态下帧级语音特征的有效获取,建立一种基于改进长短时记忆(LSTM)网络的儿童语音情感识别模型。釆用帧级
资料下载
佚名
2021-04-01 11:36:26
【语音识别】你知道什么是离线语音识别和在线语音识别吗?
很多都会问:我测X大讯飞的识别效果很好呀,为什么你们的不能达到这个效果呢?原因很简单,因为你所测试的是X大讯飞在线的语音识别模块,而我们的是离线
2021-04-01 17:11:18
【大联大品佳 Nuvoton ISD9160语音识别试用申请】嵌入语音识别的智能风扇
代码模块,简单并且容易使用,这样更能加快产品的设计需求。项目计划:①.首先下载好关于Nuvoton ISD9160语音识别开发板的SDK包,安装
2020-08-10 17:37:37
7天热门专题
换一换
换一换
- 如何分清usb-c和type-c的区别
- 中国芯片现状怎样?芯片发展分析
- vga接口接线图及vga接口定义
- 芯片的工作原理是什么?
- 华为harmonyos是什么意思,看懂鸿蒙OS系统!
- 什么是蓝牙?它的主要作用是什么?
- ssd是什么意思
- 汽车电子包含哪些领域?
- TWS蓝牙耳机是什么意思?你真的了解吗
- 什么是单片机?有什么用?
- 升压电路图汇总解析
- plc的工作原理是什么?
- 再次免费公开一肖一吗
- 充电桩一般是如何收费的?有哪些收费标准?
- ADC是什么?高精度ADC是什么意思?
- dtmb信号覆盖城市查询
- EDA是什么?有什么作用?
- 中科院研发成功2nm光刻机
- 苹果手机哪几个支持无线充电的?
- type-c四根线接法图解
- 华为芯片为什么受制于美国?
- 怎样挑选路由器?
- 元宇宙概念股龙头一览
- 锂电池和铅酸电池哪个好?
- 如何进行编码器的正确接线?接线方法介绍
- 什么是场效应管?它的作用是什么?
- 虚短与虚断的概念介绍及区别
- 晶振的作用是什么?
- 大疆无人机的价格贵吗?大约在什么价位?
- amoled屏幕和oled区别
- 苹果nfc功能怎么复制门禁卡
- 单片机和嵌入式的区别是什么
- 复位电路的原理及作用
- BLDC电机技术分析
- dsp是什么意思?有什么作用?
- 苹果无线充电器怎么使用?
- iphone13promax电池容量是多少毫安
- 芯片的组成材料有什么
- 特斯拉充电桩充电是如何收费的?收费标准是什么?
- 直流电机驱动电路及原理图
- 传感器常见类型有哪些?
- 自举电路图
- 苹果笔记本macbookpro18款与19款区别
- 通讯隔离作用
- 新斯的指纹芯片供哪些客户
- 伺服电机是如何进行工作的?它的原理是什么?
- 无人机价钱多少?为什么说无人机烧钱?
- 以太网VPN技术概述
- 手机nfc功能打开好还是关闭好
- 十大公认音质好的无线蓝牙耳机