登录/注册

语音识别代码

更多

以下是一个使用Python实现中文语音识别的简单示例代码,使用主流的SpeechRecognition库和百度AI开放平台的API:

前置要求:

  1. 安装必要库:
    pip install SpeechRecognition PyAudio
  2. 注册百度AI开放平台,创建语音识别应用,获取API Key和Secret Key

完整代码示例:

import speech_recognition as sr
from aip import AipSpeech

# 配置百度API (替换为你的密钥)
APP_ID = '你的AppID'
API_KEY = '你的API_KEY'
SECRET_KEY = '你的SECRET_KEY'
client = AipSpeech(APP_ID, API_KEY, SECRET_KEY)

def record_audio():
    """录制音频并保存为WAV文件"""
    r = sr.Recognizer()
    with sr.Microphone() as source:
        print("请开始说话...")
        audio = r.listen(source)
        print("录音结束")

    # 保存录音
    with open("audio.wav", "wb") as f:
        f.write(audio.get_wav_data())
    return "audio.wav"

def baidu_asr(file_path):
    """调用百度API进行语音识别"""
    with open(file_path, 'rb') as f:
        audio_data = f.read()

    # 参数配置(中文普通话)
    result = client.asr(audio_data, 'wav', 16000, {
        'dev_pid': 1537  # 1537表示普通话(支持英文),更多语种见文档
    })

    if 'result' in result:
        return result['result'][0]
    else:
        return "识别失败:" + str(result)

if __name__ == '__main__':
    # 步骤1:录制音频
    audio_file = record_audio()

    # 步骤2:语音识别
    text = baidu_asr(audio_file)
    print(f"识别结果:{text}")

备选方案(使用离线库):

如果希望离线识别,可使用vosk库:

# 安装:pip install vosk sounddevice
import sounddevice as sd
import queue
from vosk import Model, KaldiRecognizer

# 下载中文模型:https://alphacephei.com/vosk/models
model = Model("vosk-model-cn-0.22")  # 中文小模型路径
samplerate = 16000
device = 0  # 麦克风设备ID

q = queue.Queue()
def callback(indata, frames, time, status):
    q.put(bytes(indata))

with sd.RawInputStream(samplerate=samplerate, device=device,
                       dtype='int16', channels=1, callback=callback):
    print("请说话... (按Ctrl+C停止)")
    rec = KaldiRecognizer(model, samplerate)
    while True:
        data = q.get()
        if rec.AcceptWaveform(data):
            text = rec.Result()[14:-3]  # 提取识别结果
            if text: print("识别结果:", text)

注意事项:

  1. 百度API版需要联网,但有免费额度(200次/天)
  2. 离线版(VOSK)需下载约1.8G的中文模型
  3. 确保麦克风可用(Windows可能需要管理员权限)
  4. 安静环境识别效果更佳
  5. 专业场景建议使用阿里云/讯飞等商业API

百度API详细文档:https://cloud.baidu.com/doc/SPEECH/s/8kfzydg4d

语音识别IC分类,语音识别芯片的工作原理

语音识别芯片,也叫语音识别集成电路,是一种集声音存储、播放、录音及

2026-01-14 15:22:53

基于语音识别做一款能识别语音的App

最近做了一款语音识别的App,想着利用手机控制arduino实现RGB的调节,开发思路:基于讯飞语音

2022-03-01 07:05:08

语音识别芯片LD3320开发手册

语音识别芯片LD3320开发手册

资料下载 jf_07683188 2021-12-16 17:59:51

NRK220X语音识别模块语音芯片语音ic数据资料

NRK2202语音识别模块为广州九芯电子自主研发的一款模块,无须外围元件,直接对接外部,集成了一颗高性能、低成本的离线语音

资料下载 九芯电子语音IC 2021-10-22 10:59:30

结合MFCC和特征的语音情感识别方法

在语音情感识别中提取梅尔频率倒谱系数(MFC℃)会丢失谱特征信息,导致情感识别准确率较低。为此,提出一种结合MFCC和语谱图特征的

资料下载 佚名 2021-06-11 11:02:16

基于性能影响因素分析的语音识别平台体系结构

语音识别技术的应用领域众多,而语音识别系统的性能评测对

资料下载 佚名 2021-04-22 15:44:02

基于改进长短时记忆网络的儿童语音情感识别模型

为实现不同儿童情感需求状态下帧级语音特征的有效获取,建立一种基于改进长短时记忆(LSTM)网络的儿童语音情感识别模型。釆用帧级

资料下载 佚名 2021-04-01 11:36:26

如何通过LD3320语音识别模块识别我们预定的短语

LD3320A语音识别一、LD3320A语音识别模块介绍二、本章节实现功

2022-01-12 08:19:47

求大佬分享STM32实现的语音识别智能垃圾桶的代码

求大佬分享STM32实现的语音识别智能垃圾桶的代码

2021-12-13 06:23:09

语音识别芯片的分类及应用

语音识别芯片也叫语音识别IC,与传统的

2021-10-21 15:38:19

自动语音识别的原理是什么?

自动语音识别的原理是什么?如何利用WaveNet实现自动语音识别?

2021-06-15 09:14:07

语音识别】你知道什么是离线语音识别和在线语音识别吗?

很多都会问:我测X大讯飞的识别效果很好呀,为什么你们的不能达到这个效果呢?原因很简单,因为你所测试的是X大讯飞在线的语音识别模块,而我们的是离线

2021-04-01 17:11:18

【大联大品佳 Nuvoton ISD9160语音识别试用申请】嵌入语音识别的智能风扇

代码模块,简单并且容易使用,这样更能加快产品的设计需求。项目计划:①.首先下载好关于Nuvoton ISD9160语音识别开发板的SDK包,安装

2020-08-10 17:37:37

语音识别芯片的原理_语音识别芯片有哪些

语音识别芯片也叫语音识别IC,与传统的

2019-10-01 08:46:00

7天热门专题 换一换
相关标签