当前位置:首页 > 工业控制 > 电路设计项目集锦
[导读]语音识别技术,也称为自动语音识别(ASR),旨在将人类言语中的词汇内容转换为计算机可读的输入形式,例如按键操作、二进制编码或字符序列。与说话人识别和说话人验证(后者试图识别或验证说话者本身,而非其言语所包含的词汇内容)不同,语音识别专注于言语的语言内容。

1. 语音识别简介

语音识别技术,也称为自动语音识别(ASR),旨在将人类言语中的词汇内容转换为计算机可读的输入形式,例如按键操作、二进制编码或字符序列。与说话人识别和说话人验证(后者试图识别或验证说话者本身,而非其言语所包含的词汇内容)不同,语音识别专注于言语的语言内容。

我们的语音算法基于由 OpenAI 设计的 Whisper 模型。作为一款通用语音识别模型,Whisper 通过大量多语言、多任务的监督数据进行训练,从而在英语语音识别方面实现了与人类相当的鲁棒性和准确性。Whisper 还可执行多语言语音识别、语音翻译和语言识别等任务。其架构采用简单的端到端方式,使用编码器-解码器 Transformer 模型,将输入音频转换为对应的文本序列,并通过特殊标记来指定不同的任务。

基于EASY-EAI-Nano-TB(RV1126B)硬件主板的运行效率:

2. 快速入门

2.1 开发环境准备

如果您是首次阅读本文,请参考《入门指南/开发环境准备/Easy-Eai 编译环境准备与更新》,并按照相关操作部署编译环境。

在PC端的Ubuntu系统中执行运行脚本,以进入EASY-EAI编译环境,具体操作如下:

2.2 源代码下载

在EASY-EAI编译环境中创建一个管理目录,用于存放源代码仓库:

使用 Git 工具在管理目录中克隆远程仓库:

备注:

由于网络问题,流程可能会卡住,请耐心等待。

如果需要从 GitHub 网页下载,请下载整个仓库,而不是仅下载与此示例对应的目录。

2.3 模型部署

要运行算法演示,您需要先下载语音算法模型。

同时,将下载的语音识别算法模型复制并粘贴到 Release/ 目录中。

2.4 常规编译

进入相应的脚本目录,然后按以下方式执行编译命令:

备注:

由于依赖库已部署在板上,因此在交叉编译过程中必须保持 /mnt 的挂载。

如果使用 cpres 参数运行 build.sh 脚本,Release/ 目录中的所有资源都将被复制到开发板上。

2.5 常规执行与效果

通过串口调试或SSH调试进入板子背景,并导航至常规部署位置:

使用以下命令运行该程序:

有关详细的API说明和API调用(本程序的源代码),请参见下方说明。

3. 语音识别API说明

3.1 参考方法

为了方便客户在本地项目中直接调用我们的EASY EAI API库,此处列出了需要在项目中链接的库、头文件等,供用户轻松添加。

3.2 语音识别初始化函数

语音识别初始化函数的原型如下:

详细描述:

3.3 语音识别运行功能

语音识别运行函数的原型如下:

详细描述:

3.4 语音识别释放功能

语音识别发布功能的原型如下:

详细描述:

4. 语音识别算法流程

常规目录为 Demos/algorithm-speech_recognition/test-speech_recognition.cpp,操作流程如下:

本文编译自hackster.io

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除( 邮箱:macysun@21ic.com )。
换一批
延伸阅读

MIPI(移动产业处理器接口):由ARM、诺基亚、ST和TI等公司于2003年成立的联盟制定的一种接口标准。其目的是标准化移动设备内部接口(如摄像头、显示屏、射频/基带接口),从而降低移动设备的设计复杂度,提高设计灵活性...

关键字: 摄像头 显示屏 RV1126B

EASY-EAI编译环境是一款由广州灵眸科技自主研发的在线编译环境(开发板在线),建立了PC端与板卡端实时同步的映射关系,保障PC端进行交叉编译时能实时链接开发板的依赖库。具有以下优点:

关键字: 串口调试 开发板 RV1126B

EASY-EAIAI 编译环境是由广州凌茂科技独立开发的在线编译环境(开发板在线),可在 PC PC 终端与开发板终端之间建立实时同步映射关系,确保在 PC PC PC 端进行交叉编译时,能够实时链接到开发板的依赖库。

关键字: 开发板 计算机 RV1126B

一个离线语音识别中心,没有网络连接,没有无线路由器。只要一对运行ESPNOW协议的ESP8266。这就是我想要的房间。这些设备既可以通过按开关控制,也可以通过声音控制。像alexa这样的中央集线器可以响应你的命令。这篇文...

关键字: ESP8266 语音识别 传感器 固态继电器

北京2025年2月24日 /美通社/ -- 在近日揭晓的STIF第五届国际科创节暨2024新质生产力领航者峰会奖项评选中,安联世合中国凭借其卓越的创新实践与行业领导力,荣膺&...

关键字: 人工智能 语音识别 大数据 智能语音

随着人口老龄化程度加深,社会养老负担加重,处理好全社会的养老问题十分重要。在全球范围内,老人身体健康受到许多致命疾病的威胁。而独居老人生活中缺少家人照顾,心理上缺少慰藉,导致患病率更高,同时发生意外也无法及时得到救助。面...

关键字: 独居老人 语音识别 姿态检测 智能家居

随着人工智能技术的快速发展,智能音箱已经成为我们日常生活中不可或缺的一部分。它们通过语音识别技术,实现了人机交互的便捷性,使得用户可以通过语音指令控制家居设备、查询信息、播放音乐等。然而,语音识别技术的准确性和实时性仍然...

关键字: 智能音箱 语音识别

“Ok 谷歌做我的家庭作业”——如果这个命令有效,我们的童年将会很简单,不是吗?但是有些事情是要我们自己来做的,当然,我们不会设计一些东西来帮你完成作业。然而,我们都承认用语音指令做事很有趣!!这就是为什么我们已经建立了...

关键字: 语音识别 树莓派 自动化 Arduino

语音识别技术是一种人工智能领域的技术,它能够将人类的声音信号转化为文字。语音识别系统主要包括三个主要部分:预处理、特征提取和模式匹配。

关键字: 语音 语音识别

随着人工智能技术的快速发展,语音识别作为其中的一项重要技术,正逐渐在各个领域展现出巨大的潜力和应用前景。语音识别技术能够将人类的语音信息转换为文本,为智能家居、智能助手等领域带来了智能化、便捷化的体验。

关键字: 人工智能 语音 语音识别
关闭