今天,早上去特斯拉直营钣喷中心修车了,越看车被撞伤的位置心里越难过,虽然对方全责,但是算了一下,一个副驾门更换一下6k多,一个后排门都要修还要喷漆全算下来要1.2w, 大概可以买5个犀牛派X1了,另外轮胎也有点儿被弄坏的样子,得自己换了,又是大几千,心里有点儿忧桑。
然后到了公司后,忙完事务就尝试看看aidvoice SDK的应用。想试试看语音识别的效果。
AidVoice SDK 是阿加犀推出的专门针对语音类模型的 AI 推理 SDK,旨在简化开发者开发基于端侧 AI 技术的语音处理核心功能,灵活快速的集成到智能应用中。SDK 提供了统一高效的 API,支持业界领先的语音处理 AI 模型,可满足不同业务场景需求。
官方文档应该需要进行一次更新了,因为目前好像aidlite-qnn236 不行,得上aidlite-qnn240:
sudo aid-pkg update
sudo aid-pkg install aidlite-sdk
sudo aid-pkg install aidlite-qnn236
# 安装 AidVoice SDK
sudo aid-pkg -i aidvoice-sdk
这里要安装2.31么?我有点儿困惑,如果安装aidlite-qnn236会不会无法调用后端啊?
我为了保险起见,都安装了一下。
sudo aid-pkg update
sudo aid-pkg install aidlite-qnn231
然后仔细研究了一下开发流程图,写的好详细哈哈!
然后就去拷贝了一下官方的example教程,先学习一下。
下面是操作步骤:
- 模型下载:
2. 解压:
直接unzip就行,可以看到一个chn_jpn_yue_eng_ko_spectok.bpe.model,猜测是中文,日文,粤语,英文韩语都能推理的模型。
- 把example 搞里头,然后看看代码状态.
cp -r /usr/loca/share/aidvoice/examples ~/sensevoicesmall/
然后我就进入了asr的cpp目录里面,创建了build目录进行cmake 和make。
cd ~/sensevoicesmall/examples/asr/cpp
mkdir build && cd build
cmake ../ && make -j$(nproc)
./test_asr -m ../../../../models/QCS8550/FP16/
很快就提示callback result内容了。
语音果然是wav目录中语音的内容。不过是英文的。这个sensevoicesmall好像只支持英文,中文语音各种乱七八槽的东西哈哈。
NPU推理还是很快的,速度非常棒~
目前音频转文本的sensevoicesmall的asr是测试完成了,后面准备接麦克风实时操作看看效果。
未完待续。。。。









