行空板K10内测一(人工智能中的语音识别与语音合成功能)

2024-08-16264
AI 快速预览详细 收起
本文介绍了使用行空板K10实现的蔬菜识别语音讲解系统。该项目结合了语音识别与合成功能,适用于STEM教育场景。通过行空板K10的语音识别与合成功能,实现了语音输入和输出,解决了接口问题和编程中的线性问题。项目最终效果是通过语音输入蔬菜名称,行空板K10能够识别并语音输出相应的信息。难度适中,适合初学者学习和实践。

蔬菜识别语音讲解系统

行空板K10内测(人工智能中的语音识别与语音合成功能)

一、创作来源                                                          

     本系统来自于我们学校现在正在推广的劳动实践课程,我们为了开设这门课程,专门设计了一个劳动实践基地模型,此系统为这个模型中的一个功能。

二、设计思路(一)                                                          

      最初这个功能我们是用一个行空板+二哈传感器+语音识别与合成传感器来实现,最初我们在实现和过程中出现问题,行空板中的接口问题,还有编程中的线性问题等。正在我们束手无策时,就出现了行空板K10的内测。

     我们先实现行空板K10中的人工智能中的语音识别与语音合成功能,看是否可以达到我们的预期目标。

三、初期程序(简单)                                                   

  思维:1.唤醒小新。

              2.语音输入,如“茄子”、“大蒜”、“辣椒”、“萝卜”。

              3.行空板听到相应的关键字后,然后语音合成所输出的语句,并通过语音话筒,输出给大家。

image.png

四、改进程序(复杂)                                                  

思维:1.显示程序主题,以图片的方式进行展示、

            2.唤醒小新。

            3.语音输入,如“茄子”、“大蒜”、“辣椒”、“萝卜”。

            4.行空板听到相应的关键字后,然后语音合成所输出的语句,并通过语音话筒,输出给大家。

image.png

image.png
image.png
image.png
image.png

 

五、制作图片(FLASH)                                                  

image.png

六、注意事项                                                         

       1.图片尺寸必须在240x320像素以内。

       2.要显示图片,必须要加image.png语句。

七、几点建议                                                          

       1.语音合成输出,机器感特别的强,没有达到人类语音说话感觉。

       2.语音合成语句中,image.png,不能自动分行,当要合成的文字比较多时,必须要自行分成多个语句段。

image.png 

       3.图片显示,不能进行自动更新。当原始图片发生更改了,不能进行自我更新最新图片。

      4.说明材料上没有标明,行空板K10的最大存储容量,没有说明外置TF卡,最大容量值。

     5.行空板中的摄像头是否可以像手机一样,分别设置为两个,一个前置一个后置。

     6.要显示图片,必须要加STEM教育 · 行空板K10内测:语音识别与合成功能_image_1.webp语句,我觉的有点太麻烦,会造成程序段的臃肿。如果我放多在图片在不同时间上显示,那不就得有多少个图片就得需要多少条这个语句,最好是把这个去掉,直接显示图片。可以简化程序。

     7.人脸识别,只能用软件控制比较麻烦,是否可以在行空板上设置一个按钮,只要一按相应的按钮就可以直接识别。因为这个程序比较麻烦,把这个程序进行封装,更适合普及。

创作许可协议

本项目采用 None(不开放任何权利,保留所有权利) 进行许可。

评论(0)
- 没有更多了 -