找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

4495

积分

0

好友

587

主题
发表于 1 小时前 | 查看: 3| 回复: 0

在 B 站偶然看到一个很有趣的开源项目,忍不住分享出来。它能自动爬取吉他谱、AI 识别后驱动机械手真实弹奏,创意和实现都让人眼前一亮。

安装了电子模块的吉他装置

项目地址:https://gitee.com/Liguanxi00/liguanxi_Automatic_guitar

功能特性

用户只需说出歌名,系统便会自动爬取吉他谱图片,通过 AI 识别将其转换为机器可读的数字谱,最后驱动 18 路舵机按照真实的指法弹出音乐。

核心功能

  • AI 识谱:利用六线谱定位、OCR 文字识别和 YOLO 符头检测,最终经 DeepSeek 大模型 纠错,将图片乐谱转成 CSV 演奏数据。
  • 三种操控方式:OLED 屏幕加按键菜单、浏览器 Web 端、呼叫“小爱同学”语音点歌。
  • 硬件双主控:RK3566 主控板(泰山派)负责识谱和界面,ESP32‑S3 专管 18 路舵机时序,通过串口以 921600bps 通信。
  • 附加功能:自动调音、WiFi 联网、固件 OTA 更新、电源温度监控。

如何使用

在 RK3566 泰山派上只需执行两条命令:

git clone https://gitee.com/Liguanxi00/liguanxi_Automatic_guitar.git
cd liguanxi_Automatic_guitar && bash tools/install_deps.sh

然后运行主程序:

sudo python3 src/guitarist/main.py

启动后系统会自动加载语音引擎和 Web 服务。如果只想在 PC 上测试识谱,也可以单独运行:

cd src/score_recognition && python main.py --song 歌名

这会生成 CSV 演奏数据而不驱动吉他。

硬件部分在立创 EDA 上开源,软件代码仓库仅包含代码,模型文件通过 Git LFS 管理,PP‑OCR 和 YOLO 的 RKNN 推理均已配置完毕。项目采用 PolyForm Noncommercial 协议,个人学习、把玩完全自由,如需商用请与作者联系。

本文由云栈社区整理分享,查看更多 开源实战 项目欢迎访问社区。




上一篇:Seedance2.5 短剧宏大场面制作全流程 SOP:低成本电影级画面攻略
下一篇:解析 AI Agent 可靠性:Harness、Loop、Graph 三层工程架构
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-8-9 02:07 , Processed in 2.979820 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表