MIT App Inventor 重磅更新!Personal Audio Classifier 聲音辨識
MIT App Inventor 重磅更新,使用Personal Audio Classifier 來做「聲音」的AI訓練吧!
| 作者/攝影 | 曾吉弘 |
根據文件,這概念都是來自於 Google Teachable Machine,並使用 TensorFlow.js (MobileNet) 來訓練網路,但 TM還可以用 poseNet 來偵測人體姿勢,希望 App Inventor 也可以支援(敲碗~)。
哪些手機可以用:
MIT App Inventor 小組已表示 PAC extension 目前只有較新的 android 機種才可使用,並提供一個 apk 檔來測試,請下載並安裝這個 apk (或掃描以下 QRCODE)
把這個 apk 安裝在您想要執行 PAC 功能的 android 手機。開啟app,會先看到畫面左上角有一個 “Waiting…” 字樣,之後如果變成 “Ready and working!” 代表您的手機可以執行 PAC 聲音辨識,如果沒有的話就無法... 快去續約換新手機吧(誤)
[caption id="attachment_40212" align="aligncenter" width="409"]
測試用 apk 執行畫面,本手機可用PAC功能[/caption]
開始訓練神經網路!
STEP1. 進入 PAC 網站,點選 + 來新增一個 label,例如下圖的 hello。
STEP2. 按下 Record 來錄製聲音,錄好就會多一個綠色的頻譜(spectrum)方塊,如果錄錯了也可以刪除該檔案
STEP3. 根據 MIT App Inventor 教學,一個類別準備5~10個 sample就可以進行訓練了。訓練前可以設定一些超參數,對於進階需求的朋友可說是相當方便 。(PIC網站可以讓你新增網路層! 但是也要先知道這些網路層在幹嘛才行。)
[caption id="attachment_40216" align="aligncenter" width="555"]
MIT App Inventor PIC 網站的超參數設定[/caption]
STEP4. 訓練中,請稍等......
STEP5. 完成可以進行驗證,按下 Record 錄製一段聲音,稍等一下就會載入頻譜並在畫面右邊看到辨識結果與信心程度。老話一句,要有好的辨識結果就要有好的樣本資料,多多提供不同語氣的聲音樣本才是重點喔!(試著加入喜怒哀樂七情六慾的感覺來說 good morning 吧~)
STEP6. 匯出檔案 (mode.mdl) ,再將這個模型檔匯入您 app inventor 專案中的 PAC 元件就可以了,或者您可以用 MIT App Inventor 團隊提供的 aia檔案 (PAC元件已經在裡面了)來玩玩看。happy inventing~
留言 💬 (0)
還沒有留言,來當第一個。