音声を使ったディープラーニングのデモを1つ作ってみました。
■準備 ・音声データを用意。(https://github.com/karoldvl/ESC-50) 50種類のwavデータが用意されている ・GPU RTX2070のマシン
■モデル作成 ・1000エポック回す。丸々1日程度かかった。 ・精度は80%を超えた。
■実行 ・ボタンを1つ選択し、何の音か判定するリクエストを投げる ・モデルを参照し一致率の上位3つを返す
■用途 ・声で人を判定 ・トンネル、水道管などの打音検査 ・森の生態系の調査