NEWS
Jev型の音声判断AI「AudioDecisionModel」を公開

mocomoco株式会社は、Jev型の音声判断AI「AudioDecisionModel」を、オープンウェイトで公開しました。
短い音声への質問に、Yes/No、選択、数値で答えます。話し言葉だけでなく、音楽や動物の鳴き声、周囲の音についても尋ねられます。入出力の例は次のとおりです。
入力
- 音声
- 犬の鳴き声が入った短い音声 サンプル音声です。Amada44 / CC BY-SA 3.0
- 文脈
- 短い音声に、犬の声が入っているかを確認する
出力
mocomoco inc.のミッションとして「人の声を集め、価値としてめぐらせる。」を掲げています。集めた声を必要な人の判断や行動まで届けるには、現場や手元でも動かせる必要があるという考えのもと、ブラウザ上で動くエッジ実行と、より普及しやすいオープンウェイトモデルへの貢献として、本モデルを公開しました。
モデルとデモは Hugging Face で公開しています。
本モデルは、TypeSafe AI が提供する Jev を参考にしています。利用している基盤モデルは次のとおりです。
- Qwen/Qwen3-ASR-0.6B
- laion/clap-htsat-unfused
- sbintuitions/modernbert-ja-30m
- sbintuitions/modernbert-ja-130m
本件に関するお問い合わせはお問い合わせフォームよりお願いします。