NEWS
Jev형 음성 판단 AI 「AudioDecisionModel」 공개

mocomoco 주식회사는 Jev형 음성 판단 AI 「AudioDecisionModel」을 오픈웨이트로 공개했습니다.
짧은 음성에 대한 질문에 Yes/No, 선택, 수치로 답합니다. 말소리뿐 아니라 음악, 동물 소리, 주변 소리에 대해서도 물을 수 있습니다. 입출력 예는 다음과 같습니다.
입력
- 음성
- 개 짖는 소리가 들어간 짧은 음성 샘플 음성입니다. Amada44 / CC BY-SA 3.0
- 문맥
- 짧은 음성에 개의 소리가 들어 있는지 확인한다
출력
mocomoco inc.는 미션으로 「사람의 목소리를 모아 가치로 순환시킵니다.」를 내걸고 있습니다. 모은 목소리를 필요한 사람의 판단과 행동까지 전하려면 현장과 손안의 기기에서도 움직여야 한다는 생각 아래, 브라우저에서 동작하는 엣지 실행과 더 널리 쓰이기 쉬운 오픈웨이트 모델에 대한 기여로서 본 모델을 공개했습니다.
모델과 데모는 Hugging Face에 공개되어 있습니다.
본 모델은 TypeSafe AI가 제공하는 Jev를 참고했습니다. 이용한 기반 모델은 다음과 같습니다.
- Qwen/Qwen3-ASR-0.6B
- laion/clap-htsat-unfused
- sbintuitions/modernbert-ja-30m
- sbintuitions/modernbert-ja-130m
본 건에 관한 문의는 문의 양식을 이용해 주세요.