NEWS

Jev형 음성 판단 AI 「AudioDecisionModel」 공개

mocomoco 주식회사는 Jev형 음성 판단 AI 「AudioDecisionModel」을 오픈웨이트로 공개했습니다.

짧은 음성에 대한 질문에 Yes/No, 선택, 수치로 답합니다. 말소리뿐 아니라 음악, 동물 소리, 주변 소리에 대해서도 물을 수 있습니다. 입출력 예는 다음과 같습니다.

예시 음성에 대한 질문과 답

입력

음성
개 짖는 소리가 들어간 짧은 음성 샘플 음성입니다. Amada44 / CC BY-SA 3.0
문맥
짧은 음성에 개의 소리가 들어 있는지 확인한다
질문 JSON
{
  "개의 소리가 들어 있습니까": {
    "type": "noul",
    "instructions": "음성에 개 짖는 소리가 포함되어 있는지 확인하세요."
  }
}

출력

JSON
{
  "개의 소리가 들어 있습니까": "Yes"
}

mocomoco inc.는 미션으로 「사람의 목소리를 모아 가치로 순환시킵니다.」를 내걸고 있습니다. 모은 목소리를 필요한 사람의 판단과 행동까지 전하려면 현장과 손안의 기기에서도 움직여야 한다는 생각 아래, 브라우저에서 동작하는 엣지 실행과 더 널리 쓰이기 쉬운 오픈웨이트 모델에 대한 기여로서 본 모델을 공개했습니다.

모델과 데모는 Hugging Face에 공개되어 있습니다.

본 모델은 TypeSafe AI가 제공하는 Jev를 참고했습니다. 이용한 기반 모델은 다음과 같습니다.

본 건에 관한 문의는 문의 양식을 이용해 주세요.

문의하기