NEWS
mocomoco, 음성 인식 AI 'mocoVoice API'에 화자 분리 기능 추가!

mocomoco 주식회사는 고성능 음성 인식 AI 'mocoVoice API'에 화자 분리 기능을 추가했습니다.
본 기능을 통해 다수가 참여하는 대화나 회의의 음성 데이터를 개별 화자별로 분리하여 텍스트로 변환할 수 있습니다.
<신기능의 특징>
고성능 화자 분리
여러 명이 참여하는 대화의 텍스트 변환 시에도 '누가' '무엇을' 말했는지 명확하게 파악할 수 있습니다.
고속 화자 분리
화자 분리 기능이 추가되더라도 텍스트 변환 속도는 이전과 동일하게 1시간 분량의 음성을 최단 3분 만에 처리합니다.
다국어 지원
일본어와 영어가 혼재된 대화에서도 높은 정확도로 화자를 분리할 수 있습니다.
<활용 사례>
그룹 디스커션 회의록 작성
여러 회사가 참여하는 거래처와의 미팅 기록
다수의 연사가 등단하는 행사 및 이벤트의 텍스트 변환
<mocoVoice API 소개>
mocoVoice API는 음성 인식 업계 최고 성능을 자랑하는 OpenAI Whisper를 기반으로, mocomoco만의 독자적인 사전 알고리즘과 고속화 기술을 결합했습니다. 다음과 같은 특징을 갖추고 있습니다.
압도적인 처리 속도
1시간 분량의 음성을 최단 3분 만에 텍스트로 변환합니다. 장시간의 회의나 강연에서도 신속한 작업이 가능합니다.
독자적인 사전 기능
발음 지정이 필요 없는 사전 기능을 통해 전문 용어나 고유 명사도 정확하게 인식합니다. 일본어 및 영어 양국어에 대한 사전 등록이 가능합니다.
ChatGPT를 활용한 고품질 교정
인식된 텍스트를 자동으로 교정하여 문법적으로 정확하고 읽기 쉬운 문장으로 다듬습니다. 일본어 및 영어 각각의 언어 특성에 맞춘 교정을 실시합니다.
멀티미디어 지원
음성 파일뿐만 아니라 동영상 파일에서의 음성 추출 및 인식도 가능합니다.
코드 스위칭 지원
일본어와 영어가 혼재된 대화에서도 언어의 전환을 정확하게 감지하여 적절하게 텍스트로 변환합니다.
<요금 플랜>
화자 분리 기능은 추가 비용 없이 모든 플랜에 포함되어 있습니다. mocoVoice API의 이용 요금에 대한 자세한 내용은 다음을 참고해 주십시오: https://docs.mocomoco.ai/guides/pricing
<개발 배경>
여러 명이 참여하는 회의나 대화에서 '누가 발언했는지'를 정확하게 파악하는 것은 정보 공유 및 회의록 작성의 효율화에 있어 중요한 과제였습니다. 기존의 텍스트 변환에서는 화자가 특정되지 않아 작업 부담이 가중되고, 커뮤니케이션의 정확성이 훼손되는 경우가 적지 않았습니다. 이러한 과제를 해결하기 위해 mocomoco 주식회사에서는 빠르고 정확하게 화자를 분리할 수 있는 'mocoVoice API'의 화자 분리 기능을 개발했습니다.
<향후 전망>
본 기능을 테스트해 볼 수 있는 mocoVoice demo 페이지를 제공할 예정입니다.
mocomoco는 앞으로도 실제 환경에 맞는 상황에서 mocoVoice를 활용할 수 있도록 지속적인 개선을 진행해 나가겠습니다.
<서비스 이용 신청>
mocoVoice API의 이용을 시작하려면 아래의 API 이용 신청 양식을 통해 접수해 주십시오. 계정 생성 후 즉시 신기능을 사용해 보실 수 있습니다.
관련 페이지
mocoVoice API 이용 신청 양식 https://forms.gle/YU2a4aeHgwtF8E8L7
mocoVoice API 문서 페이지 https://docs.mocomoco.ai/
mocomoco 주식회사 홈페이지 https://www.mocomoco.ai/