ko

Please fill in your name

Mobile phone format error

전화번호를 입력해 주세요

회사 이름을 입력해 주세요

회사 이메일을 입력해 주세요

데이터 요구사항을 입력해 주세요

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

데이터 요구사항은 5자 이상이며 숫자만으로 구성될 수 없습니다

200시간 말레이어 자연 대화 음성 데이터 |음성 인식 스마트폰 수집 데이터

자동 음성 인식 데이터
말레이어
자연 대화

말레이어 음성 데이터 대화 (스마트폰)는 약 30개의 일반적인 대화 주제를 기반으로 녹음된 자료로, 228명의 다양한 지역 및 문화적 배경을 지닌 말레이시아 원어민 화자가 녹음했습니다. 본 데이터셋은 텍스트 내용, 문장 타임스탬프, 화자 ID, 성별 등 다양한 속성으로 라벨링 처리되었으며, 높은 정확도를 보장합니다. 다수의 AI 기업 검증 결과, 실제 다양한 상황 속에서도 높은 성능을 발휘해 음성 인식 관련 연구 및 응용 개발에 풍부한 리소스를 제공합니다. 우리는 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PPL을 준수합니다.

유료 데이터셋
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
사양사양
데이터 형식
16kHz, 16bit, 무압축 WAV, 모노
내용 구성
녹음 참여자는 주어진 주제 목록 중 익숙한 몇 가지를 선택하여, 각각 자연스럽고 유창한 대화를 녹음함
녹음 조건
비교적 조용한 실내 환경, 할덤 없음
녹음 장비
안드로이드 폰, 아이폰
화자 정보
총 228명(남성 85명, 여성 143명)
국가
말레이시아
언어 지역 코드
ms-MY
언어
말레이어
어노테이션 특징
텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링
정확도
단어 정확도 98%
샘플 샘플
  • Audio

    Apa tu?

  • Audio

    Masakan dia ini sedap.

  • Audio

    Jangan tangkis aih, masakan dia tu bolehlah sedap kalau kata budak-budak sana tu ah.

  • Audio

    Ah uncle Muhto tu pak cik.

  • Audio

    Kalau saya ni dekat sana tu kalau dah boleh makan tempat ini.

추천 데이터셋추천 데이터셋
특별한 요청 사항을 알려주세요

프로젝트 성숙도

초기 검토 단계 (구체적인 사양은 아직 없음)
목표는 명확하나 전문적인 가이드가 필요함
개발 또는 최적화 단계
명확한 데이터 사양을 보유한 데이터/라벨링 전문가 팀

제출함으로써,개인정보 보호 정책에 동의합니다

7bb27625-864e-4a14-8291-ba126e21c001

908cf55d-8672-4348-8a63-d6e0346b32ad