[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적 조용한 실내, 무반향 환경"},{"@type":"PropertyValue","name":"녹음 내용","value":"주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음"},{"@type":"PropertyValue","name":"인원","value":"534명 화자"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행"},{"@type":"PropertyValue","name":"언어","value":"우르두어"},{"@type":"PropertyValue","name":"적용 분야","value":"음성 인식, 화자 인식"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 98%"}]
{"id":1772,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터","datazy":[{"title":"형식","content":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리"},{"title":"녹음 환경","content":"비교적 조용한 실내, 무반향 환경"},{"title":"녹음 내용","content":"주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음"},{"title":"인원","content":"534명 화자"},{"title":"어노테이션 특징","content":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행"},{"title":"언어","content":"우르두어"},{"title":"적용 분야","content":"음성 인식, 화자 인식"},{"title":"정확도","content":"문자 정확도 98%"}],"datatag":"full duplex,Dialogue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[],"officialSummary":"351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.","dataexampl":null,"datakeyword":["풀 듀플렉스 우르두어 음성 데이터","화자별 채널 분리","음성 데이터","음성 인식 학습 데이터","자연 대화 음성 데이터"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,KO\"}]","productNameEn":"351 Hours - Urdu Full-Duplex Spontaneous Dialogue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
형식
16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리
녹음 환경
비교적 조용한 실내, 무반향 환경
녹음 내용
주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음
인원
534명 화자
어노테이션 특징
유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행