[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적 조용한 실내, 무반향 환경"},{"@type":"PropertyValue","name":"녹음 내용","value":"주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음"},{"@type":"PropertyValue","name":"인원","value":"534명 화자"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행"},{"@type":"PropertyValue","name":"언어","value":"우르두어"},{"@type":"PropertyValue","name":"적용 분야","value":"음성 인식, 화자 인식"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 98%"}]
{"id":1772,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터","datazy":[{"title":"형식","content":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리"},{"title":"녹음 환경","content":"비교적 조용한 실내, 무반향 환경"},{"title":"녹음 내용","content":"주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음"},{"title":"인원","content":"534명 화자"},{"title":"어노테이션 특징","content":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행"},{"title":"언어","content":"우르두어"},{"title":"적용 분야","content":"음성 인식, 화자 인식"},{"title":"정확도","content":"문자 정확도 98%"}],"datatag":"full duplex,Dialogue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[],"officialSummary":"351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.","dataexampl":null,"datakeyword":["풀 듀플렉스 우르두어 음성 데이터","화자별 채널 분리","음성 데이터","음성 인식 학습 데이터","자연 대화 음성 데이터"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,KO\"}]","productNameEn":"351 Hours - Urdu Full-Duplex Spontaneous Dialogue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터
풀 듀플렉스 우르두어 음성 데이터
화자별 채널 분리
음성 데이터
음성 인식 학습 데이터
자연 대화 음성 데이터
351시간 풀 듀플렉스 우르두어 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
형식
16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리
녹음 내용
주제 목록을 제공하고, 화자가 익숙한 주제를 여러 개 선택하여 대화의 자연스러움과 유창성을 확보한 후 각 주제를 중심으로 대화를 진행하고 녹음
어노테이션 특징
유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
9a6299ac-c393-4013-be06-65bf9b1299f6