[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적 조용한 실내, 무반향 환경"},{"@type":"PropertyValue","name":"녹음 내용","value":"주제 목록 제시 후, 루마니아인 화자가 익숙한 주제를 선택해 자연스러운 대화 녹음"},{"@type":"PropertyValue","name":"인원","value":"약 800명의 필리핀 현지인"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행"},{"@type":"PropertyValue","name":"국가","value":"필리핀"},{"@type":"PropertyValue","name":"언어","value":"영어"},{"@type":"PropertyValue","name":"적용 분야","value":"음성 인식, 화자 인식"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 98%"}]
{"id":1771,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"423시간 필리핀 영어 풀 듀플렉스 화자별 채널 분리 자연 대화 휴대폰 수집 음성 데이터","datazy":[{"title":"형식","content":"16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리","desc":"포맷"},{"title":"녹음 환경","content":"비교적 조용한 실내, 무반향 환경","desc":"녹음 환경"},{"title":"녹음 내용","content":"주제 목록 제시 후, 루마니아인 화자가 익숙한 주제를 선택해 자연스러운 대화 녹음","desc":"녹음 내용"},{"title":"인원","content":"약 800명의 필리핀 현지인","desc":"인원"},{"title":"어노테이션 특징","content":"유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행","desc":"라벨링 특징"},{"title":"국가","content":"필리핀","desc":"국가"},{"title":"언어","content":"영어","desc":"언어"},{"title":"적용 분야","content":"음성 인식, 화자 인식","desc":"적용 시나리오"},{"title":"정확도","content":"문자 정확도 98%","desc":"정확도"}],"datatag":"full-duplex,Dialogue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"423시간 필리핀 영어 화자별 채널 분리 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 필리핀 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.","dataexampl":null,"datakeyword":["대화형 AI 데이터셋","스마트폰 음성 데이터","필리핀 영어 음성 데이터셋","화자별 채널 분리","자연 대화","음성 인식","영어 억양"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES,JP\"},{\"code\":\"3\",\"language\":\"EN\"}]","productNameEn":"423 Hours - English(Philippine) Full-Duplex Spontaneous Dialogue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
423시간 필리핀 영어 화자별 채널 분리 자연 대화 휴대폰 수집 음성 데이터로, 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋에는 텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 필리핀 현지인이 직접 녹음했으며, 높은 정확도를 바탕으로 음성 인식 관련 연구 및 응용에 활용할 수 있는 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳐 실제 환경의 다양한 상황에서도 모델의 성능 향상에 도움이 되는 것으로 확인되었습니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
형식
16kHz, 16bit, 비압축 WAV, 모노 채널, 화자별 채널 분리
녹음 환경
비교적 조용한 실내, 무반향 환경
녹음 내용
주제 목록 제시 후, 루마니아인 화자가 익숙한 주제를 선택해 자연스러운 대화 녹음
인원
약 800명의 필리핀 현지인
어노테이션 특징
유효한 단문을 선별하여 어노테이션하고, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별 정보, 텍스트 내용이 포함되며 노이즈 어노테이션 수행