[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"녹음 환경","value":"저소음"},{"@type":"PropertyValue","name":"국가","value":"한국"},{"@type":"PropertyValue","name":"언어 지역 코드","value":"ko-KR"},{"@type":"PropertyValue","name":"언어","value":"한국어"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별, 노이즈 어노테이션"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 98%"}]
{"id":1270,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"396시간 한국어 구어체 음성 데이터","datazy":[{"title":"형식","desc":"형식","content":"16kHz, 16bit, WAV, 모노"},{"title":"녹음 환경","desc":"녹음 환경","content":"저소음"},{"title":"국가","desc":"국가","content":"한국"},{"title":"언어 지역 코드","desc":"언어 지역 코드","content":"ko-KR"},{"title":"언어","desc":"언어","content":"한국어"},{"title":"어노테이션 특징","desc":"라벨링 특성","content":"텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별, 노이즈 어노테이션"},{"title":"정확도","desc":"정확도","content":"문자 정확도 98%"}],"datatag":"Korean,Colloquial Video","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"한국어 구어체 음성 데이터로, 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋에는 텍스트 내용, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 한국 현지인이 직접 녹음했으며, 높은 정확도와 활용성을 갖추어 음성 인식 관련 연구 및 응용을 위한 풍부한 리소스를 제공합니다. 또한 실제 환경의 다양한 상황에서 모델의 성능 향상에 도움이 됩니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.","dataexampl":null,"datakeyword":["자연 음성","한국어"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"396 Hours - Korean Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
한국어 구어체 음성 데이터로, 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋에는 텍스트 내용, 화자 식별 정보, 성별 등 다양한 속성이 어노테이션되어 있습니다. 서로 다른 지역과 문화적 배경을 가진 한국 현지인이 직접 녹음했으며, 높은 정확도와 활용성을 갖추어 음성 인식 관련 연구 및 응용을 위한 풍부한 리소스를 제공합니다. 또한 실제 환경의 다양한 상황에서 모델의 성능 향상에 도움이 됩니다. 데이터 수집, 저장 및 활용 과정에서 관련 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하여 사용자의 개인정보와 합법적인 권익을 보호하고 있으며, 모든 데이터는 GDPR, CCPA 및 PIPL을 준수합니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.