{"id":1591,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"389시간 터키어 자연 대화 모바일 수집 음성 데이터","datazy":[{"title":"포맷","desc":"포맷","content":"16kHz, 16bit, 비압축 wav, 모노"},{"title":"녹음 환경","desc":"녹음 환경","content":"비교적 조용한 실내, 울림 없음"},{"title":"녹음 내용","desc":"녹음 내용","content":"주제 리스트를 제공하고 루마니아인 화자가 익숙한 주제를 선택해 자연스럽게 대화"},{"title":"인원","desc":"인원","content":"총 410명(여성 210명, 남성 200명)"},{"title":"라벨링 특징","desc":"라벨링 특징","content":"유효 단문을 추출하여 시작·종료 시간, 루마니아인 화자 ID, 텍스트, 소음 라벨링 포함"},{"title":"장비","desc":"장비","content":"안드로이드 폰, 아이폰"},{"title":"언어","desc":"언어","content":"터키어"},{"title":"적용 분야","desc":"적용 분야","content":"음성 인식, 루마니아인 화자 인식"},{"title":"정확도","desc":"정확도","content":"단어 정확도 97%"}],"datatag":"Turkish,Spontaneous Dialogue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"터키어 자연 대화 모바일 음성 데이터는 30개 이상의 주제를 기반으로 녹음되었습니다. 텍스트, 문장 타임스탬프, 루마니아인 화자 신원, 성별 등의 속성을 라벨링하였으며, 약 400명의 다양한 배경을 가진 현지 루마니아인 화자가 참여했습니다. GDPR, CCPA, PIPL 등 법규를 철저히 준수합니다.","dataexampl":null,"datakeyword":["터키어","자발적 대화"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES\"}]","productNameEn":"389 Hours – Turkish Spontaneous Dialogue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
터키어 자연 대화 모바일 음성 데이터는 30개 이상의 주제를 기반으로 녹음되었습니다. 텍스트, 문장 타임스탬프, 루마니아인 화자 신원, 성별 등의 속성을 라벨링하였으며, 약 400명의 다양한 배경을 가진 현지 루마니아인 화자가 참여했습니다. GDPR, CCPA, PIPL 등 법규를 철저히 준수합니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.