[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, 비압축 WAV, 모노"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적 조용한 실내 환경, 무반향 환경"},{"@type":"PropertyValue","name":"녹음 내용","value":"주제 목록을 제공하여 화자가 자신이 익숙한 여러 주제를 선정하여 대화의 자연스러운 흐름을 보장하며, 각 주제별로 대화를 진행하고 녹음함"},{"@type":"PropertyValue","name":"인원 구성","value":"총 480명의 대만 지역 인원, 남녀 비율 균형"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"유효한 단문을 추출하여 어노테이션하며, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별자, 텍스트 내용, 소음 어노테이션"},{"@type":"PropertyValue","name":"지역","value":"대만"},{"@type":"PropertyValue","name":"언어","value":"만다린"},{"@type":"PropertyValue","name":"적용 장면","value":"음성 인식, 음성 특징 인식"},{"@type":"PropertyValue","name":"정확도","value":"문장 정확도 95%"}]
{"id":1631,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"534시간 대만 억양 만다린 자연 대화 모바일 수집 음성 데이터","datazy":[{"title":"데이터 형식","desc":"형식","content":"16kHz, 16bit, 비압축 WAV, 모노"},{"title":"녹음 환경","desc":"녹음 환경","content":"비교적 조용한 실내 환경, 무반향 환경"},{"title":"녹음 내용","desc":"녹음 내용","content":"주제 목록을 제공하여 화자가 자신이 익숙한 여러 주제를 선정하여 대화의 자연스러운 흐름을 보장하며, 각 주제별로 대화를 진행하고 녹음함"},{"title":"인원 구성","desc":"인원","content":"총 480명의 대만 지역 인원, 남녀 비율 균형"},{"title":"어노테이션 특징","desc":"라벨링 특성","content":"유효한 단문을 추출하여 어노테이션하며, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별자, 텍스트 내용, 소음 어노테이션"},{"title":"지역","desc":"국가","content":"대만"},{"title":"언어","desc":"언어","content":"만다린"},{"title":"적용 장면","desc":"적용 장면","content":"음성 인식, 음성 특징 인식"},{"title":"정확도","desc":"정확도","content":"문장 정확도 95%"}],"datatag":"Accent Mandarin,Taiwanese,Spontaneous Dialogue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"534시간 대만 억양 만다린 자연 대화 모바일 수집 음성 데이터로, 30개 이상의 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋은 텍스트 내용, 문장 타임스탬프, 화자 신원, 성별 등 다양한 속성에 대한 어노테이션을 제공하며, 대만 지역의 인원이 녹음했습니다. 정확도가 높아 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공하며, 여러 AI 기업의 검증을 거쳤으며 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["대만","자연 대화","억양 만다린","중국어","국어"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"}]","productNameEn":"534 Hours - Taiwanese Accent Mandarin Spontaneous Dialogue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
534시간 대만 억양 만다린 자연 대화 모바일 수집 음성 데이터
대만
자연 대화
억양 만다린
중국어
국어
534시간 대만 억양 만다린 자연 대화 모바일 수집 음성 데이터로, 30개 이상의 일반적인 주제를 기반으로 대화를 시뮬레이션하여 녹음했습니다. 본 데이터셋은 텍스트 내용, 문장 타임스탬프, 화자 신원, 성별 등 다양한 속성에 대한 어노테이션을 제공하며, 대만 지역의 인원이 녹음했습니다. 정확도가 높아 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공하며, 여러 AI 기업의 검증을 거쳤으며 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
데이터 형식
16kHz, 16bit, 비압축 WAV, 모노
녹음 환경
비교적 조용한 실내 환경, 무반향 환경
녹음 내용
주제 목록을 제공하여 화자가 자신이 익숙한 여러 주제를 선정하여 대화의 자연스러운 흐름을 보장하며, 각 주제별로 대화를 진행하고 녹음함
인원 구성
총 480명의 대만 지역 인원, 남녀 비율 균형
어노테이션 특징
유효한 단문을 추출하여 어노테이션하며, 어노테이션 결과에는 유효한 단문의 시작 및 종료 시점, 화자 식별자, 텍스트 내용, 소음 어노테이션
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
3bd38fbc-3cb2-4e00-9145-a53dd0addf5d