[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"데이터 내용","value":"실제 환경에서 수집된 구어체 동영상 및 음성 데이터로, 모든 자료는 대만식 표준 중국어(대만 국어) 발음을 포함"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링"},{"@type":"PropertyValue","name":"언어","value":"대만식 표준 중국어 발음"},{"@type":"PropertyValue","name":"지역","value":"대만"},{"@type":"PropertyValue","name":"적용 장면","value":"음성 인식, 자막 생성, 콘텐츠 심사"},{"@type":"PropertyValue","name":"정확도","value":"문장 정확도 97%"}]
{"id":1295,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"1,250시간 대만 억양 중국어 구어체 음성 데이터","datazy":[{"title":"데이터 형식","desc":"형식","content":"16kHz, 16bit, WAV, 모노"},{"title":"데이터 내용","desc":"데이터 내용","content":"실제 환경에서 수집된 구어체 동영상 및 음성 데이터로, 모든 자료는 대만식 표준 중국어(대만 국어) 발음을 포함"},{"title":"어노테이션 특징","desc":"라벨링 특성","content":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링"},{"title":"언어","desc":"언어","content":"대만식 표준 중국어 발음"},{"title":"지역","desc":"국가","content":"대만"},{"title":"적용 장면","desc":"적용 장면","content":"음성 인식, 자막 생성, 콘텐츠 심사"},{"title":"정확도","desc":"정확도","content":"문장 정확도 97%"}],"datatag":"Accent mandarin; taiwanese,Colloquial Video","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"대만 국어 음성 데이터 구어체는 여러 일반 분야를 포함하며 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 ID, 성별 등 다양한 속성으로 라벨링 처리되었으며, 높은 정확도와 사용 편의성을 자랑합니다. 이는 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 다수 AI 기업의 검증을 거쳐, 모델이 실제 세계의 다양성에 뛰어난 성능을 발휘할 수 있도록 도와줍니다. 우리는 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["중국어 멀티모달 데이터","억양 중국어","억양 만다린","대만"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1250 Hours - Taiwanese Accent Mandarin Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
1,250시간 대만 억양 중국어 구어체 음성 데이터
중국어 멀티모달 데이터
억양 중국어
억양 만다린
대만
대만 국어 음성 데이터 구어체는 여러 일반 분야를 포함하며 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 ID, 성별 등 다양한 속성으로 라벨링 처리되었으며, 높은 정확도와 사용 편의성을 자랑합니다. 이는 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 다수 AI 기업의 검증을 거쳐, 모델이 실제 세계의 다양성에 뛰어난 성능을 발휘할 수 있도록 도와줍니다. 우리는 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
데이터 형식
16kHz, 16bit, WAV, 모노
데이터 내용
실제 환경에서 수집된 구어체 동영상 및 음성 데이터로, 모든 자료는 대만식 표준 중국어(대만 국어) 발음을 포함
어노테이션 특징
텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링
적용 장면
음성 인식, 자막 생성, 콘텐츠 심사
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
a56962cc-41a0-4080-9e2b-15a8c9d022a9