[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"내용 구성","value":"대화류, 개인 미디어류, 예능류 등"},{"@type":"PropertyValue","name":"녹음 환경","value":"저소음 환경"},{"@type":"PropertyValue","name":"국가","value":"인도"},{"@type":"PropertyValue","name":"언어","value":"구자라트어"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 92%"},{"@type":"PropertyValue","name":"어노테이션 특성","value":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 소음, 민감 정보 어노테이션"}]
{"id":1608,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"675시간 인도 구자라트어 구어체 음성 데이터","datazy":[{"title":"데이터 형식","content":"16kHz, 16bit, WAV, 모노","desc":"형식"},{"title":"내용 구성","content":"대화류, 개인 미디어류, 예능류 등","desc":"내용 분류"},{"title":"녹음 환경","content":"저소음 환경","desc":"녹음 환경"},{"title":"국가","content":"인도","desc":"국가"},{"title":"언어","content":"구자라트어","desc":"언어"},{"title":"정확도","content":"단어 정확도 92%","desc":"정확도"},{"title":"어노테이션 특성","content":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 소음, 민감 정보 어노테이션","desc":"라벨링 특성"}],"datatag":"Gujarati,India,Casual Conversation,Monologue,Asr","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"인도 구자라트어 구어체 음성 데이터는 1인 미디어, 대화, 라이브 방송 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 어노테이션되어 있으며, 서로 다른 지역과 문화적 배경을 지닌 여러 인도인이 녹음에 참여하였습니다. 높은 정확도와 활용도로 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 실제 세계의 다양성에 직면했을 때 모델 성능 향상에 도움이 됩니다. 저희는 데이터 수집, 저장 및 사용의 모든 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 법규를 철저히 준수하여 사용자의 개인정보와 합법적 권리를 보호하고 있습니다.","dataexampl":null,"datakeyword":["구자라트어","인도","일상 대화","독백","자동 음성 인식"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"675 Hours - Gujarati(India) Real-world Casual Conversation and Monologue speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
675시간 인도 구자라트어 구어체 음성 데이터
구자라트어
인도
일상 대화
독백
자동 음성 인식
인도 구자라트어 구어체 음성 데이터는 1인 미디어, 대화, 라이브 방송 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 어노테이션되어 있으며, 서로 다른 지역과 문화적 배경을 지닌 여러 인도인이 녹음에 참여하였습니다. 높은 정확도와 활용도로 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 실제 세계의 다양성에 직면했을 때 모델 성능 향상에 도움이 됩니다. 저희는 데이터 수집, 저장 및 사용의 모든 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 법규를 철저히 준수하여 사용자의 개인정보와 합법적 권리를 보호하고 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
![사양]()
사양
데이터 형식
16kHz, 16bit, WAV, 모노
어노테이션 특성
텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 소음, 민감 정보 어노테이션
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
df78bd70-250f-43c2-a375-e37edf394bfc