[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"내용 분류","value":"대화류, 개인 미디어류, 예능류 등"},{"@type":"PropertyValue","name":"녹음 환경","value":"저소음"},{"@type":"PropertyValue","name":"국가","value":"인도"},{"@type":"PropertyValue","name":"언어","value":"구자라트어"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 92%"},{"@type":"PropertyValue","name":"라벨링 특성","value":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 주석, 민감 정보 주석"}]
{"id":1608,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"1,528시간 구자라트어 구어체 음성 데이터","datazy":[{"title":"형식","content":"16kHz, 16bit, WAV, 모노","desc":"형식"},{"title":"내용 분류","content":"대화류, 개인 미디어류, 예능류 등","desc":"내용 분류"},{"title":"녹음 환경","content":"저소음","desc":"녹음 환경"},{"title":"국가","content":"인도","desc":"국가"},{"title":"언어","content":"구자라트어","desc":"언어"},{"title":"정확도","content":"단어 정확도 92%","desc":"정확도"},{"title":"라벨링 특성","content":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 주석, 민감 정보 주석","desc":"라벨링 특성"}],"datatag":"Gujarati,India,Casual Conversation,Monologue,Asr","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"001991_130.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250722160934/001991_130.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=rIdOoGyR%2BA%2FJ86epW2SRkjOQ2FI%3D","intro":"અને interaction માંથી વાત વાતો માંથી અંદર ઉંદર ચર્ચા કરશે વાતો કરીએ, અને એની અંદરથી તમારું વ્યક્તિત્વ,[N]","size":202444,"progress":100,"type":"mp3"},{"name":"100092_133.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250722160934/100092_133.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=eb1LmYvy3Rg0cA1NXrSxHk8gCBY%3D","intro":"તમે નવ Instagram આકાઉન ખોલો","size":49836,"progress":100,"type":"mp3"},{"name":"100022_63.wav","url":"https://storage-product.datatang.com/damp/product/samplePresentation_ipad/20250722171513/100022_63.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=ztdRrT7KDZ1k6wYKno9rSsylGNw%3D","intro":"ત્યારે જ હાંકવાનું ચાલુકરીશ.[N]","size":39788,"progress":100,"type":"mp3"},{"name":"100056_24.wav","url":"https://storage-product.datatang.com/damp/product/samplePresentation_ipad/20250722171513/100056_24.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=TT7nq8oetHEIEmGCLKzotKZdUdQ%3D","intro":"નથી.","size":15948,"progress":100,"type":"mp3"}],"officialSummary":"인도 구자라트어 구어체 음성 데이터는 1인 미디어, 대화, 라이브 방송 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 라벨링되어 있으며, 서로 다른 지역과 문화적 배경을 지닌 여러 인도인이 녹음에 참여하였습니다. 높은 정확도와 활용도로 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 실제 세계의 다양성에 직면했을 때 모델 성능 향상에 도움이 됩니다. 저희는 데이터 수집, 저장 및 사용의 모든 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 법규를 철저히 준수하여 사용자의 개인정보와 합법적 권리를 보호하고 있습니다.","dataexampl":null,"datakeyword":["구자라트어"," 인도"," 일상 대화"," 독백"," 자동 음성 인식"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"675 Hours - Gujarati(India) Real-world Casual Conversation and Monologue speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
인도 구자라트어 구어체 음성 데이터는 1인 미디어, 대화, 라이브 방송 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 라벨링되어 있으며, 서로 다른 지역과 문화적 배경을 지닌 여러 인도인이 녹음에 참여하였습니다. 높은 정확도와 활용도로 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 실제 세계의 다양성에 직면했을 때 모델 성능 향상에 도움이 됩니다. 저희는 데이터 수집, 저장 및 사용의 모든 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 법규를 철저히 준수하여 사용자의 개인정보와 합법적 권리를 보호하고 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
형식
16kHz, 16bit, WAV, 모노
내용 분류
대화류, 개인 미디어류, 예능류 등
녹음 환경
저소음
국가
인도
언어
구자라트어
정확도
단어 정확도 92%
라벨링 특성
텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 주석, 민감 정보 주석
샘플
Audio
અને interaction માંથી વાત વાતો માંથી અંદર ઉંદર ચર્ચા કરશે વાતો કરીએ, અને એની અંદરથી તમારું વ્યક્તિત્વ,[N]