[{"@type":"PropertyValue","name":"포맷","value":"16kHz 16bit 모노"},{"@type":"PropertyValue","name":"라벨링 특징","value":"텍스트, 유효 문장의 시작·종료 시점, 루마니아인 화자 ID, 성별"},{"@type":"PropertyValue","name":"언어","value":"아랍에미리트 아랍어"},{"@type":"PropertyValue","name":"적용 분야","value":"음성 인식, 동영상 자막 생성, 동영상 콘텐츠 검수"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 98%"}]
{"id":1710,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"1,503시간 아랍에미리트 아랍어 구어체 음성 데이터","datazy":[{"title":"포맷","desc":"포맷","content":"16kHz 16bit 모노"},{"title":"라벨링 특징","desc":"라벨링 특징","content":"텍스트, 유효 문장의 시작·종료 시점, 루마니아인 화자 ID, 성별"},{"title":"언어","desc":"언어","content":"아랍에미리트 아랍어"},{"title":"적용 분야","desc":"적용 분야","content":"음성 인식, 동영상 자막 생성, 동영상 콘텐츠 검수"},{"title":"정확도","desc":"정확도","content":"단어 정확도 98%"}],"datatag":"UAE,Conversation ","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"아랍에미리트 아랍어 음성 데이터_구어체. 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별 등 다양한 속성에 대한 어노테이션을 제공하며, 서로 다른 지역과 문화적 배경을 가진 아랍에미리트 현지인이 녹음했습니다. 정확도가 높고 활용성이 뛰어나 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공하며, 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["아랍에미리트 아랍어","음성 인식","자연 대화","구어체"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1,503 Hours - Arabic(UAE) Real-world Casual Conversation and Monologue speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
1,503시간 아랍에미리트 아랍어 구어체 음성 데이터
아랍에미리트 아랍어
음성 인식
자연 대화
구어체
아랍에미리트 아랍어 음성 데이터_구어체. 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별 등 다양한 속성에 대한 어노테이션을 제공하며, 서로 다른 지역과 문화적 배경을 가진 아랍에미리트 현지인이 녹음했습니다. 정확도가 높고 활용성이 뛰어나 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공하며, 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
라벨링 특징
텍스트, 유효 문장의 시작·종료 시점, 루마니아인 화자 ID, 성별
적용 분야
음성 인식, 동영상 자막 생성, 동영상 콘텐츠 검수
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
808138f3-5b1d-4189-a64d-5b89568a2049