[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"녹음 환경","value":"상대적으로 조용한 실내 환경, 일반 환경(인식에 영향을 주지 않는 소음 포함)"},{"@type":"PropertyValue","name":"내용 구성","value":"녹음자가 제공된 텍스트를 기반으로 낭독하고 녹음하며, 각 텍스트에는 인명, 전화번호, 주소, 숫자·문자열, Email, 제품 모델, 제품 일련번호, 금액 중 최소 하나의 지정 엔터티가 포함"},{"@type":"PropertyValue","name":"국가","value":"영국, 미국"},{"@type":"PropertyValue","name":"언어 지역 코드","value":"en-GB, en-US"},{"@type":"PropertyValue","name":"언어","value":"영어"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 98%(구두점, 태그 및 비음성 어노테이션 부분은 상대적으로 주관적이므로 정확도에는 구두점, 태그 및 기타 식별자의 오류가 포함되지 않음)"},{"@type":"PropertyValue","name":"녹음 장비","value":"안드로이드 스마트폰, 아이폰"}]
{"id":1960,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"186시간 영어 엔터티 어노테이션 음성 데이터|낭독 음성 인식 모바일 수집 데이터","datazy":[{"title":"데이터 형식","content":"16kHz, 16bit, WAV, 모노"},{"title":"녹음 환경","content":"상대적으로 조용한 실내 환경, 일반 환경(인식에 영향을 주지 않는 소음 포함)"},{"title":"내용 구성","content":"녹음자가 제공된 텍스트를 기반으로 낭독하고 녹음하며, 각 텍스트에는 인명, 전화번호, 주소, 숫자·문자열, Email, 제품 모델, 제품 일련번호, 금액 중 최소 하나의 지정 엔터티가 포함"},{"title":"국가","content":"영국, 미국"},{"title":"언어 지역 코드","content":"en-GB, en-US"},{"title":"언어","content":"영어"},{"title":"정확도","content":"단어 정확도 98%(구두점, 태그 및 비음성 어노테이션 부분은 상대적으로 주관적이므로 정확도에는 구두점, 태그 및 기타 식별자의 오류가 포함되지 않음)"},{"title":"녹음 장비","content":"안드로이드 스마트폰, 아이폰"}],"datatag":"America,British,English,Smartphone,Reading,Scripted Monologue","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[],"officialSummary":"영어 엔터티 어노테이션 음성 데이터_낭독(모바일)로, 제공된 텍스트를 낭독하고 녹음하는 방식으로 구성됩니다. 인명, 전화번호, 주소, 숫자·문자열, Email, 제품 모델, 제품 일련번호, 금액 등 다양한 엔터티 유형을 포함하여 풍부한 콘텐츠로 구성됩니다. 본 데이터셋은 텍스트 내용 등 다양한 속성에 대한 어노테이션이 포함되어 있으며, 높은 정확도를 갖추고 있어 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공합니다. 또한 여러 AI 기업의 검증을 거쳤으며, 실제 환경의 다양성에 직면한 모델의 성능 향상에 기여할 수 있습니다. 넥스데이타는 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["음성 데이터","낭독","음성 인식","영어","영국식 영어","미국식 영어"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,KO\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"186 hours - English Entities Scripted Monologue Smartphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
영어 엔터티 어노테이션 음성 데이터_낭독(모바일)로, 제공된 텍스트를 낭독하고 녹음하는 방식으로 구성됩니다. 인명, 전화번호, 주소, 숫자·문자열, Email, 제품 모델, 제품 일련번호, 금액 등 다양한 엔터티 유형을 포함하여 풍부한 콘텐츠로 구성됩니다. 본 데이터셋은 텍스트 내용 등 다양한 속성에 대한 어노테이션이 포함되어 있으며, 높은 정확도를 갖추고 있어 음성 인식 관련 연구 및 애플리케이션에 풍부한 리소스를 제공합니다. 또한 여러 AI 기업의 검증을 거쳤으며, 실제 환경의 다양성에 직면한 모델의 성능 향상에 기여할 수 있습니다. 넥스데이타는 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
데이터 형식
16kHz, 16bit, WAV, 모노
녹음 환경
상대적으로 조용한 실내 환경, 일반 환경(인식에 영향을 주지 않는 소음 포함)
내용 구성
녹음자가 제공된 텍스트를 기반으로 낭독하고 녹음하며, 각 텍스트에는 인명, 전화번호, 주소, 숫자·문자열, Email, 제품 모델, 제품 일련번호, 금액 중 최소 하나의 지정 엔터티가 포함
국가
영국, 미국
언어 지역 코드
en-GB, en-US
언어
영어
정확도
단어 정확도 98%(구두점, 태그 및 비음성 어노테이션 부분은 상대적으로 주관적이므로 정확도에는 구두점, 태그 및 기타 식별자의 오류가 포함되지 않음)