[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, 모노, WAV 파일"},{"@type":"PropertyValue","name":"내용 분류","value":"내용은 예능·인터뷰·대화·평가 등 여러 분야를 포함"},{"@type":"PropertyValue","name":"녹음 환경","value":"저소음"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 ID, 성별 어노테이션"},{"@type":"PropertyValue","name":"언어","value":"인도네시아어"},{"@type":"PropertyValue","name":"언어 지역 코드","value":"id-ID"},{"@type":"PropertyValue","name":"국가","value":"인도네시아"},{"@type":"PropertyValue","name":"적용 장면","value":"음성 인식, 자막 생성, 콘텐츠 심사"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 98%"}]
{"id":1268,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"1,901시간 인도네시아어 구어체 음성 데이터","datazy":[{"title":"데이터 형식","content":"16kHz, 16bit, 모노, WAV 파일","desc":"형식"},{"title":"내용 분류","content":"내용은 예능·인터뷰·대화·평가 등 여러 분야를 포함","desc":"내용 분류"},{"title":"녹음 환경","content":"저소음","desc":"녹음 환경"},{"title":"어노테이션 특징","content":"텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 ID, 성별 어노테이션","desc":"라벨링 특성"},{"title":"언어","content":"인도네시아어","desc":"언어"},{"title":"언어 지역 코드","content":"id-ID","desc":"언어 지역 코드"},{"title":"국가","content":"인도네시아","desc":"국가"},{"title":"적용 장면","content":"음성 인식, 자막 생성, 콘텐츠 심사","desc":"적용 장면"},{"title":"정확도","content":"단어 정확도 98%","desc":"정확도"}],"datatag":"Indonesian,Casual Conversation,Monologue,Asr","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"인도네시아어 음성 데이터 구어체는 소셜미디어, 대화, 라이브 방송 등 다양한 일반 분야를 포함하며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별 등 다양한 속성으로 라벨링 처리되었으며, 높은 정확도와 사용 편의성을 자랑합니다. 이는 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 다수의 AI 기업에서 검증된 바와 같이 모델이 실제 세계의 다양성에 뛰어난 성능을 발휘할 수 있도록 도와줍니다. 우리는 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["인도네시아어","자연 대화","음성 인식"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1900 Hours - Indonesian Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
1,901시간 인도네시아어 구어체 음성 데이터
인도네시아어
자연 대화
음성 인식
인도네시아어 음성 데이터 구어체는 소셜미디어, 대화, 라이브 방송 등 다양한 일반 분야를 포함하며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별 등 다양한 속성으로 라벨링 처리되었으며, 높은 정확도와 사용 편의성을 자랑합니다. 이는 음성 인식 관련 연구 및 응용에 풍부한 자원을 제공하며, 다수의 AI 기업에서 검증된 바와 같이 모델이 실제 세계의 다양성에 뛰어난 성능을 발휘할 수 있도록 도와줍니다. 우리는 데이터 보호 법규와 개인정보 보호 규정을 엄격히 준수하며, 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적 권익을 보호합니다. 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
데이터 형식
16kHz, 16bit, 모노, WAV 파일
내용 분류
내용은 예능·인터뷰·대화·평가 등 여러 분야를 포함
어노테이션 특징
텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 ID, 성별 어노테이션
적용 장면
음성 인식, 자막 생성, 콘텐츠 심사
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
7af9501e-8bd9-4369-9488-5d8e93768be1