[{"@type":"PropertyValue","name":"형식","value":"48kHz, 32bit, 비압축 WAV, 모노 채널"},{"@type":"PropertyValue","name":"콘텐츠 분류","value":"화자의 자유 대화, 화자별 녹음 파일 개별 수집"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적 조용한 실내, 무반향 환경"},{"@type":"PropertyValue","name":"녹음 장비","value":"고음질 마이크"},{"@type":"PropertyValue","name":"국가","value":"일본"},{"@type":"PropertyValue","name":"언어","value":"일본어"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 어노테이션"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 98%"}]
{"id":1971,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"579시간 48kHz 풀 듀플렉스 일본어 자연 대화 마이크 수집 음성 데이터","datazy":[{"title":"형식","content":"48kHz, 32bit, 비압축 WAV, 모노 채널"},{"title":"콘텐츠 분류","content":"화자의 자유 대화, 화자별 녹음 파일 개별 수집"},{"title":"녹음 환경","content":"비교적 조용한 실내, 무반향 환경"},{"title":"녹음 장비","content":"고음질 마이크"},{"title":"국가","content":"일본"},{"title":"언어","content":"일본어"},{"title":"어노테이션 특징","content":"텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 어노테이션"},{"title":"정확도","content":"문자 정확도 98%"}],"datatag":"Japanese,Japan,Dialogue,Full-Duplex,48khz","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[{"name":"G01000S0004_O2_9.wav","url":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0004_O2_9.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=jkSO%2FFGIkmxMVcJRlzvQz40mi80%3D","intro":"[OVERLAP/]うん[/OVERLAP]うんってなるやつがすごく多い、のがあって。","size":959764,"progress":100,"type":"mp3"},{"name":"G01000S0035_O1_7.wav","url":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0035_O1_7.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=mNTiZgZO4OpR2spwPwSBOEGE4wo%3D","intro":"うん。[N]","size":175076,"progress":100,"type":"mp3"},{"name":"G01000S0026_O2_14.wav","url":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0026_O2_14.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=lL41XUPY%2FwJJ0iYbixutcC5W%2BMA%3D","intro":"二回やるみたいな、イメージでやったら、[OVERLAP/]もう[/OVERLAP]ちょっと落ちやすいかな。","size":1199620,"progress":100,"type":"mp3"}],"officialSummary":"본 데이터는 풀 듀플렉스(Full Duplex) 대화를 전제로 수집한 고품질 일본어 음성 데이터셋입니다. Half Duplex 방식으로 재현하기 어려운 동시 발화와 중첩 발화, 자연스러운 맞장구와 끼어들기 등을 포함하여 양방향으로 동시에 진행되는 대화를 재현한 동시 양방향 음성 데이터셋으로, 실시간 대화형 AI 및 차세대 ASR의 연구개발에 적합합니다.본 데이터셋은 제공된 주제 목록에서 화자가 자신 있는 여러 주제를 선택하고, 자연스러운 대화를 진행하여 수집한 일본어 자연 대화 음성 데이터셋입니다. 일본 각 지역의 네이티브 화자가 참여한 다양한 대화를 포함하며, 고음질로 수집된 데이터를 기반으로 ASR 음향 및 언어 모델 학습, 화자 식별, 대화 시스템 평가 등 다양한 연구 분야에 활용할 수 있습니다.데이터는 각종 개인정보 보호 규정을 준수하여 관리하고 있습니다. 당사의 풀 듀플렉스 음성 데이터셋 시리즈는 일본어를 비롯해 영어, 한국어 등 다양한 언어를 지원하며, 전사 텍스트, 발화 타임스탬프, 화자 ID, 성별 등의 상세 어노테이션을 기본으로 제공합니다. 또한 화자별 독립 음성을 포함한 화자 분리 음성 데이터셋으로도 활용할 수 있으며, 녹음 조건, 화자 속성 및 라벨 사양에 따른 맞춤형 데이터 수집 및 제작에도 유연하게 대응할 수 있습니다.","dataexampl":null,"datakeyword":["풀 듀플렉스 일본어","일본어 음성 데이터","자연 대화","음성 인식 학습 데이터"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,KO\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"579 Hours - Japanese(Japan) 48khz Full-Duplex Spontaneous Dialogue Microphone speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[{"@type":"AudioObject","embedUrl":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0004_O2_9.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=jkSO%2FFGIkmxMVcJRlzvQz40mi80%3D"},{"@type":"AudioObject","embedUrl":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0035_O1_7.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=mNTiZgZO4OpR2spwPwSBOEGE4wo%3D"},{"@type":"AudioObject","embedUrl":"https://storage-product.datatang.com/damp/product/instructions_zh/20260106141227/G01000S0026_O2_14.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=lL41XUPY%2FwJJ0iYbixutcC5W%2BMA%3D"}]
579시간 48kHz 풀 듀플렉스 일본어 자연 대화 마이크 수집 음성 데이터
풀 듀플렉스 일본어
일본어 음성 데이터
자연 대화
음성 인식 학습 데이터
본 데이터는 풀 듀플렉스(Full Duplex) 대화를 전제로 수집한 고품질 일본어 음성 데이터셋입니다. Half Duplex 방식으로 재현하기 어려운 동시 발화와 중첩 발화, 자연스러운 맞장구와 끼어들기 등을 포함하여 양방향으로 동시에 진행되는 대화를 재현한 동시 양방향 음성 데이터셋으로, 실시간 대화형 AI 및 차세대 ASR의 연구개발에 적합합니다.본 데이터셋은 제공된 주제 목록에서 화자가 자신 있는 여러 주제를 선택하고, 자연스러운 대화를 진행하여 수집한 일본어 자연 대화 음성 데이터셋입니다. 일본 각 지역의 네이티브 화자가 참여한 다양한 대화를 포함하며, 고음질로 수집된 데이터를 기반으로 ASR 음향 및 언어 모델 학습, 화자 식별, 대화 시스템 평가 등 다양한 연구 분야에 활용할 수 있습니다.데이터는 각종 개인정보 보호 규정을 준수하여 관리하고 있습니다. 당사의 풀 듀플렉스 음성 데이터셋 시리즈는 일본어를 비롯해 영어, 한국어 등 다양한 언어를 지원하며, 전사 텍스트, 발화 타임스탬프, 화자 ID, 성별 등의 상세 어노테이션을 기본으로 제공합니다. 또한 화자별 독립 음성을 포함한 화자 분리 음성 데이터셋으로도 활용할 수 있으며, 녹음 조건, 화자 속성 및 라벨 사양에 따른 맞춤형 데이터 수집 및 제작에도 유연하게 대응할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
![사양]()
사양
형식
48kHz, 32bit, 비압축 WAV, 모노 채널
콘텐츠 분류
화자의 자유 대화, 화자별 녹음 파일 개별 수집
어노테이션 특징
텍스트 내용, 문장 타임스탬프, 화자 식별 정보, 성별 어노테이션
![샘플]()
샘플
Audio
[OVERLAP/]うん[/OVERLAP]うんってなるやつがすごく多い、のがあって。
Audio
Audio
二回やるみたいな、イメージでやったら、[OVERLAP/]もう[/OVERLAP]ちょっと落ちやすいかな。
![추천 데이터셋]()
추천 데이터셋
97b37ba0-a845-4054-932d-62b3113def40