[{"@type":"PropertyValue","name":"데이터 형식","value":"16kHz, 16bit, wav, 모노"},{"@type":"PropertyValue","name":"내용 분류","value":"다양한 의료 유형을 포함하며, 진단, 의약품명 등의 전문 용어가 포함됩니다. 주로 온라인 진료 상담, 의료 지식 보급, 의학 학술회의 강연 등에 집중"},{"@type":"PropertyValue","name":"녹음 환경","value":"비교적으로 조용한 실내 환경"},{"@type":"PropertyValue","name":"국가","value":"한국"},{"@type":"PropertyValue","name":"언어 지역 코드","value":"ko-KR"},{"@type":"PropertyValue","name":"언어","value":"한국어"},{"@type":"PropertyValue","name":"어노테이션 특징","value":"텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 식별자, 성별, 소음 어노테이션, 민감 정보 어노테이션, 엔터티 어노테이션(장소, 조직, 질병 관련, 치료 관련, 일반 엔터티), 대소문자 어노테이션"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 98%(태그 및 개체명은 주관적 판단이 개입될 수 있어 정확도 통계에서 제외)"}]
{"id":1499,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"203시간 한국어 의료 분야 음성 데이터 | 구어체 음성 인식 모바일 수집 데이터","datazy":[{"title":"데이터 형식","desc":"형식","content":"16kHz, 16bit, wav, 모노"},{"title":"내용 분류","desc":"내용 분류","content":"다양한 의료 유형을 포함하며, 진단, 의약품명 등의 전문 용어가 포함됩니다. 주로 온라인 진료 상담, 의료 지식 보급, 의학 학술회의 강연 등에 집중"},{"title":"녹음 환경","desc":"녹음 환경","content":"비교적으로 조용한 실내 환경"},{"title":"국가","desc":"국가","content":"한국"},{"title":"언어 지역 코드","desc":"언어 지역 코드","content":"ko-KR"},{"title":"언어","desc":"언어","content":"한국어"},{"title":"어노테이션 특징","desc":"라벨링 특성","content":"텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 식별자, 성별, 소음 어노테이션, 민감 정보 어노테이션, 엔터티 어노테이션(장소, 조직, 질병 관련, 치료 관련, 일반 엔터티), 대소문자 어노테이션"},{"title":"정확도","desc":"정확도","content":"단어 정확도 98%(태그 및 개체명은 주관적 판단이 개입될 수 있어 정확도 통계에서 제외)"}],"datatag":"Korean,Entity,Spontaneous Dialogue,Medical","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"203시간 한국 한국어 의료 분야 엔터티 어노테이션 음성 데이터_구어체로, 다양한 의료 유형을 포함하며 진단, 의약품명 등의 전문 용어가 포함되어 있습니다. 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별, 일반적인 엔터티 단어 등 다양한 속성에 대한 어노테이션을 제공하여 다양한 인공지능 애플리케이션에 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳤으며, 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.","dataexampl":null,"datakeyword":["한국어","한국어 구어체 음성 데이터","한국어 음성 인식 데이터","ASR 음성-텍스트 변환","의료 분야 데이터","특정 분야"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"203 Hours - Korean(Korea) Medical Entities Real-world Casual Conversation and Monologue speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp
[]
203시간 한국어 의료 분야 음성 데이터 | 구어체 음성 인식 모바일 수집 데이터
한국어
한국어 구어체 음성 데이터
한국어 음성 인식 데이터
ASR 음성-텍스트 변환
의료 분야 데이터
특정 분야
203시간 한국 한국어 의료 분야 엔터티 어노테이션 음성 데이터_구어체로, 다양한 의료 유형을 포함하며 진단, 의약품명 등의 전문 용어가 포함되어 있습니다. 실제 환경의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원, 성별, 일반적인 엔터티 단어 등 다양한 속성에 대한 어노테이션을 제공하여 다양한 인공지능 애플리케이션에 풍부한 리소스를 제공합니다. 여러 AI 기업의 검증을 거쳤으며, 실제 환경의 다양성에 대응하는 모델의 성능 향상에 도움이 됩니다. 데이터 보호 법규 및 개인정보 보호 규정을 엄격하게 준수하여 데이터 수집, 저장 및 사용 과정에서 사용자의 개인정보와 합법적인 권익을 보호하며, 모든 데이터는 GDPR, CCPA, PIPL을 준수합니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
![사양]()
사양
데이터 형식
16kHz, 16bit, wav, 모노
내용 분류
다양한 의료 유형을 포함하며, 진단, 의약품명 등의 전문 용어가 포함됩니다. 주로 온라인 진료 상담, 의료 지식 보급, 의학 학술회의 강연 등에 집중
어노테이션 특징
텍스트 내용, 유효 문장의 시작 및 종료 시간, 화자 식별자, 성별, 소음 어노테이션, 민감 정보 어노테이션, 엔터티 어노테이션(장소, 조직, 질병 관련, 치료 관련, 일반 엔터티), 대소문자 어노테이션
정확도
단어 정확도 98%(태그 및 개체명은 주관적 판단이 개입될 수 있어 정확도 통계에서 제외)
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
30960488-a666-4798-900e-b302724d45ad