ko

Please fill in your name

Mobile phone format error

전화번호를 입력해 주세요

회사 이름을 입력해 주세요

회사 이메일을 입력해 주세요

데이터 요구사항을 입력해 주세요

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

데이터 요구사항은 5자 이상이며 숫자만으로 구성될 수 없습니다

203시간 한국어 의료 분야 음성 데이터 | 구어체 음성 인식 모바일 수집 데이터

한국어
한국어 구어체 음성 데이터
한국어 음성 인식 데이터
ASR 음성-텍스트 변환
의료 분야 데이터

203시간의 한국어 의료 분야 구어체 음성 데이터로, 다양한 의료 유형을 포괄하며 진단명, 약품명 등 전문 용어를 포함하여 실제 의료 현장에서의 대화 상황을 반영합니다. 본 데이터셋은 텍스트 내용, 화자 신원 및 성별, 주요 개체명 등 다양한 속성에 대한 어노테이션을 제공하여 다양한 AI 애플리케이션에 풍부한 리소스를 제공합니다. 다수의 AI 기업 검증을 통해 실제 환경의 다양한 변수에 대응하는 모델 성능 향상에 효과적임이 입증되었습니다. 데이터 수집, 저장 및 활용 전 과정에 걸쳐 GDPR, CCPA, PIPL 등 개인정보 보호 규정을 준수하며, 사용자의 프라이버시와 정당한 권익을 보호합니다.

유료 데이터셋
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양사양
형식
16kHz, 16bit, wav, 모노
내용 분류
의료 유형별로 진단명, 약품명 등 전문 용어를 포함하며, 온라인 진료, 의료 상식 정보, 의학 학술 회의 및 강연 등에 집중
녹음 환경
상대적으로 조용한 실내
국가
한국
언어 지역 코드
ko-KR
언어
한국어
라벨링 특성
전사 텍스트, 유효 문장 시작 및 종료 시간, 화자 식별자, 성별, 잡음 여부, 민감 정보 비식별 처리, 개체명(위치, 기관, 질병 관련, 치료 관련, 일반 개체), 대소문자 여부
정확도
단어 정확도 98%(태그 및 개체명은 주관적 판단이 개입될 수 있어 정확도 통계에서 제외)
샘플 샘플
  • Audio

    [OVERLAP/]아직[/OVERLAP] 회복이 안 된 상태가 됩니다.[N]

  • Audio

    어깨가 아픈 이유는 정말 다양하다고요.

  • Audio

    [OVERLAP/]어깨[/OVERLAP] 관절근 사진인데

  • Audio

    붙어는 있지만 요렇게 이제 비 가역적[N]

  • Audio

    허리, 척추 그다음에 무릎관들 다음으로

추천 데이터셋추천 데이터셋
특별한 요청 사항을 알려주세요

프로젝트 성숙도

초기 검토 단계 (구체적인 사양은 아직 없음)
목표는 명확하나 전문적인 가이드가 필요함
개발 또는 최적화 단계
명확한 데이터 사양을 보유한 데이터/라벨링 전문가 팀

제출함으로써,개인정보 보호 정책에 동의합니다

00ca1e6d-b6b1-4352-a271-1394a31ce48d

ff76024d-0f4e-4adf-a0e4-440554be3a92