ko

Please fill in your name

Mobile phone format error

전화번호를 입력해 주세요

회사 이름을 입력해 주세요

회사 이메일을 입력해 주세요

데이터 요구사항을 입력해 주세요

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

데이터 요구사항은 5자 이상이며 숫자만으로 구성될 수 없습니다

711시간 베트남어 구어체 음성 데이터

베트남어
구어체 영상
텍스트 주석

베트남어 음성 데이터_구어체는 소셜 미디어, 대화, 라이브 방송 등 다양한 일반 분야의 내용을 포함하며, 실제 세계의 상호작용 상황을 반영합니다. 본 데이터셋은 텍스트 콘텐츠, 화자 신원, 성별 등 다양한 속성이 라벨링되어 있으며, 높은 정확도와 사용 편의성을 자랑합니다. 음성 인식 관련 연구 및 응용에 풍부한 리소스를 제공하며, 다수의 AI 기업 검증을 통해 실제 환경의 다양성에 직면한 모델이 우수한 성능을 발휘할 수 있도록 지원합니다. 데이터 수집, 저장 및 사용 과정에서 개인정보 보호법 및 관련 규정을 엄격히 준수하며, 모든 데이터는 GDPR, CCPA, PIPL을 따릅니다.

유료 데이터셋
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양사양
형식
16kHz, 16bit, 모노, wav 파일
내용 분류
예능, 인터뷰, 대화, 평가 등 다양한 분야 포함
녹음 환경
저소음
라벨링 특성
텍스트 내용, 유효 문장 시작 및 종료 시간, 화자 식별, 성별 라벨링
언어
베트남어
언어 지역 코드
vi-VN
국가
베트남
적용 장면
음성 인식, 자막 생성, 콘텐츠 검수
정확도
단어 정확도 98%
샘플 샘플
  • Audio

    xin mời quý vị và các bạn cùng theo dõi cuộc trò chuyện về một chủ đề mà Thảo Vân nghĩ rằng, ờ, luôn luôn mới

  • Audio

    Như ngày hôm nay, chúng tôi muốn mời quý vị, ờ không chỉ là chị em phụ nữ mà cả các anh, hãy cùng lắng nghe, cùng theo dõi với chúng tôi

  • Audio

    luôn luôn không bao giờ cũ, mặc dù nó là một chủ đề chúng ta vẫn nói nhiều lần, đó là chủ đề làm đẹp.

  • Audio

    Thưa quý vị, trong câu chuyện à đêm muộn ngày hôm nay

  • Audio

    Xin kính chào quý vị khán giả.

추천 데이터셋추천 데이터셋
579시간 48kHz 풀 듀플렉스 일본어 자연 대화 마이크 수집 음성 데이터

본 데이터는 풀 듀플렉스(Full Duplex) 대화를 전제로 수집한 고품질 일본어 음성 데이터셋입니다. Half Duplex 방식으로 재현하기 어려운 동시 발화와 중첩 발화, 자연스러운 맞장구와 끼어들기 등을 포함하여 양방향으로 동시에 진행되는 대화를 재현한 동시 양방향 음성 데이터셋으로, 실시간 대화형 AI 및 차세대 ASR의 연구개발에 적합합니다. 본 데이터셋은 제공된 주제 목록에서 화자가 자신 있는 여러 주제를 선택하고, 자연스러운 대화를 진행하여 수집한 일본어 자연 대화 음성 데이터셋입니다. 일본 각 지역의 네이티브 화자가 참여한 다양한 대화를 포함하며, 고음질로 수집된 데이터를 기반으로 ASR 음향 및 언어 모델 학습, 화자 식별, 대화 시스템 평가 등 다양한 연구 분야에 활용할 수 있습니다. 데이터는 각종 개인정보 보호 규정을 준수하여 관리하고 있습니다. 당사의 풀 듀플렉스 음성 데이터셋 시리즈는 일본어를 비롯해 영어, 한국어 등 다양한 언어를 지원하며, 전사 텍스트, 발화 타임스탬프, 화자 ID, 성별 등의 상세 어노테이션을 기본으로 제공합니다. 또한 화자별 독립 음성을 포함한 화자 분리 음성 데이터셋으로도 활용할 수 있으며, 녹음 조건, 화자 속성 및 라벨 사양에 따른 맞춤형 데이터 수집 및 제작에도 유연하게 대응할 수 있습니다.

풀 듀플렉스 일본어 일본어 음성 데이터 자연 대화 음성 인식 학습 데이터
특별한 요청 사항을 알려주세요

프로젝트 성숙도

초기 검토 단계 (구체적인 사양은 아직 없음)
목표는 명확하나 전문적인 가이드가 필요함
개발 또는 최적화 단계
명확한 데이터 사양을 보유한 데이터/라벨링 전문가 팀

제출함으로써,개인정보 보호 정책에 동의합니다

eae59167-11ec-4866-aea0-52778a5cb5f4

5334b7fd-553c-450b-9345-64379515521f