학술 연구를 위한 오픈 데이터셋
넥스데이타는 대학과 학술 기관을 포함한 전 세계 비상업적 조직을 대상으로 AI 데이터 지원 연구 프로그램을 시작했습니다. 이 프로그램은 AI 학술 연구를 지원하기 위해 컴퓨터 비전, 음성 인식 및 기타 분야에서 귀중한 학습 데이터셋을 제공합니다.
| 데이터셋 이름 | 기록 장치 | 데이터 사이즈 | 사양 |
|---|---|---|---|
| 2시간 - 4개국 영어 음성 합성 코퍼스 | 마이크 | 2시간, 4명 | 인원: 미국, 영국, 호주, 뉴질랜드 출신 4명 형식: 48,000Hz, 24비트, 비압축 WAV, 모노 채널 녹음 환경: 전문 녹음 스튜디오 |
| 20시간 - 휴대폰을 통한 프랑스어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 포르투갈; 언어: 포르투갈어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상; |
| 20시간 - 휴대폰을 통한 독일어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 독일; 언어: 독일어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상; |
| 20시간 - 휴대폰을 통한 이탈리아어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 이탈리아; 언어: 이탈리아어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상 |
| 20시간 - 휴대폰을 통한 스페인어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 스페인; 언어: 스페인어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상 |
| 20시간 - 휴대폰을 통한 유럽 포르투갈어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 포르투갈; 언어: 포르투갈어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상; |
| 20시간 - 휴대폰을 통한 일본어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 일본; 언어: 일본어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상 |
| 20시간 - 휴대폰을 통한 한국어 읽기 및 대화 음성 데이터 | 휴대폰 | 20시간 | 형식: 16kHz, 16비트, 비압축 WAV, 모노 채널; 녹음 조건: 실내 저소음, 에코 없음; 콘텐츠 유형: 읽기, 대화; 녹음 장치: 안드로이드 스마트폰, 아이폰; 국가: 대한민국; 언어: 한국어; 라벨링 특징: 텍스트 전사 포함; 정확도: 단어 정확도율(WAR) 최소 97% 이상 |
| 10시간 - 전화를 통한 파슈토 대화 음성 데이터 | 전화 | 10시간 | 형식: 8kHz 8비트, a-law/u-law PCM, 모노 채널 콘텐츠 범주: 주어진 주제에 따른 대화 녹음 조건: 낮은 배경 소음(실내) 녹음 장치: 전화기 국가: 아프가니스탄(AFG) 언어(지역) 코드: ps-AF 언어: 파슈토어 화자: 총 224명, 남성 92%, 여성 8% 라벨링 특징: 전사 텍스트, 타임스탬프, 화자 ID, 성별 정확도: 단어 정확도율(WAR) 95% 이상 |

후원 데이터셋 선택

양식 제출

피드백 대기

데이터 셋 수신








b707f43d-c664-4fdb-8431-12842fa872c1