[{"@type":"PropertyValue","name":"데이터 규모","value":"202명, 1인당 서로 다른 각도의 음성·영상 13개+txt 문서 1개 수집"},{"@type":"PropertyValue","name":"인원 구성","value":"인종 분포: 황인종(인도네시아인); 성별 분포: 남성 89명, 여성 113명; 연령 분포: 18~30세 165명, 31~45세 32명, 46~60세 5명"},{"@type":"PropertyValue","name":"수집 환경","value":"실내 자연광 및 형광등 환경"},{"@type":"PropertyValue","name":"데이터 다양성","value":"다양한 장면, 연령대, 촬영 각도"},{"@type":"PropertyValue","name":"수집 장비","value":"스마트폰, 동영상 해상도 1,920*1,080"},{"@type":"PropertyValue","name":"수집 각도","value":"정면, 왼쪽 얼굴 3개 각도, 오른쪽 얼굴 3개 각도, 하향 촬영, 상향 촬영, 왼쪽 얼굴 하향 촬영, 오른쪽 얼굴 하향 촬영, 왼쪽 얼굴 상향 촬영, 오른쪽 얼굴 상향 촬영 등 총 13개 각도의 음성·영상 데이터 동시 수집"},{"@type":"PropertyValue","name":"녹화 내용","value":"일반 분야, 내용 제한 없음"},{"@type":"PropertyValue","name":"언어","value":"표준 중국어, 각 영상별 20초 이상"},{"@type":"PropertyValue","name":"데이터 형식","value":"영상 형식은 .mp4(오디오≥16KHz 16bit, 프레임 25~30fps)"},{"@type":"PropertyValue","name":"정확도","value":"문자 정확도 95% 이상"}]
{"id":1298,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"149","type2str":null,"dataname":"202명 다각도 입술 형태 멀티모달 데이터|텍스트·음성·이미지·영상 멀티모달 알고리즘 학습 데이터","datazy":[{"title":"데이터 규모","desc":"데이터 규모","content":"202명, 1인당 서로 다른 각도의 음성·영상 13개+txt 문서 1개 수집"},{"title":"인원 구성","desc":"인원 분포","content":"인종 분포: 황인종(인도네시아인); 성별 분포: 남성 89명, 여성 113명; 연령 분포: 18~30세 165명, 31~45세 32명, 46~60세 5명"},{"title":"수집 환경","desc":"수집 환경","content":"실내 자연광 및 형광등 환경"},{"title":"데이터 다양성","desc":"데이터 다양성","content":"다양한 장면, 연령대, 촬영 각도"},{"title":"수집 장비","desc":"수집 장비","content":"스마트폰, 동영상 해상도 1,920*1,080"},{"title":"수집 각도","desc":"수집 각도","content":"정면, 왼쪽 얼굴 3개 각도, 오른쪽 얼굴 3개 각도, 하향 촬영, 상향 촬영, 왼쪽 얼굴 하향 촬영, 오른쪽 얼굴 하향 촬영, 왼쪽 얼굴 상향 촬영, 오른쪽 얼굴 상향 촬영 등 총 13개 각도의 음성·영상 데이터 동시 수집"},{"title":"녹화 내용","desc":"녹화 내용","content":"일반 분야, 내용 제한 없음"},{"title":"언어","desc":"언어","content":"표준 중국어, 각 영상별 20초 이상"},{"title":"데이터 형식","desc":"데이터 형식","content":"영상 형식은 .mp4(오디오≥16KHz 16bit, 프레임 25~30fps)"},{"title":"정확도","desc":"정확도","content":"문자 정확도 95% 이상"}],"datatag":"Lip multimodal,Mandarin Chinese,Multiple scenes,Different ages,Different shooting angles","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"202명의 다각도 입술 형태 멀티모달 영상 데이터입니다. 수집 환경은 실내 자연광 환경과 실내 형광등 환경을 포함합니다. 수집 장비는 휴대폰입니다. 수집 데이터의 다양성은 다양한 환경, 다양한 연령대 및 13가지 촬영 각도를 포함합니다. 언어는 중국어 표준어입니다. 녹음 내용은 일반 분야로, 내용에 제한이 없습니다. 데이터는 음성·이미지 분야의 멀티모달 학습 알고리즘 연구에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["입술 멀티모달","실내 형광등 장면","13개 촬영 각도","표준 중국어"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"202 People - Multi-angle Lip Multimodal Video Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
202명 다각도 입술 형태 멀티모달 데이터|텍스트·음성·이미지·영상 멀티모달 알고리즘 학습 데이터
입술 멀티모달
실내 형광등 장면
13개 촬영 각도
표준 중국어
202명의 다각도 입술 형태 멀티모달 영상 데이터입니다. 수집 환경은 실내 자연광 환경과 실내 형광등 환경을 포함합니다. 수집 장비는 휴대폰입니다. 수집 데이터의 다양성은 다양한 환경, 다양한 연령대 및 13가지 촬영 각도를 포함합니다. 언어는 중국어 표준어입니다. 녹음 내용은 일반 분야로, 내용에 제한이 없습니다. 데이터는 음성·이미지 분야의 멀티모달 학습 알고리즘 연구에 활용할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
데이터 규모
202명, 1인당 서로 다른 각도의 음성·영상 13개+txt 문서 1개 수집
인원 구성
인종 분포: 황인종(인도네시아인); 성별 분포: 남성 89명, 여성 113명; 연령 분포: 18~30세 165명, 31~45세 32명, 46~60세 5명
수집 환경
실내 자연광 및 형광등 환경
데이터 다양성
다양한 장면, 연령대, 촬영 각도
수집 장비
스마트폰, 동영상 해상도 1,920*1,080
수집 각도
정면, 왼쪽 얼굴 3개 각도, 오른쪽 얼굴 3개 각도, 하향 촬영, 상향 촬영, 왼쪽 얼굴 하향 촬영, 오른쪽 얼굴 하향 촬영, 왼쪽 얼굴 상향 촬영, 오른쪽 얼굴 상향 촬영 등 총 13개 각도의 음성·영상 데이터 동시 수집