[{"@type":"PropertyValue","name":"데이터 규모","value":"14,980장,8종 언어"},{"@type":"PropertyValue","name":"수집 환경","value":"회의실(행사장), 컨퍼런스홀 포함"},{"@type":"PropertyValue","name":"언어 구성","value":"프랑스어, 한국어, 일본어, 스페인어, 독일어, 이탈리아어, 포르투갈어, 러시아어"},{"@type":"PropertyValue","name":"수집 다양성","value":"다양한 환경, 다양한 언어, 다양한 촬영 각도, 다양한 촬영 거리, 다양한 조명 조건 포함"},{"@type":"PropertyValue","name":"수집 장비","value":"스마트폰"},{"@type":"PropertyValue","name":"수집 각도","value":"정면, 사선 촬영(좌측, 우측), 앙각 촬영"},{"@type":"PropertyValue","name":"데이터 형식","value":"이미지 형식: .jpg, 어노테이션 문서 형식: .json"},{"@type":"PropertyValue","name":"어노테이션 내용","value":"행 단위 사각형 어노테이션, 행 단위 사각형 전사"},{"@type":"PropertyValue","name":"정확도","value":"사변형 박스 꼭짓점 오차가 5픽셀 이내인 경우 올바른 검출로 판정, 검출 박스 정확도 95% 이상; 텍스트 전사 정확도 95% 이상"}]
{"id":979,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"150","type2str":null,"dataname":"14,980장 8개 언어 PPT OCR 데이터","datazy":[{"title":"데이터 규모","content":"14,980장,8종 언어"},{"title":"수집 환경","content":"회의실(행사장), 컨퍼런스홀 포함"},{"title":"언어 구성","content":"프랑스어, 한국어, 일본어, 스페인어, 독일어, 이탈리아어, 포르투갈어, 러시아어"},{"title":"수집 다양성","content":"다양한 환경, 다양한 언어, 다양한 촬영 각도, 다양한 촬영 거리, 다양한 조명 조건 포함"},{"title":"수집 장비","content":"스마트폰"},{"title":"수집 각도","content":"정면, 사선 촬영(좌측, 우측), 앙각 촬영"},{"title":"데이터 형식","content":"이미지 형식: .jpg, 어노테이션 문서 형식: .json"},{"title":"어노테이션 내용","content":"행 단위 사각형 어노테이션, 행 단위 사각형 전사"},{"title":"정확도","content":"사변형 박스 꼭짓점 오차가 5픽셀 이내인 경우 올바른 검출로 판정, 검출 박스 정확도 95% 이상; 텍스트 전사 정확도 95% 이상"}],"datatag":"Multiple scenes,Multiple languages,Different photographic angles,Different photographic distances,Different light conditions","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/2.jpg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/2.jpg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=sqPdc1rGwcLu%2BK2TLOwTHcVrLQs%3D","intro":"","size":0,"progress":100,"type":"jpg"},{"name":"/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/3.jpg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/3.jpg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=uOxRQ0dl8DcDwkjpEaXwlvSDyPg%3D","intro":"","size":0,"progress":100,"type":"jpg"},{"name":"/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/1.jpg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY190221001_demo1695808941160/APY190221001_demo/1.jpg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=1jE3Q1rsa7koY0u0viSa%2FobOefo%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"14,980장의 8개 언어 PPT OCR 데이터로, 8개 언어, 다양한 환경, 다양한 촬영 각도, 다양한 촬영 거리 및 다양한 조명 조건을 포함합니다. 어노테이션 측면에서는 행 단위 텍스트의 사변형 박스 어노테이션 및 행 단위 텍스트 전사를 진행했습니다. 본 다국어 PPT OCR 데이터는 다국어 OCR 등의 작업에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["PPT","OCR","다양한 각도","다양한 언어","다양한 조명 조건","영어","한국어","일본어"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"ocr","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,KO\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"14,980 Images PPT OCR Data of 8 Languages","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
14,980장의 8개 언어 PPT OCR 데이터로, 8개 언어, 다양한 환경, 다양한 촬영 각도, 다양한 촬영 거리 및 다양한 조명 조건을 포함합니다. 어노테이션 측면에서는 행 단위 텍스트의 사변형 박스 어노테이션 및 행 단위 텍스트 전사를 진행했습니다. 본 다국어 PPT OCR 데이터는 다국어 OCR 등의 작업에 활용할 수 있습니다.
본 데이터셋은 사업적 활용이 가능한 유료 데이터셋입니다. 즉시 활용 가능한 형태로 제공되어 AI 프로젝트에 빠르게 적용할 수 있습니다.
사양
데이터 규모
14,980장,8종 언어
수집 환경
회의실(행사장), 컨퍼런스홀 포함
언어 구성
프랑스어, 한국어, 일본어, 스페인어, 독일어, 이탈리아어, 포르투갈어, 러시아어
수집 다양성
다양한 환경, 다양한 언어, 다양한 촬영 각도, 다양한 촬영 거리, 다양한 조명 조건 포함
수집 장비
스마트폰
수집 각도
정면, 사선 촬영(좌측, 우측), 앙각 촬영
데이터 형식
이미지 형식: .jpg, 어노테이션 문서 형식: .json
어노테이션 내용
행 단위 사각형 어노테이션, 행 단위 사각형 전사
정확도
사변형 박스 꼭짓점 오차가 5픽셀 이내인 경우 올바른 검출로 판정, 검출 박스 정확도 95% 이상; 텍스트 전사 정확도 95% 이상