[{"@type":"PropertyValue","name":"데이터 규모","value":"426,687장"},{"@type":"PropertyValue","name":"언어 종류 구성","value":"번체 중국어, 일본어, 한국어, 인도네시아어, 말레이어, 태국어, 베트남어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 러시아어, 스페인어, 아랍어, 터키어, 폴란드어, 네덜란드어, 그리스어, 체코어, 필리핀어(타갈로그어)"},{"@type":"PropertyValue","name":"수집 환경","value":"자연 장면: 표어, 포스터, 경고문, 도로 표지판, 식품 포장재, 광고판, 버스 정류장 안내판, 간판 등; 문서 촬영 장면: 인쇄 문서, 카드, 영수증, 서적 및 신문 등; 전자 장면: 컴퓨터 스크린샷, 모바일 스크린샷, 전자 문서"},{"@type":"PropertyValue","name":"수집 다양성","value":"다양한 수집 환경, 촬영 각도 및 언어"},{"@type":"PropertyValue","name":"수집 장비","value":"스마트폰, 컴퓨터"},{"@type":"PropertyValue","name":"촬영 각도","value":"앙각, 부감 및 평시 촬영"},{"@type":"PropertyValue","name":"데이터 형식","value":".jpg 등 일반 이미지 형식"},{"@type":"PropertyValue","name":"정확도","value":"수집 요구 사항에 따라 수집 정확도는 95% 이상"}]
{"id":1759,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"150","type2str":null,"dataname":"426,687장 자연 장면, 문서 촬영 장면 및 전자 장면 OCR 수집 데이터","datazy":[{"title":"데이터 규모","content":"426,687장","desc":"데이터 규모"},{"title":"언어 종류 구성","content":"번체 중국어, 일본어, 한국어, 인도네시아어, 말레이어, 태국어, 베트남어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 러시아어, 스페인어, 아랍어, 터키어, 폴란드어, 네덜란드어, 그리스어, 체코어, 필리핀어(타갈로그어)","desc":"언어 종류 분포"},{"title":"수집 환경","content":"자연 장면: 표어, 포스터, 경고문, 도로 표지판, 식품 포장재, 광고판, 버스 정류장 안내판, 간판 등; 문서 촬영 장면: 인쇄 문서, 카드, 영수증, 서적 및 신문 등; 전자 장면: 컴퓨터 스크린샷, 모바일 스크린샷, 전자 문서","desc":"수집 환경"},{"title":"수집 다양성","content":"다양한 수집 환경, 촬영 각도 및 언어","desc":"수집 다양성"},{"title":"수집 장비","content":"스마트폰, 컴퓨터","desc":"수집 장비"},{"title":"촬영 각도","content":"앙각, 부감 및 평시 촬영","desc":"촬영 각도"},{"title":"데이터 형식","content":".jpg 등 일반 이미지 형식","desc":"데이터 형식"},{"title":"정확도","content":"수집 요구 사항에 따라 수집 정확도는 95% 이상","desc":"정확도"}],"datatag":"Natural Scenes,Document Photography Scenes,Electronic Scenes,OCR","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"426,687장의 자연 장면, 문서 촬영 장면 및 전자 장면 OCR 수집 데이터는 번체 중국어, 일본어, 한국어, 인도네시아어, 말레이어, 태국어, 베트남어, 폴란드어 등 20개 언어를 포함합니다. 데이터 다양성은 다양한 자연 장면 및 다양한 촬영 각도를 포함합니다. 본 데이터셋은 다국어 OCR 태스크에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["자연 환경","문서","OCR"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"ocr","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES,JP\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"426,687 Images - Natural Scenes & Document Photography Scenes & Electronic Scenes OCR Collection Data of 20 Countries","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
426,687장의 자연 장면, 문서 촬영 장면 및 전자 장면 OCR 수집 데이터는 번체 중국어, 일본어, 한국어, 인도네시아어, 말레이어, 태국어, 베트남어, 폴란드어 등 20개 언어를 포함합니다. 데이터 다양성은 다양한 자연 장면 및 다양한 촬영 각도를 포함합니다. 본 데이터셋은 다국어 OCR 태스크에 활용할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.