[{"@type":"PropertyValue","name":"데이터 규모","value":"128,900장 이미지, 이미지당 어노테이션 문서 1개, 총 2,570,135개 다각형 박스"},{"@type":"PropertyValue","name":"데이터 형식","value":"이미지 데이터 형식: .jpg 및 .jpeg, 어노테이션 문서 형식: .json"},{"@type":"PropertyValue","name":"환경 구성","value":"블러 환경, 자연 환경"},{"@type":"PropertyValue","name":"촬영 방식","value":"핸드헬드 촬영, 모아레"},{"@type":"PropertyValue","name":"언어 구성","value":"아랍어, 프랑스어, 독일어, 힌디어, 이탈리아어, 포르투갈어, 스페인어"},{"@type":"PropertyValue","name":"어노테이션 내용","value":"텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사"}]
{"id":1416,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"150","type2str":null,"dataname":"128,900장 7개 언어 다중 환경 OCR 데이터","datazy":[{"title":"데이터 규모","content":"128,900장 이미지, 이미지당 어노테이션 문서 1개, 총 2,570,135개 다각형 박스"},{"title":"데이터 형식","content":"이미지 데이터 형식: .jpg 및 .jpeg, 어노테이션 문서 형식: .json"},{"title":"환경 구성","content":"블러 환경, 자연 환경"},{"title":"촬영 방식","content":"핸드헬드 촬영, 모아레"},{"title":"언어 구성","content":"아랍어, 프랑스어, 독일어, 힌디어, 이탈리아어, 포르투갈어, 스페인어"},{"title":"어노테이션 내용","content":"텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사"}],"datatag":"Seven Languages,Multiple scenes,OCR data","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[],"officialSummary":"128,900장 7개 언어 다중 환경 OCR 데이터입니다. 본 데이터는 아랍어, 프랑스어, 독일어, 힌디어, 이탈리아어, 포르투갈어 및 스페인어의 7개 언어를 포함하며, 블러 환경과 자연 환경으로 구성됩니다. 또한 핸드헬드 촬영과 모아레의 두 가지 특수 촬영 방식을 포함합니다. 어노테이션 내용은 텍스트가 나타나는 영역에 대한 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사로 구성됩니다. 본 데이터는 OCR 등의 작업에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["7개 언어","OCR"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"ocr","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,KO\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"128,900 Images-Multiple Scenes OCR Data of Seven Languages","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
128,900장 7개 언어 다중 환경 OCR 데이터입니다. 본 데이터는 아랍어, 프랑스어, 독일어, 힌디어, 이탈리아어, 포르투갈어 및 스페인어의 7개 언어를 포함하며, 블러 환경과 자연 환경으로 구성됩니다. 또한 핸드헬드 촬영과 모아레의 두 가지 특수 촬영 방식을 포함합니다. 어노테이션 내용은 텍스트가 나타나는 영역에 대한 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사로 구성됩니다. 본 데이터는 OCR 등의 작업에 활용할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
데이터 규모
128,900장 이미지, 이미지당 어노테이션 문서 1개, 총 2,570,135개 다각형 박스
데이터 형식
이미지 데이터 형식: .jpg 및 .jpeg, 어노테이션 문서 형식: .json
환경 구성
블러 환경, 자연 환경
촬영 방식
핸드헬드 촬영, 모아레
언어 구성
아랍어, 프랑스어, 독일어, 힌디어, 이탈리아어, 포르투갈어, 스페인어
어노테이션 내용
텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사