[{"@type":"PropertyValue","name":"데이터 규모","value":"9,401장 이미지, 이미지당 어노테이션 문서 1개, 총 269,725개 다각형 박스"},{"@type":"PropertyValue","name":"데이터 형식","value":"이미지 데이터 형식: .jpg, 어노테이션 문서 형식: .json"},{"@type":"PropertyValue","name":"문자 내용","value":"대본, 도서, 시험지 등"},{"@type":"PropertyValue","name":"언어","value":"영어"},{"@type":"PropertyValue","name":"어노테이션 내용","value":"텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사"}]
{"id":1418,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"150","type2str":null,"dataname":"9,401장 영어 문서 OCR 데이터","datazy":[{"title":"데이터 규모","content":"9,401장 이미지, 이미지당 어노테이션 문서 1개, 총 269,725개 다각형 박스"},{"title":"데이터 형식","content":"이미지 데이터 형식: .jpg, 어노테이션 문서 형식: .json"},{"title":"문자 내용","content":"대본, 도서, 시험지 등"},{"title":"언어","content":"영어"},{"title":"어노테이션 내용","content":"텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사"}],"datatag":"English,Document,OCR data","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":null,"samplePresentation":[],"officialSummary":"9,401장의 영어 문서 OCR 데이터입니다. 데이터 언어는 영어이며, 텍스트 내용은 대본, 도서, 시험지 등을 포함합니다. 어노테이션 내용은 텍스트가 나타나는 영역에 대한 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사로 구성됩니다. 본 데이터는 영어 문서 OCR 등의 작업에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["영어","OCR","문서"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"ocr","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,KO\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"9,401 Images-English Document OCR Data","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp
[]
9,401장 영어 문서 OCR 데이터
영어
OCR
문서
9,401장의 영어 문서 OCR 데이터입니다. 데이터 언어는 영어이며, 텍스트 내용은 대본, 도서, 시험지 등을 포함합니다. 어노테이션 내용은 텍스트가 나타나는 영역에 대한 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사로 구성됩니다. 본 데이터는 영어 문서 OCR 등의 작업에 활용할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
![사양]()
사양
데이터 규모
9,401장 이미지, 이미지당 어노테이션 문서 1개, 총 269,725개 다각형 박스
데이터 형식
이미지 데이터 형식: .jpg, 어노테이션 문서 형식: .json
어노테이션 내용
텍스트가 나타나는 영역의 다각형 박스 어노테이션(사각형 박스 어노테이션과 이미지 세그멘테이션 어노테이션의 중간 수준의 정밀도) 및 콘텐츠 전사
![샘플]()
샘플
![추천 데이터셋]()
추천 데이터셋
36e3983d-5327-4e31-88c9-d87e6cda3c52