[{"@type":"PropertyValue","name":"데이터 규모","value":"4,995장, 자연 장면 이미지 258장, 인터넷 이미지 2,553장, 텍스트 이미지 2,184장 포함"},{"@type":"PropertyValue","name":"수집 환경","value":"자연 장면(간판, 포장 설명, 전단지, 메뉴판, 포스터 등), 인터넷 이미지(잡지 표지, 만화 표지 등), 텍스트 이미지(문서 등) 포함"},{"@type":"PropertyValue","name":"수집 다양성","value":"다양한 장면, 다양한 각도, 다양한 조명 조건 포함"},{"@type":"PropertyValue","name":"수집 장비","value":"모바일"},{"@type":"PropertyValue","name":"수집 각도","value":"앙각,수평"},{"@type":"PropertyValue","name":"데이터 형식","value":"이미지 데이터 포맷은 .jpg, 라벨링 문서 데이터 포맷은 .json"},{"@type":"PropertyValue","name":"어노테이션 내용","value":"행 단위 사각형 라벨링, 행 단위 내용 전사; 열 단위 사각형 라벨링, 열 단위 내용 전사"},{"@type":"PropertyValue","name":"정확도","value":"사각형 박스 꼭짓점의 오차가 10픽셀 이하일 경우 정확한 검출로 간주, 검출 박스 정확도는 97% 이상; 텍스트 전사 정확도는 97% 이상"}]
{"id":1059,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_tuxiang_default.webp","type1":"147","type1str":null,"type2":"150","type2str":null,"dataname":"4,995장 베트남어 OCR 어노테이션 및 전사 데이터","datazy":[{"title":"데이터 규모","content":"4,995장, 자연 장면 이미지 258장, 인터넷 이미지 2,553장, 텍스트 이미지 2,184장 포함","desc":"데이터 규모"},{"title":"수집 환경","content":"자연 장면(간판, 포장 설명, 전단지, 메뉴판, 포스터 등), 인터넷 이미지(잡지 표지, 만화 표지 등), 텍스트 이미지(문서 등) 포함","desc":"수집 환경"},{"title":"수집 다양성","content":"다양한 장면, 다양한 각도, 다양한 조명 조건 포함","desc":"수집 다양성"},{"title":"수집 장비","content":"모바일","desc":"수집 장비"},{"title":"수집 각도","content":"앙각,수평","desc":"수집 각도"},{"title":"데이터 형식","content":"이미지 데이터 포맷은 .jpg, 라벨링 문서 데이터 포맷은 .json","desc":"데이터 형식"},{"title":"어노테이션 내용","content":"행 단위 사각형 라벨링, 행 단위 내용 전사; 열 단위 사각형 라벨링, 열 단위 내용 전사","desc":"라벨링 내용"},{"title":"정확도","content":"사각형 박스 꼭짓점의 오차가 10픽셀 이하일 경우 정확한 검출로 간주, 검출 박스 정확도는 97% 이상; 텍스트 전사 정확도는 97% 이상","desc":"정확도"}],"datatag":"Vietnamese OCR,Multiple scenes,Multiple angles,Different light conditions","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"/data/apps/damp/temp/ziptemp/APY200102002_demo1695808985220/APY200102002_demo/3.jpg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY200102002_demo1695808985220/APY200102002_demo/3.jpg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=7TSAykKx%2FoJxOcmQFM5UWT1Pc4o%3D","intro":"","size":0,"progress":100,"type":"jpg"},{"name":"/data/apps/damp/temp/ziptemp/APY200102002_demo1695808985220/APY200102002_demo/5.jpg","url":"https://bj-oss-datatang-03.oss-cn-beijing.aliyuncs.com/filesInfoUpload/data/apps/damp/temp/ziptemp/APY200102002_demo1695808985220/APY200102002_demo/5.jpg?Expires=4102329599&OSSAccessKeyId=LTAI8NWs2pDolLNH&Signature=GF0IWNgdbst4A2PLeJ9K3HXqsj8%3D","intro":"","size":0,"progress":100,"type":"jpg"}],"officialSummary":"4,995장의 베트남어 OCR 어노테이션 및 전사 데이터로, 자연 환경 이미지 258장, 스크린샷 2,553장 및 텍스트 이미지 2,184장을 포함합니다. 어노테이션 측면에서는 행 단위 콘텐츠에 대해 행 단위 사변형 박스 어노테이션 및 행 단위 콘텐츠 전사를 진행했으며, 세로 열 콘텐츠에 대해서는 세로 열 사변형 박스 어노테이션 및 세로 열 콘텐츠 전사를 진행했습니다. 본 베트남어 OCR 어노테이션 및 전사 데이터는 다양한 환경에서의 베트남어 인식, 베트남어 사진 번역 등의 작업에 활용할 수 있습니다.","dataexampl":null,"datakeyword":["베트남어","OCR","문서 이미지","인터넷 이미지","자연 장면","다양한 각도","다른 조도 조건","텍스트 라인 수준 전사"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"ocr","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"4,995 Vietnamese OCR Images Data - Images with Annotation and Transcription","BGimg":"","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
4,995장의 베트남어 OCR 어노테이션 및 전사 데이터로, 자연 환경 이미지 258장, 스크린샷 2,553장 및 텍스트 이미지 2,184장을 포함합니다. 어노테이션 측면에서는 행 단위 콘텐츠에 대해 행 단위 사변형 박스 어노테이션 및 행 단위 콘텐츠 전사를 진행했으며, 세로 열 콘텐츠에 대해서는 세로 열 사변형 박스 어노테이션 및 세로 열 콘텐츠 전사를 진행했습니다. 본 베트남어 OCR 어노테이션 및 전사 데이터는 다양한 환경에서의 베트남어 인식, 베트남어 사진 번역 등의 작업에 활용할 수 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
데이터 규모
4,995장, 자연 장면 이미지 258장, 인터넷 이미지 2,553장, 텍스트 이미지 2,184장 포함
수집 환경
자연 장면(간판, 포장 설명, 전단지, 메뉴판, 포스터 등), 인터넷 이미지(잡지 표지, 만화 표지 등), 텍스트 이미지(문서 등) 포함
수집 다양성
다양한 장면, 다양한 각도, 다양한 조명 조건 포함
수집 장비
모바일
수집 각도
앙각,수평
데이터 형식
이미지 데이터 포맷은 .jpg, 라벨링 문서 데이터 포맷은 .json
어노테이션 내용
행 단위 사각형 라벨링, 행 단위 내용 전사; 열 단위 사각형 라벨링, 열 단위 내용 전사
정확도
사각형 박스 꼭짓점의 오차가 10픽셀 이하일 경우 정확한 검출로 간주, 검출 박스 정확도는 97% 이상; 텍스트 전사 정확도는 97% 이상