[{"@type":"PropertyValue","name":"형식","value":"16kHz, 16bit, WAV, 모노"},{"@type":"PropertyValue","name":"내용 분류","value":"대화류, 개인 미디어류, 예능류 등"},{"@type":"PropertyValue","name":"녹음 환경","value":"저소음"},{"@type":"PropertyValue","name":"국가","value":"태국"},{"@type":"PropertyValue","name":"언어 지역 코드","value":"th-TH"},{"@type":"PropertyValue","name":"언어","value":"태국어"},{"@type":"PropertyValue","name":"라벨링 특성","value":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링"},{"@type":"PropertyValue","name":"정확도","value":"단어 정확도 98%(라벨링, 성별 식별, 화자 식별, 악센트, 주제는 정확도 산정에서 제외)"}]
{"id":1687,"datatype":"1","titleimg":"https://ko.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"900시간 태국어 구어체 음성 데이터","datazy":[{"title":"형식","content":"16kHz, 16bit, WAV, 모노","desc":"형식"},{"title":"내용 분류","content":"대화류, 개인 미디어류, 예능류 등","desc":"내용 분류"},{"title":"녹음 환경","content":"저소음","desc":"녹음 환경"},{"title":"국가","content":"태국","desc":"국가"},{"title":"언어 지역 코드","content":"th-TH","desc":"언어 지역 코드"},{"title":"언어","content":"태국어","desc":"언어"},{"title":"라벨링 특성","content":"텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링","desc":"라벨링 특성"},{"title":"정확도","content":"단어 정확도 98%(라벨링, 성별 식별, 화자 식별, 악센트, 주제는 정확도 산정에서 제외)","desc":"정확도"}],"datatag":"Thai,Casual Conversation,ASR","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[{"name":"500001_6.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250721175406/500001_6.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=2OvhfaFaWY3zdwE%2BIHh5Rg8oXJg%3D","intro":"คุณผู้ฟังมีความคิดแบบนี้ไหมคะ ในวันที่เราเหนื่อยมากมาก เราท้อมากมาก เราเริ่มไม่อยากจะมีชีวิตอยู่แล้ว","size":241800,"progress":100,"type":"mp3"},{"name":"500002_8.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250721175406/500002_8.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=%2BXu1ouOHCx9fViVsDUxgWwASHxw%3D","intro":"อยู่ที่โคราช แล้วจะมีการซ้อมรบกันอยู่ ฝึกซ้อมรบกันอยู่น่ะ ก็ตั้งชื่อผมอะคลอดพอดี ก็ตั้งชื่อผมว่าประลองยุทธ์","size":253750,"progress":100,"type":"mp3"},{"name":"500004_4.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250721175406/500004_4.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=UI2MbKqovKI%2Fx0Rl8er4Ho3658w%3D","intro":"ปรุงแต่งอยู่ในนั้น","size":45930,"progress":100,"type":"mp3"},{"name":"500004_8.wav","url":"https://storage-product.datatang.com/damp/product/sample_presentation/20250721175406/500004_8.wav?Expires=4102415999&OSSAccessKeyId=LTAI5tEBeSWUJiqjXvBMsxEu&Signature=7Bd6uuRU0TtemREj9fJavah7cRI%3D","intro":"มันก็จะทำให้ใจรู้สึกปฏิเสธมากมาก เนี่ย แล้วมันก็เลยส่งผลออกมาเป็นความจำความรู้สึก","size":185224,"progress":100,"type":"mp3"}],"officialSummary":"태국어 구어체 음성 데이터는 대화, 1인 미디어, 예능 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 이 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 라벨링되어 있으며, 정확도와 활용도가 높아 음성 인식 연구 및 응용에 풍부한 자원을 제공합니다. 여러 AI 기업의 검증을 통해 실제 세계의 다양성에 대응하는 데 탁월한 성능을 보이는 것으로 입증되었습니다. 데이터 수집, 저장, 사용 전 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 및 개인정보 관련 법규를 철저히 준수하고 있습니다.","dataexampl":null,"datakeyword":["태국어","일상 대화","자동 음성 인식"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1004 Hours - Thai(Thailand) Real-world Casual Conversation and Monologue speech dataset","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
태국어 구어체 음성 데이터는 대화, 1인 미디어, 예능 등 일반적인 분야의 콘텐츠를 포함하고 있으며, 실제 세계의 상호작용 상황을 반영합니다. 이 데이터셋은 텍스트 내용, 화자 정보, 성별 등 다양한 속성이 라벨링되어 있으며, 정확도와 활용도가 높아 음성 인식 연구 및 응용에 풍부한 자원을 제공합니다. 여러 AI 기업의 검증을 통해 실제 세계의 다양성에 대응하는 데 탁월한 성능을 보이는 것으로 입증되었습니다. 데이터 수집, 저장, 사용 전 과정에서 GDPR, CCPA, PIPL 등 데이터 보호 및 개인정보 관련 법규를 철저히 준수하고 있습니다.
이는 상업적 사용, 연구 목적 등을 위한 유료 데이터셋입니다.라이선스가 부여된 기성 데이터셋은 AI 프로젝트의 빠른 시작에 도움을 줍니다.
사양
형식
16kHz, 16bit, WAV, 모노
내용 분류
대화류, 개인 미디어류, 예능류 등
녹음 환경
저소음
국가
태국
언어 지역 코드
th-TH
언어
태국어
라벨링 특성
텍스트 내용, 문장 타임스탬프, 화자 식별, 성별, 잡음 라벨링
정확도
단어 정확도 98%(라벨링, 성별 식별, 화자 식별, 악센트, 주제는 정확도 산정에서 제외)