स्वास्थ्य सेवा एआई के लिए चिकित्सा डेटा कैटलॉग

आपके हेल्थकेयर एआई प्रोजेक्ट को तेजी से शुरू करने के लिए ऑफ-द-शेल्फ हेल्थकेयर/मेडिकल डेटासेट

चिकित्सा डेटा सूची

मशीन लर्निंग के लिए मेडिकल और हेल्थकेयर डेटासेट

शाइप मेडिकल डेटा कैटलॉग में क्या-क्या शामिल है?

शैप मेडिकल डेटा कैटलॉग, HIPAA के अनुरूप, 31 चिकित्सा विशिष्टताओं से संबंधित पहचान रहित स्वास्थ्य सेवा प्रशिक्षण डेटा का एक रेडीमेड पुस्तकालय है, जिसमें 257,977 घंटे की चिकित्सक श्रुतलेख ऑडियो, लिखित चिकित्सा रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड और मल्टीमॉडल डेटासेट शामिल हैं। प्रत्येक डेटासेट वाणिज्यिक AI प्रशिक्षण के लिए लाइसेंस प्राप्त है और इसमें सेफ हार्बर या विशेषज्ञ निर्धारण द्वारा पहचान रहित डेटा शामिल है।

फिजिशियन डिक्टेशन ऑडियो डेटा

स्वास्थ्य देखभाल के लिए हमारे अज्ञात डेटासेट में 31 विशेषज्ञताओं से संबंधित ऑडियो फ़ाइलें शामिल हैं, जो चिकित्सकों द्वारा मरीजों की नैदानिक ​​स्थिति और नैदानिक ​​सेटिंग में चिकित्सक-रोगी मुठभेड़ों के आधार पर देखभाल की योजना का वर्णन करती हैं।

ऑफ-द-शेल्फ फिजिशियन डिक्टेशन ऑडियो फ़ाइलें:

  • स्वास्थ्य सेवा भाषण मॉडलों को प्रशिक्षित करने के लिए 257,977 विशेषज्ञताओं से 31 घंटे का वास्तविक-विश्व चिकित्सक श्रुतलेख भाषण डेटासेट
  • टेलीफोन डिक्टेशन (54.3%), डिजिटल रिकॉर्डर (24.9%), स्पीच माइक (5.4%), स्मार्ट फोन (2.7%) और अज्ञात (12.7%) जैसे विभिन्न उपकरणों से कैप्चर किया गया डिक्टेशन ऑडियो
  • PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए ऑडियो और ट्रांसक्रिप्ट को संपादित किया
चिकित्सक श्रुतलेख ऑडियो डेटा

लिखित मेडिकल रिकॉर्ड

प्रतिलेखित चिकित्सा अभिलेखों में चिकित्सक और रोगी की बातचीत, चिकित्सा रिपोर्टों और चिकित्सा मूल्यांकन का प्रतिलेखन शामिल है। यह भविष्य में आने वाले दौरों के लिए रोगी के चिकित्सा इतिहास को मैप करने में मदद करता है और डॉक्टरों के लिए एक संदर्भ बिंदु के रूप में भी कार्य करता है। यह रोगी की वर्तमान स्थिति का आकलन करने और उपयुक्त उपचार सुझाने में मदद करता है।

ऑफ-द-शेल्फ ट्रांसक्राइब्ड मेडिकल रिकॉर्ड्स:

  • हेल्थकेयर भाषण मॉडल को प्रशिक्षित करने के लिए 257,977 विशिष्टताओं से वास्तविक दुनिया के चिकित्सक श्रुतलेख के 31 घंटों का प्रतिलेखन
  • ऑपरेटिव रिपोर्ट, डिस्चार्ज सारांश, परामर्श नोट, एडमिट नोट, ईडी नोट, क्लिनिक नोट, रेडियोलॉजी रिपोर्ट इत्यादि जैसे विभिन्न कार्य प्रकारों से लिखित मेडिकल रिकॉर्ड।
  • PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए ऑडियो और ट्रांसक्रिप्ट को संपादित किया
लिखित चिकित्सा अभिलेख

इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड (ईएचआर)

इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड या ईएचआर मेडिकल रिकॉर्ड हैं जिनमें रोगी का चिकित्सा इतिहास, निदान, नुस्खे, उपचार योजना, टीकाकरण या टीकाकरण की तारीखें, एलर्जी, रेडियोलॉजी छवियां (सीटी स्कैन, एमआरआई, एक्स-रे), और प्रयोगशाला परीक्षण और बहुत कुछ शामिल हैं।

ऑफ-द-शेल्फ इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड (ईएचआर):

  • 5.1 विशिष्टताओं में 31M+ रिकॉर्ड और चिकित्सक ऑडियो फ़ाइलें
  • क्लिनिकल एनएलपी और अन्य दस्तावेज़ एआई मॉडल को प्रशिक्षित करने के लिए वास्तविक दुनिया के स्वर्ण-मानक मेडिकल रिकॉर्ड
  • मेटाडेटा जानकारी जैसे एमआरएन (अनाम), प्रवेश तिथि, डिस्चार्ज तिथि, ठहरने के दिनों की अवधि, लिंग, रोगी वर्ग, भुगतानकर्ता, वित्तीय वर्ग, राज्य, डिस्चार्ज स्वभाव, आयु, डीआरजी, डीआरजी विवरण, $ प्रतिपूर्ति, एएमएलओएस, जीएमएलओएस, जोखिम मृत्यु दर, बीमारी की गंभीरता, ग्रूपर, अस्पताल ज़िप कोड, आदि।
  • विभिन्न अमेरिकी राज्यों और क्षेत्रों से मेडिकल रिकॉर्ड- उत्तर पूर्व (46%), दक्षिण (9%), मध्यपश्चिम (3%), पश्चिम (28%), अन्य (14%)
  • कवर किए गए सभी रोगी वर्गों से संबंधित मेडिकल रिकॉर्ड - इनपेशेंट, आउटपेशेंट (नैदानिक, पुनर्वास, आवर्ती, सर्जिकल डे केयर), आपातकालीन।
इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड (ईएचआर)
  • सभी रोगी आयु समूहों से संबंधित मेडिकल रिकॉर्ड <10 वर्ष (7.9%), 11-20 वर्ष (5.7%), 21-30 वर्ष (10.9%), 31-40 वर्ष (11.7%), 41-50 वर्ष (10.4%) ), 51-60 वर्ष (13.8%), 61-70 वर्ष (16.1%), 71-80 वर्ष (13.3%), 81-90 वर्ष (7.8%), 90+ वर्ष (2.4%)
  • रोगी लिंग अनुपात 46% (पुरुष) और 54% (महिला)
  • PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए दस्तावेज़ों को संशोधित किया

खरीदारों के लिए पाँच कारण लाइसेंस शैप इसे सिलने के बजाय।

शाइप मेडिकल डेटा कैटलॉग इसलिए मौजूद है क्योंकि अधिकांश हेल्थकेयर एआई टीमें नौ से बारह महीने का समय गंवा देती हैं। किसी भी मॉडल को प्रशिक्षित करने से पहले अनुरूप प्रशिक्षण डेटा प्राप्त करना। उन महीनों का डेटा प्राप्त होने पर क्या परिवर्तन होते हैं, यह यहाँ बताया गया है।

01

कैटलॉग का पैमाना इतना बड़ा है कि ज्यादातर टीमें इसकी बराबरी नहीं कर सकतीं।

शैप कैटलॉग में शामिल हैं 257,977 घंटे चिकित्सक के श्रुतलेखों और प्रतिलेखों से 31 चिकित्सा विशेषताएँऔर ईएचआर रिकॉर्ड जो हर आयु वर्ग के रोगियों को कवर करते हैं — इतनी मात्रा जो खरीदारों को दर्जनों ओपन डेटासेट को एक साथ जोड़े बिना मॉडल को प्रशिक्षित और मूल्यांकन करें.

02

अनुपालन एक प्रारंभिक शर्त है, कोई विशेषता नहीं।

प्रत्येक Shaip मेडिकल डेटासेट के साथ आता है HIPAA सेफ हार्बर के तहत डिफ़ॉल्ट रूप से पहचान छिपानाअनुरोध पर विशेषज्ञ निर्धारण, GDPR के अनुरूप प्रबंधन, और कवर की गई संस्थाओं के लिए BAA की तैयारी। खरीदारों को बाद में अनुपालन को संशोधित करने की आवश्यकता नहीं है।

HIPAA सुरक्षित बंदरगाह विशेषज्ञ निर्धारण GDPR के अनुरूप बीएए-तैयार
03

स्वास्थ्य सेवा में प्रशिक्षित विशेषज्ञ, न कि सामान्य भीड़ कार्यकर्ताओं।

शाइप मेडिकल कैटलॉग पर एनोटेशन, ट्रांसक्रिप्शन और क्यूएशन का कार्य इनके द्वारा किया जाता है। स्वास्थ्य सेवा में प्रशिक्षित विशेषज्ञशाइप वर्कफ़्लो में मल्टी-लेयर क्यूए और ह्यूमन-इन-द-लूप वैलिडेशन शामिल हैं, जिन्हें क्लिनिकल सटीकता मानकों के अनुसार कैलिब्रेट किया गया है।

04

आज रेडीमेड उपलब्ध, ऑर्डर पर कस्टमाइज्ड।

खरीदार मौजूदा शाइप डेटासेट का तुरंत लाइसेंस ले सकते हैं या विशिष्ट जनसांख्यिकी, भूगोल, भाषाओं और तौर-तरीकों के अनुरूप कस्टम डेटा संग्रह का ऑर्डर दे सकते हैं। विक्रेताओं को बदले बिना या अनुपालन समीक्षा को दोबारा चलाए बिना.

05

यह सुविधा उन स्थानों पर उपलब्ध है जहां डेटा टीमें पहले से ही काम कर रही हैं।

Shaip के पहचान रहित EHR और चिकित्सक श्रुतलेख डेटासेट उपलब्ध हैं। डेटाब्रिक्स मार्केटप्लेसडेटा और मशीन लर्निंग टीमें जिन फॉर्मेट का पहले से इस्तेमाल करती हैं, उनमें डिलीवरी की सुविधा उपलब्ध है — JSON, CSV, WAV। किसी भी प्रतिबद्धता से पहले सैंपल डेटासेट उपलब्ध हैं।

JSON CSV WAV एफएचआईआर

सुरक्षा और अनुपालन

GDPR
HIPAA
आईएसओ 9001: 2015
एसओसी 2 प्रकार II
आईएसओ 27001
शेप हमसे संपर्क करें

पता लगाने में सक्षम है जिसकी आपको तलाश है?

सभी प्रकार के डेटा में नए ऑफ-द-शेल्फ मेडिकल डेटासेट एकत्र किए जा रहे हैं 

अपनी स्वास्थ्य देखभाल प्रशिक्षण डेटा संग्रह की चिंताओं से छुटकारा पाने के लिए अभी हमसे संपर्क करें

  • इस क्षेत्र सत्यापन उद्देश्यों के लिए है और अपरिवर्तित छोड़ दिया जाना चाहिए।
  • पंजीकरण करके, मैं शैप से सहमत हूं गोपनीयता नीति और सेवा की शर्तें और Shaip से B2B मार्केटिंग संचार प्राप्त करने के लिए अपनी सहमति प्रदान करता/करती हूँ।

मेडिकल डेटासेट स्वास्थ्य सेवा संबंधी डेटा होते हैं जिनका उपयोग AI/ML मॉडल को प्रशिक्षित करने, उनका मूल्यांकन करने और उनमें सुधार करने के लिए किया जाता है। इनमें चिकित्सक द्वारा दिए गए श्रुतलेख की ऑडियो रिकॉर्डिंग, लिखित मेडिकल रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड, कृत्रिम चिकित्सक-रोगी संवाद और प्रासंगिक पाठ, भाषण और संरचित नैदानिक ​​डेटा को संयोजित करने वाले बहुआयामी स्वास्थ्य सेवा डेटासेट शामिल हो सकते हैं।

शैप मेडिकल डेटा कैटलॉग में चिकित्सकों द्वारा दिए गए श्रुतलेख का ऑडियो, लिखित चिकित्सा रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड, कृत्रिम चिकित्सक-रोगी संवाद और बहुआयामी डेटासेट शामिल हैं जो रोगी या परामर्श स्तर पर पाठ, भाषण और संरचित नैदानिक ​​डेटा को आपस में जोड़ते हैं। इसमें 31 चिकित्सा विशिष्टताओं में चिकित्सकों द्वारा दिए गए 257,977 घंटे का ऑडियो शामिल है और यह व्यावसायिक एआई प्रशिक्षण के लिए उपलब्ध है।

जी हां। शैप के मेडिकल डेटासेट को HIPAA सेफ हार्बर के तहत डिफ़ॉल्ट रूप से डी-आइडेंटिफाइड किया जाता है, जिससे HIPAA गोपनीयता नियम में निर्दिष्ट 18 श्रेणियों के पहचानकर्ताओं को हटा दिया जाता है। सांख्यिकीय प्रमाणीकरण की आवश्यकता होने पर विशेषज्ञ निर्धारण डी-आइडेंटिफिकेशन भी उपलब्ध है, और शैप कवर की गई संस्थाओं के लिए BAA के लिए तैयार है।

जी हां। परियोजना के दायरे, भौगोलिक स्थिति, डेटा के प्रकार और संविदात्मक आवश्यकताओं के आधार पर, Shaip के चिकित्सा डेटासेट को HIPAA, GDPR और अन्य लागू स्वास्थ्य सेवा डेटा आवश्यकताओं का समर्थन करने के लिए तैयार किया जा सकता है।

दोनों विकल्प उपलब्ध हैं। Shaip, Shaip मेडिकल डेटा कैटलॉग के माध्यम से व्यावसायिक AI प्रशिक्षण के लिए तैयार स्वास्थ्य सेवा डेटासेट प्रदान करता है। यदि किसी परियोजना के लिए किसी विशिष्ट भाषा, जनसांख्यिकी, विशेषज्ञता, पद्धति या नैदानिक ​​​​स्थिति की आवश्यकता होती है, तो Shaip समान अनुपालन मानकों के तहत अनुकूलित चिकित्सा डेटा संग्रह भी कर सकता है।

जी हां। Shaip चिकित्सा डेटासेट को विशेषज्ञता, रोगी की आयु सीमा, लिंग, भौगोलिक स्थिति, भाषा, उपचार पद्धति, नैदानिक ​​​​सेटिंग, प्रारूप, मात्रा और परियोजना आवश्यकताओं के आधार पर अनुकूलित कर सकता है। अनुकूलित डेटासेट का दायरा कार्य विवरण के माध्यम से निर्धारित किया जाता है और यह लागू पहचान-निवारण और अनुपालन मानकों का पालन करता है।

जी हां। Shaip NDA के तहत प्रतिनिधि नमूना डेटासेट उपलब्ध कराता है ताकि AI टीमें लाइसेंस देने से पहले प्रारूप, गुणवत्ता, जनसांख्यिकीय कवरेज और मॉडल की उपयुक्तता का मूल्यांकन कर सकें। मानक लाइसेंस या कस्टम कलेक्शन अनुबंध से पहले नमूना डेटासेट तक पहुंच आमतौर पर पहला कदम होता है।

Shaip, संरचित रिकॉर्ड के लिए JSON, CSV और FHIR सहित AI-अनुकूल प्रारूपों में चिकित्सा डेटासेट उपलब्ध कराता है; ऑडियो के लिए युग्मित प्रतिलेखों वाली WAV फ़ाइलें; और भाषण और भाषा डेटासेट के लिए प्रतिलेख फ़ाइलें भी उपलब्ध कराता है। मल्टीमॉडल डेटासेट में टेक्स्ट, ऑडियो और संरचित नैदानिक ​​रिकॉर्ड को जोड़ने वाली मैनिफ़ेस्ट फ़ाइलें शामिल हो सकती हैं।

Shaip विशेषज्ञ समीक्षा, डोमेन-विशेषज्ञ एनोटेशन, सत्यापन कार्यप्रवाह और संरचित QA जांच के माध्यम से चिकित्सा डेटासेट की गुणवत्ता सुनिश्चित करता है। ये प्रक्रियाएं स्वास्थ्य सेवा AI विकास के लिए सटीकता, विश्वसनीयता और मॉडल की तत्परता सुनिश्चित करने में सहायक होती हैं।

जी हां। Shaip के मेडिकल डेटासेट छोटे पायलट प्रोजेक्ट और बड़े AI/ML प्रोजेक्ट दोनों के लिए उपयुक्त हैं। ये उन प्रोजेक्टों को सपोर्ट कर सकते हैं जिनमें बड़ी मात्रा में मेडिकल रिकॉर्ड, संरचित क्लिनिकल डेटा, ट्रांसक्रिप्ट या लाखों घंटों के डॉक्टर के श्रुतलेख ऑडियो की आवश्यकता होती है।

जी हां। Shaip तैयार उपयोग प्रारूपों जैसे JSON, CSV, FHIR, WAV और ट्रांसक्रिप्ट फ़ाइलों में मेडिकल डेटासेट उपलब्ध कराता है। ये प्रारूप मौजूदा AI, ML, NLP, स्पीच, हेल्थकेयर LLM और मल्टीमॉडल मॉडल विकास वर्कफ़्लो में एकीकरण का समर्थन करते हैं।

तैयार चिकित्सा डेटासेट आमतौर पर नमूने की समीक्षा, अनुबंध पर हस्ताक्षर और लाइसेंस को अंतिम रूप देने के कुछ ही दिनों के भीतर उपलब्ध कराए जा सकते हैं। कस्टम डेटा संग्रह की समयसीमा परियोजना के दायरे, डेटासेट के आकार, कार्यप्रणाली, अनुपालन आवश्यकताओं और जटिलता पर निर्भर करती है, और कार्य विवरण में परिभाषित की जाती है।

मेडिकल डेटासेट की लागत डेटासेट के प्रकार, कार्यप्रणाली, मात्रा, अनुकूलन आवश्यकताओं, लाइसेंसिंग शर्तों, वितरण समयसीमा और अनुपालन आवश्यकताओं पर निर्भर करती है। टीमें संपर्क फ़ॉर्म के माध्यम से अपनी आवश्यकताएं साझा कर सकती हैं और अनुकूलित कोटेशन प्राप्त कर सकती हैं।

उच्च गुणवत्ता वाले मेडिकल डेटासेट सटीक, विश्वसनीय और चिकित्सकीय रूप से उपयोगी हेल्थकेयर एआई मॉडल को प्रशिक्षित करने के लिए आवश्यक हैं। ये मेडिकल डॉक्यूमेंटेशन, क्लिनिकल एनएलपी, स्पीच रिकग्निशन, समराइजेशन, डिसीजन सपोर्ट, ऑटोमेशन, पेशेंट केयर वर्कफ़्लो और हेल्थकेयर डेटा इंटेलिजेंस को बेहतर बनाने में मदद करते हैं।