स्वास्थ्य सेवा एआई के लिए चिकित्सा डेटा कैटलॉग
आपके हेल्थकेयर एआई प्रोजेक्ट को तेजी से शुरू करने के लिए ऑफ-द-शेल्फ हेल्थकेयर/मेडिकल डेटासेट
मशीन लर्निंग के लिए मेडिकल और हेल्थकेयर डेटासेट
शाइप मेडिकल डेटा कैटलॉग में क्या-क्या शामिल है?
शैप मेडिकल डेटा कैटलॉग, HIPAA के अनुरूप, 31 चिकित्सा विशिष्टताओं से संबंधित पहचान रहित स्वास्थ्य सेवा प्रशिक्षण डेटा का एक रेडीमेड पुस्तकालय है, जिसमें 257,977 घंटे की चिकित्सक श्रुतलेख ऑडियो, लिखित चिकित्सा रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड और मल्टीमॉडल डेटासेट शामिल हैं। प्रत्येक डेटासेट वाणिज्यिक AI प्रशिक्षण के लिए लाइसेंस प्राप्त है और इसमें सेफ हार्बर या विशेषज्ञ निर्धारण द्वारा पहचान रहित डेटा शामिल है।
फिजिशियन डिक्टेशन ऑडियो डेटा
स्वास्थ्य देखभाल के लिए हमारे अज्ञात डेटासेट में 31 विशेषज्ञताओं से संबंधित ऑडियो फ़ाइलें शामिल हैं, जो चिकित्सकों द्वारा मरीजों की नैदानिक स्थिति और नैदानिक सेटिंग में चिकित्सक-रोगी मुठभेड़ों के आधार पर देखभाल की योजना का वर्णन करती हैं।
ऑफ-द-शेल्फ फिजिशियन डिक्टेशन ऑडियो फ़ाइलें:
- स्वास्थ्य सेवा भाषण मॉडलों को प्रशिक्षित करने के लिए 257,977 विशेषज्ञताओं से 31 घंटे का वास्तविक-विश्व चिकित्सक श्रुतलेख भाषण डेटासेट
- टेलीफोन डिक्टेशन (54.3%), डिजिटल रिकॉर्डर (24.9%), स्पीच माइक (5.4%), स्मार्ट फोन (2.7%) और अज्ञात (12.7%) जैसे विभिन्न उपकरणों से कैप्चर किया गया डिक्टेशन ऑडियो
- PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए ऑडियो और ट्रांसक्रिप्ट को संपादित किया
लिखित मेडिकल रिकॉर्ड
प्रतिलेखित चिकित्सा अभिलेखों में चिकित्सक और रोगी की बातचीत, चिकित्सा रिपोर्टों और चिकित्सा मूल्यांकन का प्रतिलेखन शामिल है। यह भविष्य में आने वाले दौरों के लिए रोगी के चिकित्सा इतिहास को मैप करने में मदद करता है और डॉक्टरों के लिए एक संदर्भ बिंदु के रूप में भी कार्य करता है। यह रोगी की वर्तमान स्थिति का आकलन करने और उपयुक्त उपचार सुझाने में मदद करता है।
ऑफ-द-शेल्फ ट्रांसक्राइब्ड मेडिकल रिकॉर्ड्स:
- हेल्थकेयर भाषण मॉडल को प्रशिक्षित करने के लिए 257,977 विशिष्टताओं से वास्तविक दुनिया के चिकित्सक श्रुतलेख के 31 घंटों का प्रतिलेखन
- ऑपरेटिव रिपोर्ट, डिस्चार्ज सारांश, परामर्श नोट, एडमिट नोट, ईडी नोट, क्लिनिक नोट, रेडियोलॉजी रिपोर्ट इत्यादि जैसे विभिन्न कार्य प्रकारों से लिखित मेडिकल रिकॉर्ड।
- PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए ऑडियो और ट्रांसक्रिप्ट को संपादित किया
इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड (ईएचआर)
इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड या ईएचआर मेडिकल रिकॉर्ड हैं जिनमें रोगी का चिकित्सा इतिहास, निदान, नुस्खे, उपचार योजना, टीकाकरण या टीकाकरण की तारीखें, एलर्जी, रेडियोलॉजी छवियां (सीटी स्कैन, एमआरआई, एक्स-रे), और प्रयोगशाला परीक्षण और बहुत कुछ शामिल हैं।
ऑफ-द-शेल्फ इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड (ईएचआर):
- 5.1 विशिष्टताओं में 31M+ रिकॉर्ड और चिकित्सक ऑडियो फ़ाइलें
- क्लिनिकल एनएलपी और अन्य दस्तावेज़ एआई मॉडल को प्रशिक्षित करने के लिए वास्तविक दुनिया के स्वर्ण-मानक मेडिकल रिकॉर्ड
- मेटाडेटा जानकारी जैसे एमआरएन (अनाम), प्रवेश तिथि, डिस्चार्ज तिथि, ठहरने के दिनों की अवधि, लिंग, रोगी वर्ग, भुगतानकर्ता, वित्तीय वर्ग, राज्य, डिस्चार्ज स्वभाव, आयु, डीआरजी, डीआरजी विवरण, $ प्रतिपूर्ति, एएमएलओएस, जीएमएलओएस, जोखिम मृत्यु दर, बीमारी की गंभीरता, ग्रूपर, अस्पताल ज़िप कोड, आदि।
- विभिन्न अमेरिकी राज्यों और क्षेत्रों से मेडिकल रिकॉर्ड- उत्तर पूर्व (46%), दक्षिण (9%), मध्यपश्चिम (3%), पश्चिम (28%), अन्य (14%)
- कवर किए गए सभी रोगी वर्गों से संबंधित मेडिकल रिकॉर्ड - इनपेशेंट, आउटपेशेंट (नैदानिक, पुनर्वास, आवर्ती, सर्जिकल डे केयर), आपातकालीन।
- सभी रोगी आयु समूहों से संबंधित मेडिकल रिकॉर्ड <10 वर्ष (7.9%), 11-20 वर्ष (5.7%), 21-30 वर्ष (10.9%), 31-40 वर्ष (11.7%), 41-50 वर्ष (10.4%) ), 51-60 वर्ष (13.8%), 61-70 वर्ष (16.1%), 71-80 वर्ष (13.3%), 81-90 वर्ष (7.8%), 90+ वर्ष (2.4%)
- रोगी लिंग अनुपात 46% (पुरुष) और 54% (महिला)
- PII ने HIPAA के अनुरूप सेफ हार्बर दिशानिर्देशों का पालन करते हुए दस्तावेज़ों को संशोधित किया
खरीदारों के लिए पाँच कारण लाइसेंस शैप इसे सिलने के बजाय।
शाइप मेडिकल डेटा कैटलॉग इसलिए मौजूद है क्योंकि अधिकांश हेल्थकेयर एआई टीमें नौ से बारह महीने का समय गंवा देती हैं। किसी भी मॉडल को प्रशिक्षित करने से पहले अनुरूप प्रशिक्षण डेटा प्राप्त करना। उन महीनों का डेटा प्राप्त होने पर क्या परिवर्तन होते हैं, यह यहाँ बताया गया है।
कैटलॉग का पैमाना इतना बड़ा है कि ज्यादातर टीमें इसकी बराबरी नहीं कर सकतीं।
शैप कैटलॉग में शामिल हैं 257,977 घंटे चिकित्सक के श्रुतलेखों और प्रतिलेखों से 31 चिकित्सा विशेषताएँऔर ईएचआर रिकॉर्ड जो हर आयु वर्ग के रोगियों को कवर करते हैं — इतनी मात्रा जो खरीदारों को दर्जनों ओपन डेटासेट को एक साथ जोड़े बिना मॉडल को प्रशिक्षित और मूल्यांकन करें.
अनुपालन एक प्रारंभिक शर्त है, कोई विशेषता नहीं।
प्रत्येक Shaip मेडिकल डेटासेट के साथ आता है HIPAA सेफ हार्बर के तहत डिफ़ॉल्ट रूप से पहचान छिपानाअनुरोध पर विशेषज्ञ निर्धारण, GDPR के अनुरूप प्रबंधन, और कवर की गई संस्थाओं के लिए BAA की तैयारी। खरीदारों को बाद में अनुपालन को संशोधित करने की आवश्यकता नहीं है।
स्वास्थ्य सेवा में प्रशिक्षित विशेषज्ञ, न कि सामान्य भीड़ कार्यकर्ताओं।
शाइप मेडिकल कैटलॉग पर एनोटेशन, ट्रांसक्रिप्शन और क्यूएशन का कार्य इनके द्वारा किया जाता है। स्वास्थ्य सेवा में प्रशिक्षित विशेषज्ञशाइप वर्कफ़्लो में मल्टी-लेयर क्यूए और ह्यूमन-इन-द-लूप वैलिडेशन शामिल हैं, जिन्हें क्लिनिकल सटीकता मानकों के अनुसार कैलिब्रेट किया गया है।
आज रेडीमेड उपलब्ध, ऑर्डर पर कस्टमाइज्ड।
खरीदार मौजूदा शाइप डेटासेट का तुरंत लाइसेंस ले सकते हैं या विशिष्ट जनसांख्यिकी, भूगोल, भाषाओं और तौर-तरीकों के अनुरूप कस्टम डेटा संग्रह का ऑर्डर दे सकते हैं। विक्रेताओं को बदले बिना या अनुपालन समीक्षा को दोबारा चलाए बिना.
यह सुविधा उन स्थानों पर उपलब्ध है जहां डेटा टीमें पहले से ही काम कर रही हैं।
Shaip के पहचान रहित EHR और चिकित्सक श्रुतलेख डेटासेट उपलब्ध हैं। डेटाब्रिक्स मार्केटप्लेसडेटा और मशीन लर्निंग टीमें जिन फॉर्मेट का पहले से इस्तेमाल करती हैं, उनमें डिलीवरी की सुविधा उपलब्ध है — JSON, CSV, WAV। किसी भी प्रतिबद्धता से पहले सैंपल डेटासेट उपलब्ध हैं।
सुरक्षा और अनुपालन
पता लगाने में सक्षम है जिसकी आपको तलाश है?
सभी प्रकार के डेटा में नए ऑफ-द-शेल्फ मेडिकल डेटासेट एकत्र किए जा रहे हैं
अपनी स्वास्थ्य देखभाल प्रशिक्षण डेटा संग्रह की चिंताओं से छुटकारा पाने के लिए अभी हमसे संपर्क करें
अक्सर पूछे जाने वाले प्रश्न (FAQ)
1. मेडिकल डेटासेट क्या हैं?
मेडिकल डेटासेट स्वास्थ्य सेवा संबंधी डेटा होते हैं जिनका उपयोग AI/ML मॉडल को प्रशिक्षित करने, उनका मूल्यांकन करने और उनमें सुधार करने के लिए किया जाता है। इनमें चिकित्सक द्वारा दिए गए श्रुतलेख की ऑडियो रिकॉर्डिंग, लिखित मेडिकल रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड, कृत्रिम चिकित्सक-रोगी संवाद और प्रासंगिक पाठ, भाषण और संरचित नैदानिक डेटा को संयोजित करने वाले बहुआयामी स्वास्थ्य सेवा डेटासेट शामिल हो सकते हैं।
2. शैप मेडिकल डेटा कैटलॉग में क्या-क्या शामिल है?
शैप मेडिकल डेटा कैटलॉग में चिकित्सकों द्वारा दिए गए श्रुतलेख का ऑडियो, लिखित चिकित्सा रिकॉर्ड, इलेक्ट्रॉनिक स्वास्थ्य रिकॉर्ड, कृत्रिम चिकित्सक-रोगी संवाद और बहुआयामी डेटासेट शामिल हैं जो रोगी या परामर्श स्तर पर पाठ, भाषण और संरचित नैदानिक डेटा को आपस में जोड़ते हैं। इसमें 31 चिकित्सा विशिष्टताओं में चिकित्सकों द्वारा दिए गए 257,977 घंटे का ऑडियो शामिल है और यह व्यावसायिक एआई प्रशिक्षण के लिए उपलब्ध है।
3. क्या Shaip के मेडिकल डेटासेट HIPAA के अनुरूप हैं?
जी हां। शैप के मेडिकल डेटासेट को HIPAA सेफ हार्बर के तहत डिफ़ॉल्ट रूप से डी-आइडेंटिफाइड किया जाता है, जिससे HIPAA गोपनीयता नियम में निर्दिष्ट 18 श्रेणियों के पहचानकर्ताओं को हटा दिया जाता है। सांख्यिकीय प्रमाणीकरण की आवश्यकता होने पर विशेषज्ञ निर्धारण डी-आइडेंटिफिकेशन भी उपलब्ध है, और शैप कवर की गई संस्थाओं के लिए BAA के लिए तैयार है।
4. क्या Shaip के मेडिकल डेटासेट GDPR और अन्य स्वास्थ्य सेवा डेटा आवश्यकताओं का समर्थन कर सकते हैं?
जी हां। परियोजना के दायरे, भौगोलिक स्थिति, डेटा के प्रकार और संविदात्मक आवश्यकताओं के आधार पर, Shaip के चिकित्सा डेटासेट को HIPAA, GDPR और अन्य लागू स्वास्थ्य सेवा डेटा आवश्यकताओं का समर्थन करने के लिए तैयार किया जा सकता है।
5. क्या मैं स्वास्थ्य सेवा संबंधी डेटासेट सीधे खरीद सकता हूँ, या उन्हें एकत्र करना आवश्यक है?
दोनों विकल्प उपलब्ध हैं। Shaip, Shaip मेडिकल डेटा कैटलॉग के माध्यम से व्यावसायिक AI प्रशिक्षण के लिए तैयार स्वास्थ्य सेवा डेटासेट प्रदान करता है। यदि किसी परियोजना के लिए किसी विशिष्ट भाषा, जनसांख्यिकी, विशेषज्ञता, पद्धति या नैदानिक स्थिति की आवश्यकता होती है, तो Shaip समान अनुपालन मानकों के तहत अनुकूलित चिकित्सा डेटा संग्रह भी कर सकता है।
6. क्या Shaip मेडिकल डेटासेट को अनुकूलित किया जा सकता है?
जी हां। Shaip चिकित्सा डेटासेट को विशेषज्ञता, रोगी की आयु सीमा, लिंग, भौगोलिक स्थिति, भाषा, उपचार पद्धति, नैदानिक सेटिंग, प्रारूप, मात्रा और परियोजना आवश्यकताओं के आधार पर अनुकूलित कर सकता है। अनुकूलित डेटासेट का दायरा कार्य विवरण के माध्यम से निर्धारित किया जाता है और यह लागू पहचान-निवारण और अनुपालन मानकों का पालन करता है।
7. क्या लाइसेंस प्राप्त करने से पहले मैं नमूना डेटासेट देख सकता हूँ?
जी हां। Shaip NDA के तहत प्रतिनिधि नमूना डेटासेट उपलब्ध कराता है ताकि AI टीमें लाइसेंस देने से पहले प्रारूप, गुणवत्ता, जनसांख्यिकीय कवरेज और मॉडल की उपयुक्तता का मूल्यांकन कर सकें। मानक लाइसेंस या कस्टम कलेक्शन अनुबंध से पहले नमूना डेटासेट तक पहुंच आमतौर पर पहला कदम होता है।
8. Shaip चिकित्सा डेटासेट किन प्रारूपों में उपलब्ध कराता है?
Shaip, संरचित रिकॉर्ड के लिए JSON, CSV और FHIR सहित AI-अनुकूल प्रारूपों में चिकित्सा डेटासेट उपलब्ध कराता है; ऑडियो के लिए युग्मित प्रतिलेखों वाली WAV फ़ाइलें; और भाषण और भाषा डेटासेट के लिए प्रतिलेख फ़ाइलें भी उपलब्ध कराता है। मल्टीमॉडल डेटासेट में टेक्स्ट, ऑडियो और संरचित नैदानिक रिकॉर्ड को जोड़ने वाली मैनिफ़ेस्ट फ़ाइलें शामिल हो सकती हैं।
9. Shaip चिकित्सा डेटासेट की गुणवत्ता कैसे सुनिश्चित करता है?
Shaip विशेषज्ञ समीक्षा, डोमेन-विशेषज्ञ एनोटेशन, सत्यापन कार्यप्रवाह और संरचित QA जांच के माध्यम से चिकित्सा डेटासेट की गुणवत्ता सुनिश्चित करता है। ये प्रक्रियाएं स्वास्थ्य सेवा AI विकास के लिए सटीकता, विश्वसनीयता और मॉडल की तत्परता सुनिश्चित करने में सहायक होती हैं।
10. क्या शाइप के मेडिकल डेटासेट बड़े एआई/एमएल प्रोजेक्ट्स के लिए स्केलेबल हैं?
जी हां। Shaip के मेडिकल डेटासेट छोटे पायलट प्रोजेक्ट और बड़े AI/ML प्रोजेक्ट दोनों के लिए उपयुक्त हैं। ये उन प्रोजेक्टों को सपोर्ट कर सकते हैं जिनमें बड़ी मात्रा में मेडिकल रिकॉर्ड, संरचित क्लिनिकल डेटा, ट्रांसक्रिप्ट या लाखों घंटों के डॉक्टर के श्रुतलेख ऑडियो की आवश्यकता होती है।
11. क्या Shaip के मेडिकल डेटासेट को मौजूदा AI मॉडल और वर्कफ़्लो में एकीकृत किया जा सकता है?
जी हां। Shaip तैयार उपयोग प्रारूपों जैसे JSON, CSV, FHIR, WAV और ट्रांसक्रिप्ट फ़ाइलों में मेडिकल डेटासेट उपलब्ध कराता है। ये प्रारूप मौजूदा AI, ML, NLP, स्पीच, हेल्थकेयर LLM और मल्टीमॉडल मॉडल विकास वर्कफ़्लो में एकीकरण का समर्थन करते हैं।
12. Shaip मेडिकल डेटासेट प्राप्त करने में कितना समय लगता है?
तैयार चिकित्सा डेटासेट आमतौर पर नमूने की समीक्षा, अनुबंध पर हस्ताक्षर और लाइसेंस को अंतिम रूप देने के कुछ ही दिनों के भीतर उपलब्ध कराए जा सकते हैं। कस्टम डेटा संग्रह की समयसीमा परियोजना के दायरे, डेटासेट के आकार, कार्यप्रणाली, अनुपालन आवश्यकताओं और जटिलता पर निर्भर करती है, और कार्य विवरण में परिभाषित की जाती है।
13. मेडिकल डेटासेट की कीमत कितनी होती है?
मेडिकल डेटासेट की लागत डेटासेट के प्रकार, कार्यप्रणाली, मात्रा, अनुकूलन आवश्यकताओं, लाइसेंसिंग शर्तों, वितरण समयसीमा और अनुपालन आवश्यकताओं पर निर्भर करती है। टीमें संपर्क फ़ॉर्म के माध्यम से अपनी आवश्यकताएं साझा कर सकती हैं और अनुकूलित कोटेशन प्राप्त कर सकती हैं।
14. स्वास्थ्य सेवा में एआई/एमएल के लिए मेडिकल डेटासेट क्यों महत्वपूर्ण हैं?
उच्च गुणवत्ता वाले मेडिकल डेटासेट सटीक, विश्वसनीय और चिकित्सकीय रूप से उपयोगी हेल्थकेयर एआई मॉडल को प्रशिक्षित करने के लिए आवश्यक हैं। ये मेडिकल डॉक्यूमेंटेशन, क्लिनिकल एनएलपी, स्पीच रिकग्निशन, समराइजेशन, डिसीजन सपोर्ट, ऑटोमेशन, पेशेंट केयर वर्कफ़्लो और हेल्थकेयर डेटा इंटेलिजेंस को बेहतर बनाने में मदद करते हैं।