Danh mục dữ liệu y tế cho trí tuệ nhân tạo trong chăm sóc sức khỏe

Bộ dữ liệu y tế / chăm sóc sức khỏe có sẵn để bắt đầu dự án AI chăm sóc sức khỏe của bạn

Danh mục dữ liệu y tế

Bộ dữ liệu y tế và chăm sóc sức khỏe cho Máy học

Danh mục dữ liệu y tế Shaip bao gồm những gì?

Kho dữ liệu y tế Shaip là một thư viện dữ liệu đào tạo chăm sóc sức khỏe đã được ẩn danh, tuân thủ HIPAA, bao gồm 31 chuyên khoa y tế, với tổng cộng 257,977 giờ ghi âm lời đọc của bác sĩ, hồ sơ y tế được phiên âm, hồ sơ sức khỏe điện tử và các bộ dữ liệu đa phương thức. Mỗi bộ dữ liệu đều được cấp phép sử dụng cho mục đích đào tạo AI thương mại và được cung cấp kèm theo quy trình ẩn danh Safe Harbor hoặc Expert Determination.

Dữ liệu âm thanh đọc chính tả của bác sĩ

Bộ dữ liệu ẩn danh của chúng tôi dành cho chăm sóc sức khỏe bao gồm các tệp âm thanh trên 31 chuyên khoa do bác sĩ đọc, mô tả tình trạng lâm sàng và kế hoạch chăm sóc của bệnh nhân dựa trên các cuộc gặp gỡ giữa bác sĩ và bệnh nhân trong môi trường lâm sàng.

Tệp âm thanh đọc chính tả của bác sĩ ngoại khoa:

  • 257,977 giờ dữ liệu giọng nói đọc chính tả thực tế của bác sĩ từ 31 chuyên khoa để đào tạo các mô hình giọng nói chăm sóc sức khỏe
  • Âm thanh đọc chính tả được ghi lại từ các thiết bị khác nhau như Telephone Dictation (54.3%), Máy ghi âm kỹ thuật số (24.9%), Mic nói (5.4%), Điện thoại thông minh (2.7%) và Không xác định (12.7%)
  • PII âm thanh và bản ghi đã được biên dịch lại tuân theo Nguyên tắc che giấu an toàn tuân theo HIPAA
Dữ liệu âm thanh chính tả của bác sĩ

Hồ sơ y tế được chép lại

Hồ sơ bệnh án được sao chép bao gồm các cuộc trò chuyện giữa bác sĩ và bệnh nhân, các báo cáo y khoa và đánh giá y khoa. Nó giúp lập bản đồ bệnh sử của bệnh nhân cho các lần tái khám sau và cũng đóng vai trò là điểm tham chiếu cho bác sĩ. Nó giúp đánh giá tình trạng hiện tại của bệnh nhân và đề xuất phương pháp điều trị phù hợp.

Hồ sơ y tế được sao chép không có giá trị:

  • Phiên âm 257,977 giờ diễn thuyết của bác sĩ trong thế giới thực từ 31 chuyên khoa để đào tạo các mô hình Bài phát biểu trong chăm sóc sức khỏe
  • Hồ sơ Y tế được sao chép từ nhiều loại công việc khác nhau như Báo cáo hoạt động, Tóm tắt xuất viện, Ghi chú tư vấn, Ghi chú nhập học, Ghi chú ED, Ghi chú Phòng khám, Báo cáo X quang, v.v.
  • PII âm thanh và bản ghi đã được biên dịch lại tuân theo Nguyên tắc che giấu an toàn tuân theo HIPAA
Hồ sơ y tế được sao chép

Hồ sơ sức khỏe điện tử (EHR)

Hồ sơ sức khỏe điện tử hoặc EHR là hồ sơ y tế chứa lịch sử y tế của bệnh nhân, chẩn đoán, đơn thuốc, kế hoạch điều trị, ngày tiêm chủng hoặc chủng ngừa, dị ứng, hình ảnh X quang (CT Scan, MRI, X-Rays) và các xét nghiệm trong phòng thí nghiệm và hơn thế nữa.

Hồ sơ sức khỏe điện tử có sẵn (EHR):

  • 5.1M + Bản ghi và tệp âm thanh bác sĩ trong 31 chuyên khoa
  • Hồ sơ y tế tiêu chuẩn vàng trong thế giới thực để đào tạo NLP lâm sàng và các mô hình AI tài liệu khác
  • Thông tin siêu dữ liệu như MRN (Ẩn danh), Ngày nhập học, Ngày xuất viện, Thời gian lưu trú, Giới tính, Hạng bệnh nhân, Người thanh toán, Hạng tài chính, Tiểu bang, Xử lý xuất viện, Tuổi, DRG, Mô tả DRG, Khoản hoàn trả $, AMLOS, GMLOS, Rủi ro tỷ lệ tử vong, Mức độ nghiêm trọng của bệnh tật, Cá mú, Mã Zip bệnh viện, v.v.
  • Hồ sơ Y tế từ các tiểu bang và khu vực khác nhau của Hoa Kỳ - Đông Bắc (46%), Nam (9%), Trung Tây (3%), Tây (28%), Các vùng khác (14%)
  • Hồ sơ Y tế thuộc tất cả các Hạng bệnh nhân được bảo hiểm- Nội trú, Ngoại trú (Lâm sàng, Phục hồi chức năng, Định kỳ, Chăm sóc ban ngày phẫu thuật), Cấp cứu.
Hồ sơ sức khỏe điện tử (ehr)
  • Hồ sơ bệnh án thuộc tất cả các Nhóm tuổi bệnh nhân <10 tuổi (7.9%), 11-20 tuổi (5.7%), 21-30 tuổi (10.9%), 31-40 tuổi (11.7%), 41-50 tuổi (10.4%) ), 51-60 tuổi (13.8%), 61-70 tuổi (16.1%), 71-80 tuổi (13.3%), 81-90 tuổi (7.8%), 90+ tuổi (2.4%)
  • Tỷ lệ giới tính của bệnh nhân là 46% (Nam) và 54% (Nữ)
  • Tài liệu được biên tập lại PII tuân theo Nguyên tắc che giấu an toàn tuân theo HIPAA

Năm lý do người mua giấy phép Shaip thay vì khâu chúng lại với nhau.

Danh mục dữ liệu y tế Shaip tồn tại là vì Hầu hết các nhóm AI trong lĩnh vực chăm sóc sức khỏe đều mất từ ​​chín đến mười hai tháng. Thu thập dữ liệu huấn luyện tuân thủ quy định trước khi huấn luyện bất kỳ mô hình nào. Đây là những thay đổi khi dữ liệu của những tháng đó được trả lại.

01

Quy mô danh mục mà hầu hết các nhóm khác không thể sánh kịp.

Danh mục sản phẩm của Shaip bao gồm... 257,977 giờ ghi âm lời đọc của bác sĩ, bản ghi chép từ 31 chuyên khoa y tếvà hồ sơ bệnh án điện tử (EHR) bao gồm mọi nhóm tuổi bệnh nhân — khối lượng dữ liệu đủ lớn để người mua có thể tiếp cận. Huấn luyện và đánh giá mô hình mà không cần ghép nối hàng tá bộ dữ liệu mở..

02

Tuân thủ là điều kiện tiên quyết, chứ không phải là một tính năng.

Mỗi bộ dữ liệu y tế của Shaip đều đi kèm với... Mặc định sử dụng tính năng ẩn danh dữ liệu theo chuẩn HIPAA Safe Harbor.Xác định chuyên gia theo yêu cầu, xử lý phù hợp với GDPR và sẵn sàng BAA cho các thực thể được bảo hiểm. Người mua không cần phải điều chỉnh lại việc tuân thủ sau khi giao dịch đã hoàn tất.

Cảng an toàn HIPAA Quyết định của chuyên gia Tuân thủ GDPR Sẵn sàng BAA
03

Cần các chuyên gia được đào tạo về y tế, chứ không phải những người lao động tự do thông thường.

Việc chú thích, phiên âm và kiểm định chất lượng trên danh mục y tế Shaip được thực hiện bởi các chuyên gia được đào tạo về chăm sóc sức khỏeQuy trình làm việc của Shaip bao gồm kiểm soát chất lượng nhiều lớp và xác thực có sự tham gia của con người, được hiệu chỉnh theo các tiêu chuẩn độ chính xác lâm sàng.

04

Hàng có sẵn hôm nay, hàng đặt làm theo yêu cầu.

Khách hàng có thể cấp phép sử dụng ngay lập tức các bộ dữ liệu hiện có của Shaip hoặc đặt hàng thu thập dữ liệu tùy chỉnh theo các nhóm nhân khẩu học, khu vực địa lý, ngôn ngữ và phương thức cụ thể — mà không cần thay đổi nhà cung cấp hoặc chạy lại quy trình kiểm tra tuân thủ..

05

Có sẵn tại những nơi mà các nhóm dữ liệu đang làm việc.

Dữ liệu hồ sơ bệnh án điện tử (EHR) và bản ghi âm lời nói của bác sĩ do Shaip thu thập, đã được ẩn danh, hiện có sẵn trên [trang web]. Thị trường DatabricksVới khả năng cung cấp dữ liệu ở các định dạng mà các nhóm dữ liệu và học máy đã sử dụng — JSON, CSV, WAV. Các bộ dữ liệu mẫu có sẵn trước khi cam kết bất kỳ điều gì.

JSON CSV WAV FHIR

Bảo mật & Tuân thủ

GDPR
HIPAA
ISO 9001: 2015
SOC 2 Loại II
ISO 27001
Shaip liên hệ với chúng tôi

Không thể tìm thấy những gì bạn đang tìm kiếm?

Bộ dữ liệu y tế mới có sẵn đang được thu thập trên tất cả các loại dữ liệu 

Liên hệ với chúng tôi ngay bây giờ để loại bỏ những lo lắng về thu thập dữ liệu đào tạo chăm sóc sức khỏe của bạn

  • Trường này là dành cho mục đích xác nhận và phải được giữ nguyên.
  • Bằng cách đăng ký, tôi đồng ý với Shaip Chính sách bảo mậtCác Điều Khoản của Dịch Vụ và cung cấp sự đồng ý của tôi để nhận thông tin tiếp thị B2B từ Shaip.

Bộ dữ liệu y tế là dữ liệu chăm sóc sức khỏe được sử dụng để huấn luyện, đánh giá và cải thiện các mô hình AI/ML. Chúng có thể bao gồm bản ghi âm lời đọc của bác sĩ, hồ sơ y tế được phiên âm, hồ sơ sức khỏe điện tử, các đoạn hội thoại tổng hợp giữa bác sĩ và bệnh nhân, và các bộ dữ liệu chăm sóc sức khỏe đa phương thức kết hợp văn bản, giọng nói và dữ liệu lâm sàng có cấu trúc liên quan.

Kho dữ liệu y tế Shaip bao gồm các bản ghi âm lời đọc của bác sĩ, hồ sơ y tế được phiên âm, hồ sơ sức khỏe điện tử, các đoạn hội thoại tổng hợp giữa bác sĩ và bệnh nhân, và các bộ dữ liệu đa phương thức liên kết văn bản, giọng nói và dữ liệu lâm sàng có cấu trúc ở cấp độ bệnh nhân hoặc lượt khám. Kho dữ liệu này bao gồm 257,977 giờ ghi âm lời đọc của bác sĩ thuộc 31 chuyên khoa y tế và có sẵn để đào tạo trí tuệ nhân tạo thương mại.

Đúng vậy. Các bộ dữ liệu y tế của Shaip được ẩn danh theo mặc định theo quy định HIPAA Safe Harbor, loại bỏ 18 loại thông tin nhận dạng được quy định trong Quy tắc Bảo mật HIPAA. Việc ẩn danh dựa trên xác định của chuyên gia cũng có sẵn khi cần chứng nhận thống kê, và Shaip đã sẵn sàng cho các tổ chức được bảo hiểm theo thỏa thuận BAA.

Có. Bộ dữ liệu y tế của Shaip có thể được chuẩn bị để đáp ứng các yêu cầu về dữ liệu chăm sóc sức khỏe theo HIPAA, GDPR và các quy định khác hiện hành, tùy thuộc vào phạm vi dự án, khu vực địa lý, loại dữ liệu và các yêu cầu hợp đồng.

Cả hai lựa chọn đều khả dụng. Shaip cung cấp các bộ dữ liệu y tế có sẵn thông qua Danh mục Dữ liệu Y tế Shaip để đào tạo AI thương mại. Nếu một dự án yêu cầu ngôn ngữ, nhân khẩu học, chuyên khoa, phương thức hoặc bối cảnh lâm sàng cụ thể, Shaip cũng có thể thực hiện thu thập dữ liệu y tế tùy chỉnh theo cùng các tiêu chuẩn tuân thủ.

Có. Shaip có thể tùy chỉnh các bộ dữ liệu y tế theo chuyên khoa, nhóm tuổi bệnh nhân, giới tính, khu vực địa lý, ngôn ngữ, phương thức chẩn đoán, môi trường lâm sàng, định dạng, khối lượng và yêu cầu dự án. Các bộ dữ liệu tùy chỉnh được xác định phạm vi thông qua bản mô tả công việc và tuân thủ các tiêu chuẩn ẩn danh và tuân thủ quy định hiện hành.

Đúng vậy. Shaip cung cấp các bộ dữ liệu mẫu đại diện theo thỏa thuận bảo mật (NDA) để các nhóm AI có thể đánh giá định dạng, chất lượng, phạm vi nhân khẩu học và độ phù hợp của mô hình trước khi cấp phép. Việc truy cập vào các bộ dữ liệu mẫu thường là bước đầu tiên trước khi ký kết Giấy phép Tiêu chuẩn hoặc Hợp tác với Bộ sưu tập Tùy chỉnh.

Shaip cung cấp các bộ dữ liệu y tế ở định dạng sẵn sàng cho AI, bao gồm JSON, CSV và FHIR cho hồ sơ có cấu trúc; các tệp WAV kèm bản ghi tương ứng cho âm thanh; và các tệp bản ghi cho bộ dữ liệu ngôn ngữ và lời nói. Các bộ dữ liệu đa phương thức có thể bao gồm các tệp kê khai liên kết văn bản, âm thanh và hồ sơ lâm sàng có cấu trúc.

Shaip đảm bảo chất lượng bộ dữ liệu y tế thông qua việc xem xét của chuyên gia, chú thích của chuyên gia lĩnh vực, quy trình xác thực và kiểm tra chất lượng có cấu trúc. Những quy trình này giúp đảm bảo tính chính xác, độ tin cậy và sự sẵn sàng của mô hình cho việc phát triển trí tuệ nhân tạo trong lĩnh vực chăm sóc sức khỏe.

Đúng vậy. Bộ dữ liệu y tế của Shaip có khả năng mở rộng quy mô cho cả các dự án thí điểm nhỏ và các dự án AI/ML cấp doanh nghiệp. Chúng có thể hỗ trợ các dự án yêu cầu khối lượng lớn hồ sơ y tế, dữ liệu lâm sàng có cấu trúc, bản ghi chép hoặc hàng trăm nghìn giờ ghi âm lời nói của bác sĩ.

Đúng vậy. Shaip cung cấp các bộ dữ liệu y tế ở các định dạng sẵn sàng sử dụng như JSON, CSV, FHIR, WAV và các tệp bản ghi. Các định dạng này hỗ trợ tích hợp vào các quy trình phát triển mô hình AI, ML, NLP, giọng nói, LLM chăm sóc sức khỏe và đa phương thức hiện có.

Thông thường, các bộ dữ liệu y tế có sẵn có thể được cung cấp trong vòng vài ngày sau khi xem xét mẫu, ký hợp đồng và hoàn tất thủ tục cấp phép. Thời gian thu thập dữ liệu tùy chỉnh phụ thuộc vào phạm vi dự án, kích thước bộ dữ liệu, phương thức thu thập, yêu cầu tuân thủ và độ phức tạp, và được xác định trong bản mô tả công việc.

Chi phí của các bộ dữ liệu y tế phụ thuộc vào loại dữ liệu, phương thức, khối lượng, yêu cầu tùy chỉnh, điều khoản cấp phép, thời gian giao hàng và nhu cầu tuân thủ. Các nhóm có thể chia sẻ yêu cầu của họ thông qua biểu mẫu Liên hệ với chúng tôi để nhận báo giá tùy chỉnh.

Các bộ dữ liệu y tế chất lượng cao rất cần thiết để đào tạo các mô hình AI chăm sóc sức khỏe chính xác, đáng tin cậy và hữu ích về mặt lâm sàng. Chúng giúp cải thiện việc lập hồ sơ y tế, xử lý ngôn ngữ tự nhiên lâm sàng, nhận dạng giọng nói, tóm tắt, hỗ trợ ra quyết định, tự động hóa, quy trình chăm sóc bệnh nhân và trí tuệ dữ liệu chăm sóc sức khỏe.