← Quay lại Cách hoạt động

Phân loại thiết kế nghiên cứu

Từ PublicationType của PubMed đến điểm thiết kế trong Điểm tin cậy

Tài liệu này trình bày khung phân loại được Công cụ kiểm tra và phân loại Nghiên cứu sử dụng để phân tích các nghiên cứu. Việc xác định chính xác thiết kế nghiên cứu là yếu tố nền tảng khi đánh giá tài liệu y khoa về skincare, vì phương pháp luận quyết định độ tin cậy và khả năng ứng dụng thực tiễn. Loại nghiên cứu được xác định sẽ ảnh hưởng trực tiếp đến điểm thiết kế cơ sở trong tổng Điểm tin cậy.

Thang bậc bằng chứng

Tháp bằng chứng thể hiện một khung cấu trúc xếp hạng các phương pháp nghiên cứu dựa trên nguy cơ sai lệch nội tại. Ở tầng cơ sở là các mô hình in vitro, tiến dần lên qua Báo cáo ca, nghiên cứu Quan sát, và RCT, đạt đỉnh ở Tổng quan hệ thống và Phân tích gộp. Các tầng cao hơn thường cung cấp bằng chứng lâm sàng vững chắc hơn, do đó mang lại trọng số phương pháp luận lớn hơn.

Cần lưu ý rằng vị trí cao hơn trên tháp bằng chứng không tự động đảm bảo tính hợp lệ hay sự thật lâm sàng. Một RCT được thực hiện kém với những khiếm khuyết phương pháp luận nghiêm trọng có thể mang lại kết luận kém tin cậy hơn một nghiên cứu Quan sát được thiết kế và phân tích chặt chẽ. Xếp hạng cấu trúc chỉ đóng vai trò là xác suất cơ sở về độ vững chắc chứ không phải là thước đo tuyệt đối.

Tám hạng mục

LoạiĐiểmMô tả
Phân tích gộp40Phân tích gộp sử dụng các kỹ thuật thống kê để tổng hợp dữ liệu từ nhiều nghiên cứu độc lập, tạo ra một ước lượng định lượng duy nhất về hiệu quả của can thiệp. Bằng cách gộp kết quả bằng toán học, phương pháp này giải quyết các mâu thuẫn và tăng cường sức mạnh thống kê vượt qua các thử nghiệm đơn lẻ. Nhờ sự tổng hợp định lượng nghiêm ngặt, thiết kế này nhận được mức điểm tối đa là 40 trong Điểm tin cậy.
Tổng quan hệ thống38Tổng quan hệ thống xác định, đánh giá và tổng hợp mọi bằng chứng thực nghiệm đáp ứng các tiêu chí hợp lệ được xác định trước để trả lời một câu hỏi nghiên cứu cụ thể. Khác với các bài viết tường thuật, phương pháp này sử dụng các quy trình rõ ràng, có thể tái lập nhằm giảm thiểu sai lệch. Dù thiếu sự gộp số liệu thống kê của Phân tích gộp, sự tổng hợp định tính nghiêm ngặt giúp thiết kế này đạt mức điểm 38.
RCT35Một RCT phân bổ ngẫu nhiên người tham gia vào nhóm can thiệp hoặc nhóm chứng, giúp cách ly hiệu quả thực sự của phương pháp điều trị. Các dấu hiệu chất lượng chính trong nghiên cứu da liễu bao gồm phân nhóm ngẫu nhiên, mù đôi, đối chứng placebo và thiết kế chia nửa mặt. Là tiêu chuẩn vàng để xác lập hiệu quả lâm sàng nhân quả, RCT nhận được điểm thiết kế cơ sở vững chắc là 35.
Quan sát20Các thiết kế Quan sát, bao gồm nghiên cứu thuần tập, cắt ngang, tiến cứu và hồi cứu, liên quan đến việc theo dõi đối tượng trong môi trường tự nhiên mà không có sự can thiệp từ nhà nghiên cứu. Mặc dù rất có giá trị trong việc xác định các mối tương quan dịch tễ và hồ sơ an toàn dài hạn, chúng không thể xác lập quan hệ nhân quả một cách chắc chắn. Do đó, các thiết kế này được cấp mức điểm cơ sở là 20.
Tổng quan15Các bài Tổng quan tường thuật cung cấp những bản tóm tắt mô tả rộng rãi về tài liệu hiện tại cho một chủ đề cụ thể mà không áp dụng các giao thức tìm kiếm nghiêm ngặt, có thể tái lập. Vì sai lệch chọn lọc của tác giả có thể ảnh hưởng nặng nề đến các bằng chứng được đưa vào và kết luận sau đó, những bài báo này được xếp thấp hơn trên tháp bằng chứng, nhận mức điểm thiết kế cơ sở là 15.
Báo cáo ca10Báo cáo ca và chuỗi ca bệnh ghi nhận các quan sát lâm sàng từ một bệnh nhân duy nhất hoặc một nhóm nhỏ cá nhân trải qua các can thiệp giống nhau. Chúng thiếu nhóm chứng và giá trị thống kê, chủ yếu đóng vai trò tạo ra các giả thuyết lâm sàng sơ bộ. Do bản chất hoàn toàn mang tính giai thoại, các thiết kế này được chỉ định mức Điểm tin cậy cơ sở là 10.
In vitro8Các nghiên cứu In vitro khảo sát các quá trình sinh học bên ngoài cơ thể sống, sử dụng môi trường được kiểm soát như mô hình nuôi cấy tế bào, dòng tế bào keratinocyte, fibroblast, hoặc mô ex vivo. Dù thiết yếu để làm sáng tỏ cơ chế phân tử, các phản ứng tế bào thường không thể hiện đúng kết quả lâm sàng phức tạp trên người. Do vậy, chúng nhận mức điểm cơ sở là 8.
Khác5Hạng mục Khác được dành cho các ấn phẩm không thể được ánh xạ một cách tự tin vào một khung phương pháp chuẩn dựa trên siêu dữ liệu hiện có. Điều này bao gồm các bài xã luận, ý kiến chuyên gia, hoặc các định dạng không rõ ràng thiếu thiết kế thực nghiệm. Để ngăn ngừa việc đánh giá quá cao các phương pháp chưa được xác minh, chúng nhận mức điểm thấp nhất là 5.

Cách hệ thống gán nhãn

Công cụ kiểm tra và phân loại Nghiên cứu chủ yếu xác định thiết kế nghiên cứu bằng cách trích xuất siêu dữ liệu PublicationType có cấu trúc do PubMed cung cấp. Các chuyên gia lập chỉ mục gán các thẻ từ vựng MeSH chuẩn hóa này cho bài báo, đảm bảo độ chính xác phân loại cao. Khi các thẻ có thẩm quyền xuất hiện, hệ thống sẽ ưu tiên chúng hơn bất kỳ phân tích văn bản nào.

Trong trường hợp thiếu các thẻ siêu dữ liệu rõ ràng, hệ thống sử dụng các thuật toán heuristic để quét tiêu đề và abstract nhằm tìm kiếm từ vựng cấu trúc. Sự hiện diện của các thuật ngữ cụ thể như randomized, placebo, keratinocyte, hoặc cohort sẽ kích hoạt logic phân loại phụ. Tuy nhiên, cơ chế dự phòng này bị hạn chế bởi cách diễn đạt ngôn ngữ đa dạng của các tác giả.

Ví dụ minh hoạ

Xem xét một ấn phẩm có tiêu đề "Randomized, placebo-controlled, split-face comparison of 0.1% retinaldehyde versus 0.05% tretinoin in photoaged skin." Nếu thẻ PubMed bị thiếu, công cụ heuristic sẽ xử lý abstract. Các từ khóa quyết định "randomized," "placebo-controlled," và "split-face" ngay lập tức giải quyết phân loại thành RCT, bỏ qua các hạng mục cấp thấp và chỉ định Điểm tin cậy tương ứng một cách chính xác.

Giới hạn

Các thuật toán heuristic dựa trên từ khóa có những hạn chế nội tại và đôi khi có thể hoạt động sai lệch trong quá trình xử lý tự động. Ví dụ, một bài Tổng quan tường thuật thảo luận sâu về một thử nghiệm ngẫu nhiên có thể vô tình kích hoạt regex của RCT. Do đó, hệ thống được lập trình để luôn ưu tiên các thẻ PublicationType chính thức nhằm giảm thiểu các dị thường này.

Điểm tin cậy cơ sở được tính toán phản ánh nghiêm ngặt sức mạnh lý thuyết của phương pháp luận được sử dụng, không phải là sự thật thực nghiệm tuyệt đối của kết quả. Việc thực thi kém, xung đột lợi ích không được tiết lộ, hoặc thống kê bị thao túng có thể làm hỏng bất kỳ thiết kế nào. Do đó, người đọc phải kiểm tra kỹ lưỡng toàn văn bài báo thay vì chỉ dựa vào đánh giá tự động.