[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"_public_topic_publications_%C4%91%E1%BB%99%20l%E1%BB%87ch%20h%E1%BA%ADu%20nghi%E1%BB%87m{\"limit\":5}":3,"_public_topic_byId_%C4%91%E1%BB%99%20l%E1%BB%87ch%20h%E1%BA%ADu%20nghi%E1%BB%87m":11},{"code":4,"data":5,"meta":10},"SUCCESS",{"latest":6,"mostCited":7,"vietnamFeatured":8,"vietnamLatest":9},[],[],[],[],null,{"code":4,"data":12,"meta":10},{"id":13,"title":14,"description":15,"content":16,"term":13,"englishTitle":17,"synonyms":18,"definition":19,"discipline":20,"references":21,"faqs":46,"createUser":56,"publishUser":60,"keywords":61,"keywordCount":57,"enrichTopicLink":62,"status":63,"createTime":64,"updateTime":65,"publishTime":66,"linkEnrichedTime":10,"publicationScanTime":10,"contentErrorMessage":10,"viewCount":67,"wikidataId":10,"relateTopics":68},"độ lệch hậu nghiệm","Độ lệch hậu nghiệm (posterior deviance) là gì?","Độ lệch hậu nghiệm là đại lượng đánh giá độ khớp của mô hình thống kê Bayes, làm cơ sở tính số tham số hiệu dụng và tiêu chuẩn thông tin độ lệch.","\u003Cp>Độ lệch hậu nghiệm (posterior deviance) là thước đo độ không phù hợp của mô hình thống kê Bayes đối với tập dữ liệu quan sát, được xác định thông qua việc lấy kỳ vọng của hàm độ lệch thống kê trên phân phối xác suất hậu nghiệm của các tham số. Khái niệm này phản ánh mức độ biến thiên và độ khớp tổng thể của mô hình khi tính đến toàn bộ sự không chắc chắn của tham số thay vì chỉ dựa vào một ước lượng điểm đơn lẻ. Bài viết này trình bày cơ sở toán học của độ lệch hậu nghiệm, vai trò trung tâm trong tiêu chuẩn thông tin độ lệch, quy trình tính toán qua chuỗi Markov Monte Carlo, cùng các giới hạn lý thuyết và tiêu chuẩn thay thế hiện đại.\u003C\u002Fp>\n\n\u003Ch2>Bản chất toán học và cơ sở lý thuyết\u003C\u002Fh2>\n\u003Cp>Trong lý thuyết thống kê cổ điển, hàm độ lệch (deviance) đóng vai trò tương tự như tổng bình phương phần dư trong phân tích hồi quy tuyến tính, được sử dụng để đánh giá mức độ sai lệch giữa mô hình đang xét và một mô hình bão hòa (saturated model) có khả năng khớp hoàn hảo với dữ liệu. Đối với một tập dữ liệu quan sát được ký hiệu là \u003Cscript type=\"math\u002Ftex\">y\u003C\u002Fscript> và vector tham số chưa biết ký hiệu là \u003Cscript type=\"math\u002Ftex\">\\theta\u003C\u002Fscript>, hàm độ lệch chuẩn hóa được định nghĩa bởi biểu thức:\u003C\u002Fp>\n\u003Cscript type=\"math\u002Ftex; mode=display\">D(\\theta) = -2 \\ln p(y|\\theta) + 2 \\ln f(y)\u003C\u002Fscript>\n\u003Cp>Trong phương trình trên, đại lượng \u003Cscript type=\"math\u002Ftex\">p(y|\\theta)\u003C\u002Fscript> biểu thị hàm hợp lý (likelihood function) của dữ liệu dưới điều kiện tham số \u003Cscript type=\"math\u002Ftex\">\\theta\u003C\u002Fscript>, còn thành phần \u003Cscript type=\"math\u002Ftex\">f(y)\u003C\u002Fscript> là hàm chuẩn hóa phụ thuộc hoàn toàn vào dữ liệu quan sát nhằm đưa độ lệch của mô hình bão hòa về mức không. Khi tiến hành so sánh giữa các mô hình cạnh tranh cùng sử dụng chung một tập dữ liệu quan sát, thành phần chuẩn hóa \u003Cscript type=\"math\u002Ftex\">f(y)\u003C\u002Fscript> không thay đổi giữa các mô hình. Do đó, trong thực hành tính toán thống kê, các nhà nghiên cứu thường áp dụng dạng độ lệch thu gọn không chuẩn hóa:\u003C\u002Fp>\n\u003Cscript type=\"math\u002Ftex; mode=display\">D(\\theta) = -2 \\ln p(y|\\theta) + C\u003C\u002Fscript>\n\u003Cp>Trong đó đại lượng \u003Cscript type=\"math\u002Ftex\">C\u003C\u002Fscript> là một hằng số tùy ý không phụ thuộc vào vector tham số \u003Cscript type=\"math\u002Ftex\">\\theta\u003C\u002Fscript>. Hệ số âm hai xuất hiện từ sự tương đồng tiệm cận với phân phối Chi bình phương trong định lý Wilks của suy diễn hợp lý cực đại.\u003C\u002Fp>\n\n\u003Cp>Khác biệt căn bản giữa thống kê cổ điển và thống kê Bayes nằm ở bản chất của vector tham số \u003Cscript type=\"math\u002Ftex\">\\theta\u003C\u002Fscript>. Trong khuôn khổ suy diễn Bayes, tham số không phải là một giá trị cố định chưa biết, mà là một biến ngẫu nhiên tuân theo phân phối xác suất. Dưới tác động của dữ liệu quan sát \u003Cscript type=\"math\u002Ftex\">y\u003C\u002Fscript> thông qua định lý Bayes, sự không chắc chắn về tham số được mô tả đầy đủ bởi phân phối hậu nghiệm \u003Cscript type=\"math\u002Ftex\">p(\\theta|y)\u003C\u002Fscript>. Do hàm độ lệch \u003Cscript type=\"math\u002Ftex\">D(\\theta)\u003C\u002Fscript> là một hàm số xác định trên không gian tham số, bản thân \u003Cscript type=\"math\u002Ftex\">D(\\theta)\u003C\u002Fscript> cũng trở thành một biến ngẫu nhiên có phân phối xác suất riêng dưới phân phối hậu nghiệm. Phân phối này được gọi là phân phối của độ lệch hậu nghiệm.\u003C\u002Fp>\n\n\u003Cp>Để tóm tắt phân phối này thành một chỉ số định lượng phản ánh độ khớp tổng thể của mô hình, Spiegelhalter và cộng sự (2002) đã đề xuất sử dụng kỳ vọng hậu nghiệm của độ lệch, ký hiệu là \u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript>:\u003C\u002Fp>\n\u003Cscript type=\"math\u002Ftex; mode=display\">\\bar{D} = E_{\\theta|y}[D(\\theta)] = \\int D(\\theta) p(\\theta|y) d\\theta\u003C\u002Fscript>\n\u003Cp>Kỳ vọng này tích hợp toàn bộ không gian tham số có trọng số theo mật độ xác suất hậu nghiệm, phản ánh giá trị độ lệch trung bình mà mô hình tạo ra trên toàn bộ các trạng thái khả dĩ của tham số.\u003C\u002Fp>\n\n\u003Ch2>Vai trò trong tiêu chuẩn thông tin độ lệch\u003C\u002Fh2>\n\u003Cp>Mặc dù độ lệch hậu nghiệm trung bình \u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript> là thước đo tốt cho độ khớp, việc chỉ dựa vào giá trị này để lựa chọn mô hình sẽ dẫn đến hiện tượng quá khớp (overfitting). Một mô hình càng có nhiều tham số tự do và cấu trúc phức tạp thì độ lệch trung bình càng nhỏ, nhưng khả năng tổng quát hóa trên dữ liệu mới sẽ suy giảm. Do đó, lý thuyết lựa chọn mô hình đòi hỏi một cơ chế phạt tương xứng cho độ phức tạp của mô hình.\u003C\u002Fp>\n\n\u003Cp>Spiegelhalter và cộng sự (2002) đã giới thiệu khái niệm số tham số hiệu dụng, ký hiệu là \u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript>, được đo lường bằng hiệu số giữa độ lệch hậu nghiệm trung bình và độ lệch được đánh giá tại ước lượng điểm trung bình hậu nghiệm của các tham số:\u003C\u002Fp>\n\u003Cscript type=\"math\u002Ftex; mode=display\">p_D = \\bar{D} - D(\\bar{\\theta})\u003C\u002Fscript>\n\u003Cp>Trong biểu thức này, đại lượng \u003Cscript type=\"math\u002Ftex\">\\bar{\\theta} = E[\\theta|y]\u003C\u002Fscript> biểu thị vector trung bình hậu nghiệm của các tham số, và \u003Cscript type=\"math\u002Ftex\">D(\\bar{\\theta})\u003C\u002Fscript> là hàm độ lệch được tính trực tiếp tại điểm ước lượng trung bình đó. Về mặt ý nghĩa thống kê, đại lượng \u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript> phản ánh sự sụt giảm độ lệch trung bình khi tham số dao động tự do trong phân phối hậu nghiệm so với khi tham số bị cố định tại điểm trung bình. Trong các mô hình tuyến tính đơn giản với tiên nghiệm không chứa thông tin, số tham số hiệu dụng \u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript> xấp xỉ bằng đúng số lượng tham số thực tế của mô hình.\u003C\u002Fp>\n\n\u003Cp>Tiêu chuẩn thông tin độ lệch (Deviance Information Criterion, viết tắt là DIC) được thiết lập như tổng của độ khớp mô hình và hình phạt cho độ phức tạp:\u003C\u002Fp>\n\u003Cscript type=\"math\u002Ftex; mode=display\">DIC = \\bar{D} + p_D = D(\\bar{\\theta}) + 2 p_D\u003C\u002Fscript>\n\u003Cp>Biểu thức này cho thấy tiêu chuẩn thông tin độ lệch là sự khái quát hóa trực tiếp của tiêu chuẩn thông tin Akaike trong bối cảnh phân tích Bayes phân cấp, trong đó độ lệch hậu nghiệm đóng vai trò trung tâm cấu thành cả thước đo độ khớp lẫn hình phạt phức tạp.\u003C\u002Fp>\n\n\u003Ch2>Phương pháp ước lượng qua chuỗi Markov Monte Carlo\u003C\u002Fh2>\n\u003Cp>Trong các mô hình Bayes thực tế, việc tính toán tích phân giải tích để tìm kỳ vọng \u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript> hầu như không khả thi do độ phức tạp cao của không gian tham số và cấu trúc phi tuyến tính của hàm hợp lý. Các nhà nghiên cứu sử dụng các thuật toán lấy mẫu chuỗi Markov Monte Carlo (MCMC) như thuật toán Gibbs hoặc Metropolis-Hastings để sinh ra chuỗi mẫu từ phân phối hậu nghiệm.\u003C\u002Fp>\n\n\u003Cp>Giả sử chuỗi MCMC sau giai đoạn khởi động (burn-in) thu được một tập hợp gồm \u003Cscript type=\"math\u002Ftex\">S\u003C\u002Fscript> mẫu tham số, ký hiệu là \u003Cscript type=\"math\u002Ftex\">\\theta^{(1)}, \\theta^{(2)}, \\dots, \\theta^{(S)}\u003C\u002Fscript>. Quy trình ước lượng các đại lượng độ lệch hậu nghiệm được thực hiện tuần tự qua các bước:\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>Tính toán độ lệch cho từng mẫu:\u003C\u002Fstrong> Tại mỗi bước lấy mẫu thứ \u003Cscript type=\"math\u002Ftex\">s\u003C\u002Fscript>, tính giá trị độ lệch \u003Cscript type=\"math\u002Ftex\">D(\\theta^{(s)}) = -2 \\ln p(y|\\theta^{(s)})\u003C\u002Fscript>.\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Ước lượng độ lệch hậu nghiệm trung bình:\u003C\u002Fstrong> Tính trung bình cộng của chuỗi độ lệch mẫu:\n\u003Cscript type=\"math\u002Ftex; mode=display\">\\bar{D} \\approx \\frac{1}{S} \\sum_{s=1}^S D(\\theta^{(s)})\u003C\u002Fscript>\n\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Xác định trung bình tham số hậu nghiệm:\u003C\u002Fstrong> Tính vector kỳ vọng mẫu của các tham số:\n\u003Cscript type=\"math\u002Ftex; mode=display\">\\bar{\\theta} \\approx \\frac{1}{S} \\sum_{s=1}^S \\theta^{(s)}\u003C\u002Fscript>\n\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Tính độ lệch tại điểm trung bình:\u003C\u002Fstrong> Đánh giá hàm độ lệch tại vector tham số trung bình vừa tìm được để thu được \u003Cscript type=\"math\u002Ftex\">D(\\bar{\\theta})\u003C\u002Fscript>.\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Tính số tham số hiệu dụng và chỉ số DIC:\u003C\u002Fstrong> Lấy hiệu số để tìm \u003Cscript type=\"math\u002Ftex\">p_D = \\bar{D} - D(\\bar{\\theta})\u003C\u002Fscript>, sau đó cộng với \u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript> để xác định giá trị DIC.\u003C\u002Fli>\n\u003C\u002Ful>\n\n\u003Cp>Bảng dưới đây tổng hợp các đại lượng liên quan đến độ lệch hậu nghiệm và cách diễn giải tương ứng trong phân tích dữ liệu:\u003C\u002Fp>\n\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>Đại lượng thống kê\u003C\u002Fth>\n\u003Cth>Ký hiệu toán học\u003C\u002Fth>\n\u003Cth>Ý nghĩa trong mô hình\u003C\u002Fth>\n\u003Cth>Phương pháp tính trong MCMC\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\n\u003Ctr>\n\u003Ctd>Hàm độ lệch tại mẫu thứ s\u003C\u002Ftd>\n\u003Ctd>\u003Cscript type=\"math\u002Ftex\">D(\\theta^{(s)})\u003C\u002Fscript>\u003C\u002Ftd>\n\u003Ctd>Mức độ không khớp của mẫu tham số cụ thể với dữ liệu\u003C\u002Ftd>\n\u003Ctd>Tính trực tiếp từ hàm log hợp lý tại mẫu s\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Độ lệch hậu nghiệm trung bình\u003C\u002Ftd>\n\u003Ctd>\u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript>\u003C\u002Ftd>\n\u003Ctd>Thước đo tổng thể về độ không phù hợp của mô hình\u003C\u002Ftd>\n\u003Ctd>Trung bình cộng của chuỗi giá trị độ lệch\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Độ lệch tại trung bình hậu nghiệm\u003C\u002Ftd>\n\u003Ctd>\u003Cscript type=\"math\u002Ftex\">D(\\bar{\\theta})\u003C\u002Fscript>\u003C\u002Ftd>\n\u003Ctd>Độ lệch của mô hình khi cố định tham số tại điểm trung bình\u003C\u002Ftd>\n\u003Ctd>Đánh giá hàm độ lệch tại điểm trung bình các mẫu\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Số tham số hiệu dụng\u003C\u002Ftd>\n\u003Ctd>\u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript>\u003C\u002Ftd>\n\u003Ctd>Độ phức tạp hiệu quả có tính đến hiệu ứng co của tiên nghiệm\u003C\u002Ftd>\n\u003Ctd>Hiệu số giữa độ lệch trung bình và độ lệch tại điểm trung bình\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>Tiêu chuẩn thông tin độ lệch\u003C\u002Ftd>\n\u003Ctd>\u003Cscript type=\"math\u002Ftex\">DIC\u003C\u002Fscript>\u003C\u002Ftd>\n\u003Ctd>Tiêu chuẩn so sánh mô hình cân bằng độ khớp và độ phức tạp\u003C\u002Ftd>\n\u003Ctd>Tổng của độ lệch trung bình và số tham số hiệu dụng\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\n\u003C\u002Ftable>\n\n\u003Ch2>Ưu điểm và ứng dụng thực tiễn\u003C\u002Fh2>\n\u003Cp>Ưu thế nổi bật nhất của việc sử dụng độ lệch hậu nghiệm và tiêu chuẩn DIC nằm ở khả năng xử lý các mô hình cấu trúc phân cấp (hierarchical models) hoặc mô hình đa mức (multilevel models). Trong các mô hình này, việc xác định số lượng tham số tự do thực sự là một bài toán hóc búa đối với thống kê cổ điển. Khi các tham số ngẫu nhiên chịu sự kiểm soát của phân phối tiên nghiệm chung, hiện tượng co (shrinkage) làm giảm số bậc tự do thực tế của mô hình. Đại lượng \u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript> dựa trên độ lệch hậu nghiệm tự động nắm bắt mức độ co này mà không đòi hỏi nhà nghiên cứu phải đếm số tham số theo cách thủ công.\u003C\u002Fp>\n\n\u003Cp>Một ưu điểm thực tiễn khác là chi phí tính toán thuận lợi. Trong các phần mềm thống kê thuộc họ BUGS như WinBUGS, OpenBUGS và JAGS, giá trị log hợp lý và nút độ lệch của từng mẫu được theo dõi tự động theo mặc định trong quá trình cập nhật trạng thái chuỗi. Do đó, việc theo dõi và trích xuất độ lệch hậu nghiệm không đòi hỏi các thuật toán phụ trợ phức tạp hoặc các phép lấy mẫu bổ sung tốn kém tài nguyên tính toán.\u003C\u002Fp>\n\n\u003Cp>Tại Việt Nam, các phương pháp phân tích Bayes ứng dụng độ lệch hậu nghiệm ngày càng được áp dụng rộng rãi trong nhiều lĩnh vực nghiên cứu khoa học chuyên sâu:\u003C\u002Fp>\n\u003Cul>\n\u003Cli>\u003Cstrong>Dịch tễ học và y tế công cộng:\u003C\u002Fstrong> Phân tích mô hình không gian - thời gian về sự lan truyền của các bệnh truyền nhiễm, nơi các hiệu ứng ngẫu nhiên cấp tỉnh hoặc cấp huyện được làm trơn thông qua các phân phối tiên nghiệm có cấu trúc không gian. Độ lệch hậu nghiệm giúp so sánh tính phù hợp giữa mô hình lân cận không gian và mô hình độc lập.\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Kinh tế lượng và tài chính:\u003C\u002Fstrong> Ước lượng các mô hình biến động ngẫu nhiên (stochastic volatility) và mô hình chuỗi thời gian phi tuyến tính trong phân tích biến động giá trị thị trường chứng khoán và tỷ giá hối đoái.\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Sinh thái học định lượng và lâm nghiệp:\u003C\u002Fstrong> Mô hình hóa mật độ quần thể sinh vật và động thái tái sinh rừng dựa trên dữ liệu điều tra ô mẫu phân cấp, hỗ trợ đánh giá tác động của biến đổi môi trường.\u003C\u002Fli>\n\u003C\u002Ful>\n\n\u003Ch2>So sánh độ lệch hậu nghiệm với các tiêu chuẩn lựa chọn mô hình\u003C\u002Fh2>\n\u003Cp>Để đánh giá đầy đủ vị trí của độ lệch hậu nghiệm trong hệ thống các công cụ thống kê, cần đặt đại lượng này trong mối tương quan so sánh với các tiêu chuẩn lựa chọn mô hình phổ biến khác bao gồm Tiêu chuẩn thông tin Akaike (AIC), Tiêu chuẩn thông tin Bayes (BIC), Tiêu chuẩn thông tin áp dụng rộng rãi (WAIC) và Kiểm định chéo loại một điểm (LOO-CV).\u003C\u002Fp>\n\n\u003Ctable>\n\u003Cthead>\n\u003Ctr>\n\u003Cth>Tiêu chuẩn so sánh\u003C\u002Fth>\n\u003Cth>Bản chất lý thuyết\u003C\u002Fth>\n\u003Cth>Cách xử lý phân phối hậu nghiệm\u003C\u002Fth>\n\u003Cth>Ưu điểm nổi bật\u003C\u002Fth>\n\u003Cth>Hạn chế chính\u003C\u002Fth>\n\u003C\u002Ftr>\n\u003C\u002Fthead>\n\u003Ctbody>\n\u003Ctr>\n\u003Ctd>AIC (Akaike)\u003C\u002Ftd>\n\u003Ctd>Suy diễn hợp lý cực đại cổ điển\u003C\u002Ftd>\n\u003Ctd>Không sử dụng thông tin hậu nghiệm\u003C\u002Ftd>\n\u003Ctd>Dễ tính toán, phù hợp mẫu lớn đơn giản\u003C\u002Ftd>\n\u003Ctd>Không áp dụng được cho cấu trúc phân cấp phức tạp\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>BIC (Schwarz)\u003C\u002Ftd>\n\u003Ctd>Xấp xỉ thừa số Bayes theo tiệm cận\u003C\u002Ftd>\n\u003Ctd>Chỉ đánh giá tại điểm cực đại hợp lý\u003C\u002Ftd>\n\u003Ctd>Nhất quán khi kích thước mẫu tiến tới vô cùng\u003C\u002Ftd>\n\u003Ctd>Phạt quá nặng mô hình trong phân tích phân cấp\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>DIC (Spiegelhalter)\u003C\u002Ftd>\n\u003Ctd>Dựa trên độ lệch hậu nghiệm trung bình\u003C\u002Ftd>\n\u003Ctd>Sử dụng kỳ vọng độ lệch và điểm trung bình tham số\u003C\u002Ftd>\n\u003Ctd>Tích hợp tự nhiên trong MCMC, đo độ phức tạp hiệu dụng\u003C\u002Ftd>\n\u003Ctd>Phụ thuộc dạng tham số hóa, có thể cho p_D âm\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>WAIC (Watanabe)\u003C\u002Ftd>\n\u003Ctd>Dự báo tiệm cận Bayes đầy đủ\u003C\u002Ftd>\n\u003Ctd>Tính toán mật độ dự báo từng điểm trên toàn bộ chuỗi\u003C\u002Ftd>\n\u003Ctd>Bất biến dưới phép đổi tham số, nền tảng toán chặt chẽ\u003C\u002Ftd>\n\u003Ctd>Đòi hỏi dữ liệu phân chia độc lập có điều kiện\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003Ctr>\n\u003Ctd>LOO-CV\u003C\u002Ftd>\n\u003Ctd>Kiểm định chéo ngoài mẫu\u003C\u002Ftd>\n\u003Ctd>Ước lượng mật độ dự báo ngoài mẫu qua trọng số PSIS\u003C\u002Ftd>\n\u003Ctd>Phản ánh trực tiếp năng lực dự báo thực tế\u003C\u002Ftd>\n\u003Ctd>Nhạy cảm với các điểm dữ liệu dị biệt có ảnh hưởng lớn\u003C\u002Ftd>\n\u003C\u002Ftr>\n\u003C\u002Ftbody>\n\u003C\u002Ftable>\n\n\u003Ch2>Hạn chế lý thuyết và hướng phát triển\u003C\u002Fh2>\n\u003Cp>Mặc dù được ứng dụng rộng rãi trong nhiều thập kỷ, độ lệch hậu nghiệm và tiêu chuẩn thông tin độ lệch bộc lộ ba hạn chế lý thuyết quan trọng đã được cộng đồng khoa học quốc tế mổ xẻ chi tiết.\u003C\u002Fp>\n\n\u003Cp>Thứ nhất là tính không bất biến đối với phép tái tham số hóa (reparameterization). Trong công thức tính số tham số hiệu dụng \u003Cscript type=\"math\u002Ftex\">p_D = \\bar{D} - D(\\bar{\\theta})\u003C\u002Fscript>, đại lượng \u003Cscript type=\"math\u002Ftex\">D(\\bar{\\theta})\u003C\u002Fscript> phụ thuộc trực tiếp vào vector trung bình hậu nghiệm \u003Cscript type=\"math\u002Ftex\">\\bar{\\theta}\u003C\u002Fscript>. Trong khi các phân vị (như giá trị trung vị) của phân phối có tính bất biến dưới các phép biến đổi đơn điệu, kỳ vọng toán học \u003Cscript type=\"math\u002Ftex\">E[\\theta|y]\u003C\u002Fscript> lại biến đổi phi tuyến tính khi tham số được biểu diễn dưới dạng hàm số khác (chẳng hạn chuyển đổi từ phương sai sang độ lệch chuẩn hoặc độ chính xác). Hệ quả là cùng một mô hình và tập dữ liệu, việc thay đổi cách biểu diễn toán học của tham số có thể làm thay đổi giá trị \u003Cscript type=\"math\u002Ftex\">p_D\u003C\u002Fscript> và giá trị DIC cuối cùng.\u003C\u002Fp>\n\n\u003Cp>Thứ hai là nguy cơ phát sinh giá trị âm cho số tham số hiệu dụng. Như Plummer (2008) đã chỉ ra trong phân tích hàm mất mát phạt, khi phân phối hậu nghiệm có dạng bất đối xứng rõ rệt, đa đỉnh hoặc trong các mô hình hỗn hợp (mixture models), ước lượng trung bình hậu nghiệm \u003Cscript type=\"math\u002Ftex\">\\bar{\\theta}\u003C\u002Fscript> có thể rơi vào vùng có mật độ xác suất rất thấp giữa hai đỉnh phân phối. Tại vị trí đó, giá trị độ lệch \u003Cscript type=\"math\u002Ftex\">D(\\bar{\\theta})\u003C\u002Fscript> có thể vượt quá độ lệch hậu nghiệm trung bình \u003Cscript type=\"math\u002Ftex\">\\bar{D}\u003C\u002Fscript>, dẫn đến kết quả \u003Cscript type=\"math\u002Ftex\">p_D \u003C 0\u003C\u002Fscript>. Hiện tượng số tham số hiệu dụng nhận giá trị âm làm mất tính hợp lý logic của hình phạt độ phức tạp và vô hiệu hóa khả năng so sánh mô hình.\u003C\u002Fp>\n\n\u003Cp>Thứ ba là vấn đề dự báo ngoài mẫu. Gelman và cộng sự (2013) đã phân tích rằng độ lệch hậu nghiệm và DIC về bản chất vẫn là các tiêu chuẩn dựa trên ước lượng điểm cắm vào (plug-in estimates), chưa đạt đến mức độ Bayes toàn phần trong việc tính toán phân phối dự báo hậu nghiệm (posterior predictive distribution). Để khắc phục các hạn chế này, Watanabe (2010) đã phát triển tiêu chuẩn thông tin áp dụng rộng rãi (WAIC). Tiêu chuẩn WAIC đánh giá log mật độ dự báo từng điểm trên toàn bộ phân phối hậu nghiệm thay vì sử dụng một ước lượng điểm đại diện, đảm bảo tính bất biến dưới mọi phép biến đổi tham số và duy trì nền tảng toán học vững chắc ngay cả trong các mô hình phi chuẩn.\u003C\u002Fp>\n\n\u003Cp>Trong thực hành nghiên cứu hiện đại, mặc dù độ lệch hậu nghiệm vẫn giữ nguyên giá trị sư phạm và là công cụ chẩn đoán nhanh độ khớp mô hình, các nhà khoa học khuyến nghị kết hợp đánh giá độ lệch hậu nghiệm song song với WAIC và kiểm định chéo LOO-CV để đảm bảo tính chuẩn xác và độ tin cậy cao nhất khi đưa ra kết luận lựa chọn mô hình thống kê.\u003C\u002Fp>\n","posterior deviance",[],"Độ lệch hậu nghiệm (posterior deviance) là thước đo độ không phù hợp của mô hình thống kê Bayes, được tính bằng hàm độ lệch thống kê đánh giá trên phân phối hậu nghiệm của các tham số. Đại lượng này đóng vai trò nền tảng trong việc xác định số tham số hiệu dụng và tính toán tiêu chuẩn thông tin độ lệch (DIC) để so sánh các mô hình.","NATURAL_SCIENCES",[22,30,38],{"citationText":23,"title":24,"authors":25,"source":26,"year":27,"doi":28,"url":29},"Spiegelhalter, D. J., Best, N. G., Carlin, B. P., & van der Linde, A. (2002). Bayesian Measures of Model Complexity and Fit. Journal of the Royal Statistical Society Series B: Statistical Methodology, 64(4), 583-639.","Bayesian Measures of Model Complexity and Fit","Spiegelhalter, D. J., Best, N. G., Carlin, B. P., & van der Linde, A.","Journal of the Royal Statistical Society Series B: Statistical Methodology",2002,"10.1111\u002F1467-9868.00353","https:\u002F\u002Fdoi.org\u002F10.1111\u002F1467-9868.00353",{"citationText":31,"title":32,"authors":33,"source":34,"year":35,"doi":36,"url":37},"Gelman, A., Hwang, J., & Vehtari, A. (2013). Understanding predictive information criteria for Bayesian models. Statistics and Computing, 24(6), 997-1016.","Understanding predictive information criteria for Bayesian models","Gelman, A., Hwang, J., & Vehtari, A.","Statistics and Computing",2013,"10.1007\u002Fs11222-013-9416-2","https:\u002F\u002Fdoi.org\u002F10.1007\u002Fs11222-013-9416-2",{"citationText":39,"title":40,"authors":41,"source":42,"year":43,"doi":44,"url":45},"Plummer, M. (2008). Penalized loss functions for Bayesian model comparison. Biostatistics, 9(3), 523-539.","Penalized loss functions for Bayesian model comparison","Plummer, M.","Biostatistics",2008,"10.1093\u002Fbiostatistics\u002Fkxm049","https:\u002F\u002Fdoi.org\u002F10.1093\u002Fbiostatistics\u002Fkxm049",[47,50,53],{"question":48,"answer":49},"Độ lệch hậu nghiệm khác gì so với độ lệch trong thống kê cổ điển?","Trong thống kê cổ điển, độ lệch được tính toán tại một ước lượng điểm duy nhất của tham số như ước lượng hợp lý cực đại. Ngược lại, độ lệch hậu nghiệm trong thống kê Bayes được xem xét trên toàn bộ phân phối xác suất hậu nghiệm, cho phép tính toán kỳ vọng độ lệch trung bình và đánh giá toàn diện sự không chắc chắn của mô hình.",{"question":51,"answer":52},"Vì sao không nên chỉ dùng độ lệch hậu nghiệm trung bình để chọn mô hình?","Nếu chỉ dựa vào giá trị độ lệch hậu nghiệm trung bình, nhà nghiên cứu sẽ luôn ưu tiên các mô hình phức tạp có nhiều tham số vì chúng khớp dữ liệu huấn luyện tốt hơn. Điều này dễ dẫn đến hiện tượng quá khớp (overfitting), làm giảm khả năng dự báo trên dữ liệu mới. Do đó, cần kết hợp hình phạt số tham số hiệu dụng như trong tiêu chuẩn DIC.",{"question":54,"answer":55},"Khi nào tiêu chuẩn DIC dựa trên độ lệch hậu nghiệm gặp thất bại?","Tiêu chuẩn DIC có thể cho kết quả sai lệch khi phân phối hậu nghiệm có dạng phi chuẩn, đa đỉnh hoặc trong các mô hình hỗn hợp (mixture models). Trong những trường hợp này, số tham số hiệu dụng p_D có thể nhận giá trị âm, hoặc việc thay đổi dạng toán học của tham số làm thay đổi kết quả lựa chọn mô hình. Khi đó, các tiêu chuẩn như WAIC hoặc LOO-CV được khuyến nghị sử dụng thay thế.",{"id":57,"researcherId":10,"name":58,"imageUrl":59},1,"Nguyễn Ngọc Sơn","https:\u002F\u002Flh3.googleusercontent.com\u002Fa\u002FACg8ocLGfGsF1nYQqYK5BasTLhNu1dBrBXg2fcEgBNPXJ0p2gqLQnO7i=s96-c",{"id":57,"researcherId":10,"name":58,"imageUrl":59},[13],false,"PUBLISHED","2025-12-01T11:20:56.455+00:00","2026-10-06T03:27:27.659+00:00","2026-10-06T03:27:27.631+00:00",0,[69,77,82,87,92,97,102,107,112,117],{"id":70,"title":71,"term":70,"englishTitle":70,"definition":72,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"proton","Proton là gì? Cấu trúc và ứng dụng của Proton","Proton là một hạt hạ nguyên tử bền vững thuộc nhóm baryon cấu tạo từ hai quark lên và một quark xuống, mang điện tích nguyên tố dương và có khối lượng nghỉ xấp xỉ 1.6726 x 10^-27 kg nằm trong hạt nhân nguyên tử.","natural-sciences","Khoa học tự nhiên","#0E9F9C","atom",{"id":78,"title":79,"term":78,"englishTitle":80,"definition":81,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"nhiệt độ nóng chảy","Nhiệt độ nóng chảy là gì? Các nghiên cứu khoa học liên quan","nhiet do nong chay","khái niệm và đối tượng nghiên cứu cơ bản trong khoa học tự nhiên, phản ánh các đặc trưng bản chất, cơ chế vận hành và các quy luật tương tác hệ thống trong thực tiễn.",{"id":83,"title":84,"term":83,"englishTitle":85,"definition":86,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"hằng số tốc độ","Hằng số tốc độ là gì? Các bài nghiên cứu khoa học liên quan","rate constant","Hằng số tốc độ (Reaction Rate Constant, ký hiệu k) là một hệ số tỷ lệ đặc trưng trong phương trình động học biểu thị tốc độ của phản ứng hóa học khi nồng độ của tất cả các chất phản ứng bằng đơn vị.",{"id":88,"title":89,"term":88,"englishTitle":90,"definition":91,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"động vật linh trưởng","Động vật linh trưởng là gì? Tiến hóa Perelman, giải phẫu Fleagle và Estrada","primates","Động vật linh trưởng là một bộ thú có vú bậc cao đặc trưng bởi bàn tay ngón cái đối diện, thị giác lập thể 3D và vỏ não phát triển, tiến hóa qua các nhánh Mũi ướt và Mũi khô theo nghiên cứu Perelman-Fleagle.",{"id":93,"title":94,"term":93,"englishTitle":95,"definition":96,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"đồng vị","Đồng vị là gì? Phân loại và ứng dụng trong khoa học hiện đại","isotope","Đồng vị là các biến thể của cùng một nguyên tố hóa học có cùng số proton trong hạt nhân nhưng khác nhau về số neutron, dẫn đến khối lượng nguyên tử khác nhau.",{"id":98,"title":99,"term":98,"englishTitle":100,"definition":101,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"chu trình sinh địa hóa","Chu trình sinh địa hóa: Khái niệm, nguyên lý và ứng dụng","Biogeochemical cycle","Chu trình sinh địa hóa là một thuật ngữ và phạm trù học thuật then chốt trong lĩnh vực natural sciences, phản ánh các nguyên lý, cơ chế và phương pháp luận chuyên sâu đã được chuẩn hóa trong nghiên cứu và ứng dụng thực tiễn.",{"id":103,"title":104,"term":103,"englishTitle":105,"definition":106,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"ethylene","Ethylene là gì? Cấu trúc hóa học, vai trò sinh học và ứng dụng","Ethylene","Ethylene (ethene, công thức hóa học C2H4) là một hydrocarbon không no thuộc nhóm anken đơn giản nhất, tồn tại ở thể khí không màu, đồng thời là một phytohormone dạng khí điều hòa sự chín và rụng ở thực vật.",{"id":108,"title":109,"term":108,"englishTitle":110,"definition":111,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"không khí ẩm","Không khí ẩm là gì? Các công bố khoa học về Không khí ẩm","moist air","Không khí ẩm là hỗn hợp nhiệt động học giữa không khí khô và hơi nước, có các thông số đặc trưng gồm độ ẩm tương đối, độ ẩm tuyệt đối và nhiệt độ điểm sương.",{"id":113,"title":114,"term":113,"englishTitle":115,"definition":116,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"hệ số phân bố","Hệ số phân bố là gì? Ý nghĩa trong hóa học và dược lý","Partition Coefficient","Hệ số phân bố (partition coefficient, ký hiệu P hoặc log P) là đại lượng nhiệt động học biểu thị tỷ lệ nồng độ cân bằng của một chất tan không phân ly giữa hai dung môi không trộn lẫn (thường là 1-octanol và nước).",{"id":118,"title":119,"term":118,"englishTitle":118,"definition":120,"discipline":20,"disciplineCode":73,"disciplineLabel":74,"disciplineColor":75,"disciplineIcon":76},"phytoplankton","Phytoplankton là gì? Vai trò sinh thái, chu trình carbon và hiện tượng nở hoa","Phytoplankton (thực vật phù du) là tập hợp các vi sinh vật tự dưỡng quang hợp trôi nổi trong các thủy vực nước ngọt và đại dương, đóng vai trò sản xuất sơ cấp nền tảng của lưới thức ăn thủy sinh và điều hòa chu trình carbon toàn cầu."]