医疗保险健康计划支付中事件报告不可靠情况下的事件发生时间估计

——Medicare Advantage编码强度与过度编码的新评估框架

背景与问题

美国Medicare计划通过风险调整向Medicare Advantage(MA)私营保险公司预付保费,依据受益人的疾病层级(HCC)评分确定支付额。由于保险公司保留支付盈余,其有强烈动机尽可能多地编码诊断或选择更严重等级,即“过度编码”(upcoding)。据估计,此举每年给联邦政府造成数百亿美元损失,且多主要保险公司曾因欺诈被司法部调查。

现有编码强度评估多依赖年度诊断计数,并以传统Medicare(TM)为参照。但TM本身存在编码不足(undercoding)问题,导致差异被高估。同时,研究者缺乏带标签的过度编码数据,难以开发和验证新方法。

原文下载,请扫码加入知识库

医疗保险健康计划支付中事件报告不可靠情况下的事件发生时间估计

方法与创新

作者首次将时间-事件(生存分析)引入Medicare编码行为监测,扩展了受限平均时间损失(RMTL)估计量。核心思路:将每个HCC的首次报告视为“事件”,观察其在多个监测期(如季度)内的累计发生情况。针对同一疾病不同严重等级(如轻、中、重度痴呆)互斥编码的特点,引入竞争风险框架。

提出三类估计量:

  1. 组间差异估计(ψ):比较MA与TM在某一监测期内“无事件平均时间”的差异,反映编码强度。

  2. 跨期变化估计(ψ_M):监测连续监测期之间差异的变化,捕捉动态编码行为。

  3. 严重性过度编码估计(ω):比较最严重与最轻微等级HCC在MA和TM中的报告差异,识别将低严重度患者“升级”为高严重度编码的行为。

同时,利用参考HCC的持续性估算TM的编码不足比例(ε),对结果进行校正。

为克服无标签数据难题,作者基于NIH“All of Us”研究中65岁以上人群的自报健康条件(不受编码激励影响),开发了开源R包 upcoding,可模拟具有真实共病模式的基线数据,并按需添加任意比例的任何可用型或严重性型过度编码及编码不足,且标记每例过度编码——这是首个公开可用的带标签模拟工具。

模拟实验结果

模拟采用1000次重复,每组100万观测,设置MA组过度编码20%~30%,TM组5%并同时施加0~15%的编码不足。

结果显示:

  • 新估计量(ψ)能清晰区分MA与TM的编码差异,且差异随过度编码程度增大而增大,对TM编码不足的敏感性有限(因为编码不足分散于全部115个HCC,对单一HCC影响小)。

  • 跨监测期估计量(ψ_M)可反映固定样本下可编码个体逐渐耗尽的特征,有助于识别哪些HCC被“过度开掘”。

  • 对比广泛使用的DECI(基于年度风险评分比值),DECI对少数HCC的过度编码几乎无反应,却对编码不足高度敏感,易低估MA与TM的真实差距。

保险政策意义

本研究提供了一套可早期、规模化追踪编码行为的统计工具,尤其适用于风险调整公式更新后新激励行为的监测。其估计量可直接用于排序各HCC的“可疑程度”,辅助稽查。开源R包则降低了方法开发门槛,促进可重复研究。

该框架不仅适用于Medicare,也可推广至其他按风险付费的保险场景(如商业健康险、医疗补助计划),帮助监管者识别系统性编码操纵,保护支付体系完整性,节省公共资金,同时避免对正常服务机构的误判。


结论:通过引入生存分析思想并纠正TM编码不足,作者提出的时间-事件估计器克服了传统计数法的缺陷,结合公开模拟工具,为健康保险支付中的编码行为监管提供了实用且可扩展的新范式。

发布者:保险日报,转转请注明出处:https://www.insurdaily.com/archives/6376.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
保险日报的头像保险日报
何时不该做决定:克服人工智能裁决中事实性妄下断言的框架
上一篇 2026年 7月 11日 下午4:39
保险行业投资端系列研究(二):分红险转型重塑险资配置框架
下一篇 2026年 7月 11日 下午5:26

相关推荐

  • 我国责任保险区域发展差异及影响因素研究

    责任保险作为财产保险的重要分支,具有分散侵权风险、化解社会矛盾、辅助社会治理的独特功能。然而,我国责任保险市场虽增长迅速(2006年保费56.2亿元增至2022年1147.5亿元),却面临显著的区域发展不平衡问题。基于2006—2022年31个省份面板数据的实证研究显示,东部发达地区与中西部地区的责任保险密度、深度及保费规模差距悬殊,上海责任保险密度(504…

    2026年 8月 14日
    7400
  • 深度学习助力作物产量预测,赋能农业保险评估

    该论文提出一种新型预测框架(LYRA-RaTAR),通过融合多尺度时序建模与检索增强技术,大幅提升了美国县域级玉米产量预测的准确性。虽然核心属于农业遥感与机器学习领域,但其研究成果对农业保险评估具有直接支撑价值。 技术突破:传统模型在大范围、长时序预测中常因空间异质性和年际波动失效。新模型采用双重架构——GRU捕捉日尺度生长动态,跨年注意力机制提取长期依赖(…

    2026年 8月 11日
    4600
  • 灰天鹅事件生成方法及其在保险风险评估中的应用

    该研究提出一种利用可微分气象模型进行梯度下降优化的方法,可从历史观测数据出发,生成“灰天鹅”极端天气事件——即尚未发生但具有现实可能性的罕见灾害情景。以飓风菲奥娜(2022)为例,通过对初始条件施加微小扰动,成功模拟出类似飓风桑迪(2012)的登陆路径和更强气压深度(最低919hPa,桑迪为940hPa),并在其他四个飓风案例中验证了方法的可复现性。 从保险…

    2026年 7月 27日
    10300
  • 保险文档解析的AI基准测试:ParseBench的启示

    保险行业正大规模引入AI代理处理理赔、核保、监管报送等文档密集型工作。然而,文档解析的微小错误会直接传导为决策失误——例如表格表头错位导致理赔金额读取错误、图表数据遗漏影响风险评估、删除线或上标等语义格式丢失致使合同条款理解偏差。现有解析工具在保险场景下的实际表现,长期缺乏针对性评估。 面向保险文档的基准设计ParseBench构建了约2,000页经人工核验…

    2026年 7月 22日
    12900
  • 2022年全球及中国食管癌流行病学特征

    食管癌全球及中国流行病学特征:疾病负担与防控启示 食管癌是全球常见的恶性肿瘤之一。2022年全球新发食管癌511,054例,死亡445,391例,发病率和死亡率均居全球前列。中国食管癌新发224,012例、死亡187,467例,分别占全球的43.8%和42.1%,发病和死亡人数均居全球第1位,防控形势极为严峻。【原文下载,请在文末扫码加入知识库】 核心数据:…

    2026年 7月 14日
    15500

发表回复

登录后才能评论

联系我们

400-800-8888

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信