机器学习与频率-严重性分解在车险定价中的应用

保险纯保费预测是车险定价的核心,直接影响组合盈利性与费率公平性。传统精算实践普遍采用频率-严重性分解框架,将纯保费拆解为预期索赔频次与平均索赔强度,分别建模后再合并。该方法契合索赔过程的双重随机性,兼具可解释性与灵活性。

本研究基于法国车险数据,对比了传统广义线性模型(GLM)与机器学习方法(XGBoost)在频次、强度及纯保费预测中的表现。主要发现如下:

一、XGBoost显著提升频次预测能力
在频次建模中,XGBoost的均方误差、相关系数及高风险段提升率(Lift)均优于Poisson GLM、样条GLM及GAM。变量重要性显示,Bonus-Malus系数、驾驶年龄、车龄是关键风险因子,与精算直觉一致。

二、强度建模面临精度与分布拟合的权衡
Gamma GLM在Gamma离差指标上占优,但预测值过度向均值收缩;XGBoost则能捕捉非线性关系,获得更低的平均绝对误差和更高相关系数。二者各有侧重,说明机器学习在强度端可补充传统模型,但无法完全替代。

三、分解框架下“XGBoost频次 + XGBoost强度”获得最低预测误差,但风险分层表现并非最优——“XGBoost频次 + Gamma强度”在高风险段的提升率更高。这揭示了预测精度与风险排序之间存在微弱但一致的权衡:追求整体误差最小化,未必能最好地识别高赔付保单。

四、分解方法优于直接建模
相比直接预测总赔款的XGBoost和Tweedie GLM,分解框架在误差和相关性上均占优。这说明分别建模频次与强度,能更充分地利用索赔过程的结构信息,尤其当频次与强度受不同因素驱动时,优势更为突出。

实践启示:若定价目标为最小化整体误差,宜采用双XGBoost分解模型;若目标为优化承保筛选与风险分级,则应重视频次建模的准确性,并接受适度误差增加。模型选择应服务于业务目标,而非唯精度论。分解框架为机器学习提供了坚实的精算基础,二者融合是车险定价的可行方向。

机器学习与频率-严重性分解在车险定价中的应用

发布者:保险日报,转转请注明出处:https://www.insurdaily.com/archives/6801.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
保险日报的头像保险日报
保险行业周报:上半年分红险翻倍增长,板块防御价值凸显
上一篇 5天前
存款搬家下的保险配置价值
下一篇 4天前

相关推荐

  • 数字金融使用显著促进家庭商业保险消费

    我国保险密度与深度仍低于全球平均水平,家庭商业保险参与率偏低是突出痛点。数字金融凭借低成本、广覆盖、信息高效传播等优势,正深刻影响家庭保险消费决策。 实证研究(基于CHFS 2017、2019年数据)表明:数字金融使用能显著提升家庭购买商业保险的概率及保费支出占比,且结论稳健。其作用路径有两条:一是通过提升家庭收入水平,夯实保险购买的经济基础;二是通过增强社…

    2026年 7月 24日
    9800
  • 保险数据准备中的统计陷阱与纠偏框架

    保险损失数据具有典型的零膨胀与厚尾特征(如车险中无赔案保单占比极高),传统随机划分训练/测试集常导致极端值分配失衡,扭曲模型评估。论文通过模拟证明:随机拆分下极端观测落入测试集的标准差达7.72,而基于“支撑点”的最小能量距离拆分法将标准差压缩至1.28,且回归系数估计误差从2.6%降至0.7%,显著提升精算模型的稳定性与可重复性。 高维特征筛选是另一痛点。…

    2026年 8月 2日
    600
  • 学龄前儿童基本医疗保险:参保困境与保障效果

    我国基本医保参保率超95%,但学龄前儿童参保率不足70%,未参保人数超3000万,占未参保总人口近一半。这一群体住院率远高于其他年龄段,却面临“高需求、低覆盖”的矛盾。 参保率偏低的关键障碍在于信息认知不足。实证显示,父母至少一方参加城乡居民医保(含新农合、城居保)的家庭,其子女参保概率比父母双方均为城镇职工医保的家庭高出6个百分点。前者对儿童参保流程、政策…

    5天前
    1100
  • 2020—2026年5月中国保险业保费走势分析

    截至2026年5月,全行业原保险保费累计收入约1.18万亿元,同比增长约14%。从年度走势看,2020—2025年保费总量从4.5万亿级逐步攀升至约5.5万亿级,2026年前五个月增速加快,反映需求回暖。 人身险仍占主导,健康险增长突出。 2026年1—5月人身险保费约9,742亿元,占总保费82%,其中寿险约8,609亿元,健康险约1,092亿元。健康险自…

    2026年 7月 24日
    22500
  • 受限AI模型对保险业的挑战:评估缺口与市场影响

    Anthropic以“限制分发”模式发布前沿AI模型Mythos,仅限少数经审核的合作伙伴使用,形成了继开源、开放权重、闭源之后的第四类模型。此举旨在降低模型被恶意利用的风险——Mythos在检测漏洞、开发利用链方面表现优异。 这对(再)保险公司构成双重挑战。其一,攻击威胁加速:AI压缩了漏洞披露到利用的时间窗口(从数月缩至数小时),类似2017年Shado…

    5天前
    1300

发表回复

登录后才能评论

联系我们

400-800-8888

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信