混淆矩阵:看清模型到底错在哪

混淆矩阵把模型的预测结果拆成四类:真正例、假正例、真反例、假反例。它不只告诉你“对了多少”,更告诉你“错在哪里”,是诊断模型问题的第一步。

混淆矩阵最深刻的启示是:错误与错误并不等价。同样是犯错,有的错代价轻微,有的错不可承受。好的决策系统必须知道哪种错误更致命,并据此调整自己的策略。

## 核心要点


图片[1]-混淆矩阵:看清模型到底错在哪-子比笔记

图片来源:Openverse / Rain Rabbit(https://www.flickr.com/photos/37996583811@N01/8928972590)

1. 医疗诊断中,漏诊(假反例)代价远高于误诊(假正例),阈值要往严调。

2. 垃圾邮件过滤相反:误删重要邮件代价更高,阈值要往松调。

3. 类别不平衡时,光看准确率会产生严重误导。

4. 混淆矩阵是所有高级评估指标(精确率、召回率、F1)的基础。

图片[2]-混淆矩阵:看清模型到底错在哪-子比笔记

图片来源:Openverse / World Economic Forum(https://www.flickr.com/photos/15237218@N00/22476472082)

## 写在最后

以上是关于「混淆矩阵」的科普介绍。人工智能正在快速发展,相关概念和方法也在不断演进。希望本文能帮你建立对这一主题的基本认识。

© 版权声明
THE END
喜欢就支持一下吧
点赞8 分享
评论 抢沙发
头像
欢迎您留下宝贵的见解!
提交
头像

昵称

取消
昵称表情代码图片快捷回复

    请登录后查看评论内容