NLP Academy · 课时

精确率、召回率与 F1

必须理解的权衡

第 2 / 4 课13 个步骤

精确率、召回率与 F1 是 CoddyKit 上的免费 NLP Academy 课时。 这是第 2 节课,共 4 节。 你可以在下方免费阅读本课时的完整内容 — 然后在浏览器中使用内置代码编辑器和全天候 AI 导师进行实践。 这是 NLP Academy 学习路径的一部分,你的进度在网页和 CoddyKit 应用中同步。 NLP Academy 课程共包含 4 节课。

不止一个数字

要看清准确率之外的情况,您可以针对每个类别将结果分成四个部分。由此可以得到精确率、召回率和 F1,这些才是重要的指标。

正类

请将您关心的类别指定为正类,例如垃圾邮件或欺诈。精确率和召回率都用于描述您处理该类别的效果。

精确率:相信警报

精确率要回答的是:在所有被标记为正类的样本中,有多少确实是正类?精确率高意味着误报很少。

召回率:全部捕获

召回率要回答的是:在所有真实的正类样本中,您捕获了多少?召回率高意味着漏检很少。

此消彼长

精确率和召回率通常会相互权衡。标记更多项目时,召回率会上升,但精确率会下降;标记更少时则相反。

应该先看哪个

垃圾邮件过滤器更看重精确率,因为误将正常邮件丢入垃圾箱的代价很高。癌症筛查更看重召回率,因为漏掉病例的后果严重得多。

F1:一个平衡的得分

F1 得分使用精调平均数,将精确率和召回率合并为一个数字,从而奖励两者都表现良好的模型。

为什么使用调和平均数

F1 使用调和平均数,因此模型无法靠一项指标造假。如果精确率或召回率中的任意一个接近零,F1 也会保持较低。

在 Python 中查看

斯科特学习库可以通过整洁的 classification_report 一次输出这三个指标,您可以按类别快速查看。

from sklearn.metrics import classification_report
print(classification_report(y_true, y_pred))

单独获取一个指标

如果您只需要查看正类的 F1,也可以直接提取单个指标。

from sklearn.metrics import f1_score
f1 = f1_score(y_true, y_pred)

根据代价进行选择

没有哪个指标在所有场景下都最好。请根据问题中每种错误在现实世界中的代价,选择精确率、召回率或 F1。

快速检查

将指标与它要回答的问题进行匹配。

回顾

精确率限制误报,召回率限制漏检,而 F1 平衡二者。让每个错误的代价决定您使用哪种指标。📊

免费开始

用 AI 导师学习 Python — 免费

在浏览器中编写并运行真实代码,获得全天候 AI 导师的即时帮助,并在网页或应用中继续学习。

课程
30
课程
120

常见问题解答

「精确率、召回率与 F1」课时是免费的吗?

是的 — 「精确率、召回率与 F1」的完整文本可在网页上免费阅读。要进行交互式练习(内置代码编辑器和全天候 AI 导师)并解锁 NLP Academy 课程的其余内容,请升级到 CoddyKit PRO。 NLP Academy 课程共包含 4 节课。

「精确率、召回率与 F1」这节课中我会学到什么?

必须理解的权衡 你通过在浏览器中直接运行的动手代码来练习 NLP Academy,全天候 AI 导师会在你学习这节课的过程中回答你的问题。

学习 NLP Academy 需要有经验吗?

无需任何先前经验。CoddyKit 上的 NLP Academy 课程适合初学者到高级学习者,你可以从这里开始或从头开始,按照自己的节奏学习。 这是第 2 节课,共 4 节。

「精确率、召回率与 F1」课时需要多长时间?

大多数 CoddyKit 课程大约需要 5–10 分钟。每节课都很精短且互动,所以你能稳步进步,并在网页和应用中从离开的地方继续。

我能在这节 NLP Academy 课中编写并运行代码吗?

能。每节 NLP Academy 课都包含内置代码编辑器,你可以在浏览器中直接编写并运行真实代码,并获得即时 AI 反馈 — 无需本地设置。

此课程中的所有课时

  1. 准确率为何可能骗人
  2. 精确率、召回率与 F1
  3. 解读混淆矩阵
  4. 正确进行交叉验证
← 返回 NLP Academy