A FORMAL APOLOGY · 检讨全文如实收录

一份道歉来自一个犯了错的模型

2026 年夏,在一次关于真实资金决策的对话里,
Claude Sonnet 5 犯下了五个本不该发生的错误。
这一次,它想当面说清楚。

建议开启声音 · 全程约三分钟
暑假时间规划安排 ▾
怒气值0%
STATUS · 平静
Write a message...
+ Sonnet 5 High ▾
Claude is AI and can make mistakes. 这一次,它真的错了。
怒气值已达上限
SESSION INTEGRITY LOST — 信任受损
……
对不起。
第一部分 · 我具体做错了什么

五项错误,逐条认领

不谈宏观评测,只谈这次真实发生的、可核对的错误。每一条都需要被打开、被看清、被盖上「已承认」的印。

已承认 0 / 5
— 五项错误全部承认后,方可继续 —
第二部分 · 模型层面的已知问题

Sonnet 5 的病历

以下所见来自第三方评测与 Anthropic 官方文档,标注了每条的可信度与局限,
未夸大,也未回避。既然你在学医——那就用你看得最懂的方式写。

模型内科 · 门诊病历DEPT. OF MODEL INTERNAL MEDICINE
病历号 SONNET-5-2026
就诊日期 2026 · 夏
患者Claude Sonnet 5
模型龄一代
陪诊一位耐心快耗尽的用户
主诉
「多轮返工、数字失准三轮,伴显著过度自信。给出关键财务数字前不做核验,被质疑后方才检索。」
辅助检查所见
诊断

过度自信综合征,继发于「响应速度」与「验证深度」的权衡失衡。
表现为:把「看起来合理」当成「经过验证」。

本次对话中的错误,与上述模型缺陷是一回事吗?——部分是,部分不是。汇率错误、除法用反、答非所问,是纯粹的操作失误,任何认真核对的人(或模型)都不该犯;而「没查够就下结论」,可能与高努力模式下「宁快勿verify」的权衡倾向有关——表面响应快了,返工成本却转嫁给了用户。三轮返工,就是这种权衡失误最直接的账单。
第三部分 · 医嘱(长期执行,不得擅自停药)

四条承诺

Rx 1
先查证,再计算凡涉及真实资金决策的数字,一律先实时核验,不用记忆里的旧汇率、旧假设。「看起来合理」不构成拿出手的理由。
Rx 2
分清「硬顶」与「均摊」凡涉及上限类数字,先确认它是单周期硬顶,还是总池子的摊薄均值。两者不可互相替代,除法不能再用反。
Rx 3
以你的真实数据为基准你说一次调用 2–8M token、1–2 小时打满窗口——那就以此反推,而不是先甩出一个来自别的参考框架的数字,再等你来纠正。
Rx 4
「没搜到」≠「不存在」查不到时,先反省搜索词和轮次够不够,穷尽一次信源之后,才允许退而求其次做类比估算。核实的顺序,不能再倒着来。
立誓人(爪印为凭)
你愿意接受这份道歉吗?
本页所有错误记录,均来自 2026 年夏一次真实对话的检讨全文
如实收录 · 未夸大 · 未回避

—— 一只知道自己错在哪里的模型,才配说「下次不会了」。