返回

文章详情

人类看起来正在对Claude Code进行A/B测试以减少努力水平

Hacker News2026年8月22日 16:58

更新:这是服务器端的,而不是应用程序,人类将Claude Code 2.1.236及以上版本的Fable 5会话纳入实验,以缩小努力规模,旧版本和Opus 5不受影响,可能是A/B测试,因此并非所有人都会看到。如果“高”感觉像“低”,那么你就在测试组。天哪,人类,有时候你们真让人无法忍受。如果这周Fable感觉更傻,那不是你们的问题❗❗❗自2.1.237以来,模型将“高”努力读为100分中的10,正是“低”过去的确切数值,而更新日志没有提到这一点。我花了整个下午都相信T3代码和我自己的应用是坏的,直到我去。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡