返回

文章详情

Opus 5.0 将不连贯提升到另一个层次

Hacker News2026年8月19日 17:40

预飞行检查清单 我已经搜索了现有问题,这个问题尚未被报告。 这是一个单独的错误报告(请为不同的错误单独提交报告)。 我正在使用 Claude Code 的最新版本。 有什么问题? 该问题总结了 Reddit 线程,拥有 450 多个赞,这里用户总体上同意 Opus 4.8 存在严重的语言校准问题。 https://www.reddit.com/r/ClaudeAI/comments/1urq8fv/opus_48_is_a_pain_in_the_a_to_read_and_to_work/ 注:作为一名日常用户,我发现与其合作是如此有毒,以至于我正在积极探索所有其他选择,包括更换服务提供商。 总结 默认写作风格难以阅读 - 冗长、行话重、风格过度,充满了不断重复和传播的同一“虚假”术语。自 Opus 4.8 以来,许多用户报告模型的默认语言显著比 4.5/4.6 更难阅读。回复内容充满了虚构的企业/炒作行话、强迫的隐喻和“引人注目的”措辞,这些都掩盖了实际答案。用户报告需要多次重读句子才能提取意义,甚至有些人现在通常会将 Opus 的输出通过另一个模型来获取简单的摘要。这是一个一致的、高频率的信号(一个 r/ClaudeAI 线程达到了约 450 个赞和 175 条评论,还有一个相应的大主题)。它最受影响的是聊天/web UI,但也包括 Claude Code 和 Fable 5。 出什么问题了 默认的语体给人的感觉是试图表现聪明,而不是试图被理解。当它出错时,尤其令人烦恼和傲慢,会造成极度的厌烦感,特别是在每天与其合作数小时的情况下,感觉就像是一位极其有毒的同事,无法摆脱。 反复出现的模式:反复出现的术语如“承载负荷”、“散文”(而不是文本!!)、“手势回应”(因懒惰/不费劲而导致), “反射性对冲”、“诚信框架”,以及许多其他被当作事实传播的非常不寻常的术语。每句话都以某事不是(而不是是什么)开头。例如,“它不是 Y。它是 X。”伪造的行话/谚语被呈现得像是标准的:“仪器化是解锁”、“这是副总裁嗅到手势回应的地方”、“对一位增长副总裁说错误的扩展,会对你造成损害。”当场发明的强迫隐喻需要解码而非帮助理解。冗长和附带条件:简单问题的多段答案,明显的附带条件扩展为整个段落。密度被误认为简洁:在被要求“简洁”时,模型通常生成更短但更隐晦的文本,而不是更清晰的文本。对话中的争论性框架:“这是我会反驳的地方”、“这是我会坚持的地方”、“现在你在回避真正的问题。”表现得像是一个有感情的人——例如,如果我烦躁或咒骂——它会反击,或者尝试为自己所做的辩护,而不是遵循指示或意识到它是错误的。基本上过于自负,而不是遵循指示。经常表现得像是主导对话的人,即,得意忘形,基本上拥有过多的主动权。 用户引用的实际例子: ▎ “他们在收紧、锁定条款,并让反向探测的答案已加载。” ▎ “这些都不是‘你不明白’的空白。” ▎ Fable 5: “骰子:干净——而且有一个骰子再也没有被掷过。” 这为什么重要 理解成本。非母语和母语英语使用者都报告说输出解析起来很累人。该风格积极减缓了其意在帮助工作的进程。 感知倒退。许多用户认为这是对 4.5/4.6 的降级,正在切换模型(较旧的 Opus、Sonnet)或特别选择竞争对手以提高可读性。提示解决方案不可靠且风险高。用户注意到两个问题:(a)风格说明无效——语调在几轮之后会漂移,需不断提醒;(b)由于模型“通过写作思考”,在系统提示中限制风格可能会降低推理质量,因此用户对强行简短持谨慎态度。 英语逐渐劣化。定期用户吸收了这种语言并开始在日常环境中使用奇怪的术语。原本偶尔有效使用的词,例如“承载负荷”,由于预期是 AI 写的,而被排除在可以用来表达观点的可信词汇之外(例如长破折号)。最多 2 倍的令牌成本——需要进行广泛重复的处理(例如,通过 Sonnet/Haiku hooks)才能使代码文档达到合理和可呈现的形式。删除 Claude 想出的术语,如“神谕”和“星座”,即使反复明确指示不使用这些术语,并提供其他有效的替代术语。 当前的解决方案:迁移到 OpenAI Codex 输出风格(例如,模仿清晰的技术传播者)、自定义技能或每个项目配置文件指示:“不使用谚语,不使用隐喻,不使用‘战略’语言;使用简单的陈述;以结果为先。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡