Did Codex Reset
GitHub

QQ·微信群

Arena.ai 表示 Claude Opus 5.5 比 Opus 5 更易讀,但回答更長

Arena.ai

Arena.ai 分析了 Claude Opus 5.5 與 Opus 5 在高推理 Text Arena 輸出中的寫法。該機構表示,12 項寫作指標中有 10 項朝較佳方向變化,而 Opus 5.5 應較易閱讀。

長內容詞的比例由 41.7% 降至 38.6%,是分析中所有 Claude 模型的最低比例。平均句長下降 17%,由 12.14 詞減至 10.03 詞。回答平均加長 6%,由 453 詞增至 481 詞。Arena.ai 表示,這使 Opus 5.5 成為 Opus 系列中回答最長的模型。

Arena.ai 表示,該模型在兩個常見的人工智能痕跡上也不那麼容易辨認,破折號減少 95%,分號減少 73%。該機構又表示,新的破綻可能正在出現:「perhaps」「arguably」等模糊限定與保留說法上升 97%,由每 1,000 詞 0.39 次增至 0.77 次,為分析中所有 Claude 模型的最高比率。