今天把 Claude Code 換成 Opus 5.5,還不到一天,就在畫面中間看到整句簡體:
明白了,P1~P5交给另一个session处理,本session负责交接和审查。
前後文又都是正體。我的 CLAUDE.md 從頭到尾寫的都是正體、臺灣用語。
以前會冒簡體的都是中國模型,MiniMax、GLM 我都寫過。我一直以為這是中國的開放權重模型才有的問題。
我在 omp 上的做法很直接:寫一個 extension,模型的輸出存進對話之前,先丟給 OpenCC 轉成正體。
Claude Code 搬不過來。查了 hook 的文件,hook 讀得到 Claude 的輸出,但改不了。
漏在哪裡
我請 Claude 把我 9 月的 Claude Code 對話紀錄全部掃一次。回覆本文沒有一則是它自己漏的,掃到的簡體都是在引用別的東西:Codex 的回報、語音辨識的比對表、日文、連結標題。
它說,漏的是 thinking。
我不確定。它的 CoT 我看不太出來是哪一段,最後的回覆確實沒問題,但我看到的簡體大多在中間。
再只看今天,把命中的位置分開算。工具呼叫之間的短說明有 189 則,一則都沒漏。thinking 區塊有 5 則真的漏字,其中 3 則是整句簡體。
中間那些字,不是 Opus 寫的原文
我要 Claude 把它的輸出類型攤開給我看。
Opus 5.5 的輸出分三種區塊:thinking、text、tool_use。Opus 5 在工具呼叫之間寫的說明是 text,就是它自己寫的字。Opus 5.5 改了,超過一兩句的說明改成 thinking 區塊回傳。
thinking 區塊裡本來就不是原始的推理,拿到的都是摘要。文件寫明,摘要是另一個模型處理的,負責思考的那個模型也看不到摘要。
所以我在畫面中間讀到的,已經是另一個模型改寫過的版本。
我跟它查這件事的那個 session 就有例子。它寫給我的進度說明是「只看開頭 450 字,網太窄了」,紀錄裡存的是「且僅檢查前 450 字,覆蓋範圍太窄」。意思一樣,字全換了。
同一個詞,九分鐘前後
紀錄裡剛好有一組對照。
早上 7:34,Opus 5.5 回覆我時寫「針對模型調 prompt」。7:43,同一個 session 中間的摘要出現:
针对每次呼叫都是大量圖片token prefill加少量輸出
同一句裡,「针对」是簡體,「輸出」是正體。
另一個 session 也一樣。7:38 的摘要裡有一個詞是簡體,一分半鐘後,Opus 5.5 寫進程式註解的同一個詞是正體。
它自己也不是完全沒漏。今天 1140 次工具呼叫裡,它兩次把「進度總覽」寫成「进度總覽」,只錯一個字,第一次幾秒後就自己改回來。摘要裡的是整句。
原始推理不會回傳,我沒辦法證明它想事情的時候就是正體。只能說,整句的簡體都在摘要裡。
比例變高了嗎?同樣那兩個詞,昨天 Opus 5 的摘要寫的是正體。只有兩個例子,算不出比例。
摘要模型是不是比較小?文件沒寫,只說是另一個模型。
比較確定的是管道換了。以前中間那些字是 Opus 自己寫的,現在要先經過另一個模型。
hook 碰不到那一層
我還是先裝了一個 UserPromptSubmit hook,每一輪塞一段正體提醒給 Claude,連進度說明都點名。
現在看,這個提醒影響的是 Opus 自己寫的內容,那部分今天只錯過同一個字。摘要模型看不看得到這段提醒,文件沒寫。
能修的在 Anthropic 那邊。
FB 上有人留言,說不要新模型一上線就切過去。
也許吧。只是這次寫在文件裡,是設計,不是上線初期的 bug。
而且跟 Fable 比,Opus 5.5 真的省很多,API 定價的輸入和輸出都只要 Fable 5.1 的四成。
