UTC 十月五日 23:33,Claude Code 2.1.290 上了 GitHub。release notes 列了 190 條,光是以 Fixed 起頭的就有 112 條。

四小時二十二分鐘後,2.1.291 出來了,只有兩行。第一行修的是 2.1.290 自己帶進來的退化:cloud session 可能把你對權限提示的回答弄丟。

一次開一百多帖藥,難免有一帖帶出副作用。我在意的是副作用被誰發現、多快被寫下來。這次是四個多小時,而且寫在公開的頁面上。

一、Claude Code 2.1.290/2.1.291:一百多條修正,四小時後補一刀

兩版的時間我是從 GitHub API 的 published_at 取的:2.1.290 是 UTC 10 月 5 日 23:33,2.1.291 是 UTC 10 月 6 日 03:55。換成台北時間,兩版都落在 10 月 6 日,一個早上 7:33,一個中午 11:55。

2.1.291 的兩行原文:

「Fixed a regression in 2.1.290 where cloud sessions could drop answers to permission prompts」

「Fixed a regression in 2.1.288 where the last messages of a session could be lost when quitting」

第二行比較值得多看一眼。2.1.288 是 UTC 10 月 2 日 20:19 發布的,那一版我在 10/3 寫過。照這行字面,退出時可能丟掉最後幾則訊息的問題,從 2.1.288 一路帶到 2.1.290,前後三天多,中間還隔了一個 2.1.289。

2.1.290 那 190 條裡,我挑出幾條「本來會靜靜出錯」的:

「Fixed Bash permission checks auto-approving some read-only commands (such as rg or git grep) whose arguments the shell would still expand as wildcards; these now prompt for approval」

「Fixed some permission rules and safety checks not being applied to a tool call after a PreToolUse hook rewrote its input」

另一條是定時任務:/loop 設了間隔、或設了提醒,對話被 compaction 之後再 resume,任務會靜靜地不再回來。修正的但書寫得很老實,「covers compactions made from this version on」,只涵蓋這版之後發生的 compaction,之前已經壓過的那些不保證。

我的做法:跑 cloud session、或讓 Claude Code 無人值守的人,這種上百條的大版本出來當天先別急著升,等它的下一個小版號,2.1.291 就是那種等法會等到的東西。例外是退出丟訊息那條,它從 2.1.288 就在,等也等不掉,直接升到 2.1.291 才是解。如果你只在本機互動使用、每個權限提示都自己按,cloud session 那個退化碰不到你,這段建議可以忽略。

以上都是 release notes 的描述,我沒有逐條驗證。

原文來源:Claude Code v2.1.291 / Claude Code v2.1.290

二、OpenAI 在歐盟替 ChatGPT 的文字加浮水印:換掉 10% 的字,偵測率剩 66%

TechCrunch 10 月 5 日報導,OpenAI 要在歐盟替 ChatGPT 與 Codex 產生的文字加上看不見的浮水印,理由是遵循 EU AI Act。依 TechCrunch,AI Act 的透明度規則 8 月 2 日生效,要求 AI 公司用其他系統認得出來的方式標記 AI 產生的內容。

浮水印不是一個符號。TechCrunch 的描述是:

「works by subtly shaping the model’s word choices, leaving a pattern readers can’t see, but a detector can pick up」

OpenAI 同時發了技術報告,方法叫 textGrain,與賓州大學、耶魯的研究人員合寫。報告裡的例子是用一把 secret key 去排序下一個字的候選,幾百次這種微小的推力加起來,偵測器只要有文字和那把 key,就認得出來。因為它藏在用字本身,複製貼上會跟著走。OpenAI 也說浮水印不會識別使用者,打開之後模型表現沒有明顯變化。

推出範圍分兩塊。歐盟符合資格的 ChatGPT 與 Codex 用戶,所有方案在未來幾週陸續上線,只限歐盟。API 那邊全球都能對「select models」打開,從公布當天起可用,預設關閉。OpenAI 也說了,上線時不會把文字浮水印設成全球預設。

然後是這則最有意思的一句。改字能不能把它洗掉?OpenAI 自己的測試說可以:

「In one test, replacing 10% of words with synonyms dropped detection from about 92% to 66%.」

十個字換一個同義詞,偵測率掉了二十幾個百分點。OpenAI 還列了幾種本來就比較難偵測的文字:短段落、數學答案、翻譯過的文字。

也因為這些限制,偵測器第一階段只開給「approved researchers and expert organizations」。一般人拿到一篇文章,目前沒辦法用 OpenAI 的偵測器自己查。

OpenAI 對反方向也講得很清楚,沒有浮水印「does not prove human authorship」,文字可能太短、改太多,或來自別家的 AI。

這裡的不對稱很大。有浮水印,可以說明 OpenAI 的系統產生或處理過其中一部分;沒有浮水印,證明不了是人寫的。而會讓浮水印消失的,剛好就是有動機的人一定會做的事:改寫、翻譯、換字。換個角度問,怎樣用這套東西一定會出事?拿它去抓人。最容易被抓到的是懶得改的那群;真正想藏的人換掉一成的字,照 OpenAI 那次測試,偵測率就從約九成二掉到六成六。它篩出來的是「改沒改」,不是「誰寫的」。

TechCrunch 還補了一段背景:依《華爾街日報》2024 年的報導,OpenAI 先前就做過文字浮水印、但一直沒推出,部分原因是擔心使用者會跑去用沒有浮水印的對手。這次只在法律有要求的歐盟推給使用者,API 預設關閉,跟那段顧慮放在一起看,誘因的方向一致:浮水印推到哪裡,看的是法律要求到哪裡。

我的立場:不管是老師、主管還是審稿人,都不該把「偵測到/沒偵測到浮水印」當成判定誰用了 AI 的依據。TechCrunch 的報導裡沒有誤判率,也就是把人寫的判成 AI 的比例,我在原文找不到這個數字。如果之後有獨立單位公布偵測器在實際改寫程度下的偵測率,加上誤判率,而且兩個數字都好看,我會重新評估它能不能拿來當輔助證據。

原文來源:TechCrunch,2026-10-05

三、Etched 據報收到 400 億到 500 億美元估值的報價

TechCrunch 10 月 5 日引述知情人士報導,AI 晶片新創 Etched 正在審視一批投資報價,估值區間是:

「from $40 billion from top-tier investors to $50 billion from lesser-known backers」

這是「報價」,不是完成的融資。消息來源是知情人士,原文寫明「These fundraising talks are early, so terms of any deal, should one happen, may change.」Etched 拒絕評論。

Etched 上一次募資是 9 月,以 210 億美元估值募到 7 億美元,Jane Street 領投;再前一次是 7 月,3 億美元、估值 103 億美元,Sequoia 領投。談到這批報價的知情人士還說,如果這次募到跟上一輪一樣多,Etched 最多能多出 3.5 年的 runway。

這段裡我最在意的是那個區間的方向:出價比較高的是名氣比較小的投資人,頂級投資人給的是區間的下緣。最高的那個數字,出自名聲押得最少的一方。拿 500 億去說「Etched 值這麼多」,等於讓區間裡最弱的訊號替整個公司定價。

TechCrunch 交代前兩輪時還寫了一句通則:連續兩輪的 back-to-back 融資,本質上像是一筆融資拆成兩段、各給一個估值,這種做法在熱門新創越來越常見。如果 Etched 的 7 月與 9 月也是這種結構,那「兩個月從 103 億翻到 210 億」有一部分是切法造成的,不全是公司在兩個月裡長大了一倍。

我不會拿 400 億當 Etched 的價格去推任何東西。具名的領投方、簽下的條款、公布的金額,三樣齊了,那才是價格。

原文來源:TechCrunch,2026-10-05

四、Cohere North 2:agent 開始記得上一次的對話

Cohere 10 月 5 日發表 North 2。官方頁對 Memory 的描述只有一句:

「Agents that keep context across sessions, instead of starting cold every time.」

同一頁列了 Skills、Libraries、Memory、Applications、Automations 幾類能力,新增 Slack、SharePoint、OneDrive、Outlook、Exchange、Jira、Linear、Notion、GitHub 等連接器。管理端有一項叫 Flow control,原文是「Monitor and control token spend and limiting by defining consumption tiers based on requests and token rates for users and groups」,用請求數與 token 速率替使用者和群組分級。官方頁沒寫價格。

記憶這種功能,出事的方式通常很安靜。它記住了一個過期的前提,下一次就帶著那個前提往下做,使用者不會看到哪一句是從舊對話來的。Cohere 沒說過它有這個問題,這是我看到「跨 session」這四個字時,第一個想到的失敗形狀。

我在官方頁上找不到記憶保留多久、怎麼刪除的說明。企業要開 Memory 之前,這兩件該先問到書面答案。等 Cohere 的文件把這兩件寫清楚,這段提醒就可以拿掉。

原文來源:Cohere 官方部落格:Introducing North 2

今天只整理這 4 則。


2.1.291 第一行寫的是「a regression in 2.1.290」,弄壞東西的版號直接印在上面。手上是哪一版,對一下就知道自己在不在範圍裡。

浮水印給不出這種對照。偵測器說沒有,照 OpenAI 自己的話,那也證明不了是人寫的。Etched 的 500 億也是,數字出來了,出價的人沒有具名。

今天這四則,我真的會動手的只有一件:把 Claude Code 升到 2.1.291。浮水印等誤判率,Etched 等簽了字的條款,Cohere 的記憶等它寫清楚保留多久、怎麼刪。