Codex CLI 還是 Claude Code:這題先看你已經在付誰的錢
大部分「Codex CLI vs Claude Code」的比較文都在問錯的問題。它們問誰寫 code 比較準、誰的 context 管理比較聰明,然後給你一張兩欄的表,最後結論是「各有優缺點,看你的需求」。 看你的需求——這四個字等於什麼都沒說。 真正該問的是這個:你公司已經買了 ChatGPT 的 seat 嗎?如果買了,Codex CLI 對你的邊際成本是零。codex 這個 CLI 本身是 Apache-2.0 的開源軟體(gh api repos/openai/codex 查到的 license.spdx_id 就是 Apache-2.0,archived 是 false,最後一次 push 就在查詢當天 2026-09-04),付費方案買的是用量上限,不是產品本身。官方的說法是 Codex 包含在 ChatGPT Free、Go、Plus、Pro、Business、Enterprise 裡面,沒有獨立的 Codex 訂閱這種東西。 Claude Code 那邊的門檻不一樣。官方文件寫得很直白:「Most surfaces require a Claude subscr...
那句引文是誰抄出來的:拆開 Claude Citations 的切塊與索引
模型回答的最後一行寫著「來源:使用手冊第 12 頁」。你翻到第 12 頁,那句話不在上面。這個 12 是怎麼算出來的? 答案通常很掃興:它沒算。那個頁碼跟正文是同一批 token,一起被生成出來的,所以它跟旁邊那句話一樣,是根據上下文挑一個看起來最合理的數字填進去。prompt 寫得再嚴格也改不掉這件事,「請務必附上原文出處與頁碼」只會讓它挑得更認真,挑出來的仍然是猜的。引用在這個做法裡只是一種文字風格,沒有任何機制保證它指得到東西。 Claude 的 Messages API 有個開關會把這條產生路徑整個換掉。開關本身只有一行 citations: {"enabled": true},但它背後動了三層東西:引文由誰產生、文件在哪一層被切開、座標由誰計算。這三層決定了你拿到的東西有多可靠,也決定了你的前端要重寫多少。所以這篇從底下往上拆,拆完再回頭講怎麼開。 第一層:那段引文是誰產生的開了 citations 之後,回應裡每一個 citation 物件都有一個 cited_text 欄位,裡面裝的是原文的那段字。關鍵在於這段字的來路:它由 ...
AI 與科技新聞摘要 - 2026/09/03
一個能自己找出程式漏洞的模型,該賣給誰? 這聽起來像研討會的圓桌題目,9 月 2 日它變成一份要填的申請表。答案先擱著,因為前後兩天還有四件事在問同一個問題的不同版本:晶圓廠的產能、一家開源模型平台的所有權、一筆說不清是新增還是重講的投資承諾,還有一樁沒揭露價格的併購。 從那樁沒揭露價格的併購講起。 一、Palo Alto Networks 花 5 億美元買下 Console,一年七樁5 億美元這個價格,是兩位知情人士講的,現金加股票,TechCrunch 掛的是獨家。雙方 9 月 1 日宣布時並沒有揭露財務條件,所以嚴格說,這是二手數字。 Console 成立於 2024 年,創辦人是 Andrei Serban(報導沒寫他的正式職稱,我也不補)。募資紀錄很短:2025 年 6 月種子輪 620 萬美元由 Thrive Capital 領投,A 輪 2,300 萬美元由 DST Global 與 Thrive 共同領投,被併購前估值 1.57 億美元。從 1.57 億到 5 億,大約 3.2 倍。 它做的事很具體:自動化密碼重設、開通 Figma 或 Miro 這類應用的權限、...
九份 ADR:一個畫圖技能包怎麼把設計品味變成 CI 關卡
2026 年 4 月,GitHub 上多了一個叫 diagram-design 的 repo。作者 Cathryn Lavery 做它的理由很生活化:她自己寫部落格要配圖,每次不是跟 Figma 耗三十分鐘,就是乾脆不放圖。 不到五個月,這個 repo 衝到三萬顆星。翻進去會發現它沒有函式庫、沒有 CLI、也沒有 web app,就是一包寫給 AI coding agent 讀的畫圖規格。你對 Claude Code 說「幫我畫一張架構圖:前端、後端、資料庫、Redis 快取」,它照著規格手寫 inline SVG,吐一個雙擊就能開、離線也看得懂的單檔 HTML 給你。 在它出現以前那之前,工程師要在文章裡塞一張圖,路只有三條。開 Figma 手拖,品質可控但時間吃到飽。寫 Mermaid,語法五分鐘搞定,可是排版邏輯完全插不上手,你只能接受它給的那個結果。第三條是直接叫 AI 畫,然後拿到那種東西:圓角方框、深色底、青紫色光暈,每個節點長得一模一樣,看起來很「科技」但你講不出它到底表達了什麼。 repo 的一句話介紹就是衝著第三條路來的:No shadows. No Merma...
這個 session 的模型到底是誰決定的:Claude Code 模型來源的優先序
以前要決定 Claude Code 跑哪個模型,能動的地方只有兩個:~/.claude/settings.json 裡的 model,還有你在對話裡打的 /model。檔案管長期、指令管當下,衝突的時候誰贏也很直覺,就是後打的那個贏。整件事三十秒查得完。 八月過完之後,這個題目變成五個地方。 先說這篇跟站上另外兩篇的分工。〈Claude Code keybindings 完整教學〉那篇提過 modelPicker,但它整篇在講綁鍵,modelPicker 只是路過。〈pilotfish 把模型綁死在八個角色上〉那篇提過 CLAUDE_CODE_SUBAGENT_MODEL,講的是別人家專案怎麼設計角色分工,不是 Claude Code 自己的解析順序。站上也有不少「該選哪個模型」的選型建議。這篇跟那些都不同:不談選哪個,只談同一件事有五個地方可以設的時候,實際生效的是哪一個。 從前:檔案一層,指令一層舊的心智模型只需要記一條規則。設定檔有層級(managed settings 最高,往下是 --settings、.claude/settings.local.json、.claud...
AI 與科技新聞摘要 - 2026/09/02
這一輪拿到錢的公司,賣的東西越來越像保險。不是做出新的能力,是替別人已經做出來的能力擔保:你的 agent 載了誰寫的工具、你的基礎設施改了什麼會連動到哪裡。有人把複雜度往外推的同時,就有人靠「幫你盯著那堆複雜度」開公司。以下五則都是 2026 年 9 月 1 日發布的消息。 一、AIR 募得 5,000 萬美元,要替企業檢查 agent 用了誰寫的工具資安新創 AIR 完成兩輪種子期募資,合計 5,000 萬美元(第一輪 1,000 萬、第二輪 4,000 萬)。創辦團隊出身以色列 Unit 8200 情報部隊,目前約 40 人,客戶 20 家以上,其中約 25% 是大型企業。CEO 是 Yair Saban,CTO 是 Niv Hoffman。投資人名單包含 Sequoia Capital 與 Greenoaks Capital,另有 Cognition 的 president Zach Frankel、Wiz 共同創辦人 Yinon Costica、Clay 共同創辦人 Varun Anand 等人參與。 產品做三件事。Discovery 負責找出公司系統裡到底有哪些 AI...
A2A 從 v0.3 升到 v1.0:會噴錯的那幾條,反而最好修
A2A 從 v0.3 升上 v1.0,十一個 JSON-RPC 方法全部改名。這是整份 breaking change 清單裡最不需要擔心的一段。 先把分工講清楚,這篇不重複別人的地盤。A2A 是什麼、它跟 MCP 各自負責 agent 生態的哪一段、TaskState 那組狀態怎麼運作,站上 8 月 22 日那篇〈一個 agent 中途反問你問題,這件事在 MCP 的抽象裡沒有位置〉已經拆過一輪。這篇只做一件事:手上有照 v0.3 寫的 client,直接往 v1.0 升,會在哪裡壞、哪裡先壞、哪裡壞了你還不知道。 時間差先擺出來。gh api 查 releases,v0.3.0 是 2025 年 7 月 30 日,v1.0.0 到 2026 年 3 月 12 日才發,最新的 v1.0.1 是 2026 年 5 月 28 日。中間隔了七個多月,那七個多月裡寫成的程式碼、教學、範例,全部是舊名字。 為什麼改名反而是最安全的一段規格 docs/specification.md 的 §5.3 Method Mapping Reference 給了一張對照表。這張表是全集,不是舉例: ...
你寫的 deny 規則,可能根本沒擋到:Claude Code 權限規則的五種漏擋形態
這篇 9 月 2 日才動筆,發文日期掛回當天。文中的版本號與「目前」指的是撰寫當日的官方文件狀態。 settings.json 存檔,關掉編輯器。deny 規則寫好了,看起來很合理。 然後你就停在一個有點尷尬的地方:你要怎麼知道它真的有在擋? 站上先前那篇〈Claude Code 權限系統完整教學〉講的是 allow、deny、ask 三種規則怎麼寫、* 怎麼用,那是把規則寫出來的部分。這篇不重講那些,這篇只談一件事:規則寫出來之後,它可能沒有涵蓋到你以為它涵蓋的範圍。定位是寫過規則的人回頭自檢,不是入門。 你能做的兩種驗證,各自只證明得了一小塊想確認規則有效,直覺上有兩招。第一招是叫 Claude 跑一次你想擋的那個指令,看它會不會停下來問你。這招有用,但它只證明了一件事:你剛剛打的那一種寫法被擋住了。同一件事在 shell 裡通常有五六種寫法,你試的是其中一種。這跟「我 grep 不到就代表它不存在」是同一個毛病,證據的涵蓋範圍比你要下的結論小。 另一招是看 Claude Code 啟動時有沒有警告你。這招在特定情況下真的有用,2.1.246 版(npm 上是 2026 ...
AI 與科技新聞摘要 - 2026/09/01
9 月 1 日早上 Apple 官網那則交接消息,其實是四個月前就寫好的,日曆翻到這一頁而已。Tim Cook 的頭銜正式換掉,媒體標題準備了半年。真正沒有預告過的東西藏在另外幾則公告裡,其中兩則放在一起看,有點刺眼。 一、Anthropic 發表 Claude Fable 5.1 與 Mythos 5.1:便宜了,也比較不會誤擋Anthropic 同一天推出兩個版本,Fable 5.1 全面開放(Claude.ai、API、AWS、Google Cloud、Microsoft Azure),Mythos 5.1 走 trusted access 計畫,只給通過審核的資安與生命科學專業人士。官方把這一版的定位講得很直接:「Claude Fable 5.1 takes important steps towards addressing feedback from customers on price, data retention, and safeguards.」三件事,價格、資料保留、安全防護誤擋。 價格那塊,API 定價是輸入每百萬 token 10 美元、輸出 50 美元...
你下載的模型權重,是誰簽的名?Model Signing 該不該進你的流程
這篇實際動筆的日子是 2026 年 9 月 2 日,發文日期仍掛回 9 月 1 日當天。文中所有關於 Model Signing 的描述,對照的是動筆那天的官方規格。 你機器上正在跑的東西,有幾個是驗過簽章才裝的? 我的 ~/.claude/skills/ 底下躺著幾十個 skill,plugin 又是一批,MCP server 有好幾個是 npx 直接拉起來的。這些全都是別人寫的程式碼,全都在我的帳號權限下執行,而我裝它們的時候,一次簽章都沒驗過。裝的當下完全沒感覺,回頭想才發現這條線一直是敞開的。 同一件事在模型權重上更誇張。pip install 背後有 PyPI 的簽章機制,容器映像檔有 cosign 可以簽、可以驗,這兩層大家吵了好幾年終於補起來了。然後你從 Hugging Face git clone 一包幾 GB 的權重下來,直接餵給 from_pretrained(),中間沒有任何人簽過名。整條供應鏈裡最重、最難用肉眼檢查、最有機會藏東西的那一塊,反而是唯一沒被簽的。 OpenSSF 底下的 sigstore 有個專案在補這個洞,叫 model-transpa...














