Claude 這幾天更新了什麼:背景跑完的活,它現在會交代放在哪
跑一個要半小時的任務,你按下 enter 就關掉視窗。回來第一個問題永遠是同一個——它做完了嗎,東西放在哪。Claude Code 這兩版剛好都在回答這件事。
跑一個要半小時的任務,你按下 enter,關掉視窗去做別的事。
回來的時候,第一個問題永遠是同一個——它做完了嗎,做完的東西放在哪。
Claude Code 這兩版(2.1.221、2.1.222)合計六十條更新,扣掉純修 bug 的還有二十七條。裡面一半是沙箱憑證遮罩、Gateway 欄位驗證這種你永遠不會注意到的地基。但剩下那幾條剛好都在回答上面那個問題:把一段工作交出去之後,你怎麼知道它去了哪裡、花了多少、動了什麼。
v2.1.221 改了背景 session 的收尾行為。以前一個背景任務跑完,工作就停在它停的地方,你得自己去翻分支、翻暫存區、翻它到底改了哪幾個檔。現在它會 commit 並 push 把工作保住,只有在任務性質需要時才開 draft PR,照你 CLAUDE.md 裡寫的 git 規則走,而且結束時一定講一句:工作放在哪。同一版還把 /status 加上 session 種類——interactive、或者背景任務的 attached 與 unattended。
這是把「委派」從一個信任問題,變成一個查詢問題。設計師真的會用 Claude Code 的場合,多半是改一整批東西,很少是從零寫功能:把六十個元件的命名規則換掉、把散在十幾個檔案裡的色碼收斂成 token、把一份接手的舊網站 class 名稱掃過一遍。這種活的共同點是過程你不想看,結果你一定要驗。以前「不想看」跟「找不到」是綁在一起的,現在拆開了。
它沒解決的是驗收本身。commit 有了,不代表那個 diff 是你要的。它回報的是座標,品質還是你自己的事。
同一版在 claude-api skill 底下加了 prompt-audit 子指令,用途是掃你的 prompt 與 tool description,挑出「為了舊模型而寫的寫法」。旁邊還有一條相關的改動:當 Claude 想呼叫一支標了 disable-model-invocation 的 skill,它以前會自己去模仿那支 skill 的流程,現在改成直接告訴你「這支要你自己叫」。
prompt 是會過期的資產,而多數人沒把它當資產管理。設計師手上多半有一份自己攢的清單——生圖的、寫規格的、跑競品分析的。那些為了哄舊模型而加的贅句(「請一步一步思考」「請務必仔細檢查」「你是一位資深設計師」)在新模型身上多半沒有作用,有些還會把它真正該注意的東西擠掉版面。prompt-audit 目前掃的是 API 場景,你那份清單它不會自己跑過去,但它把「定期回頭體檢」變成一個具體到可以排進行事曆的動作。
第二條更值得留意。模仿一支 skill 的流程跟執行它,是兩件不同的事。一套被規範化的流程如果被憑印象重演,產出會長得很像、細節全錯——而長得很像正是最難抓的那種錯。
VS Code 端加了 Focus view:聊天選單裡的一個開關,把工具活動收進可展開的每輪摘要,旁邊留一個「現在正在跑什麼」的即時指示,Ctrl+Alt+F 切換。另一頭,Stats 面板改成把 cache token 算進總量,並拆成 input、output、cache read、cache write 四項。auto mode 的權限檢查也順手降了成本——平行工具呼叫的檢查改成 cache 友善,並重用已快取的對話前綴。
這兩件事是同一個方向的兩端:Focus view 把你不需要看的收起來,Stats 把你一直看不到的攤開來。設計師第一次用 agent 跑長任務,最常見的兩種不適剛好就是這兩個——畫面滾太快,不知道它在幹嘛;帳單來了,不知道錢花在哪。前者現在有摺疊,後者現在有分類。
Focus view 目前只在 VS Code 有。你如果是在終端機或網頁端跑,這條跟你無關。
v2.1.222 收緊了 Remote Control 的自動啟動:repo 內的 .claude/settings.json 或 .claude/settings.local.json 現在只能關掉它,不能打開它。要開,得在使用者層級用 /config 自己開。同一版還把 auto mode 底下的 SendMessage——一個 agent session 送訊息給另一個——納入權限分類器,送出前先過一次審查。
設計師 clone 別人 repo 的頻率比想像中高。Framer 的 starter、Next.js 的樣板、GitHub 上撿到的元件庫、學生交上來的作業。那些資料夾裡有沒有一份 .claude/settings.json,你不會每次都打開來看。這個改動把「開啟遠端遙控」這件事的權限從專案層級搬回使用者層級:設定檔可以幫你關,不能幫你開。
這類改動的特徵是,做對了你完全不會有感覺。會有感覺的那一天,通常已經來不及了。
/plugin 裝的外掛在安全的情況下直接生效,不用再跑 /reload-plugins;遇到過期的 marketplace 目錄會先更新再重試。:thumbsup:、:love: 這類常見別名。這兩版沒有新模型、沒有新介面。二十七條有感更新裡,真正改變你怎麼做事的大概就四條,其餘是地基。
值得看的是方向:工作結束會回報下落、成本拆到看得見、權限往使用者層級收斂。這三件事共用同一個假設——使用者已經開始把整段工作整段交出去,不再坐在旁邊一問一答。工具正在為「你不在現場」重新設計。
反過來說,如果你用 Claude 的方式還停在網頁介面一問一答,這兩版對你幾乎沒有影響。ultraplan 被移除、Vertex AI 的 tool search 重開,這些都是給已經把 agent 接進流程的人看的。判斷這波更新跟你有沒有關係,只要問一句:你上次讓它自己跑超過十分鐘,是什麼時候。
prompt-audit 把「舊 prompt 該回頭體檢」變成具體動作,Stats 面板則把 cache token 攤成四項成本。