Claude Code官方省Token指南:11個技巧讓額度用得更久
Anthropic 發布 Claude Code 省 Token 指南。核心就一句:上下文越長,後面每一輪越貴。聊天、文件和命令輸出都會繼續佔用 Token,也會因此更快消耗額度。
整理下來,有 11 個最實用的技巧:
換任務就 /clear。完成一個任務後就清掉上下文。還在做同一任務,只是前面的內容沒用了,再用 /compact 壓縮。長會話越往後越貴,因為每一輪都會重新帶上之前的內容。
模型和 effort 開局就選好。中途執行 /model 或 /effort 會打掉 prompt cache(提示詞緩存),下一輪需要重新處理整段上下文。Fast mode 也是一樣,最好一開始就開。
離開前先 /compact。訂閱用戶的緩存約 1 小時過期,API Key 默認約 5 分鐘。緩存過期後再回來,下一輪通常要重新處理整個上下文。趁緩存還在時壓縮更便宜。
最近幾輪跑偏就 /rewind。它只刪掉後面幾輪,前面的緩存還能繼續用。/compact 會重寫整個對話,成本更高。
文件直接用 @ 文件名。Claude 會在第一輪直接拿到文件,可以省掉一次 Read 或搜索。通常一個文件只需要 @ 一次,重複 @ 反而可能把同一文件再塞一份進上下文。
Prompt 盡量說具體。與其說「測試掛了」,不如直接告訴 Claude 哪個測試、哪個文件。否則它可能先 grep、搜索、讀一堆文件,這些結果之後每一輪都會繼續佔上下文。
測試和日誌盡量少輸出。Build、測試、git log 的輸出都會留在上下文。可以加 quiet 參數、只輸出錯誤,或者用 tail 截斷。Claude Code 對超過 3 萬字符的命令輸出反而會自動寫入文件,只把摘要和路徑留在會話裡。
用 /context 查啟動負擔。新會話一開始就可以看 CLAUDE.md、MCP 和工具定義佔了多少上下文。CLAUDE.md 只放通用規則,專項流程放進按需加載的 Skill,不用的 MCP 用 /mcp 關掉。
簡單任務用更小的模型、更低的 effort。大模型輸入和輸出都更貴,thinking 也屬於輸出 Token。純執行類任務沒必要一直用最高檔模型和最高推理強度。
大日誌交給 subagent,小任務別濫用。Subagent 有獨立上下文,只把最終結果帶回主會話,適合讀大量日誌、搜索文件。但它也要重新讀文件、自己跑多輪,小任務反而可能更貴。搜索、讀日誌這類任務還可以指定 Haiku 或 Sonnet。
/loop 最好單獨開會話。每次循環都是完整的一輪,會重複攜帶當前會話的全部上下文。如果間隔超過緩存時間,還可能疊加一次緩存失效。官方建議另開終端,用一個乾淨會話專門跑循環。
Anthropic 的建議歸根結底就是:少塞無用內容,任務結束及時清,會話別拖得太長。
-- 價格
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

DGrid AI 深度解讀:去中心化 AI 基礎設施如何讓服務「可調用、可驗證、可結算」

AI時代未來最重要的5個習慣

Meta Muse Spark 1.2 和 Muse Code 低價檔發布,價格比 DeepSeek 便宜29%

從「投機資產」到「下一代金融底層」,Crypto 正長出一套新的 TradFi 世界?

100億美元買一個中轉站?Stripe看中了OpenRouter什麼

看似最愚蠢的 AI 提示剛剛擊敗了數月的精心遊戲設計提示工程

Karpathy 提出長篇口述 Prompt 工作法

字節跳動發布 Seed Audio 1.0 生成音頻模型

Kimi K3 發布一週眾生相:共識、分歧、大勢

GPT-5.6 調用 64 個 Agent 提出 50 年猜想證明

砍掉80%系統提示詞後,Claude Fable 5開始反問開發者

xBubble 如何破局 VC 重注的 OPC 經濟

楊歌 Gary:Agent 經濟與 AI 亞微觀經濟學

Uniswap的手續費開關如何重新設計收益

Litecoin的下一次減半期前的現狀

XRP分類帳,每個帳戶的交易量是去年同期的三倍=Evernorth調查 RLUSD餘額約為七倍

不用換平台、不用搬資金:BiFu 讓加密交易者直接交易黃金與外匯








