Token 降本增效 · 9 / 13

語法層:Prompt 是寫給機器的

進入實戰四層的第一層。很多產品早期為了調試方便,或者乾脆是讓 AI 代寫的提示詞,習慣用 ###、** 加粗、JSON 展示數據。這些對人類友好的排版,在大模型的計費邏輯裏全是「詞法税」。

詞法税YAMLCSVMinified JSON
這筆税有多重:13% 都是格式

作者做了一個 Token 可視化分析工具(yusuan.ai/analyzer),把一段精簡版 Lyra 提示詞丟進去分析:光是加粗用的 ** 符號,就吃掉了 8.5% 的 Token。算上列表、標題符號、JSON 縮進換行,這份提示詞 13% 都是格式性內容。一般產品的 Prompt 裏,10%–20% 都是這種裝飾性 Token。

Token 可視化分析:** 符號出現 33 次佔比 4.16%
Token 可視化分析(yusuan.ai/analyzer):一段提示詞裏 ** 出現 33 次,僅這一個符號就佔 4.16%。(圖:作者分享原稿)
裝飾性 Token 佔比 10%-20%
千萬級調用量下,每月 10%–20% 的預算花在「讓產品經理看起來舒服一點」上。(圖:作者分享原稿)
Prompt 是寫給機器的指令,最終版本不需要美觀。機器關注的是邏輯,而不是排版。** 只用在真正需要強調的地方。
互動演示 · 同一份數據的三種帳單

把 50 條用戶記錄餵給模型,三種格式點開對比。字段名重複 50 遍的 JSON 陣列,是 RAG 場景的重災區。

三條經驗

1、複雜對象用 YAML(或 TOON),別用 JSON。JSON 的信噪比太低:每個 Key 雙引號包裹、每層嵌套花括號閉合,而這些符號往往獨立計費。YAML 用縮進代替閉合符號、冒號代替「引號+冒號」,Token 通常省 10%–15%,多的能到 40%。TOON 是專為省 Token 設計的新格式,但作為新格式 LLM 不一定支持得好——所以更穩的組合是 YAML + CSV。

2、扁平列表用 CSV,別用 JSON 陣列。帶表頭的表格把重複鍵名全幹掉,長列表場景砍 30%–60%,同樣的上下文窗口還能塞更多數據。

JSON 陣列與 CSV 表格的對比
鍵名只寫一遍,消除所有重複:長列表場景 Token 直接省 30%–60%。(圖:作者分享原稿)

3、後台輸出強制 Minified JSON。輸出端的 Token 比輸入端更貴,還直接影響接口返回速度。面向用戶的流式輸出可以寬鬆點,但純後台任務(提取標籤、情感分析、數據清洗)不需要任何排版——在 System Prompt 裏顯式約束:

輸出必須是 Minified JSON,不換行、不縮進、不加程式碼塊標記。 示例:{"id":1,"status":"ok"}

機器讀數據不需要美觀,只需要合法。批量任務加上這條約束後,生成耗時顯著下降。

本節要點
✓

先去 yusuan.ai/analyzer 量一下你的 Prompt:裝飾性 Token 通常佔 10%–20%,這是最容易拿的一筆錢。

✓

數據結構按場景選:複雜對象 YAML、扁平列表 CSV、後台輸出 Minified JSON。

✓

輸出比輸入貴,管住輸出格式既省錢又提速(第 12 節還有三招)。

內容來源:整理自作者團隊內部分享《AI Token 降本增效策略分享》實戰篇「01|語法層」。工具:yusuan.ai/analyzer;YAML 規範見 yaml.org。