完整做法 A · 省 token

別讓 AI 額度一下就燒光

你留言了 token,這是完整版——影片塞不下的細節都在這:為什麼會燒、每一招怎麼實際做、還有什麼時候別做過頭。

原則就一句:需要才用
先搞懂:token 為什麼會燒

token 是 AI 讀字、計費的單位。關鍵是一件很多人不知道的事:每次你送出一句話,AI 都會把「整段對話 + 你貼進去的所有東西」從頭到尾重讀一遍,才回你。

所以你背著的東西越多,每一次來回就越貴、也越慢。省 token 的核心只有一句話——別讓它每次都扛不需要的東西。下面 3 個習慣,就是最常見的 3 種「扛太多」。

1

Mistake 01大文件:只給需要的部分

你把整份三百多頁的 PDF(合約、報告、論文)丟進去,只為了問其中一小段

為什麼燒 token

AI 沒辦法「只翻到第 37 頁」——你給它整份,它每次回答都要把整份重讀一遍。你問三個問題,它就等於把那 300 頁讀了三遍。而且雜訊太多,答案還常常不準。

正確做法
  1. 先想清楚你真正需要的是哪幾頁、哪一段
  2. 主要是讀文字(條款、內文)→ 把文件轉成純文字/Markdown,只貼你需要的段落。 會寫程式:用微軟開源的 MarkItDownpip install markitdown,再 markitdown 檔案.pdf 就轉成 Markdown。 不寫程式:直接在 PDF 裡選取那幾段文字複製貼上;或先把需要的頁(例如第 30–40 頁)另存成小 PDF 再上傳。
  3. 需要看圖表、表格、排版、掃描件 → 留著 PDF 別轉文字(轉了版面會不見),但一樣只上傳需要的那幾頁
別這樣:整份文件原封不動丟進去,只為了問其中一小段——最貴、最慢,答案還最容易被雜訊帶偏。
2

Mistake 02新任務:開新對話

一個對話從上上禮拜用到現在,什麼都在裡面

為什麼燒 token

對話越長,AI 每次回你都要把前面全部重讀一次。你只是要寫一封請假信,它卻扛著三個禮拜、好幾萬字的歷史在算——又慢又貴,還容易被舊內容干擾、答歪。

正確做法
  1. 全新、跟前面無關的任務 → 直接開一個新對話,讓它只看到這件事。
  2. 判斷標準一句話:前面那些內容,對這個新任務「有用嗎」?沒用,就開新的。
  3. 同一個專案、脈絡真的有用 → 就留在同一個對話;長期資料可以放進「專案/Project」功能集中管理,不必每次重貼。
別這樣:把一大段無關的舊對話,硬帶進一個全新的任務。(注意:長對話本身不是錯,重點是「無關」才丟。)
3

Mistake 03簡單任務:需要才開功能

只是要改一句話,卻把 Extended Thinking、網路搜尋、連接器、各種工具全部開著

為什麼燒 token

每一個功能都會讓 AI 多做事、多讀東西:深度思考會讓它「想更久」、搜尋會拉一堆網頁進來、連接器會把你的檔案讀進來。需要時很強,不需要時就是純浪費——等於叫全公司來開會改一個字。

正確做法(對症下藥)
  1. 最新/即時資訊 → 才開網路搜尋
  2. 要它讀你的檔案、信箱、文件 → 才開連接器
  3. 遇到真的很難、需要推理的問題 → 才開深度思考(Extended Thinking)
  4. 只是改字、翻譯、寫短訊 → 全部關掉,用最簡單的模式,又快又省。
別這樣:預設全開,什麼小事都動用所有功能。(功能不是壞,是「需要才開」。)
30 秒自我檢查(截圖收藏)
一句話總結
需要才用。給它需要的、開新對話、別全部打開。

覺得有用?在影片下面留言 token,也告訴我你看過最扯的 AI 用法 👇

追蹤 @fatty_bamba →
工程師 · AI 博士 · PrimeStride AI 創辦人|每週教你把 AI 真的用對
薪水實拿計算機 試算 → 錢花去哪了 花費健檢 →
*本頁為教育示範,非官方文件,不構成專業建議。功能名稱依你用的 AI(ChatGPT/Claude/Gemini 等)介面為準。MarkItDown 為微軟開源工具(github.com/microsoft/markitdown)。