讓長文件塞進 AI 的 context window

把長篇報告或合約貼進 ChatGPT、Claude,常常被截斷、燒掉一大把 token,或者 AI 悄悄跳過中段。先把文件清乾淨——需要的話再縮小——讓真正重要的內容更完整地送進模型。

為什麼長文件在 AI 裡會出問題

長度本身不是唯一的問題——你貼進去的東西,很多根本不是內容:

  • 文件比 context window 還長,尾端被悄悄丟掉,AI 只讀了一半就回答你。
  • 原始匯出檔塞滿頁首、頁尾、頁碼與重複的樣板文字,燒 token 卻沒有意義。
  • 在付費 API 上每多一個 token 就是錢,臃腫的文件很快變得昂貴。
  • 就算塞得進去,埋在中段的內容得到的注意力,也比開頭和結尾少。

解法:先清雜訊,需要再縮小

LessTokens 先移除可量測的版面雜訊,例如重複頁面裝飾、分隔線與斷行錯誤,同時保留抽出的內容。若選擇精簡(Lean)模式,還可能移除偵測到的重複樣板與浮水印,並揭露這些清理。結果會顯示轉換前後估算與帶正負號的 Token 變化:清除雜訊時可能減少,加入 Markdown 結構時可能增加。

Beary 在等一份文件。選取或拖放檔案即可開始。

將文件或圖片拖放到這裡

文件與截圖使用同一個選擇入口:PDF、Word、OpenDocument、PowerPoint、Excel、HTML、CSV/TSV、TXT、Markdown、JSON、XML、YAML、LOG、PNG 或 JPG · 最大 100 MB

也可在本頁任意處按 Ctrl/⌘+V,直接貼上已複製的截圖。

LessTokens 怎麼幫它塞得下

  • 移除重複的頁首、頁尾與獨立頁碼——這些加了 token 卻沒有意義。
  • 移除裝飾性分隔線、修復斷行錯誤,讓文字緊湊乾淨。
  • 可選的精簡模式會移除整份文件裡重複的樣板與浮水印——需自行開啟,且會列出移除了什麼。
  • 顯示轉換前後估算與帶正負號的 Token 變化;標準模式不會摘要抽出的內容。

老實說,能縮多少

對本來就乾淨的文字,減少幅度很小:乾淨文字在不刪意義的前提下幾乎無法壓縮,而標準模式我們絕不刪你的意義。真正的效果在那些塞滿重複裝飾、浮水印或樣板的文件——那正是精簡模式針對的目標,它逐字移除重複內容,絕不改寫或摘要。如果文件遠大於 context window,拆成幾份有時仍是必要的;LessTokens 絕不為了硬塞而悄悄丟掉你獨有的內容。

常見問題

這樣就能把任何文件塞進 context window 嗎?

它會移除沒有意義的 token——頁面裝飾,以及精簡模式下的重複樣板——讓更多真實內容塞得進去。但如果實際內容仍比視窗大,任何清理都無法在不刪意義下縮小它;把它拆成幾份才是誠實的做法,而我們絕不會悄悄替你刪。

精簡模式會改動我的文字嗎?

不會。精簡模式只逐字移除重複內容(頁首、浮水印、樣板)——絕不改寫、改述或摘要,還會列出移除了什麼供你核對。標準模式則保留每一行。

我的檔案會保密嗎?

檔案僅暫時處理、絕不用於訓練 AI,並在 60 分鐘內自動刪除。完整細節見隱私權政策。

檔案保留政策

上傳的原始檔與轉換結果都屬暫時資料,不會被保存為永久文件庫。

  • 上傳的原始檔只用於產生您的 Markdown 結果,處理結束後立即刪除,最晚不超過 60 分鐘。
  • 轉換結果與任務紀錄最多提供 60 分鐘,期限屆滿後即失效,並由系統自動從使用中的資料庫移除。
  • 我們不建立永久文件庫;但由服務商管理的基礎設施快照可能保留殘餘副本,最長 5 天後自動失效。
  • 上傳的原始檔只在任務處理期間存放於暫時性本機空間;若處理中斷,定期清理程序會移除任何已逾期的暫存檔。