用 AI 的自然直覺是「把所有東西都給它」:整份文件貼進去、所有訊息都附上。資訊越多,答案越好——對吧?不一定。這是工作記憶的實作課:官方先用一個記憶測驗測「你自己」,讓你體驗序列位置效應——中間的東西最先消失;再告訴你 LLM 有一模一樣的偏誤:關鍵資訊落在長脈絡中段時,準確率掉超過 30%(Lost in the Middle 研究)。結論只有一句:更多脈絡 ≠ 更好結果。要的不是更多,是更聰明。
| 課程單元 | Lesson 9|Try It Out: Context Degradation |
| 預估時間 | 約 15–20 分鐘(互動實作) |
| 課型 | 🛠 實作練習(Try it out)——建議搭配官方互動頁一起玩 |
| 官方單元連結 | Try it out: Context Degradation(英文互動頁) |
直覺的陷阱:「把所有東西都貼給它」
用 AI 的時候,很自然會想:整份文件貼進去、每一則訊息都附上、找得到的脈絡全塞進去。資訊越多,答案越好——對吧?
不一定。有一個現象,每個考前抱過佛腳的人都懂:一次能記在腦子裡的東西有極限,而且中間的部分最先消失。在談這如何影響 AI 之前,官方先讓你看看它怎麼影響「你」。
記憶測驗:先測你自己
官方互動頁的開場是一個記憶測驗:快速看過一串單字,然後憑記憶寫出你記得的。強烈建議先去玩,再回來往下讀——親身體驗比任何解釋都有力。
🎯 → 先去官方頁做記憶測驗(約 2 分鐘),做完再回來。
做完了嗎?你記得的單字,多半集中在清單的開頭和結尾,中間的消失了。這不是你記性差——這是人類記憶百年來被反覆驗證的規律。而重點來了:LLM 表現出一模一樣的偏誤。
U 型曲線:序列位置效應
你剛剛經歷的現象叫序列位置效應(serial position effect),心理學家研究了超過一世紀:清單開頭的項目受益於初始效應(primacy)——它們被複誦得比較多;結尾的項目受益於新近效應(recency)——它們還新鮮。中間兩頭不沾。畫成圖就是一條 U 型曲線:
迷人的部分來了:大型語言模型呈現同樣的形狀。2023 年史丹佛的研究者(Liu et al.,論文名就叫「Lost in the Middle」)測試了同一個關鍵事實放在長脈絡不同位置的效果:放在最開頭或最結尾時準確率最高;埋在中間時,準確率掉了超過 30%。
💡 這不是小毛病,是結構性的:Transformer 的注意力模式,天生就給脈絡視窗的兩端更多權重。上一課說的「中段迷失」,現在你知道它的形狀(U 型)、它的數據(-30%)、和它的原因(注意力結構)了。
對提示的實際意義:危險模式 vs 安全模式
貼一份 20 頁文件進提示,然後問一個答案在第 11 頁的問題——模型漏掉它的機率,比答案在第 1 頁或第 20 頁時高得多。這對你組織脈絡的方式有直接的指導意義:
實務建議直截了當:最重要的指示放在脈絡的開頭與結尾。如果某條限制絕對必須被遵守——在開頭早早聲明,並在接近結尾處重申一次。不要指望模型對中間的一切一視同仁。
官方也提醒:這是起點,不是天花板。隨著你越來越熟練,你會發展出更精細的脈絡結構技巧——利用資訊在視窗中的位置、決定該放什麼與砍什麼、防止關鍵指示滑進注意力死區。目標永遠一樣:讓模型一眼就明白你真正要什麼。
更大的圖景:脈絡工程
脈絡衰退,就是「多給一點脈絡就好了」不總是正解的原因:你每多塞一塊脈絡,就把其他內容往中間——注意力死區——推得更深。這是脈絡工程(context engineering)的核心張力:
狠心篩選,只留真正相關的
關鍵內容佔據開頭與結尾
每一塊多餘的,都在稀釋重要的
更多脈絡 ≠ 更好結果。模型的注意力是有限的。狠心篩選、策略性擺放、重申重要的事。你自己的記憶測驗早就告訴你答案了:中間的字消失了——同樣的事,發生在每一段長對話、每一份貼入的文件、每一個被塞爆的視窗裡。解方不是更多,是更聰明。
動手做:官方互動頁任務清單
打開官方互動頁,把下面三關玩完:
☑️ 第一關|記憶測驗:認真做完單字回想測驗,然後檢查:你記得的字是不是集中在頭尾?把你的 U 型畫出來。
☑️ 第二關|用 AI 重現 Lost in the Middle:這其實就是 Lesson 8 練習的探測二——把一條關鍵指示埋在長文件中段問一次、移到頂端再問一次。如果你上一課跳過了,現在帶著 U 型曲線的理解補做,感受會完全不同。
☑️ 第三關|重構一個真實提示:找出你最近一次「貼了一大包」給 AI 的提示,用安全模式重構它:關鍵指示放最前面、結尾重申一次、砍掉至少三分之一不必要的內容。比較新舊版本的輸出。
課後反思
- 「人和 LLM 有同一個 U 型偏誤」這件事,有沒有改變你對「AI 記憶」的想像?(提醒:機制不同——人是複誦與新鮮度,Transformer 是注意力結構——但形狀相同,所以應對策略也相通。)
- 你平常的提示習慣偏向「危險模式」還是「安全模式」?最容易被你埋進中段的是哪類資訊?
下一課預告
三個特性講完,剩最後一個:可引導性(Steerability)——你下指令時究竟握有多少控制權?為什麼「用表格回答」它百發百中,「寫得專業一點」卻常常落空?控制力從哪裡來、又在哪裡漏掉?
延伸閱讀
常見問題 FAQ
2023 年史丹佛研究者發表的發現:把關鍵事實放在長脈絡的不同位置測試,放在最開頭或最結尾時準確率最高,埋在中間時準確率下降超過 30%。成因是 Transformer 的注意力天生偏重脈絡視窗的兩端。
心理學研究超過一世紀的現象:記憶一串項目時,開頭(初始效應)和結尾(新近效應)記得最好,中間最差,畫成圖是一條 U 型曲線。大型語言模型處理長脈絡時呈現同樣的形狀。
開頭與結尾。絕對必須遵守的限制,在開頭早早聲明、在接近結尾處重申一次;不要把它埋在長文件或長對話的中段——那是注意力死區。
在有限的注意力預算下設計脈絡的技藝:決定放什麼(狠心篩選)、放哪裡(關鍵內容佔據頭尾)、砍什麼(每塊多餘內容都在稀釋重要內容)。核心認知是:更多脈絡不等於更好結果。
本文為 Anthropic 官方課程之中文學習筆記。原課程建立於 Prof. Rick Dakan(Ringling College of Art and Design)與 Prof. Joseph Feller(University College Cork)發展的 AI Fluency Framework 之上,以 CC BY-NC-SA 4.0 授權釋出。Copyright 2026 Anthropic.
📬 喜歡這篇文章?訂閱電子報不錯過任何更新
生成式 AI 時代,最珍貴的資產不是工具本身,而是你的提問力與協作思維。
每週精選 AI 實戰技巧、官方課程更新與 AI 工作流攻略,直接寄到你的信箱!




發佈留言