Bible Network Crypto DeFi Onchain RWA AI Agent Stablecoin Chain SAFU CryptoTax DeFAI AGI Claude Me Claude Skill Claude Design Claude Cowork
獨立知識媒體
與任何項目無關聯
讓 Claude 替你工作,不只是幫你回答
claudecowork-me.com
最新
用 Claude Cowork 串接 Excel 跟 PowerPoint 前,你該知道資料是怎麼「自己」流過去的  ·  什麼時候該用 Claude Cowork,什麼時候用一般對話就好?官方給的五個判斷指標  ·  沒改設定就用 Claude Cowork 的 Legal Plugin 審合約?你可能在用美國法律標準審核台灣合約  ·  Claude Cowork 終於能被稽核了:Compliance API 正式涵蓋 Cowork session,但這改變了什麼、又還留下哪些缺口  ·  Claude Cowork「自動核准」跟「跳過所有核准」差在哪?一個關鍵字的差別,決定了誰在幫你把關  ·  Claude Cowork 的 Finance Plugin 能做到什麼?官方財務外掛完整拆解,以及它明確不做的事
名詞解析 · core-concepts

Example Ordering

範例排序
core-concepts intermediate

30 秒版 · 給沒耐心的人
少樣本提示裡放進去的範例,排列順序本身會影響 Claude 模仿的重點——放在最後的範例容易被當成「最該優先參考」的那個,不是單純的裝飾性排列,順序本身就是一種指令。
完整解說 +
01 · 這是什麼?

範例排序指的是:在 few-shot prompting(少樣本提示)裡附上多個範例時,這些範例被放進提示的先後順序,會實際影響 Claude 從中學到什麼、模仿哪些特徵。這不是「有沒有給範例」或「給幾個範例」的問題——這兩件事屬於 few-shot prompting 本身要處理的範疇;範例排序處理的是更細一層的問題:同一組範例,換一個排列順序,輸出結果可能不一樣。多數人在準備少樣本提示時,只在意有沒有涵蓋到需要的情境,很少意識到「先放哪個、後放哪個」本身也是一個會影響結果的變數。

02 · 為什麼存在?

這件事會被需要,是因為模型在處理一連串範例時,並非把每個範例當成完全對等、無差別的參考資料,最後出現的內容往往帶有更強的權重——這跟人在讀一長串範例時的傾向類似,最近讀到的東西記得最清楚,也最容易被當成「這是重點」。如果你手上的範例裡,前面幾個是常規情況、最後一個剛好是特殊情況(例如例外處理、格式差異最大的那個),Claude 很可能把那個特例的特徵當成整體規則的核心,過度套用到不該套用的地方。這個效應在範例之間差異愈大時愈明顯,範例彼此愈相似時影響愈小,這也是為什麼同一組範例、換個順序測試,有時候會得到肉眼可見不同的輸出。

03 · 如何影響你的決策?

實務上有三個具體做法。第一,把最具代表性、最能反映「一般情況該怎麼處理」的範例放在最前面,讓 Claude 先建立起主要規則的印象,特例或邊界情況放在中間,不要放最後。第二,如果範例裡確實需要包含一個特例(例如格式差異較大的邊界案例),刻意在該範例後面再補一個回歸主流格式的範例,避免特例是提示裡最後看到的內容。第三,範例之間如果差異很大、彼此不容易被視為同一類,先測試不同排列組合,觀察輸出穩不穩定——如果調換順序後輸出有明顯差異,代表這組範例本身可能不夠一致,這時候該檢討的往往不是排序本身,是範例的選擇是不是涵蓋了太多不同類型的情境,硬要用同一組範例覆蓋。

04 · 你該怎麼辦?

對你來說,範例排序真正的價值在於:當少樣本提示的輸出「莫名其妙偏向某個範例的風格」而你想不通為什麼,排序往往是被忽略的答案——多數人第一時間會懷疑是不是範例本身選錯了,卻沒想到問題可能只是順序不對,把最後一個範例換到中間,問題可能就解決了,不需要重新找範例。真正該建立的習慣是:準備少樣本提示時,把「哪個範例放最前面、哪個放最後面」當成跟「選哪些範例」同等重要的決定,而不是選完範例之後隨手貼上去的順序。要留意的風險是:範例差異愈小,排序的影響愈不明顯,這時候花時間反覆調整順序未必划算,值得投入排序優化的通常是範例彼此差異較大、或其中包含明顯特例的情況。

實際例子 +

OpenAI 研究團隊在 2020 年發表的 GPT-3 論文《Language Models are Few-Shot Learners》裡已經觀察到,少樣本提示的效果會隨提示裡範例的呈現方式而波動;此後多篇針對 in-context learning(情境內學習)的後續研究進一步證實,範例的排列順序是造成同一組範例、不同測試結果出現變異的因素之一,這類「順序敏感性」的討論後來成為提示工程領域檢討提示穩定性時的常見切入點。

常見誤解 +
✕ 誤解1
× 誤解:範例的排列順序只是視覺上的整理,不影響輸出,實際是:放在最後的範例往往帶有更強的權重,容易被當成優先參考的對象,同一組範例換順序測試,輸出結果可能有明顯差異
✕ 誤解2
× 誤解:只要範例本身選得好,順序不重要,實際是:範例之間差異愈大,順序的影響愈明顯,如果特例或邊界案例剛好排在最後,容易被過度模仿,即使範例本身選擇正確,排序不當一樣會導致輸出偏離預期
這件事跟你有什麼關係 +
直接影響

優點是不需要換範例、只調整順序就能修正輸出偏離的問題,成本極低,通常幾秒鐘就能調整測試;缺點是效果不穩定,範例之間差異愈小,排序帶來的改善愈不明顯,花時間反覆調整順序有時候不如直接檢討範例本身的選擇是不是有問題。

提問
請至少輸入 10 個字
更多相關主題