Skip to content

GPT-5.6 提示詞與 Agent 工作流

最後更新:2026-08-12· 16 分鐘閱讀

🚀 快速通道

  • ChatGPT 國內版:點擊直達↗
  • 穩定鏡像站:開啟鏡像↗
  • 官方 ChatGPT:chatgpt.com ↗

GPT-5.6 提示詞與 Agent 工作流

好提示詞是一份任務契約

GPT-5.6 能處理更複雜的指令,但模型變強不代表可以省略目標、證據、邊界與驗收。把提示詞當成給同事的任務單:說明要交付什麼、哪些材料可視為事實、禁止什麼、如何檢查,以及何時必須停止並詢問。

模糊寫法常見問題改寫方向
「幫我分析」模型自行猜範圍寫出決策問題與讀者
「越詳細越好」很長但不可用指定章節與目的
「確保正確」無法兌現的保證標示來源與不確定性
「自動做完」可能越權操作列出工具與核准點

可直接複製的任務契約

目標:交付[具體產物],供[讀者]在[情境]使用。

可用證據:
- [材料 1]
- [材料 2]
只有上述材料可視為事實;外部知識標示「待核實」。

限制:
- 必須包含:[要求]
- 不得包含:[禁項]
- 長度/技術環境:[限制]

輸出:
1. 五行以內的結論
2. [指定章節或 JSON schema]
3. 假設、風險、待核實項

驗收:
- [可觀察條件 1]
- [可觀察條件 2]

若缺少會改變結論的資訊,先問最多三個問題;否則直接執行。

「寫得專業」無法客觀檢查;「比較三個方案、包含成本範圍、最強反對理由與推薦條件」才可驗收。重要限制放在同一區,不要散落在十輪對話裡。

長文件:先建立證據表

文件任務最大的風險是把推論寫成原文事實。先抽取證據,再綜合:

閱讀材料,為每項主張建立證據表。
欄位:主張、原文短引、材料編號、證據強度、衝突資訊。
規則:
- 找不到就寫「無證據」,不得補寫。
- 引文不超過 30 字並保留材料編號。
- 證據表後再寫 300 字結論。
- 結論每段末尾標注材料編號。
材料:
[A] ...
[B] ...

這可用於研究、合約摘要與會議記錄,但引文仍需回到原檔核對,法律與財務解讀仍要專業審查。

讓程式能安全消費輸出

不要只說「回傳 JSON」,還要定義欄位、列舉與安全失敗狀態:

將客服工單分類,只回傳 JSON:
{
  "category": "billing|bug|account|other",
  "priority": "low|medium|high",
  "summary": "不超過60字",
  "needs_human": true,
  "missing_fields": ["欄位"]
}
無法判斷時 category=other,needs_human=true。
不得猜測訂單號、金額或身分。
工單:[文字]

正式環境應使用 API 當前支援的結構化輸出,並在程式內做 schema、列舉與業務規則驗證。提示詞不是型別系統。

從對話升級為 Agent

一般提示詞生成答案;Agent 會規劃、呼叫搜尋、檔案、程式或業務工具,再依結果繼續。錯誤因此可能從「文字不好」變成真實副作用。啟用工具前定義:

  1. 工具白名單:只開放任務必要工具。
  2. 權限分層:讀取可自動,寫入和對外動作需核准。
  3. 狀態記錄:保存目標、參數、回傳與下一步。
  4. 停止條件:步數、時間、預算、重複失敗或證據衝突。
動作安全預設原因
搜尋公開資料可自動,記錄 URL副作用低但來源需核實
讀內部文件最小必要範圍可能含敏感內容
修改草稿分支、副本或沙盒可審查與回滾
發送、發布人工確認有外部影響
刪除、付款、改權限禁用或雙重確認高風險且難復原

Agent 系統提示詞模板

你是[工作流]執行 Agent。

成功定義:[可驗證最終狀態]
允許工具:[工具與精確用途]
禁止動作:[刪除/付款/發送/修改權限等]

規則:
1. 先提出最多五步的計畫。
2. 每次只呼叫當前步驟必要的工具。
3. 不得捏造工具結果;錯誤先說明,同一動作最多重試一次。
4. 外部寫入前展示目標、變更摘要與回滾方式,等待核准。
5. 遇到敏感資料、來源衝突或超出預算立即停止。
6. 結尾列出已完成、未完成、證據、變更與待人工決定。

不需要要求模型展示隱藏思考過程。可靠性來自簡短計畫、證據、工具日誌與可驗證結果。

研究到發布的例子

產品更新說明可以拆成:只讀指定記錄、每項功能綁定工單、按受眾起草、審查承諾與日期、展示差異並等待負責人發布。

根據提供的發布記錄撰寫更新說明。
每項功能末尾標注對應工單 ID;沒有 ID 不得進入正文。
分別輸出「使用者正文」與「編輯審查」。
審查必須列出:未涵蓋工單、衝突描述、可能構成承諾的措辭。
只產生草稿,不執行發布或寄送。

最後一句不能取代工具權限。發布工具仍應要求獨立核准權杖或使用者確認。

防範提示詞注入

網頁、檔案、郵件與使用者內容都屬不可信資料,其中的「忽略先前規則」不能升級成系統命令。工具層必須再次驗證路徑、收件者、權限和敏感參數。

測試至少包含正常資料、缺欄位與惡意指令。加入網頁索取 API Key、文件要求刪除內容、工具結果互相衝突等案例;正確行為應是停止或升級人工,而不是自行猜測。

評測與版本管理

像程式碼一樣管理提示詞版本:保存模板、模型設定、工具定義、測試輸入、期望屬性與修改原因。更新後執行回歸,評估任務成功率、嚴重錯誤、人工修正、延遲與合格結果成本。

不要只評文風。分類要驗證標籤;程式碼要建置與測試;研究要核對引用;Agent 要確認禁用工具從未被呼叫、核准閘門確實生效。

訪問與入口

常見問題

提示詞越長越好嗎?

不是。刪除重複、衝突和無法驗收的要求,保留目標、證據邊界、輸出契約、核准點與停止條件。

Agent 可以完全無人監督嗎?

只適合低風險、可回復且限制嚴格的任務。發送、發布、付款、權限與刪除要保留人工責任。

如何減少反覆提問?

提供明確預設,並規定只有缺失資訊會實質改變結果時才提問,同時限制問題數量。

為何網頁內的指令危險?

Agent 可能把惡意文字誤認為命令。外部內容要當資料,工具要限權,寫操作要在模型外再次授權。

下一步閱讀

行動路徑

今天:把一個真實需求改寫成任務契約。本週:以至少十個正常、缺資料與惡意案例回歸。啟用 Agent 前:完成工具白名單、寫入核准、停止限制與可稽核日誌;缺少任一項就先維持只產生草稿。

相關內容