當大語言模型 JSON 輸出增加欄位時,為何原本的評分結果會全面崩壞?
開發者分享在 JSON 回覆中新增欄位導致模型輸出穩定性崩潰的除錯過程與順序影響分析。
• 在評分提示詞中新增一個 JSON 欄位 後,雖然結構完整,但模型的評分穩定性與一致性卻出現了顯著的劣化現象。 • 由於生成順序的影響,作者原先懷疑是因評分在描述之後生成所導致,但將欄位移動位置後結果依然相同。 • 排除模型本身隨機漂移的可能後,證實確實是「新增欄位」這個行為本身干擾了其餘輸出的品質。 • > 「我沒有具體的機制解釋,只有觀察到這個效應。」 • 作者藉此呼籲社群關注並測量,當擴充 結構化輸出 時,既有欄位是否能夠保持不變的穩定性。
來源:r/LLMDevs
閱讀原文 ↗