OpenAI GPT-6 Astra 深度評測:最強電腦操作與程式碼模型實戰解析
Kilo Code 分享在生產環境預覽 OpenAI 新模型 GPT-6 Astra 的真實開發心得與踩坑紀錄。
• OpenAI 最新推出的 GPT-6 Astra 被定位為能跨瀏覽器、試算表與終端機自主運作的「電腦操作員」,標誌著邁向 AGI 時代的重要一步。 • 在程式碼編寫與代理任務的表現上,Astra 展現出頂級的 工具調用能力 與幾近完美的 Git 推理能力,能自主完成複雜的長週期任務。 • 實際測試顯示其產出的 UI/UX 具備極佳的 審美品味,且能誠實面對能力極限,大幅降低幻覺機率。 • 由於預設傾向 過度工程化 與過度研究,開發者使用時需要明確給予最小化指令,以避免不必要的 Token 消耗。
Astra 的多步驟執行能力帶來了質的飛躍,它不是在寫一個函式,而是在真正「完成一項工作」。 • 雖然價格較前代模型昂貴(每百萬輸入 10 美元、輸出 50 美元),但在實際工作負載中展現的高自主性讓它物超所值。
來源:Kilo Code Blog
閱讀原文 ↗另見:Simon Willison、GitHub Copilot Changelog、Latent Space