AI 寫程式不是「會或不會」,而是一道逐漸往上的能力階梯:
第 1 階|程式碼補全:看到目前程式,幫你接下一行。
第 2 階|聊天問答:根據問題解釋錯誤、產生函式。
第 3 階|跨檔修改:讀取專案脈絡,同時修改多個檔案。
第 4 階|執行工具:跑指令、測試程式,再根據錯誤修正。
第 5 階|Coding Agent:自己拆解任務、選工具,並決定下一步。
往上爬時,AI 能看到的範圍更大、能執行的操作更多。
但真正的分水嶺是另一件事:從「你決定下一步」變成「AI 自己決定下一步」。
權限越高,驗收也越難。補全一行程式,你可能一眼就能檢查;Agent 一次跨十個檔案修改,你還能確認每個改動都正確嗎?
所以真正的問題不是「AI 能做到第幾階」,而是:
這一階 AI 做完之後,你驗得動嗎?
能產生程式碼不等於能證明產品正確;測試、規格、資安檢查與最終判斷,仍需要人負責。
延伸閱讀
Yang et al., SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering, NeurIPS 2024(arXiv:2405.15793)。