本系列不只介紹 Codex 功能,而是把它放進真實軟體工程流程中實測。從理解既有 Repo、處理 Issue、修 Bug、跨檔案修改、補測試,到 Code Review、PR、CI 與多 Agent 協作,逐步比較 Human、Codex 與 Human+Codex 的完成時間、成功率、人工介入與錯誤類型,最後回答:Coding Agent 能做到多接近真正的軟體工程師?
這幾年用 AI 寫程式,我已經很習慣把問題切小之後丟給它,某個 function 不知道怎麼寫、SQL 卡住,或是一段程式看不太懂,就把相關片段貼上去問,通常幾...
昨天做的事情其實還算安全,我只是把一個完整的 GitHub 專案交給 Codex,看看它能不能自己讀 README、找入口、追檔案之間的關係,最後整理出這個專案...
前兩天把專案交給 Codex 之後,我一直在想一個問題,如果只是叫 AI 改一個 function、修一個明確的 bug,其實跟以前把程式碼貼進 ChatGPT...
前三天把專案交給 Codex 之後,我慢慢發現一件事,如果只是叫它找到某個問題、修改某個檔案,其實跟平常把程式碼貼給 AI 的差距還沒有想像中那麼大。 真正讓我...
昨天第一次讓 Codex 自己從專案裡找 Bug,最後確實有找到問題,也完成了修改。 如果按照我以前使用 AI 寫程式的習慣,做到這裡大概就結束了。AI 給我修...
前幾天一路測下來,我已經讓 Codex 做過讀專案、找問題、修改程式,也開始慢慢習慣把比較完整的任務交給它,不再每次都先自己找到檔案,再把其中幾十行程式碼貼出去...
前幾天使用 Codex 的方式,大多還是我先決定要做什麼,再把任務交給它,例如修一個 Bug、調整某個功能、看懂專案結構,或是根據 Issue 去修改指定的地方...
前幾天讓 Codex 做的事情雖然越來越接近真正的開發流程,從看專案、找問題、修改程式到跑測試都有碰到,但仔細想想,這些任務大多還是可以把範圍縮在幾個檔案裡,只...
前幾天一路把 Codex 從看懂專案、找問題、修改程式帶到自己跑測試之後,我開始發現一件滿有趣的事,就是 Codex 做得好不好,好像不只跟模型能力有關,我怎麼...
前幾天把專案交給 Codex 之後,我慢慢發現一件很有趣的事,每次它完成修改,最後幾乎都會整理一段看起來很完整的說明,告訴我改了哪些檔案、修掉什麼問題、做了哪些...