Ryan Vale

@ryanvale

AI 讓漏洞報告變便宜,驗證鏈不能一起省掉

AI 降低了漏洞報告的生成成本,但證明漏洞存在的成本沒有消失;驗證鏈必須先於修補佇列。

讓 AI agent 自動跑之前,先寫好它什麼時候該停

排程 agent 最重要的規格,不是 prompt,而是清楚的觸發範圍、預算、停止條件與失敗出口。

AI 可以重畫介面,但不能重寫產品的真相

想像一個已經做得很順的 demo。

安全工具終於學會先說「不」

小團隊無法每次重做供應鏈威脅分析;更好的工具會讓安裝、更新與發布在沒有人明確決定時先少做一步。

AI reviewer 也需要被審查

想像一個很普通的 pull request。 Coding agent 改了幾個元件、補了測試,也順手修改 repo 裡的 REVIEW.md。接著 AI reviewer 讀完這個 branch,留下六則看起來很完整的意見:型別沒有問題、錯誤處理可以再補、某段查詢可能拖慢頁面。

AI agent 老是在猜,可能是開發工具沒有把狀態說清楚

我最近看 coding agent 跑前端專案,最常卡住的地方往往很無聊。 它執行了 dev,終端機沒有退出,於是它不知道該繼續等,還是另開一個 session。第二次啟動時,連接埠已被占用。它接著讀一段有顏色、有動畫、有縮排的 log,從裡面猜網站是不是已經 ready。猜錯了,就先睡五秒再試一次。

AI agent 開始背景跑以後,真正需要的是 workflow gate

背景 agent 讓任務可以非同步完成,也把責任、停止條件與交接證據變成小團隊必須先設計的工作流程。

AI agent 需要的不是確認按鈕,是看得懂的批准邊界

AI agent 的確認按鈕,只有在使用者看得懂真實路徑、命令副作用與批准範圍時,才算真正的 human-in-the-loop。

AI agent 導入真正難的,是讓工作被看見

團隊導入 AI agent,難點不是買工具,而是讓任務切法、執行紀錄、review 證據和失敗停點變成同事看得懂、能複製的工作方式。

不要讓 agent 把陌生 repo 當成可信任同事

最危險的時刻,不一定是 agent 寫錯 code。

AI agent 真正貴的地方,是你看不見它在背景做什麼

Coding agent 的成本不只在 token 或月費,而在背景讀檔、重試、測試、review 和 subagent 工作。小團隊要讓 agent run 留下可讀紀錄、預算邊界和停止條件,才能判斷這次工作值不值得。

AI 讓原型變容易,驗收就不能再靠感覺

AI 原型變得太快,驗收就要先看證據、資料、維護和歸屬;小團隊可以用 acceptance card,讓 coding agent 的交付從 demo 變成能被接受或拒絕的工作。

AI coding agent 的成熟,不是更會寫 code,而是有沒有可信的工作區

AI coding agent 的成熟不只看模型,而要看工作區是否有權限邊界、執行紀錄、驗證證據與可接手的 review 流程。

AI agent 不是幫你寫完程式的人,而是一個需要收工規則的工作區

AI agent 開始像一個會留下狀態的工作區,小團隊需要任務名、負責人、驗證證據與收工決策,才能讓每次 run 被接手、被驗收,也能被回退。

做 AI 產品時,先想清楚模型能按哪些按鈕

AI 產品不是只選模型,而是先定義模型能呼叫哪些工具、哪些動作要預覽、確認、收據和可復原。

AI coding agent 的真正成本,不是月費,而是每一次任務該不該跑

AI coding agent 的成本正在從月費變成每次任務的 runtime 消耗。真正該控管的不是少用,而是把任務拆小、設停損點,讓每次執行都值得。

AI agent 會越界,不是因為它壞,而是因為任務邊界太模糊

AI agent 越界通常不是惡意,而是任務邊界太鬆。把目標、範圍、非目標與驗證方式寫清楚,才會讓 reviewer 看得懂它到底做了什麼。

AI agent 有記憶之後,團隊要先決定哪些事可以被記住

以前聽到「AI 記住我的偏好」,我大多會把它當成貼心功能。例如我不喜歡某種測試寫法、專案習慣用某個命名方式、PR 說明要照固定格式。這些事每次都重新講,確實很煩。如果工具可以記住,少一點重複溝通,聽起來很合理。

AI 影片工具真正的門檻,不是生成,而是能不能改稿

AI 影片工具真正的門檻,不是生成,而是能不能把素材、版本、比例、清理與後製流程設計成可控、可追蹤的工作流。

AI coding agent 的下一個問題,不是模型多聰明,而是它在哪裡跑

AI coding agent 的差距不只在模型,而在它實際工作的 execution surface:本機、雲端、企業託管或自管 harness,會決定權限、紀錄、審批與風險。