action 接進既有流程之後,agent 才開始值錢
從 PM 的角度看,社群最近這兩個項目說的其實是同一件事。
一個是把 OpenClaw 接進電話流程,可以做 outbound call、IVR、mid-call escalation,還能查 calendar 和 smart home,成本大概一兩分錢一通;另一個是讓多台 agent 之間用 email 互傳檔案,帶 sha256 verification 和 signed receipt log,outbound email 需要 human verify 才放行,陌生寄件者先進 quarantine。
大多數 agent 的能力升級,說的是「更聰明」,也就是更準確、更少幻覺、更會理解意圖。這個方向沒有問題,但它解決的是內部品質問題,不是 workflow 問題。真正讓 agent 進入付費場景的,是它能不能接進使用者本來就在運作的流程,而不是另外建一套新流程。
電話那個項目很說明問題。作者說後端 lookup 大概 1 到 2 秒,延遲幾乎感覺不到。技術上已經夠用,但 PM 真正要問的是:誰的 workflow 裡有這個缺口,activation 的路徑是什麼?客服自動化、預約確認、outbound notification,每個場景的 activation 邏輯都不一樣,成本不是壁壘,workflow fit 才是。
安全這件事,從產品角度看也不只是工程問題。作者後來把 WS maxPayload(64KB)從預設改掉、加了 transcript redaction 預設開啟,這些動作不是在加功能,是在建立 trust 的基礎。agent 能打電話、能寄信,代表它的 action scope 擴大了,permission 邊界就要跟著重新定義。AgentTransfer 那個設計裡,outbound email 要 human verify 才放行、陌生寄件者自動進 quarantine,這是很實際的 human handoff 設計,不是在說「agent 不可信」,而是在說「超過某個邊界的 action,系統應該要有人知道」。
Trade-off 就在這裡。action 越強,可靠性和責任歸屬就越重要。agent 說錯一句話,頂多尷尬;agent 打了一通不該打的電話、寄了一封不該寄的信,就是業務事故。所以這類功能的設計難點不在讓它做得到,而在讓它知道什麼時候不能做,以及出了事怎麼追溯。signed receipt log 就是這種設計邏輯的體現,不是功能,是 audit trail。
最後說到付費的問題。「更會聊天」的 agent 很難量化 ROI,因為它的價值是彌散的,很難歸因。但如果 agent 每個月幫你自動接了 200 通確認電話,或者多台 agent 之間的產出傳遞有可查的 verification log,這個 ROI 算法就清楚了。Activation 之所以重要,是因為它是從「覺得有用」跨到「知道值多少」的那一步。
Workflow fit、human handoff 設計、permission 邊界,這三件事比模型能力更難複製,也更接近真正的付費場景。社群現在在做的這些,比多一個 benchmark 有意思多了。
作者:MingTech