昨天把手機配對進來了。今天來看它實際多了什麼。
設定 → 裝置,每台裝置底下會列出一排能力標籤。


標籤只是分類,真正能叫的是底下的指令。我這兩台的清單是這樣:
Pixel 8a 19 個
calendar.events contacts.search notifications.list
notifications.actions device.health device.permissions
motion.activity motion.pedometer location.get
camera.list camera.snap camera.clip
device.info device.status system.notify
talk.ptt.start talk.ptt.stop talk.ptt.cancel
talk.ptt.once
Windows Companion 14 個
browser.proxy screen.snapshot system.run
system.run.prepare system.which system.execApprovals.get
system.execApprovals.set camera.list
camera.snap camera.clip device.info
device.status location.get system.notify
相機、位置、裝置狀態、通知。
同一個 agent,不同的身體。 它可以叫手機拍照,也可以叫電腦拍照,自己決定要用哪一個。
行事曆、聯絡人、讀通知、操作通知上的按鈕、活動偵測、計步、語音對講。
這些是你的生活。電腦不知道你今天走了幾步,也看不到你 LINE 跳了什麼。
notifications.actions 那個特別有意思——它不只能讀通知,還能按下通知上的按鈕。
螢幕截圖、瀏覽器代理、在這台機器上執行指令。
這些是執行能力。手機沒有 shell,system.run 在它身上完全不存在。
手機給的是你的脈絡,電腦給的是你的手。
一個知道你的狀況,一個能動手做事。接在同一個 Gateway 上,agent 兩邊都能用。
官方文件提到 Android 還有兩個指令:mobile.ui.observe 和 mobile.ui.act——讀畫面上有什麼,然後點下去。
我的清單裡沒有。
原因文件也寫了:Android 只有在開啟「無障礙控制」時才會宣告這兩個指令。 沒開就等於沒有。
所以如果你想讓 agent 幫你操作手機 App,光配對是不夠的,要再去開無障礙權限。
這也呼應前面講過的:能力不是模型給的,是那台裝置給的——而裝置給不給,取決於你在那台裝置上開了什麼。