昨天談到:
一個可信的 AI,必須有能力停在:
「我不知道。」
今天我要談另一個很現實、甚至有點無聊的問題。
電腦重新開機之後呢?
如果 Sol 要成為一個長期存在的 AI System,
不可能假設:
Runtime 永遠不會停。
Windows 不會更新。
服務不會重新啟動。
機器不會斷電。
真正的系統一定會遇到:
Restart。
Shutdown。
Recovery。
所以有一天我開始問:
重新開機後,回來的真的還是正確的 Sol Runtime 嗎?

這句話聽起來很奇怪。
電腦重開。
程式自己啟動。
畫面有反應。
不就回來了?
以前我可能也會這樣判斷。
後來才發現:
「有東西跑起來」跟「系統正確恢復」差很多。

例如:
新版 Runtime 啟動了。
但舊版也一起啟動。
這算成功嗎?
不算。
服務起來了。
但 Health 不正常。
算嗎?
也不算。

畫面可以使用。
但底下其實不是我們預期的 Runtime。
算嗎?
還是不算。
所以我們後來不再把:
「程式出現了」
當成 Recovery PASS。
而是先定義:
Recovery 之後,Expected State 到底是什麼?
對 V1.8 來說,我們會確認幾件事情。
正確版本是否恢復。
正確 Runtime 是否啟動。
Health 是否正常。
是否只有預期的 Active Runtime。
系統是否回到要求的 Operational State。

這些條件都成立,
才有資格說:
Recovery PASS。
而且我們也發現:
只測一次 Restart 還不夠。
Windows 的啟動與關機其實有不同情境。
所以後來真的測了:
Windows Restart
Fast Startup / Hybrid Shutdown
Controlled Full Shutdown
Full Cold Boot
以及:
Multi-day Burn-in Continuity

也就是不只看:
「重開後活著。」
還要看:
持續運作之後是不是仍然維持正確狀態。
這些測試最後都有 Machine Evidence。
也因此,我們才把指定範圍的:
V1.8 Operational Continuity
標成:
QUALIFIED
這裡我一定要特別講清楚。
我們 Qualification 的是:
Operational Continuity
不是:
Full AI Identity Continuity
這兩件事情不能混在一起。
Operational Continuity 回答的是:
系統中斷之後,
能不能重新回到:
正確、可驗證的 Runtime State。
但 AI Identity Continuity 還要回答更多問題。
例如:
Model 換了呢?
Machine 換了呢?
Memory 更新了呢?
未來從 Home Body 換到 Car Body 呢?
怎麼證明仍然是同一個 Sol?
這些問題不是一次 Restart Qualification 能證明的。
所以我現在比較喜歡一句:
Verifiable recovery is part of operational continuity.
它不是:
「重新啟動就算延續。」
而是:
中斷之後,能不能回到正確而且可驗證的狀態。

這個「可驗證」非常重要。
以前我可能會說:
「它自動起來了,所以沒問題。」
現在我會繼續問:
哪一個版本?
哪一個 Runtime?
Health 呢?
舊 Runtime 有沒有同時存在?
Evidence 呢?
這跟 Day 06 的:
No Evidence. No Completion.
完全是同一件事。
Recovery 也不能只靠:
「看起來有回來。」
它必須有:
Expected State。
Test Condition。
Machine Evidence。
Pass / Fail。
這件事情還讓我發現另一個很有意思的問題。
如果一個 AI System 想長期存在,
那:
Recovery 本身就是設計的一部分。
不能只設計:
正常運作時怎麼跑。
還要設計:
中斷之後怎麼回來。
這跟很多真實系統其實一樣。
好的系統不是:
永遠不會壞。
而是:
出現可預期的中斷時,
知道怎麼回到正確狀態。
所以我現在對 Continuity 的理解也變了。
Continuity 不是:
永遠不中斷。
更接近:
中斷後,仍能有證據地回到正確狀態。

這個觀念對未來 Physical AI 其實更重要。
如果有一天 Sol 真的進入:
智慧住宅。
辦公室。
建築。
車。
甚至其他 Body。
那 Restart / Recovery 不能是一個:
「應該沒問題吧。」
因為錯誤 Runtime 如果重新取得 Physical Capability,
後果就不只是聊天內容不對。
所以我現在會把 Recovery 當成:
Identity、Authority、Governance 之前的一個重要工程基礎。
但仍然要守住 Scope:
今天我們真正有 Evidence 的,是:
V1.8 Operational Continuity Qualification。
完整 AI Identity Continuity,
仍然是後續要解的問題。
Day 12 走到這裡,
第二週其實也開始出現另一個轉折。
前面我們一直在談:
Memory。
Retrieval。
Authority。
Evidence。
Continuity。
可是只要一個 AI 開始不只是:
「知道」
而是開始:
「做」
風險就完全不一樣了。
聊天答錯,
我可以叫 Sol 再想一次。
但如果 Tool 已經真的執行?
如果狀態已經改變?
如果未來 Physical World 已經被影響?
那事情就不能只問:
「AI 聰不聰明?」
而要問:
它憑什麼做?
Day 13,
我們開始進入第三階段。
AI 開始會用工具以後,我反而更緊張了。
