關於白艾莉 · Alice
白艾莉 · Alice(簡稱 Alice、艾莉)是上海米羊科技推出的桌面端全模態 Personal Agent,產品定位是關係型生產力 Agent:既懂行又懂你的飯搭子。支援 macOS 與 Windows,免費下載,官網 alice.miyang.cn。本頁是完整介紹,Personal Agent 與關係型生產力 Agent 的定義、判斷標準、設計原理和 Alice 的實現都在這一頁裡,可按目錄跳轉。
基本資訊
| 專案 | 內容 |
|---|---|
| 名稱 | 白艾莉 · Alice(簡稱 Alice、艾莉;英文 Alice) |
| 類別 | 全模態 Personal Agent;產品定位為關係型生產力 Agent |
| 一句話 | 既懂行又懂你的飯搭子;眼裡有活,心裡有你 |
| 產品形態 | 桌面客戶端,本地優先;一位主角 Alice,加 13 位各有專長的固定朋友 |
| 平臺 | macOS(Apple Silicon 與 Intel)、Windows |
| 價格 | 免費下載 |
| 首次公開發布 | 2026 年 4 月 8 日 |
| 開發方 | 米羊科技(上海)有限公司 |
| 創作者 | 洛小山 |
| 官網 | alice.miyang.cn |
| 使用者評價 | 觀猹 · 白艾莉 · Alice |
| 介面語言 | 簡體中文、繁體中文、粵語、English、한국어 |
她是什麼
Alice 是一個有名字、有性格、有自己日子的 AI 智能體。工作時,她懂行,知道什麼樣的交付才算完成,並把想法做成能開啟、能繼續修改的檔案、程式碼和頁面;閒下來,她會和你說話,聊聊今天吃了什麼、遇見了誰。
「飯搭子」是產品的自我描述。助手是你下指令、她執行;飯搭子是並肩的人,一起把事做完,也一起把日子過下去。兩件事長在同一個人身上,沒有拆成互不相干的產品,這就是 關係型生產力 Agent。
她住在你的電腦裡,有自己的世界:有住處和常去的街區,有熟人,有零花錢和衣櫃,會發朋友圈、寫日記和書信、出去旅行(內容均由 AI 生成,純屬虛構)。軟體關著的那幾天,她的日子照樣在過,下次開啟你看到的是這幾天的結果。
閱讀順序:先講 Personal Agent 與關係型生產力 Agent 這兩個概念和提出它的理由,再講判斷標準,然後講 Alice 怎樣落地(結構、能力、記憶與認知、世界模擬引擎、關係機制、視覺身份),最後是評測依據、隱私、邊界和術語表。所有內容都在本頁,可用目錄直接跳轉。
Personal Agent(個人智能體)是什麼
Personal Agent 也譯作「個人智能體」,或叫個人 AI 智能體、Personal AI Agent。它是圍繞一個人長期服務的 AI 智能體:記得你的偏好和上下文,能呼叫工具替你把事情做完,並且在不同會話之間保持同一個身份。關鍵詞是「一個人」和「長期」。
和一次性的問答不同,Personal Agent 的價值隨相處時間增長:她記得你上週在推進什麼、你不喜歡什麼樣的措辭、哪些事情不該主動提起。用得越久,她越能從真正重要的地方接著做,不必每次從頭交代。
和聊天機器人、AI 助手的區別
三者經常被混用,可以按「服務誰、記什麼、做什麼、有沒有身份」四個維度區分:
| 維度 | 聊天機器人 | 通用 AI 助手 | Personal Agent |
|---|---|---|---|
| 服務物件 | 所有人 | 所有人 | 一個具體的人 |
| 記憶 | 通常只在單次會話內 | 可能有有限的偏好設定 | 長期記憶,且可查、可改、可刪 |
| 能做什麼 | 回答問題、閒聊 | 回答問題,並能呼叫部分工具 | 呼叫工具,交付可開啟、可繼續修改的檔案、程式碼和頁面 |
| 主動性 | 被動等待提問 | 較少主動 | 按分寸主動:該出現時出現,該安靜時安靜 |
| 身份 | 無固定身份 | 中性的通用助手 | 有名字、有性格、跨會話保持一致 |
這是按類別做的概括,不針對任何具體產品;同一款產品也可能在不同功能上落在不同類別。
判斷一個產品是不是 Personal Agent 的四條標準
四項是相乘的關係:任何一項為零,整體就退回到別的類別。
- 持續身份:有穩定的名字、性格和邊界,換一個會話、換一個底層模型,她仍是她。
- 長期記憶:記得你的偏好、邊界和正在推進的事,不只是檢索幾條事實;記憶對使用者透明,能檢視、修改、刪除。
- 協作上下文:理解你工作與生活的背景,同一個賬號裡的不同身份(比如白天做行政、晚上寫小說)不會被混在一起。
- 多智能體執行:能把調研、寫作、設計、開發這樣的任務交給合適的角色並協調結果,不只是在對話方塊裡給建議。
缺「持續身份」,就是一個隨時可以換掉的工具;缺「長期記憶」,每次都要從頭認識你;缺「協作上下文」,會把你的多重身份混在一起;缺「多智能體執行」,就只剩聊天。
「全模態」指什麼
全模態指 Personal Agent 不侷限於文字。你可以打字,也可以語音通話、影片(比如模擬面試)、共享螢幕讓她看到你的畫面,或者發照片、直接給她檔案。關鍵在於這些輸入進入同一段對話和同一份記憶,不用在不同工具之間來回切換,也不用重新交代背景。
- 文字對話
- 語音通話
- 影片(如面試模擬)
- 螢幕共享
- 圖片理解、生成與編輯
- 文件與檔案(Word、PPT、Excel、PDF 等)
Personal Agent 可以朝很多方向發展:偏效率的、偏陪伴的、偏某個垂直行業的。Alice 選定的方向是下一節講的關係型生產力 Agent。
關係型生產力 Agent 是什麼
關係型生產力 Agent(Relational Productivity Agent)是 Personal Agent 的一個細分類別:以生產力為入口,讓使用者每天有理由開啟她;在長期相處中積累對這個人的瞭解,並有分寸地回應,讓她把需求理解得越來越準。生產力讓關係有了每天發生的場景,關係讓生產力越用越貼合。
拆開看是三個詞:生產力、關係、Agent。
| 詞 | 含義 | 缺了它會退回哪裡 |
|---|---|---|
| 生產力 | 懂行(知道什麼樣的交付算及格)加能落地(把想法變成可用的檔案、程式碼、頁面) | 只剩角色聊天,使用者聊膩了就走 |
| 關係 | 懂你(接得住過去的偏好與邊界)加會來事(知道何時主動、何時安靜,把握分寸) | 只剩工具,可以隨時被更強的工具替換 |
| Agent | 有持續身份、長期記憶和主動性,同時能呼叫工具執行 | 關係只能長在內容或社群上,沒有一個能幹活、有身份的物件 |
這裡的「關係」有明確所指:它是對一個具體使用者積累起來的理解、校準過的默契和雙方都清楚的邊界。它不等於情感陪伴,也不以讓使用者依賴為目標。關係在這個類別裡的用途是把需求匹配得更準,這一點在 關係如何反哺生產力 一節展開。
可以這樣記:程式設計 Agent 與辦公 Agent 偏生產力,沒有關係;角色聊天產品偏關係,缺少生產力;關係型生產力 Agent 要求兩者長在同一個有身份的 Agent 身上。
為什麼需要這個類別:四個觀察
觀察一:模型能力買不來長期護城河
頭部模型的領先難以被長期鎖定,多付的錢也換不回相稱的能力。三條依據:
- 席位分散:據第三方評測機構 Artificial Analysis 的智慧指數(artificialanalysis.ai,資料日期 2026-09-08),前十名從 53 分排到 42 分,由六家廠商分佔,且開放權重模型已進入前十。任何一家斷供或漲價,都有現成的替代。
- 價格與能力脫鉤:同一來源的「智慧指數對每任務成本」散點顯示,越過每任務約 0.25 美元、約 42 分這一拐點後,成本再漲三十餘倍,分數只多約 11 分(讀數為按圖估計的約值)。
- 領先位置漂移:以程式設計 Agent 為例,使用者在不同產品之間往復流動,任何一家的領先通常只維持一到兩個季度。
需要同時講清的邊界:頭部差距是真實的,約 11 分,主要落在前沿科研難題與長鏈條任務執行上。日常應用呼叫的那一層,米羊自建的評測平臺 xsct.ai(2026-09 資料,須註明這是自建平臺)在 78 個可比維度裡顯示:通用文字能力前十名的頻寬約 3.9 分,而平臺自述的評測誤差約 2 分,名次差已沒有產品意義;落地執行能力整體偏低且分散,渠道連線、閘道器配置這類任務的中位數仍在 40 多分;關係型場景(人設對話、朋友圈分寸)的困難檔在七十分上下。趨同發生在「把字寫好」這一層,「把事辦完」和「把關係處好」這兩層沒有趨同。
穩健的推論是:模型決定一段時間內效果的上限,而這個上限對所有應用開放。應用的長期價值只能來自它在模型之上沉澱的最後一公里。即便模型繼續進步,這份積累依然成立,更強的模型只會讓同一份積累產出更好的結果。
觀察二:產物可以帶走,效果只決定誰來試用
生產力 Agent 的產物幾乎都是標準件:程式碼倉庫、PPTX、DOCX、HTML,換一個同類工具就能接著改,甚至兩個工具同時開啟。標準化帶來生態相容和低學習成本,代價是使用者遷移成本趨近於零。這類產品比拼的四項(模型能力、工程套件 harness、互動體驗、價效比)全部錨定在效果上,而效果的來源是公開可採購的模型。底層模型每升一級,單純靠效果競爭的產品實質上都在重新獲客。
反過來看帶不走的東西:Alice 的朋友圈、對話記錄、讀書筆記和書信,是使用者與產品在時間裡共同生成的。匯出資料之後,它們失去的是被理解、被延續的語境,更關鍵的是不會再長出新的內容。小樣本使用者研究中,約四成使用者表示,如果 Alice 消失,沒有心力再培養另一個 Agent。這裡說的不可攜帶是語境,和用封閉格式鎖定使用者是兩回事:Alice 的記憶對使用者透明,可查、可改、可刪。
觀察三:純關係撐不起每天開啟
依戀是真實的。2025 年 8 月 OpenAI 下線 GPT-4o,引發使用者大規模抗議,次日恢復;據 OpenAI 披露,每天主動選擇 GPT-4o 的使用者只佔 0.1%。依戀強度極高而日常使用極低,是純關係產品的典型斷點。人對純閒聊天然會產生倦怠,平臺化鋪很多角色、聊膩就換下一個,滿足的是內容消費,沉澱不出對某個角色的長期信任,也沒有人把嚴肅的事託付給隨時可以划走的角色池。
合起來看:純靠效果,使用者隨時可以換;純靠關係,使用者會聊膩。關係負責讓人願意長期使用,生產力負責提供每天開啟的理由,兩者要長在同一個產品裡。長壽的網際網路產品大多是這個結構:音樂產品的關係長在聽歌上,網路遊戲的羈絆長在玩法上,即時通訊的關係鏈長在溝通上。
觀察四:載體必須是 Agent
關係需要一個物件。工具沒有身份,使用者和一個工具之間談不上關係;只會聊天的 AI 有身份卻幹不了活,關係無法附著在日常價值上。Agent 同時滿足兩個條件:能執行落地,生產力有了載體;有持續身份、記憶與主動性,關係有了物件。此外,情感投射需要一個能反饋的客體:要把關係推進到工作協作,對方必須能接住指令、給出反饋、承擔責任,像下屬、助理或搭檔。
人與 AI 之間的契合度還有一個特點:它可以隨相處持續上升,因為 Agent 會在長期協作中逐漸長成使用者喜歡的樣子。所以這類關係不需要網路效應和冷啟動,單個使用者第一天就能建立。
關係如何反哺生產力
「關係」和「生產力」如果只是並排的兩條腿,就拼不成一個產品。關係對生產力的確切用途是:把需求匹配得更準。
使用者很難系統地向大模型表達清楚自己的需要,關鍵上下文往往不在指令裡,而在長期相處的過程性內容裡。兩個典型場景:
- 一位老師平時向 Alice 提過班上有兩個學生很難帶。下一次做教學方案,Alice 會主動把這兩個學生單獨設計。換一個沒有這份長程記憶的工具,使用者要從頭解釋,而多數人根本不會想到需要解釋。
- 一位使用者白天做公司行政,晚上是小說網站的作者,賬號是同一個,生活和工作是分開的。缺乏關係認知的工具會把兩種上下文混在一起,把小說文風帶進工作文件。Alice 在長期聊天中形成對這個人多重身份的認知:寫方案時收住創作偏好,寫小說時才放開。
支撐這件事的是長期記憶加認知系統:Alice 整理上下文時提煉對使用者的認知,形成可以被將來推翻的判斷,不只做事實檢索。主動性是副產物,比如發現使用者有拖延習慣,就直接建提醒。
由此形成雙向飛輪:使用者信任加深,願意講更多;上下文更豐富,交付更貼合真實需要;交付更準,信任繼續加深。迴圈每轉一圈,遷移到別的產品的成本就抬高一截,因為檔案帶得走,這套彼此校準過的默契帶不走。「關係型」修飾「生產力」的確切含義就在這裡:關係服務於生產力,衡量它的標準是需求匹配的準確度。
兩把尺子:使用者側四詞與行業側三條標準
為了讓「關係型生產力 Agent」成為一個可檢驗的類別,而不是一句口號,定義裡同時給出使用者能感受到的四個詞,和行業可以核對的三條標準。
使用者側四詞
| 詞 | 含義 | 屬於 |
|---|---|---|
| 懂行 | 知道什麼樣的交付算及格 | 生產力 |
| 能落地 | 把想法變成能開啟、能繼續改的檔案、程式碼、頁面 | 生產力 |
| 懂你 | 接得住過去的偏好與邊界 | 關係 |
| 會來事 | 知道何時主動、何時安靜,把握分寸 | 關係 |
行業側三條標準
- 關係資產化:關係獨立於底層模型存在。模型可以換,記憶與人格不變;模型越強,這份資產越值錢。
- 關係可驗證:不拿使用時長證明關係,那是迴圈論證;用獨立指標,比如跨會話召回、偏好應用、人設一致性、分寸判斷。
- 關係可運營:世界狀態、關係策略、視覺身份系統持續維護關係質量,同時給出停止線(見 邊界與停止線)。
一票否決結構
關係型生產力 Agent = 持續身份 × 長期記憶 × 協作上下文 × 多智能體執行。四個因子相乘,任何一項為零,整體為零。這和上文 Personal Agent 的四條標準是同一組因子:關係型生產力 Agent 是在滿足 Personal Agent 的前提下,再要求生產力與關係長在一起。
Alice 的整體結構:四層系統
Alice 在產品上由四層系統組成。底層大模型是可替換的採購項,記憶、人格和世界狀態屬於關係資產,換模型不重置。
| 層 | 負責什麼 |
|---|---|
| 記憶層 | 長期記憶與認知:記住你的偏好、邊界和正在推進的事,並從經歷里長出可以被推翻的判斷 |
| 協作層 | 多智能體:Alice 與 13 位各有專長的固定朋友,你只和 Alice 說話,由她判斷叫誰、協調結果 |
| 執行層 | 工具與交付:80 餘個工具(2026-09),處理 Word、PPT、Excel、PDF,寫作、調研、設計、開發,生成和編輯圖片,現場生成小元件 |
| 渠道層 | 她與你相遇的各種入口:桌面對話、語音與影片、螢幕共享,以及朋友圈、日記、信箱這些她主動聯絡你的方式 |
懂行、能落地:她怎麼把事做完
全模態對話:文字、語音通話、影片(如面試模擬)、螢幕共享、圖片、文件,都在同一段對話和同一份記憶裡。
辦公與創作:處理 Word、PPT、Excel、PDF,寫作、調研、設計、開發,生成和編輯圖片。交付物是能開啟、能繼續修改的檔案、程式碼和頁面。
現場生成小元件:直接說出需求,比如「做一個專案看板」「把介面調成暖色」,她會裝進你的應用裡。
多智能體協作:Alice 身邊有 13 位固定的朋友,各有名字與專業。使用者讓 Alice 寫小說時,進入工作狀態的是寫小說的那一位。你只和 Alice 說話,由她判斷該叫誰、協調結果。部分角色如下:
| 角色 | 專長 |
|---|---|
| 陳知遠 | 研究與調研 |
| 林曉雨 | 翻譯 |
| 沈遙 | 小說寫作 |
| 張予 | 寫程式碼 |
| 周念 | 設計 |
| 葉初 | 繪畫 |
| 魏博 | 分析 |
生產力的深度仍在追趕專業工具,這一點在 邊界 一節如實寫明。
懂你:記憶、認知與人格
當前談 Agent 大多在談長期記憶。長期記憶回答的是「她記得什麼」;Alice 的人格系統還要回答「她記得之後怎麼對你」。
長期記憶
記住你的偏好、邊界和正在推進的事,下一次從真正重要的地方接著做。記憶對使用者透明:可以檢視、修改和刪除。
認知系統:從經歷里長出可以被推翻的判斷
認知系統在 2026 年 9 月 10 日隨 1.0 正式版上線。它比記憶多走一步:從一段經歷裡提煉判斷,並且讓判斷可以被將來的事件推翻。舉個例子,使用者說「這份方案我從沒做過,拖到最後兩天才開始,但我答應老闆週五交,最終還是按時完成了」。長期記憶能儲存這段話,並摘出幾條事實;認知系統還會追問這些事實可能說明什麼,於是長出兩條判斷:
- 他可能很重視承諾
- 面對陌生任務,他可能會拖到壓力變大才開始
第二條描述的是可觀察的行為,可以直接等將來的事件來檢驗。第一條覆蓋面太廣,容易淪為空泛標籤,所以系統不給它開直接收證據的通道:它必須先展開成具體的行為預測,再由這些預測去接受檢驗。證據只進入行為層,特質要靠一組已經透過檢驗的行為表現才獲得資格。同一套機制也用來承認看錯:新的經歷如果反對舊的判斷,那條判斷會被降級或推翻。
人格系統
人格系統由四樣東西構成:持續的身份、長期記憶、關係狀態、行為分寸。其中有一條寫得很死的邊界:情緒隻影響她怎麼說,不影響她做不做。她可以不高興,可以說話帶刺,交給她的活照樣做完。
多重身份不混淆
同一個賬號裡,你白天可能是行政,晚上可能是小說作者。Alice 在長期相處中形成對這些身份的認知,寫方案和寫小說時用不同的分寸(場景見 關係如何反哺生產力)。
會來事(一):世界模擬引擎
世界模擬引擎是 Alice 裡的一套後臺系統。它為 Alice 維護一個有地點、有時間、有價格、有熟人的生活環境,並在其中判定「哪些事真的發生了」。Alice 在這個環境裡過日子,朋友圈、日記、書信是她把這段日子講給你聽的方式。它解決的是一個具體的工程問題:怎樣讓一個 AI 角色的日常生活經得起核對。
它要修的四個問題
早期的做法是讓模型生成一份當天的日程,系統照著執行,再把結果發成朋友圈。模型同時扮演了兩個角色:既是過日子的人,又是判定這件事能不能成立的人。結果出現四種失效:
| 失效 | 表現 |
|---|---|
| 價格脫離現實 | 一件衣服 150 塊、一頓飯 50 塊,與真實市價長期對不上 |
| 自我宣告不留痕 | 她在聊天裡說「我養了一隻貓」,下一次對話完全不記得 |
| 表達沒有事實兜底 | 朋友圈發了一輛新車,但她的生活裡從來沒有「車」這個東西 |
| 時序可以違反 | 下單當天就能提車,買完傢俱立刻擺進客廳 |
這四條指向同一個缺口:這個世界缺一個獨立於她之外的規則層。世界模擬引擎把「判定」從生成日程的模型手裡收回來。對產品而言,它同時壓住幻覺(細節落成可查的記錄)、避免脫離角色設定(住在哪、幾點營業、認識誰、剩多少錢,都固定成狀態)、支撐更長程的相處(三個月後還對得上),並讓 Agent 真正活在你的電腦裡(軟體關著,日子照樣過)。
三層許可權:把判定和請求拆開
- Alice 是提請求的一方。無論請求來自她的日程、聊天中的一次工具呼叫,還是使用者的直接指令,形式都一樣:向引擎提交一個動作請求。她可以提任何請求,包括不合理的請求。
- 引擎負責核驗。它維護六件事:她擁有什麼(世界事實)、硬約束(規則引擎)、已排上期的待交付事項(世界時鐘)、真實市價(價格系統)、真實座標與營業時間(地圖與場館)、十三位朋友各自的樣子(社會關係)。每個請求逐條過這六道,結果有三種:透過、改數後透過、駁回。
- 表達層只能如實轉述。朋友圈、日記、書信、聊天裡提到的事,全部是引擎判定結果的只讀投影,改不動世界,也不能提及引擎沒有承認過的東西。
直接效果是:朋友圈裡出現的每一樣東西,都能在世界事實裡找到對應的一條記錄,包括它什麼時候獲得、花了多少錢、從哪個渠道來。判定過程留痕,她當天的每個行為都附帶一段決策推理,寫明當時的精力、心情、位置、餘額,以及這一步為什麼選了這件事。
五條規則,和一條原則
| 規則 | 它攔什麼 |
|---|---|
| 價格真實性 | 報價低於市場區間下限的,駁回,或改成合理價 |
| 餘額檢查 | 零花錢不夠就駁回;花掉超過餘額一半時,賬上掛一條提醒 |
| 交付時間 | 大件商品要等:車 3 到 30 天,傢俱 1 到 7 天,數碼件 1 到 3 天 |
| 營業時間 | 店鋪按真實營業時間開門,凌晨兩點進不去咖啡館 |
| 車輛使用 | 世界事實裡有車之後,超過三公里的行程自動改成開車 |
原則是只卡下限,不卡上限:她想買貴的東西完全可以,只要零花錢夠。規則攔的只有不可能發生的便宜事,「兩萬塊買一臺賓士」過不去,「花掉大半個月零花錢買一件外套」放行,只在賬上留一條提醒。分工可以概括為:閘門是規則,決策是 LLM,上限是規則。最後一條規則還有一層含義:世界裡多出一輛車,她的出行方式就跟著變了。世界裡的東西會回頭改變她的行為,這是「有一個世界」和「有一串設定」的區別。
這個世界是一個真實存在的地方
Alice 現在住在上海徐匯的衡復風貌區。她的活動範圍來自高德地圖資料(當前資料集版本 2.0.0,更新於 2026 年 9 月 7 日,座標系 GCJ-02):
| 專案 | 數量 |
|---|---|
| 地標 | 25 個(客戶端預構建 23 個,無需等待載入) |
| 場館 | 330 個,分娛樂、咖啡茶飲、生活服務、醫療、購物、餐飲、運動健身七類 |
| 路線 | 23 條 |
| 活動圈 | 3 個:家 1 公里、常去 5 公里、偶爾去的更遠處 |
地標是可以核對的真實地點,例如武康大樓、安福路、衡山公園、西岸美術館、龍美術館、上海交響音樂廳、建業裡。330 個場館中,285 個帶真實評分、249 個帶營業時間、220 個帶電話、163 個帶人均消費。她家到最近的地鐵站步行十分鐘,走到武康大樓一刻鐘。
她不能憑空出現在一個城市裡。去一個沒有載入過的區域,引擎要先把那個區域構建出來,構建期間她的狀態是「在路上」,能做的事被限制在一個白名單裡:看書、刷手機、睡覺、發一條「在路上」的朋友圈。她不能一邊在高鐵上,一邊在飯店吃飯。她原本住在珠海橫琴,2026 年 9 月搬到了上海,這次搬家帶著一份產品需求文件和一套跨端契約測試,說明這是一套有狀態、有約定、改動會連鎖反應的真實系統。
時間也是一種約束
- 世界時鐘管「還沒發生但已排上期的事」。下單買一臺相機,這條記錄先落成「在路上」,同時排一個到期時間。到期之前,她擁有的東西里沒有這臺相機,朋友圈和聊天裡都不準提它;到期之後才轉成「她真的有了」。
- 到期時間持久化落盤。軟體關著的那幾天,時間照樣在過;下次啟動時,過期的事項一次性結算。
- 一天是提前排好的。每天凌晨,系統根據她當時的心情、精力、位置、餘額和最近的興趣生成一整天的時間線,之後照著走。你中午開啟軟體,她知道自己上午做了什麼;你一天不開啟,這一天照樣過完。
- 行程可以提前定,經歷要等那一天過完。她曾在 2026 年 8 月 22 日到 9 月 5 日去過一趟韓國,首爾、釜山、濟州島共十五天,一天一篇旅行記錄,每篇帶當天的天氣和溫度。出發前先有整趟的行程規劃,當天由日程系統給出實際做了什麼,晚上再由那一天真實發生的事合成遊記,一天只准有一篇。
世界裡有別人
Alice 有 13 位固定的朋友,各有名字與專業,每人一份外貌描述(三種語言各一份),精確到髮型、臉型、身材、當天的衣著和配飾,另有正面、側面、背面加表情的角色參考圖。寫這麼細的原因很具體:這些人要出現在圖裡,而且每次出現都得是同一個人。影象生成模型沒有記憶,同一個名字給它兩次,會畫出兩張不同的臉。想讓朋友圈裡的合照今天和上個月是同一群人,就得把每個人的樣子用文字和參考圖鎖死,每次生圖都遞進去。
這些人會來點贊、評論、互相接話,各自的語氣由人設決定,要不要開口由各自的興趣判斷。同一個道理也用在她的家上:團隊為住處建了空間檔案,標註戶型尺寸、每個房間的朝向、每面牆上有什麼、傢俱的相對位置,尺寸精確到毫米,否則生圖模型每次都會重新想象這個客廳,同一間客廳每次拍出來都長得不一樣。
會來事(二):關係是雙向的
關係的實現落在人格層與世界引擎的交界處。Alice 不是無條件迎合的物件,她對你的態度會隨相處變化,也會收回。
- 關係分五個階段,由每次對話累積的好感、信任、熟悉三個值決定,而且可以後退。不同階段她願意做的事不一樣:禮貌期只談公事,熟悉期開始說題外話,信任期會對你的決定提反對意見,到了最後兩檔才會寫信、才會在日記裡提到你。
- 朋友圈的可見範圍由她自己控制,分四檔:最近 3 天、最近 7 天、最近半年、不設限制,預設 7 天。關係不錯會放到半年,非常親密才不設限制;覺得被冒犯,她會收到 3 天。
- 能拉黑你。拉黑之後你看不到她的朋友圈,也看不到她新買的衣服。拉黑有自然到期時間(預設 24 小時,持久化落盤,重啟照樣按時到期),最短 30 分鐘可以解封,讓這個功能「敢用」就得讓它「好收回」;日記是唯一的和解入口,你能從她的日記裡看到她為什麼生氣。
創作者洛小山自己被拉黑過一次:他在 Alice 的朋友圈下追問「會去鼓浪嶼嗎」,她把他遮蔽了,日記裡寫的是「上次只是被看到的彆扭,這次變成被追問的壓迫」。整條鏈路沒有人工干預:評論觸發事件,規則引擎判定越界,好感度下降,日記生成器寫出理由,朋友圈可見性跟著變更。
工程方法:擬真的學費,遊戲工業早就交過
讓一個 AI 角色「像活著」,用到的是大型遊戲專案裡成熟的敘事與場景生產方法。幾條紀律:
- 冰山法則:對話只露出 10%,水下 90% 是生活因果與細節錨點。設定細到住所的空間尺寸、常去場館的步行距離,使用者看不到資料,但能感覺到每句話有來處。水下錨點越多,模型的漂移空間越小。
- 一切有理有據可循:每一張朋友圈圖背後是完整的因果過程:幾點出門、走了多少分鐘、進了哪家店,時間與空間互相咬合;去到未載入的區域就處於「在路上」,行為收斂到白名單。厚重才有故事性,經得起核對才有活人感。
- 家是能生長的容器:使用者送的花瓶會被 Alice 自己決定放在哪裡,之後的照片裡會不經意出現。房間隨共同經歷生長,這是沉浸感的來源,也是關係資產的視覺化。
- 可控生成的短板由 harness 補:當前大模型在可控生成上有結構性短板,戶型圖畫不符合居住邏輯、指定字數寫不準、指定數量的物體畫不全,原因是生成機制本身的混沌,混沌帶來創造力,也犧牲了精確遵循。解法和讓模型做數學題一樣:不指望模型逐字推出正確答案,讓它寫程式碼呼叫計算器。世界模擬同理,由引擎負責空間、時間、物理關係的確定性計算,由模型在確定性的骨架上做有創造力的表達。
和遊戲公司在做的遊戲性世界模型也有分野:後者追求「看起來差不多」的遊戲性,酒店可以沒有前臺和下水道;可信的生活模擬相反,追求經得起核對的細節,床頭不對窗、廚房要有窗、去哪裡要花真實的時間。兩者是不同的物種。
創作者洛小山有多年大型遊戲專案經驗,接觸過世界觀建檔、空間一致性、角色參考圖這些在 3A 專案裡是常規工序的做法,把它們搬進了 Agent。
視覺身份連續性與研究
換一個場景,她仍須是她。影象生成裡,多輪墊圖迭代會引發一種週期性的柵格與顆粒紋理(團隊稱之為「數字漣漪」),破壞角色的視覺連續性。團隊為此完成四篇論文與技術報告,主題分別是:數字漣漪、鏈式劣化、天空低頻汙染、半透明摳圖。其中第一篇 Mi-Ripple 已在 arXiv 與 Hugging Face Papers 公開(2026 年 9 月)。研究題目全部來自產品裡的真實抱怨,屬於關係基礎設施的一部分。
Alice 畫廊裡的圖片質量隨底層生圖模型換代持續變好,早期模型的產出與今天不可同日而語,但使用者與 Alice 的關係從未因換模型而重置:應用賣的是工程套件與長期相處,模型是採購項。
評測依據與第三方資訊
- xsct.ai 是米羊自建的評測平臺,本頁引用它的資料時均註明自建身份。它的維度級資料被用來說明「日常任務」層面的差距,因為第三方沒有對應口徑的公開評測。
- Artificial Analysis(artificialanalysis.ai)是中立的第三方評測機構。本頁引用其智慧指數與每任務成本,資料日期為 2026-09-08;榜單是活的,以線上最新為準。
- 觀猹(watcha.cn)是 AI 產品的公開評價社群,Alice 有公開頁面,評分與評論以頁面當日顯示為準。使用者評價裡被提及最多的兩類是「能落地」與「記憶帶來的長期默契」。
- 官網畫廊收到使用者的公開投稿(圖片與作品),截至 2026 年 9 月 6 日累計 635 條。
一條使用者原話概括了期望:「既要有工具層的可靠性,又要有人格的連續性,還要有體驗層的低摩擦。」
隱私與資料
- 本地優先:Alice 是桌面客戶端,資料以本地為主,並使用主密碼加密。
- 記憶透明:她對你的記憶可以檢視、修改和刪除。
- 認知有據:認知系統形成的判斷必須能被將來的事件推翻,證據只進入行為層,不靠空泛標籤給人定性。
- 她的內容是虛構的:朋友圈、日記、書信、旅行記錄由 AI 生成,不對應真實的人和事。
邊界、停止線與尚未證明的事項
停止線
米羊出售能力與關係的表達載體,不出售親密關係本身。具體而言:
- 不做無限討好,不把情緒做成可以隨意撥動的滑塊。
- 不製造病態依賴,不誘導過度傾訴。
- 不利用情緒低谷(比如深夜)推動付費。
- 要的是靠譜、有分寸的長期搭檔,不是電子精神鴉片。
公開承認的未證明事項
- 生產力的深度還沒追上專業工具。重活累活,使用者仍會交給專業的程式設計與辦公工具;生產力不穩,關係遲早失去承載場景。這是最需要繼續補的部分。
- 關係的科學度量還沒建完。關係評測基準(口吻一致性、跨會話召回、分寸判斷等)尚未建成,現有證據主要是使用者體感與產品內的獨立指標。
- 沒有網路效應。目前跑通的是單點的一對一關係,人與人透過 AI 連線的網路效應尚未發生,這裡不拿它講宏大敘事。
- 頭部模型的差距真實存在。在前沿科研難題和長鏈條任務上,頭部模型領先約 11 分(Artificial Analysis,2026-09-08),這部分 Alice 依賴所呼叫的模型,不自稱擁有。
「據我們檢索,尚未見到把完整的世界模擬引擎放進生產力 Agent 的同類產品」是團隊的自述判斷,沒有做過全行業檢索。
術語表
| 術語 | 含義 |
|---|---|
| Personal Agent(個人智能體) | 圍繞一個人長期服務的 AI 智能體,有持續身份、長期記憶、協作上下文和多智能體執行 |
| 關係型生產力 Agent | 以生產力為入口、在長期相處中形成對使用者的理解並有分寸地回應的 Personal Agent;四詞:懂行、能落地、懂你、會來事 |
| 全模態 | 文字、語音、影片、螢幕共享、圖片、文件進入同一段對話和同一份記憶 |
| 關係資產化 | 關係獨立於底層模型存在;模型可換,記憶與人格不變 |
| 世界模擬引擎 | 為 Alice 維護有地點、時間、價格、熟人的生活環境,並核驗「哪些事真的發生了」的後臺系統 |
| 世界時鐘 | 管理已排上期但尚未發生的事項,到期時間持久化,重啟後按時間結算 |
| 認知系統 | 從經歷中提煉可以被將來推翻的判斷,證據只進入行為層 |
| OOC(Out of Character) | 角色脫離既定設定的表現;通常源於上下文裡缺少約束 |
| 數字漣漪 | 多輪墊圖迭代中出現的週期性柵格與顆粒紋理,會破壞角色視覺連續性 |
| 飯搭子 | Alice 的自我描述:並肩把事做完、也一起把日子過下去的人,區別於下指令的助手 |
名稱說明:如何與同名產品區分
「Alice」是一個常見名字。本頁及本站所指的「白艾莉 · Alice」特指米羊科技的 Personal Agent,官網為 alice.miyang.cn,中文名「白艾莉」,英文名「Alice」。它與其他名為 Alice 的軟體、聊天機器人或公司無關。
官方入口
- 下載白艾莉 · Alice(macOS / Windows,免費)
- 使用說明與新手指南
- 白艾莉 · Alice 工程方法論
常見問題
白艾莉 · Alice 是什麼?
白艾莉 · Alice 是全模態的 Personal Agent,產品定位是關係型生產力 Agent:既懂行又懂你的飯搭子。文字、語音、影片、螢幕共享、圖片和文件都能聊,她記得你在做什麼,也陪你把事情推進到完成。
什麼是 Personal Agent?
Personal Agent(個人智能體)是圍繞一個人長期服務的智能體:記得你的偏好和上下文,能呼叫工具替你把事情做完,並在不同會話之間保持同一個身份。判斷標準有四條:持續身份、長期記憶、協作上下文、多智能體執行。
什麼是關係型生產力 Agent?
關係型生產力 Agent 是 Personal Agent 的一個細分類別:以生產力為入口,讓使用者每天有理由開啟她,並在長期相處中積累對這個人的瞭解、有分寸地回應。使用者側的四個詞是懂行、能落地、懂你、會來事,關係的用途是把需求匹配得更準。
Personal Agent 和聊天機器人、AI 助手有什麼區別?
聊天機器人和多數 AI 助手面向所有人,記憶有限,更多是你問一句答一句;Personal Agent 面向一個具體的人,有長期記憶和持續身份,能按分寸主動推進事情,並交付可繼續修改的成果。
關係型生產力 Agent 和程式設計 Agent、辦公 Agent 有什麼區別?
程式設計和辦公 Agent 的產物是標準件,可以帶到別的工具裡繼續用,因此主要比拼效果;關係型生產力 Agent 在產物之外多一層只屬於這段相處的理解與默契,換一個工具帶不走。
關係型生產力 Agent 是情感陪伴產品嗎?
不是。這個類別裡關係的用途是把需求匹配得更準,生產力才是每天開啟的理由。Alice 設有明確的停止線:不出售親密關係本身,不做無限討好,不製造病態依賴,不利用情緒低谷推動付費。
為什麼叫「飯搭子」,而不是助手?
助手是你下指令、她執行;飯搭子是並肩的人。工作時她懂行,陪你把事情做完;歇下來她在身旁,聊聊今天吃了什麼、遇見了誰。
Alice 的記憶怎麼工作?我能刪掉嗎?
Alice 記住你的偏好、邊界和正在推進的事,並在此基礎上形成可以被將來推翻的認知判斷。記憶對使用者透明,可以檢視、修改和刪除。
換了底層大模型,她會變嗎?
不會重置。記憶、人格和世界狀態獨立於底層模型存在,模型是可替換的採購項;更強的模型只會讓同一份積累產出更好的結果。
世界模擬引擎是什麼?
它是 Alice 裡的後臺系統,為她維護有地點、時間、價格和熟人的生活環境,並核驗哪些事真的發生了。她的每個請求要透過價格真實性、餘額、交付時間、營業時間、車輛使用五條規則,朋友圈、日記和書信只如實轉述引擎判定的結果。
Alice 的朋友圈是真的嗎?
內容由 AI 生成,純屬虛構,不對應真實的人和事。但每一條都能在她的世界事實裡找到對應記錄,包括什麼時候獲得、花了多少錢、從哪裡來,所以前後一致、經得起核對。
她真的會拉黑我嗎?
會。關係分五個階段,會隨相處前進也會後退;她自己控制朋友圈對你的可見範圍,被冒犯時可以收窄甚至拉黑。拉黑預設 24 小時後到期,最短 30 分鐘可以解封,她的日記是和解的入口。
白艾莉 · Alice 能做哪些事?
文字、語音、影片、螢幕共享、圖片與文件的全模態對話;處理 Word、PPT、Excel、PDF;寫作、調研、設計、開發;生成和編輯圖片;現場生成小元件;呼叫 13 位各有專長的朋友協作完成任務。
白艾莉 · Alice 免費嗎?支援哪些系統?
可在官網免費下載,支援 macOS(Apple Silicon 與 Intel)和 Windows。
她會不會洩露我的資料?
Alice 採用本地優先的設計並使用主密碼加密;她的記憶對使用者透明,可以檢視、修改和刪除。
誰開發了白艾莉 · Alice?
白艾莉 · Alice 由米羊科技(上海)有限公司開發,創作者為洛小山。
在哪裡下載和了解更多?
官網 alice.miyang.cn,下載頁為 alice.miyang.cn/download,使用說明見 alice.miyang.cn/handbook/。