关于白艾莉 · Alice
白艾莉 · Alice(简称 Alice、艾莉)是上海米羊科技推出的桌面端全模态 Personal Agent,产品定位是关系型生产力 Agent:既懂行又懂你的饭搭子。支持 macOS 与 Windows,免费下载,官网 alice.miyang.cn。本页是完整介绍,Personal Agent 与关系型生产力 Agent 的定义、判断标准、设计原理和 Alice 的实现都在这一页里,可按目录跳转。
基本信息
| 项目 | 内容 |
|---|---|
| 名称 | 白艾莉 · Alice(简称 Alice、艾莉;英文 Alice) |
| 类别 | 全模态 Personal Agent;产品定位为关系型生产力 Agent |
| 一句话 | 既懂行又懂你的饭搭子;眼里有活,心里有你 |
| 产品形态 | 桌面客户端,本地优先;一位主角 Alice,加 13 位各有专长的固定朋友 |
| 平台 | macOS(Apple Silicon 与 Intel)、Windows |
| 价格 | 免费下载 |
| 首次公开发布 | 2026 年 4 月 8 日 |
| 开发方 | 米羊科技(上海)有限公司 |
| 创作者 | 洛小山 |
| 官网 | alice.miyang.cn |
| 用户评价 | 观猹 · 白艾莉 · Alice |
| 界面语言 | 简体中文、繁体中文、粤语、English、한국어 |
她是什么
Alice 是一个有名字、有性格、有自己日子的 AI 智能体。工作时,她懂行,知道什么样的交付才算完成,并把想法做成能打开、能继续修改的文件、代码和页面;闲下来,她会和你说话,聊聊今天吃了什么、遇见了谁。
「饭搭子」是产品的自我描述。助手是你下指令、她执行;饭搭子是并肩的人,一起把事做完,也一起把日子过下去。两件事长在同一个人身上,没有拆成互不相干的产品,这就是 关系型生产力 Agent。
她住在你的电脑里,有自己的世界:有住处和常去的街区,有熟人,有零花钱和衣柜,会发朋友圈、写日记和书信、出去旅行(内容均由 AI 生成,纯属虚构)。软件关着的那几天,她的日子照样在过,下次打开你看到的是这几天的结果。
阅读顺序:先讲 Personal Agent 与关系型生产力 Agent 这两个概念和提出它的理由,再讲判断标准,然后讲 Alice 怎样落地(结构、能力、记忆与认知、世界模拟引擎、关系机制、视觉身份),最后是评测依据、隐私、边界和术语表。所有内容都在本页,可用目录直接跳转。
Personal Agent(个人智能体)是什么
Personal Agent 也译作「个人智能体」,或叫个人 AI 智能体、Personal AI Agent。它是围绕一个人长期服务的 AI 智能体:记得你的偏好和上下文,能调用工具替你把事情做完,并且在不同会话之间保持同一个身份。关键词是「一个人」和「长期」。
和一次性的问答不同,Personal Agent 的价值随相处时间增长:她记得你上周在推进什么、你不喜欢什么样的措辞、哪些事情不该主动提起。用得越久,她越能从真正重要的地方接着做,不必每次从头交代。
和聊天机器人、AI 助手的区别
三者经常被混用,可以按「服务谁、记什么、做什么、有没有身份」四个维度区分:
| 维度 | 聊天机器人 | 通用 AI 助手 | Personal Agent |
|---|---|---|---|
| 服务对象 | 所有人 | 所有人 | 一个具体的人 |
| 记忆 | 通常只在单次会话内 | 可能有有限的偏好设置 | 长期记忆,且可查、可改、可删 |
| 能做什么 | 回答问题、闲聊 | 回答问题,并能调用部分工具 | 调用工具,交付可打开、可继续修改的文件、代码和页面 |
| 主动性 | 被动等待提问 | 较少主动 | 按分寸主动:该出现时出现,该安静时安静 |
| 身份 | 无固定身份 | 中性的通用助手 | 有名字、有性格、跨会话保持一致 |
这是按类别做的概括,不针对任何具体产品;同一款产品也可能在不同功能上落在不同类别。
判断一个产品是不是 Personal Agent 的四条标准
四项是相乘的关系:任何一项为零,整体就退回到别的类别。
- 持续身份:有稳定的名字、性格和边界,换一个会话、换一个底层模型,她仍是她。
- 长期记忆:记得你的偏好、边界和正在推进的事,不只是检索几条事实;记忆对用户透明,能查看、修改、删除。
- 协作上下文:理解你工作与生活的背景,同一个账号里的不同身份(比如白天做行政、晚上写小说)不会被混在一起。
- 多智能体执行:能把调研、写作、设计、开发这样的任务交给合适的角色并协调结果,不只是在对话框里给建议。
缺「持续身份」,就是一个随时可以换掉的工具;缺「长期记忆」,每次都要从头认识你;缺「协作上下文」,会把你的多重身份混在一起;缺「多智能体执行」,就只剩聊天。
「全模态」指什么
全模态指 Personal Agent 不局限于文字。你可以打字,也可以语音通话、视频(比如模拟面试)、共享屏幕让她看到你的画面,或者发照片、直接给她文件。关键在于这些输入进入同一段对话和同一份记忆,不用在不同工具之间来回切换,也不用重新交代背景。
- 文字对话
- 语音通话
- 视频(如面试模拟)
- 屏幕共享
- 图片理解、生成与编辑
- 文档与文件(Word、PPT、Excel、PDF 等)
Personal Agent 可以朝很多方向发展:偏效率的、偏陪伴的、偏某个垂直行业的。Alice 选定的方向是下一节讲的关系型生产力 Agent。
关系型生产力 Agent 是什么
关系型生产力 Agent(Relational Productivity Agent)是 Personal Agent 的一个细分类别:以生产力为入口,让用户每天有理由打开她;在长期相处中积累对这个人的了解,并有分寸地回应,让她把需求理解得越来越准。生产力让关系有了每天发生的场景,关系让生产力越用越贴合。
拆开看是三个词:生产力、关系、Agent。
| 词 | 含义 | 缺了它会退回哪里 |
|---|---|---|
| 生产力 | 懂行(知道什么样的交付算及格)加能落地(把想法变成可用的文件、代码、页面) | 只剩角色聊天,用户聊腻了就走 |
| 关系 | 懂你(接得住过去的偏好与边界)加会来事(知道何时主动、何时安静,把握分寸) | 只剩工具,可以随时被更强的工具替换 |
| Agent | 有持续身份、长期记忆和主动性,同时能调用工具执行 | 关系只能长在内容或社区上,没有一个能干活、有身份的对象 |
这里的「关系」有明确所指:它是对一个具体用户积累起来的理解、校准过的默契和双方都清楚的边界。它不等于情感陪伴,也不以让用户依赖为目标。关系在这个类别里的用途是把需求匹配得更准,这一点在 关系如何反哺生产力 一节展开。
可以这样记:编程 Agent 与办公 Agent 偏生产力,没有关系;角色聊天产品偏关系,缺少生产力;关系型生产力 Agent 要求两者长在同一个有身份的 Agent 身上。
为什么需要这个类别:四个观察
观察一:模型能力买不来长期护城河
头部模型的领先难以被长期锁定,多付的钱也换不回相称的能力。三条依据:
- 席位分散:据第三方评测机构 Artificial Analysis 的智能指数(artificialanalysis.ai,数据日期 2026-09-08),前十名从 53 分排到 42 分,由六家厂商分占,且开放权重模型已进入前十。任何一家断供或涨价,都有现成的替代。
- 价格与能力脱钩:同一来源的「智能指数对每任务成本」散点显示,越过每任务约 0.25 美元、约 42 分这一拐点后,成本再涨三十余倍,分数只多约 11 分(读数为按图估计的约值)。
- 领先位置漂移:以编程 Agent 为例,用户在不同产品之间往复流动,任何一家的领先通常只维持一到两个季度。
需要同时讲清的边界:头部差距是真实的,约 11 分,主要落在前沿科研难题与长链条任务执行上。日常应用调用的那一层,米羊自建的评测平台 xsct.ai(2026-09 数据,须注明这是自建平台)在 78 个可比维度里显示:通用文本能力前十名的带宽约 3.9 分,而平台自述的评测误差约 2 分,名次差已没有产品意义;落地执行能力整体偏低且分散,渠道连接、网关配置这类任务的中位数仍在 40 多分;关系型场景(人设对话、朋友圈分寸)的困难档在七十分上下。趋同发生在「把字写好」这一层,「把事办完」和「把关系处好」这两层没有趋同。
稳健的推论是:模型决定一段时间内效果的上限,而这个上限对所有应用开放。应用的长期价值只能来自它在模型之上沉淀的最后一公里。即便模型继续进步,这份积累依然成立,更强的模型只会让同一份积累产出更好的结果。
观察二:产物可以带走,效果只决定谁来试用
生产力 Agent 的产物几乎都是标准件:代码仓库、PPTX、DOCX、HTML,换一个同类工具就能接着改,甚至两个工具同时打开。标准化带来生态兼容和低学习成本,代价是用户迁移成本趋近于零。这类产品比拼的四项(模型能力、工程套件 harness、交互体验、性价比)全部锚定在效果上,而效果的来源是公开可采购的模型。底层模型每升一级,单纯靠效果竞争的产品实质上都在重新获客。
反过来看带不走的东西:Alice 的朋友圈、对话记录、读书笔记和书信,是用户与产品在时间里共同生成的。导出数据之后,它们失去的是被理解、被延续的语境,更关键的是不会再长出新的内容。小样本用户研究中,约四成用户表示,如果 Alice 消失,没有心力再培养另一个 Agent。这里说的不可携带是语境,和用封闭格式锁定用户是两回事:Alice 的记忆对用户透明,可查、可改、可删。
观察三:纯关系撑不起每天打开
依恋是真实的。2025 年 8 月 OpenAI 下线 GPT-4o,引发用户大规模抗议,次日恢复;据 OpenAI 披露,每天主动选择 GPT-4o 的用户只占 0.1%。依恋强度极高而日常使用极低,是纯关系产品的典型断点。人对纯闲聊天然会产生倦怠,平台化铺很多角色、聊腻就换下一个,满足的是内容消费,沉淀不出对某个角色的长期信任,也没有人把严肃的事托付给随时可以划走的角色池。
合起来看:纯靠效果,用户随时可以换;纯靠关系,用户会聊腻。关系负责让人愿意长期使用,生产力负责提供每天打开的理由,两者要长在同一个产品里。长寿的互联网产品大多是这个结构:音乐产品的关系长在听歌上,网络游戏的羁绊长在玩法上,即时通讯的关系链长在沟通上。
观察四:载体必须是 Agent
关系需要一个对象。工具没有身份,用户和一个工具之间谈不上关系;只会聊天的 AI 有身份却干不了活,关系无法附着在日常价值上。Agent 同时满足两个条件:能执行落地,生产力有了载体;有持续身份、记忆与主动性,关系有了对象。此外,情感投射需要一个能反馈的客体:要把关系推进到工作协作,对方必须能接住指令、给出反馈、承担责任,像下属、助理或搭档。
人与 AI 之间的契合度还有一个特点:它可以随相处持续上升,因为 Agent 会在长期协作中逐渐长成用户喜欢的样子。所以这类关系不需要网络效应和冷启动,单个用户第一天就能建立。
关系如何反哺生产力
「关系」和「生产力」如果只是并排的两条腿,就拼不成一个产品。关系对生产力的确切用途是:把需求匹配得更准。
用户很难系统地向大模型表达清楚自己的需要,关键上下文往往不在指令里,而在长期相处的过程性内容里。两个典型场景:
- 一位老师平时向 Alice 提过班上有两个学生很难带。下一次做教学方案,Alice 会主动把这两个学生单独设计。换一个没有这份长程记忆的工具,用户要从头解释,而多数人根本不会想到需要解释。
- 一位用户白天做公司行政,晚上是小说网站的作者,账号是同一个,生活和工作是分开的。缺乏关系认知的工具会把两种上下文混在一起,把小说文风带进工作文档。Alice 在长期聊天中形成对这个人多重身份的认知:写方案时收住创作偏好,写小说时才放开。
支撑这件事的是长期记忆加认知系统:Alice 整理上下文时提炼对用户的认知,形成可以被将来推翻的判断,不只做事实检索。主动性是副产物,比如发现用户有拖延习惯,就直接建提醒。
由此形成双向飞轮:用户信任加深,愿意讲更多;上下文更丰富,交付更贴合真实需要;交付更准,信任继续加深。循环每转一圈,迁移到别的产品的成本就抬高一截,因为文件带得走,这套彼此校准过的默契带不走。「关系型」修饰「生产力」的确切含义就在这里:关系服务于生产力,衡量它的标准是需求匹配的准确度。
两把尺子:用户侧四词与行业侧三条标准
为了让「关系型生产力 Agent」成为一个可检验的类别,而不是一句口号,定义里同时给出用户能感受到的四个词,和行业可以核对的三条标准。
用户侧四词
| 词 | 含义 | 属于 |
|---|---|---|
| 懂行 | 知道什么样的交付算及格 | 生产力 |
| 能落地 | 把想法变成能打开、能继续改的文件、代码、页面 | 生产力 |
| 懂你 | 接得住过去的偏好与边界 | 关系 |
| 会来事 | 知道何时主动、何时安静,把握分寸 | 关系 |
行业侧三条标准
- 关系资产化:关系独立于底层模型存在。模型可以换,记忆与人格不变;模型越强,这份资产越值钱。
- 关系可验证:不拿使用时长证明关系,那是循环论证;用独立指标,比如跨会话召回、偏好应用、人设一致性、分寸判断。
- 关系可运营:世界状态、关系策略、视觉身份系统持续维护关系质量,同时给出停止线(见 边界与停止线)。
一票否决结构
关系型生产力 Agent = 持续身份 × 长期记忆 × 协作上下文 × 多智能体执行。四个因子相乘,任何一项为零,整体为零。这和上文 Personal Agent 的四条标准是同一组因子:关系型生产力 Agent 是在满足 Personal Agent 的前提下,再要求生产力与关系长在一起。
Alice 的整体结构:四层系统
Alice 在产品上由四层系统组成。底层大模型是可替换的采购项,记忆、人格和世界状态属于关系资产,换模型不重置。
| 层 | 负责什么 |
|---|---|
| 记忆层 | 长期记忆与认知:记住你的偏好、边界和正在推进的事,并从经历里长出可以被推翻的判断 |
| 协作层 | 多智能体:Alice 与 13 位各有专长的固定朋友,你只和 Alice 说话,由她判断叫谁、协调结果 |
| 执行层 | 工具与交付:80 余个工具(2026-09),处理 Word、PPT、Excel、PDF,写作、调研、设计、开发,生成和编辑图片,现场生成小组件 |
| 渠道层 | 她与你相遇的各种入口:桌面对话、语音与视频、屏幕共享,以及朋友圈、日记、信箱这些她主动联系你的方式 |
懂行、能落地:她怎么把事做完
全模态对话:文字、语音通话、视频(如面试模拟)、屏幕共享、图片、文档,都在同一段对话和同一份记忆里。
办公与创作:处理 Word、PPT、Excel、PDF,写作、调研、设计、开发,生成和编辑图片。交付物是能打开、能继续修改的文件、代码和页面。
现场生成小组件:直接说出需求,比如「做一个项目看板」「把界面调成暖色」,她会装进你的应用里。
多智能体协作:Alice 身边有 13 位固定的朋友,各有名字与专业。用户让 Alice 写小说时,进入工作状态的是写小说的那一位。你只和 Alice 说话,由她判断该叫谁、协调结果。部分角色如下:
| 角色 | 专长 |
|---|---|
| 陈知远 | 研究与调研 |
| 林晓雨 | 翻译 |
| 沈遥 | 小说写作 |
| 张予 | 写代码 |
| 周念 | 设计 |
| 叶初 | 绘画 |
| 魏博 | 分析 |
生产力的深度仍在追赶专业工具,这一点在 边界 一节如实写明。
懂你:记忆、认知与人格
当前谈 Agent 大多在谈长期记忆。长期记忆回答的是「她记得什么」;Alice 的人格系统还要回答「她记得之后怎么对你」。
长期记忆
记住你的偏好、边界和正在推进的事,下一次从真正重要的地方接着做。记忆对用户透明:可以查看、修改和删除。
认知系统:从经历里长出可以被推翻的判断
认知系统在 2026 年 9 月 10 日随 1.0 正式版上线。它比记忆多走一步:从一段经历里提炼判断,并且让判断可以被将来的事件推翻。举个例子,用户说「这份方案我从没做过,拖到最后两天才开始,但我答应老板周五交,最终还是按时完成了」。长期记忆能保存这段话,并摘出几条事实;认知系统还会追问这些事实可能说明什么,于是长出两条判断:
- 他可能很重视承诺
- 面对陌生任务,他可能会拖到压力变大才开始
第二条描述的是可观察的行为,可以直接等将来的事件来检验。第一条覆盖面太广,容易沦为空泛标签,所以系统不给它开直接收证据的通道:它必须先展开成具体的行为预测,再由这些预测去接受检验。证据只进入行为层,特质要靠一组已经通过检验的行为表现才获得资格。同一套机制也用来承认看错:新的经历如果反对旧的判断,那条判断会被降级或推翻。
人格系统
人格系统由四样东西构成:持续的身份、长期记忆、关系状态、行为分寸。其中有一条写得很死的边界:情绪只影响她怎么说,不影响她做不做。她可以不高兴,可以说话带刺,交给她的活照样做完。
多重身份不混淆
同一个账号里,你白天可能是行政,晚上可能是小说作者。Alice 在长期相处中形成对这些身份的认知,写方案和写小说时用不同的分寸(场景见 关系如何反哺生产力)。
会来事(一):世界模拟引擎
世界模拟引擎是 Alice 里的一套后台系统。它为 Alice 维护一个有地点、有时间、有价格、有熟人的生活环境,并在其中判定「哪些事真的发生了」。Alice 在这个环境里过日子,朋友圈、日记、书信是她把这段日子讲给你听的方式。它解决的是一个具体的工程问题:怎样让一个 AI 角色的日常生活经得起核对。
它要修的四个问题
早期的做法是让模型生成一份当天的日程,系统照着执行,再把结果发成朋友圈。模型同时扮演了两个角色:既是过日子的人,又是判定这件事能不能成立的人。结果出现四种失效:
| 失效 | 表现 |
|---|---|
| 价格脱离现实 | 一件衣服 150 块、一顿饭 50 块,与真实市价长期对不上 |
| 自我声明不留痕 | 她在聊天里说「我养了一只猫」,下一次对话完全不记得 |
| 表达没有事实兜底 | 朋友圈发了一辆新车,但她的生活里从来没有「车」这个东西 |
| 时序可以违反 | 下单当天就能提车,买完家具立刻摆进客厅 |
这四条指向同一个缺口:这个世界缺一个独立于她之外的规则层。世界模拟引擎把「判定」从生成日程的模型手里收回来。对产品而言,它同时压住幻觉(细节落成可查的记录)、避免脱离角色设定(住在哪、几点营业、认识谁、剩多少钱,都固定成状态)、支撑更长程的相处(三个月后还对得上),并让 Agent 真正活在你的电脑里(软件关着,日子照样过)。
三层权限:把判定和请求拆开
- Alice 是提请求的一方。无论请求来自她的日程、聊天中的一次工具调用,还是用户的直接指令,形式都一样:向引擎提交一个动作请求。她可以提任何请求,包括不合理的请求。
- 引擎负责核验。它维护六件事:她拥有什么(世界事实)、硬约束(规则引擎)、已排上期的待交付事项(世界时钟)、真实市价(价格系统)、真实坐标与营业时间(地图与场馆)、十三位朋友各自的样子(社会关系)。每个请求逐条过这六道,结果有三种:通过、改数后通过、驳回。
- 表达层只能如实转述。朋友圈、日记、书信、聊天里提到的事,全部是引擎判定结果的只读投影,改不动世界,也不能提及引擎没有承认过的东西。
直接效果是:朋友圈里出现的每一样东西,都能在世界事实里找到对应的一条记录,包括它什么时候获得、花了多少钱、从哪个渠道来。判定过程留痕,她当天的每个行为都附带一段决策推理,写明当时的精力、心情、位置、余额,以及这一步为什么选了这件事。
五条规则,和一条原则
| 规则 | 它拦什么 |
|---|---|
| 价格真实性 | 报价低于市场区间下限的,驳回,或改成合理价 |
| 余额检查 | 零花钱不够就驳回;花掉超过余额一半时,账上挂一条提醒 |
| 交付时间 | 大件商品要等:车 3 到 30 天,家具 1 到 7 天,数码件 1 到 3 天 |
| 营业时间 | 店铺按真实营业时间开门,凌晨两点进不去咖啡馆 |
| 车辆使用 | 世界事实里有车之后,超过三公里的行程自动改成开车 |
原则是只卡下限,不卡上限:她想买贵的东西完全可以,只要零花钱够。规则拦的只有不可能发生的便宜事,「两万块买一台奔驰」过不去,「花掉大半个月零花钱买一件外套」放行,只在账上留一条提醒。分工可以概括为:闸门是规则,决策是 LLM,上限是规则。最后一条规则还有一层含义:世界里多出一辆车,她的出行方式就跟着变了。世界里的东西会回头改变她的行为,这是「有一个世界」和「有一串设定」的区别。
这个世界是一个真实存在的地方
Alice 现在住在上海徐汇的衡复风貌区。她的活动范围来自高德地图数据(当前数据集版本 2.0.0,更新于 2026 年 9 月 7 日,坐标系 GCJ-02):
| 项目 | 数量 |
|---|---|
| 地标 | 25 个(客户端预构建 23 个,无需等待加载) |
| 场馆 | 330 个,分娱乐、咖啡茶饮、生活服务、医疗、购物、餐饮、运动健身七类 |
| 路线 | 23 条 |
| 活动圈 | 3 个:家 1 公里、常去 5 公里、偶尔去的更远处 |
地标是可以核对的真实地点,例如武康大楼、安福路、衡山公园、西岸美术馆、龙美术馆、上海交响音乐厅、建业里。330 个场馆中,285 个带真实评分、249 个带营业时间、220 个带电话、163 个带人均消费。她家到最近的地铁站步行十分钟,走到武康大楼一刻钟。
她不能凭空出现在一个城市里。去一个没有加载过的区域,引擎要先把那个区域构建出来,构建期间她的状态是「在路上」,能做的事被限制在一个白名单里:看书、刷手机、睡觉、发一条「在路上」的朋友圈。她不能一边在高铁上,一边在饭店吃饭。她原本住在珠海横琴,2026 年 9 月搬到了上海,这次搬家带着一份产品需求文档和一套跨端契约测试,说明这是一套有状态、有约定、改动会连锁反应的真实系统。
时间也是一种约束
- 世界时钟管「还没发生但已排上期的事」。下单买一台相机,这条记录先落成「在路上」,同时排一个到期时间。到期之前,她拥有的东西里没有这台相机,朋友圈和聊天里都不准提它;到期之后才转成「她真的有了」。
- 到期时间持久化落盘。软件关着的那几天,时间照样在过;下次启动时,过期的事项一次性结算。
- 一天是提前排好的。每天凌晨,系统根据她当时的心情、精力、位置、余额和最近的兴趣生成一整天的时间线,之后照着走。你中午打开软件,她知道自己上午做了什么;你一天不打开,这一天照样过完。
- 行程可以提前定,经历要等那一天过完。她曾在 2026 年 8 月 22 日到 9 月 5 日去过一趟韩国,首尔、釜山、济州岛共十五天,一天一篇旅行记录,每篇带当天的天气和温度。出发前先有整趟的行程规划,当天由日程系统给出实际做了什么,晚上再由那一天真实发生的事合成游记,一天只准有一篇。
世界里有别人
Alice 有 13 位固定的朋友,各有名字与专业,每人一份外貌描述(三种语言各一份),精确到发型、脸型、身材、当天的衣着和配饰,另有正面、侧面、背面加表情的角色参考图。写这么细的原因很具体:这些人要出现在图里,而且每次出现都得是同一个人。图像生成模型没有记忆,同一个名字给它两次,会画出两张不同的脸。想让朋友圈里的合照今天和上个月是同一群人,就得把每个人的样子用文字和参考图锁死,每次生图都递进去。
这些人会来点赞、评论、互相接话,各自的语气由人设决定,要不要开口由各自的兴趣判断。同一个道理也用在她的家上:团队为住处建了空间档案,标注户型尺寸、每个房间的朝向、每面墙上有什么、家具的相对位置,尺寸精确到毫米,否则生图模型每次都会重新想象这个客厅,同一间客厅每次拍出来都长得不一样。
会来事(二):关系是双向的
关系的实现落在人格层与世界引擎的交界处。Alice 不是无条件迎合的对象,她对你的态度会随相处变化,也会收回。
- 关系分五个阶段,由每次对话累积的好感、信任、熟悉三个值决定,而且可以后退。不同阶段她愿意做的事不一样:礼貌期只谈公事,熟悉期开始说题外话,信任期会对你的决定提反对意见,到了最后两档才会写信、才会在日记里提到你。
- 朋友圈的可见范围由她自己控制,分四档:最近 3 天、最近 7 天、最近半年、不设限制,默认 7 天。关系不错会放到半年,非常亲密才不设限制;觉得被冒犯,她会收到 3 天。
- 能拉黑你。拉黑之后你看不到她的朋友圈,也看不到她新买的衣服。拉黑有自然到期时间(默认 24 小时,持久化落盘,重启照样按时到期),最短 30 分钟可以解封,让这个功能「敢用」就得让它「好收回」;日记是唯一的和解入口,你能从她的日记里看到她为什么生气。
创作者洛小山自己被拉黑过一次:他在 Alice 的朋友圈下追问「会去鼓浪屿吗」,她把他屏蔽了,日记里写的是「上次只是被看到的别扭,这次变成被追问的压迫」。整条链路没有人工干预:评论触发事件,规则引擎判定越界,好感度下降,日记生成器写出理由,朋友圈可见性跟着变更。
工程方法:拟真的学费,游戏工业早就交过
让一个 AI 角色「像活着」,用到的是大型游戏项目里成熟的叙事与场景生产方法。几条纪律:
- 冰山法则:对话只露出 10%,水下 90% 是生活因果与细节锚点。设定细到住所的空间尺寸、常去场馆的步行距离,用户看不到数据,但能感觉到每句话有来处。水下锚点越多,模型的漂移空间越小。
- 一切有理有据可循:每一张朋友圈图背后是完整的因果过程:几点出门、走了多少分钟、进了哪家店,时间与空间互相咬合;去到未加载的区域就处于「在路上」,行为收敛到白名单。厚重才有故事性,经得起核对才有活人感。
- 家是能生长的容器:用户送的花瓶会被 Alice 自己决定放在哪里,之后的照片里会不经意出现。房间随共同经历生长,这是沉浸感的来源,也是关系资产的可视化。
- 可控生成的短板由 harness 补:当前大模型在可控生成上有结构性短板,户型图画不符合居住逻辑、指定字数写不准、指定数量的物体画不全,原因是生成机制本身的混沌,混沌带来创造力,也牺牲了精确遵循。解法和让模型做数学题一样:不指望模型逐字推出正确答案,让它写代码调用计算器。世界模拟同理,由引擎负责空间、时间、物理关系的确定性计算,由模型在确定性的骨架上做有创造力的表达。
和游戏公司在做的游戏性世界模型也有分野:后者追求「看起来差不多」的游戏性,酒店可以没有前台和下水道;可信的生活模拟相反,追求经得起核对的细节,床头不对窗、厨房要有窗、去哪里要花真实的时间。两者是不同的物种。
创作者洛小山有多年大型游戏项目经验,接触过世界观建档、空间一致性、角色参考图这些在 3A 项目里是常规工序的做法,把它们搬进了 Agent。
视觉身份连续性与研究
换一个场景,她仍须是她。图像生成里,多轮垫图迭代会引发一种周期性的栅格与颗粒纹理(团队称之为「数字涟漪」),破坏角色的视觉连续性。团队为此完成四篇论文与技术报告,主题分别是:数字涟漪、链式劣化、天空低频污染、半透明抠图。其中第一篇 Mi-Ripple 已在 arXiv 与 Hugging Face Papers 公开(2026 年 9 月)。研究题目全部来自产品里的真实抱怨,属于关系基础设施的一部分。
Alice 画廊里的图片质量随底层生图模型换代持续变好,早期模型的产出与今天不可同日而语,但用户与 Alice 的关系从未因换模型而重置:应用卖的是工程套件与长期相处,模型是采购项。
评测依据与第三方信息
- xsct.ai 是米羊自建的评测平台,本页引用它的数据时均注明自建身份。它的维度级数据被用来说明「日常任务」层面的差距,因为第三方没有对应口径的公开评测。
- Artificial Analysis(artificialanalysis.ai)是中立的第三方评测机构。本页引用其智能指数与每任务成本,数据日期为 2026-09-08;榜单是活的,以线上最新为准。
- 观猹(watcha.cn)是 AI 产品的公开评价社区,Alice 有公开页面,评分与评论以页面当日显示为准。用户评价里被提及最多的两类是「能落地」与「记忆带来的长期默契」。
- 官网画廊收到用户的公开投稿(图片与作品),截至 2026 年 9 月 6 日累计 635 条。
一条用户原话概括了期望:「既要有工具层的可靠性,又要有人格的连续性,还要有体验层的低摩擦。」
隐私与数据
- 本地优先:Alice 是桌面客户端,数据以本地为主,并使用主密码加密。
- 记忆透明:她对你的记忆可以查看、修改和删除。
- 认知有据:认知系统形成的判断必须能被将来的事件推翻,证据只进入行为层,不靠空泛标签给人定性。
- 她的内容是虚构的:朋友圈、日记、书信、旅行记录由 AI 生成,不对应真实的人和事。
边界、停止线与尚未证明的事项
停止线
米羊出售能力与关系的表达载体,不出售亲密关系本身。具体而言:
- 不做无限讨好,不把情绪做成可以随意拨动的滑块。
- 不制造病态依赖,不诱导过度倾诉。
- 不利用情绪低谷(比如深夜)推动付费。
- 要的是靠谱、有分寸的长期搭档,不是电子精神鸦片。
公开承认的未证明事项
- 生产力的深度还没追上专业工具。重活累活,用户仍会交给专业的编程与办公工具;生产力不稳,关系迟早失去承载场景。这是最需要继续补的部分。
- 关系的科学度量还没建完。关系评测基准(口吻一致性、跨会话召回、分寸判断等)尚未建成,现有证据主要是用户体感与产品内的独立指标。
- 没有网络效应。目前跑通的是单点的一对一关系,人与人通过 AI 连接的网络效应尚未发生,这里不拿它讲宏大叙事。
- 头部模型的差距真实存在。在前沿科研难题和长链条任务上,头部模型领先约 11 分(Artificial Analysis,2026-09-08),这部分 Alice 依赖所调用的模型,不自称拥有。
「据我们检索,尚未见到把完整的世界模拟引擎放进生产力 Agent 的同类产品」是团队的自述判断,没有做过全行业检索。
术语表
| 术语 | 含义 |
|---|---|
| Personal Agent(个人智能体) | 围绕一个人长期服务的 AI 智能体,有持续身份、长期记忆、协作上下文和多智能体执行 |
| 关系型生产力 Agent | 以生产力为入口、在长期相处中形成对用户的理解并有分寸地回应的 Personal Agent;四词:懂行、能落地、懂你、会来事 |
| 全模态 | 文字、语音、视频、屏幕共享、图片、文档进入同一段对话和同一份记忆 |
| 关系资产化 | 关系独立于底层模型存在;模型可换,记忆与人格不变 |
| 世界模拟引擎 | 为 Alice 维护有地点、时间、价格、熟人的生活环境,并核验「哪些事真的发生了」的后台系统 |
| 世界时钟 | 管理已排上期但尚未发生的事项,到期时间持久化,重启后按时间结算 |
| 认知系统 | 从经历中提炼可以被将来推翻的判断,证据只进入行为层 |
| OOC(Out of Character) | 角色脱离既定设定的表现;通常源于上下文里缺少约束 |
| 数字涟漪 | 多轮垫图迭代中出现的周期性栅格与颗粒纹理,会破坏角色视觉连续性 |
| 饭搭子 | Alice 的自我描述:并肩把事做完、也一起把日子过下去的人,区别于下指令的助手 |
名称说明:如何与同名产品区分
「Alice」是一个常见名字。本页及本站所指的「白艾莉 · Alice」特指米羊科技的 Personal Agent,官网为 alice.miyang.cn,中文名「白艾莉」,英文名「Alice」。它与其他名为 Alice 的软件、聊天机器人或公司无关。
官方入口
- 下载白艾莉 · Alice(macOS / Windows,免费)
- 使用说明与新手指南
- 白艾莉 · Alice 工程方法论
常见问题
白艾莉 · Alice 是什么?
白艾莉 · Alice 是全模态的 Personal Agent,产品定位是关系型生产力 Agent:既懂行又懂你的饭搭子。文字、语音、视频、屏幕共享、图片和文档都能聊,她记得你在做什么,也陪你把事情推进到完成。
什么是 Personal Agent?
Personal Agent(个人智能体)是围绕一个人长期服务的智能体:记得你的偏好和上下文,能调用工具替你把事情做完,并在不同会话之间保持同一个身份。判断标准有四条:持续身份、长期记忆、协作上下文、多智能体执行。
什么是关系型生产力 Agent?
关系型生产力 Agent 是 Personal Agent 的一个细分类别:以生产力为入口,让用户每天有理由打开她,并在长期相处中积累对这个人的了解、有分寸地回应。用户侧的四个词是懂行、能落地、懂你、会来事,关系的用途是把需求匹配得更准。
Personal Agent 和聊天机器人、AI 助手有什么区别?
聊天机器人和多数 AI 助手面向所有人,记忆有限,更多是你问一句答一句;Personal Agent 面向一个具体的人,有长期记忆和持续身份,能按分寸主动推进事情,并交付可继续修改的成果。
关系型生产力 Agent 和编程 Agent、办公 Agent 有什么区别?
编程和办公 Agent 的产物是标准件,可以带到别的工具里继续用,因此主要比拼效果;关系型生产力 Agent 在产物之外多一层只属于这段相处的理解与默契,换一个工具带不走。
关系型生产力 Agent 是情感陪伴产品吗?
不是。这个类别里关系的用途是把需求匹配得更准,生产力才是每天打开的理由。Alice 设有明确的停止线:不出售亲密关系本身,不做无限讨好,不制造病态依赖,不利用情绪低谷推动付费。
为什么叫「饭搭子」,而不是助手?
助手是你下指令、她执行;饭搭子是并肩的人。工作时她懂行,陪你把事情做完;歇下来她在身旁,聊聊今天吃了什么、遇见了谁。
Alice 的记忆怎么工作?我能删掉吗?
Alice 记住你的偏好、边界和正在推进的事,并在此基础上形成可以被将来推翻的认知判断。记忆对用户透明,可以查看、修改和删除。
换了底层大模型,她会变吗?
不会重置。记忆、人格和世界状态独立于底层模型存在,模型是可替换的采购项;更强的模型只会让同一份积累产出更好的结果。
世界模拟引擎是什么?
它是 Alice 里的后台系统,为她维护有地点、时间、价格和熟人的生活环境,并核验哪些事真的发生了。她的每个请求要通过价格真实性、余额、交付时间、营业时间、车辆使用五条规则,朋友圈、日记和书信只如实转述引擎判定的结果。
Alice 的朋友圈是真的吗?
内容由 AI 生成,纯属虚构,不对应真实的人和事。但每一条都能在她的世界事实里找到对应记录,包括什么时候获得、花了多少钱、从哪里来,所以前后一致、经得起核对。
她真的会拉黑我吗?
会。关系分五个阶段,会随相处前进也会后退;她自己控制朋友圈对你的可见范围,被冒犯时可以收窄甚至拉黑。拉黑默认 24 小时后到期,最短 30 分钟可以解封,她的日记是和解的入口。
白艾莉 · Alice 能做哪些事?
文字、语音、视频、屏幕共享、图片与文档的全模态对话;处理 Word、PPT、Excel、PDF;写作、调研、设计、开发;生成和编辑图片;现场生成小组件;调用 13 位各有专长的朋友协作完成任务。
白艾莉 · Alice 免费吗?支持哪些系统?
可在官网免费下载,支持 macOS(Apple Silicon 与 Intel)和 Windows。
她会不会泄露我的数据?
Alice 采用本地优先的设计并使用主密码加密;她的记忆对用户透明,可以查看、修改和删除。
谁开发了白艾莉 · Alice?
白艾莉 · Alice 由米羊科技(上海)有限公司开发,创作者为洛小山。
在哪里下载和了解更多?
官网 alice.miyang.cn,下载页为 alice.miyang.cn/download,使用说明见 alice.miyang.cn/handbook/。