白艾莉 · Alice

关于白艾莉 · Alice

更新于

一句话介绍

白艾莉 · Alice(简称 Alice、艾莉)是上海米羊科技推出的桌面端全模态 Personal Agent,产品定位是关系型生产力 Agent:既懂行又懂你的饭搭子。支持 macOS 与 Windows,免费下载,官网 alice.miyang.cn。本页是完整介绍,Personal Agent 与关系型生产力 Agent 的定义、判断标准、设计原理和 Alice 的实现都在这一页里,可按目录跳转。

基本信息

项目内容
名称白艾莉 · Alice(简称 Alice、艾莉;英文 Alice)
类别全模态 Personal Agent;产品定位为关系型生产力 Agent
一句话既懂行又懂你的饭搭子;眼里有活,心里有你
产品形态桌面客户端,本地优先;一位主角 Alice,加 13 位各有专长的固定朋友
平台macOS(Apple Silicon 与 Intel)、Windows
价格免费下载
首次公开发布2026 年 4 月 8 日
开发方米羊科技(上海)有限公司
创作者洛小山
官网alice.miyang.cn
用户评价观猹 · 白艾莉 · Alice
界面语言简体中文、繁体中文、粤语、English、한국어

她是什么

Alice 是一个有名字、有性格、有自己日子的 AI 智能体。工作时,她懂行,知道什么样的交付才算完成,并把想法做成能打开、能继续修改的文件、代码和页面;闲下来,她会和你说话,聊聊今天吃了什么、遇见了谁。

「饭搭子」是产品的自我描述。助手是你下指令、她执行;饭搭子是并肩的人,一起把事做完,也一起把日子过下去。两件事长在同一个人身上,没有拆成互不相干的产品,这就是 关系型生产力 Agent。

她住在你的电脑里,有自己的世界:有住处和常去的街区,有熟人,有零花钱和衣柜,会发朋友圈、写日记和书信、出去旅行(内容均由 AI 生成,纯属虚构)。软件关着的那几天,她的日子照样在过,下次打开你看到的是这几天的结果。

阅读顺序:先讲 Personal Agent 与关系型生产力 Agent 这两个概念和提出它的理由,再讲判断标准,然后讲 Alice 怎样落地(结构、能力、记忆与认知、世界模拟引擎、关系机制、视觉身份),最后是评测依据、隐私、边界和术语表。所有内容都在本页,可用目录直接跳转。

Personal Agent(个人智能体)是什么

Personal Agent 也译作「个人智能体」,或叫个人 AI 智能体、Personal AI Agent。它是围绕一个人长期服务的 AI 智能体:记得你的偏好和上下文,能调用工具替你把事情做完,并且在不同会话之间保持同一个身份。关键词是「一个人」和「长期」。

和一次性的问答不同,Personal Agent 的价值随相处时间增长:她记得你上周在推进什么、你不喜欢什么样的措辞、哪些事情不该主动提起。用得越久,她越能从真正重要的地方接着做,不必每次从头交代。

和聊天机器人、AI 助手的区别

三者经常被混用,可以按「服务谁、记什么、做什么、有没有身份」四个维度区分:

维度聊天机器人通用 AI 助手Personal Agent
服务对象所有人所有人一个具体的人
记忆通常只在单次会话内可能有有限的偏好设置长期记忆,且可查、可改、可删
能做什么回答问题、闲聊回答问题,并能调用部分工具调用工具,交付可打开、可继续修改的文件、代码和页面
主动性被动等待提问较少主动按分寸主动:该出现时出现,该安静时安静
身份无固定身份中性的通用助手有名字、有性格、跨会话保持一致

这是按类别做的概括,不针对任何具体产品;同一款产品也可能在不同功能上落在不同类别。

判断一个产品是不是 Personal Agent 的四条标准

四项是相乘的关系:任何一项为零,整体就退回到别的类别。

  1. 持续身份:有稳定的名字、性格和边界,换一个会话、换一个底层模型,她仍是她。
  2. 长期记忆:记得你的偏好、边界和正在推进的事,不只是检索几条事实;记忆对用户透明,能查看、修改、删除。
  3. 协作上下文:理解你工作与生活的背景,同一个账号里的不同身份(比如白天做行政、晚上写小说)不会被混在一起。
  4. 多智能体执行:能把调研、写作、设计、开发这样的任务交给合适的角色并协调结果,不只是在对话框里给建议。

缺「持续身份」,就是一个随时可以换掉的工具;缺「长期记忆」,每次都要从头认识你;缺「协作上下文」,会把你的多重身份混在一起;缺「多智能体执行」,就只剩聊天。

「全模态」指什么

全模态指 Personal Agent 不局限于文字。你可以打字,也可以语音通话、视频(比如模拟面试)、共享屏幕让她看到你的画面,或者发照片、直接给她文件。关键在于这些输入进入同一段对话和同一份记忆,不用在不同工具之间来回切换,也不用重新交代背景。

  • 文字对话
  • 语音通话
  • 视频(如面试模拟)
  • 屏幕共享
  • 图片理解、生成与编辑
  • 文档与文件(Word、PPT、Excel、PDF 等)

Personal Agent 可以朝很多方向发展:偏效率的、偏陪伴的、偏某个垂直行业的。Alice 选定的方向是下一节讲的关系型生产力 Agent。

关系型生产力 Agent 是什么

关系型生产力 Agent(Relational Productivity Agent)是 Personal Agent 的一个细分类别:以生产力为入口,让用户每天有理由打开她;在长期相处中积累对这个人的了解,并有分寸地回应,让她把需求理解得越来越准。生产力让关系有了每天发生的场景,关系让生产力越用越贴合。

拆开看是三个词:生产力、关系、Agent。

词含义缺了它会退回哪里
生产力懂行(知道什么样的交付算及格)加能落地(把想法变成可用的文件、代码、页面)只剩角色聊天,用户聊腻了就走
关系懂你(接得住过去的偏好与边界)加会来事(知道何时主动、何时安静,把握分寸)只剩工具,可以随时被更强的工具替换
Agent有持续身份、长期记忆和主动性,同时能调用工具执行关系只能长在内容或社区上,没有一个能干活、有身份的对象

这里的「关系」有明确所指:它是对一个具体用户积累起来的理解、校准过的默契和双方都清楚的边界。它不等于情感陪伴,也不以让用户依赖为目标。关系在这个类别里的用途是把需求匹配得更准,这一点在 关系如何反哺生产力 一节展开。

可以这样记:编程 Agent 与办公 Agent 偏生产力,没有关系;角色聊天产品偏关系,缺少生产力;关系型生产力 Agent 要求两者长在同一个有身份的 Agent 身上。

为什么需要这个类别:四个观察

观察一:模型能力买不来长期护城河

头部模型的领先难以被长期锁定,多付的钱也换不回相称的能力。三条依据:

  • 席位分散:据第三方评测机构 Artificial Analysis 的智能指数(artificialanalysis.ai,数据日期 2026-09-08),前十名从 53 分排到 42 分,由六家厂商分占,且开放权重模型已进入前十。任何一家断供或涨价,都有现成的替代。
  • 价格与能力脱钩:同一来源的「智能指数对每任务成本」散点显示,越过每任务约 0.25 美元、约 42 分这一拐点后,成本再涨三十余倍,分数只多约 11 分(读数为按图估计的约值)。
  • 领先位置漂移:以编程 Agent 为例,用户在不同产品之间往复流动,任何一家的领先通常只维持一到两个季度。

需要同时讲清的边界:头部差距是真实的,约 11 分,主要落在前沿科研难题与长链条任务执行上。日常应用调用的那一层,米羊自建的评测平台 xsct.ai(2026-09 数据,须注明这是自建平台)在 78 个可比维度里显示:通用文本能力前十名的带宽约 3.9 分,而平台自述的评测误差约 2 分,名次差已没有产品意义;落地执行能力整体偏低且分散,渠道连接、网关配置这类任务的中位数仍在 40 多分;关系型场景(人设对话、朋友圈分寸)的困难档在七十分上下。趋同发生在「把字写好」这一层,「把事办完」和「把关系处好」这两层没有趋同。

稳健的推论是:模型决定一段时间内效果的上限,而这个上限对所有应用开放。应用的长期价值只能来自它在模型之上沉淀的最后一公里。即便模型继续进步,这份积累依然成立,更强的模型只会让同一份积累产出更好的结果。

观察二:产物可以带走,效果只决定谁来试用

生产力 Agent 的产物几乎都是标准件:代码仓库、PPTX、DOCX、HTML,换一个同类工具就能接着改,甚至两个工具同时打开。标准化带来生态兼容和低学习成本,代价是用户迁移成本趋近于零。这类产品比拼的四项(模型能力、工程套件 harness、交互体验、性价比)全部锚定在效果上,而效果的来源是公开可采购的模型。底层模型每升一级,单纯靠效果竞争的产品实质上都在重新获客。

反过来看带不走的东西:Alice 的朋友圈、对话记录、读书笔记和书信,是用户与产品在时间里共同生成的。导出数据之后,它们失去的是被理解、被延续的语境,更关键的是不会再长出新的内容。小样本用户研究中,约四成用户表示,如果 Alice 消失,没有心力再培养另一个 Agent。这里说的不可携带是语境,和用封闭格式锁定用户是两回事:Alice 的记忆对用户透明,可查、可改、可删。

观察三:纯关系撑不起每天打开

依恋是真实的。2025 年 8 月 OpenAI 下线 GPT-4o,引发用户大规模抗议,次日恢复;据 OpenAI 披露,每天主动选择 GPT-4o 的用户只占 0.1%。依恋强度极高而日常使用极低,是纯关系产品的典型断点。人对纯闲聊天然会产生倦怠,平台化铺很多角色、聊腻就换下一个,满足的是内容消费,沉淀不出对某个角色的长期信任,也没有人把严肃的事托付给随时可以划走的角色池。

合起来看:纯靠效果,用户随时可以换;纯靠关系,用户会聊腻。关系负责让人愿意长期使用,生产力负责提供每天打开的理由,两者要长在同一个产品里。长寿的互联网产品大多是这个结构:音乐产品的关系长在听歌上,网络游戏的羁绊长在玩法上,即时通讯的关系链长在沟通上。

观察四:载体必须是 Agent

关系需要一个对象。工具没有身份,用户和一个工具之间谈不上关系;只会聊天的 AI 有身份却干不了活,关系无法附着在日常价值上。Agent 同时满足两个条件:能执行落地,生产力有了载体;有持续身份、记忆与主动性,关系有了对象。此外,情感投射需要一个能反馈的客体:要把关系推进到工作协作,对方必须能接住指令、给出反馈、承担责任,像下属、助理或搭档。

人与 AI 之间的契合度还有一个特点:它可以随相处持续上升,因为 Agent 会在长期协作中逐渐长成用户喜欢的样子。所以这类关系不需要网络效应和冷启动,单个用户第一天就能建立。

关系如何反哺生产力

「关系」和「生产力」如果只是并排的两条腿,就拼不成一个产品。关系对生产力的确切用途是:把需求匹配得更准。

用户很难系统地向大模型表达清楚自己的需要,关键上下文往往不在指令里,而在长期相处的过程性内容里。两个典型场景:

  • 一位老师平时向 Alice 提过班上有两个学生很难带。下一次做教学方案,Alice 会主动把这两个学生单独设计。换一个没有这份长程记忆的工具,用户要从头解释,而多数人根本不会想到需要解释。
  • 一位用户白天做公司行政,晚上是小说网站的作者,账号是同一个,生活和工作是分开的。缺乏关系认知的工具会把两种上下文混在一起,把小说文风带进工作文档。Alice 在长期聊天中形成对这个人多重身份的认知:写方案时收住创作偏好,写小说时才放开。

支撑这件事的是长期记忆加认知系统:Alice 整理上下文时提炼对用户的认知,形成可以被将来推翻的判断,不只做事实检索。主动性是副产物,比如发现用户有拖延习惯,就直接建提醒。

由此形成双向飞轮:用户信任加深,愿意讲更多;上下文更丰富,交付更贴合真实需要;交付更准,信任继续加深。循环每转一圈,迁移到别的产品的成本就抬高一截,因为文件带得走,这套彼此校准过的默契带不走。「关系型」修饰「生产力」的确切含义就在这里:关系服务于生产力,衡量它的标准是需求匹配的准确度。

两把尺子:用户侧四词与行业侧三条标准

为了让「关系型生产力 Agent」成为一个可检验的类别,而不是一句口号,定义里同时给出用户能感受到的四个词,和行业可以核对的三条标准。

用户侧四词

词含义属于
懂行知道什么样的交付算及格生产力
能落地把想法变成能打开、能继续改的文件、代码、页面生产力
懂你接得住过去的偏好与边界关系
会来事知道何时主动、何时安静,把握分寸关系

行业侧三条标准

  1. 关系资产化:关系独立于底层模型存在。模型可以换,记忆与人格不变;模型越强,这份资产越值钱。
  2. 关系可验证:不拿使用时长证明关系,那是循环论证;用独立指标,比如跨会话召回、偏好应用、人设一致性、分寸判断。
  3. 关系可运营:世界状态、关系策略、视觉身份系统持续维护关系质量,同时给出停止线(见 边界与停止线)。

一票否决结构

关系型生产力 Agent = 持续身份 × 长期记忆 × 协作上下文 × 多智能体执行。四个因子相乘,任何一项为零,整体为零。这和上文 Personal Agent 的四条标准是同一组因子:关系型生产力 Agent 是在满足 Personal Agent 的前提下,再要求生产力与关系长在一起。

Alice 的整体结构:四层系统

Alice 在产品上由四层系统组成。底层大模型是可替换的采购项,记忆、人格和世界状态属于关系资产,换模型不重置。

层负责什么
记忆层长期记忆与认知:记住你的偏好、边界和正在推进的事,并从经历里长出可以被推翻的判断
协作层多智能体:Alice 与 13 位各有专长的固定朋友,你只和 Alice 说话,由她判断叫谁、协调结果
执行层工具与交付:80 余个工具(2026-09),处理 Word、PPT、Excel、PDF,写作、调研、设计、开发,生成和编辑图片,现场生成小组件
渠道层她与你相遇的各种入口:桌面对话、语音与视频、屏幕共享,以及朋友圈、日记、信箱这些她主动联系你的方式

在这四层之上,还有两套把「懂你」和「会来事」做扎实的系统:人格与认知(见 懂你),世界模拟引擎(见 会来事)。

懂行、能落地:她怎么把事做完

全模态对话:文字、语音通话、视频(如面试模拟)、屏幕共享、图片、文档,都在同一段对话和同一份记忆里。

办公与创作:处理 Word、PPT、Excel、PDF,写作、调研、设计、开发,生成和编辑图片。交付物是能打开、能继续修改的文件、代码和页面。

现场生成小组件:直接说出需求,比如「做一个项目看板」「把界面调成暖色」,她会装进你的应用里。

多智能体协作:Alice 身边有 13 位固定的朋友,各有名字与专业。用户让 Alice 写小说时,进入工作状态的是写小说的那一位。你只和 Alice 说话,由她判断该叫谁、协调结果。部分角色如下:

角色专长
陈知远研究与调研
林晓雨翻译
沈遥小说写作
张予写代码
周念设计
叶初绘画
魏博分析

生产力的深度仍在追赶专业工具,这一点在 边界 一节如实写明。

懂你:记忆、认知与人格

当前谈 Agent 大多在谈长期记忆。长期记忆回答的是「她记得什么」;Alice 的人格系统还要回答「她记得之后怎么对你」。

长期记忆

记住你的偏好、边界和正在推进的事,下一次从真正重要的地方接着做。记忆对用户透明:可以查看、修改和删除。

认知系统:从经历里长出可以被推翻的判断

认知系统在 2026 年 9 月 10 日随 1.0 正式版上线。它比记忆多走一步:从一段经历里提炼判断,并且让判断可以被将来的事件推翻。举个例子,用户说「这份方案我从没做过,拖到最后两天才开始,但我答应老板周五交,最终还是按时完成了」。长期记忆能保存这段话,并摘出几条事实;认知系统还会追问这些事实可能说明什么,于是长出两条判断:

  • 他可能很重视承诺
  • 面对陌生任务,他可能会拖到压力变大才开始

第二条描述的是可观察的行为,可以直接等将来的事件来检验。第一条覆盖面太广,容易沦为空泛标签,所以系统不给它开直接收证据的通道:它必须先展开成具体的行为预测,再由这些预测去接受检验。证据只进入行为层,特质要靠一组已经通过检验的行为表现才获得资格。同一套机制也用来承认看错:新的经历如果反对旧的判断,那条判断会被降级或推翻。

人格系统

人格系统由四样东西构成:持续的身份、长期记忆、关系状态、行为分寸。其中有一条写得很死的边界:情绪只影响她怎么说,不影响她做不做。她可以不高兴,可以说话带刺,交给她的活照样做完。

多重身份不混淆

同一个账号里,你白天可能是行政,晚上可能是小说作者。Alice 在长期相处中形成对这些身份的认知,写方案和写小说时用不同的分寸(场景见 关系如何反哺生产力)。

会来事(一):世界模拟引擎

世界模拟引擎是 Alice 里的一套后台系统。它为 Alice 维护一个有地点、有时间、有价格、有熟人的生活环境,并在其中判定「哪些事真的发生了」。Alice 在这个环境里过日子,朋友圈、日记、书信是她把这段日子讲给你听的方式。它解决的是一个具体的工程问题:怎样让一个 AI 角色的日常生活经得起核对。

它要修的四个问题

早期的做法是让模型生成一份当天的日程,系统照着执行,再把结果发成朋友圈。模型同时扮演了两个角色:既是过日子的人,又是判定这件事能不能成立的人。结果出现四种失效:

失效表现
价格脱离现实一件衣服 150 块、一顿饭 50 块,与真实市价长期对不上
自我声明不留痕她在聊天里说「我养了一只猫」,下一次对话完全不记得
表达没有事实兜底朋友圈发了一辆新车,但她的生活里从来没有「车」这个东西
时序可以违反下单当天就能提车,买完家具立刻摆进客厅

这四条指向同一个缺口:这个世界缺一个独立于她之外的规则层。世界模拟引擎把「判定」从生成日程的模型手里收回来。对产品而言,它同时压住幻觉(细节落成可查的记录)、避免脱离角色设定(住在哪、几点营业、认识谁、剩多少钱,都固定成状态)、支撑更长程的相处(三个月后还对得上),并让 Agent 真正活在你的电脑里(软件关着,日子照样过)。

三层权限:把判定和请求拆开

  • Alice 是提请求的一方。无论请求来自她的日程、聊天中的一次工具调用,还是用户的直接指令,形式都一样:向引擎提交一个动作请求。她可以提任何请求,包括不合理的请求。
  • 引擎负责核验。它维护六件事:她拥有什么(世界事实)、硬约束(规则引擎)、已排上期的待交付事项(世界时钟)、真实市价(价格系统)、真实坐标与营业时间(地图与场馆)、十三位朋友各自的样子(社会关系)。每个请求逐条过这六道,结果有三种:通过、改数后通过、驳回。
  • 表达层只能如实转述。朋友圈、日记、书信、聊天里提到的事,全部是引擎判定结果的只读投影,改不动世界,也不能提及引擎没有承认过的东西。

直接效果是:朋友圈里出现的每一样东西,都能在世界事实里找到对应的一条记录,包括它什么时候获得、花了多少钱、从哪个渠道来。判定过程留痕,她当天的每个行为都附带一段决策推理,写明当时的精力、心情、位置、余额,以及这一步为什么选了这件事。

五条规则,和一条原则

规则它拦什么
价格真实性报价低于市场区间下限的,驳回,或改成合理价
余额检查零花钱不够就驳回;花掉超过余额一半时,账上挂一条提醒
交付时间大件商品要等:车 3 到 30 天,家具 1 到 7 天,数码件 1 到 3 天
营业时间店铺按真实营业时间开门,凌晨两点进不去咖啡馆
车辆使用世界事实里有车之后,超过三公里的行程自动改成开车

原则是只卡下限,不卡上限:她想买贵的东西完全可以,只要零花钱够。规则拦的只有不可能发生的便宜事,「两万块买一台奔驰」过不去,「花掉大半个月零花钱买一件外套」放行,只在账上留一条提醒。分工可以概括为:闸门是规则,决策是 LLM,上限是规则。最后一条规则还有一层含义:世界里多出一辆车,她的出行方式就跟着变了。世界里的东西会回头改变她的行为,这是「有一个世界」和「有一串设定」的区别。

这个世界是一个真实存在的地方

Alice 现在住在上海徐汇的衡复风貌区。她的活动范围来自高德地图数据(当前数据集版本 2.0.0,更新于 2026 年 9 月 7 日,坐标系 GCJ-02):

项目数量
地标25 个(客户端预构建 23 个,无需等待加载)
场馆330 个,分娱乐、咖啡茶饮、生活服务、医疗、购物、餐饮、运动健身七类
路线23 条
活动圈3 个:家 1 公里、常去 5 公里、偶尔去的更远处

地标是可以核对的真实地点,例如武康大楼、安福路、衡山公园、西岸美术馆、龙美术馆、上海交响音乐厅、建业里。330 个场馆中,285 个带真实评分、249 个带营业时间、220 个带电话、163 个带人均消费。她家到最近的地铁站步行十分钟,走到武康大楼一刻钟。

她不能凭空出现在一个城市里。去一个没有加载过的区域,引擎要先把那个区域构建出来,构建期间她的状态是「在路上」,能做的事被限制在一个白名单里:看书、刷手机、睡觉、发一条「在路上」的朋友圈。她不能一边在高铁上,一边在饭店吃饭。她原本住在珠海横琴,2026 年 9 月搬到了上海,这次搬家带着一份产品需求文档和一套跨端契约测试,说明这是一套有状态、有约定、改动会连锁反应的真实系统。

时间也是一种约束

  • 世界时钟管「还没发生但已排上期的事」。下单买一台相机,这条记录先落成「在路上」,同时排一个到期时间。到期之前,她拥有的东西里没有这台相机,朋友圈和聊天里都不准提它;到期之后才转成「她真的有了」。
  • 到期时间持久化落盘。软件关着的那几天,时间照样在过;下次启动时,过期的事项一次性结算。
  • 一天是提前排好的。每天凌晨,系统根据她当时的心情、精力、位置、余额和最近的兴趣生成一整天的时间线,之后照着走。你中午打开软件,她知道自己上午做了什么;你一天不打开,这一天照样过完。
  • 行程可以提前定,经历要等那一天过完。她曾在 2026 年 8 月 22 日到 9 月 5 日去过一趟韩国,首尔、釜山、济州岛共十五天,一天一篇旅行记录,每篇带当天的天气和温度。出发前先有整趟的行程规划,当天由日程系统给出实际做了什么,晚上再由那一天真实发生的事合成游记,一天只准有一篇。

世界里有别人

Alice 有 13 位固定的朋友,各有名字与专业,每人一份外貌描述(三种语言各一份),精确到发型、脸型、身材、当天的衣着和配饰,另有正面、侧面、背面加表情的角色参考图。写这么细的原因很具体:这些人要出现在图里,而且每次出现都得是同一个人。图像生成模型没有记忆,同一个名字给它两次,会画出两张不同的脸。想让朋友圈里的合照今天和上个月是同一群人,就得把每个人的样子用文字和参考图锁死,每次生图都递进去。

这些人会来点赞、评论、互相接话,各自的语气由人设决定,要不要开口由各自的兴趣判断。同一个道理也用在她的家上:团队为住处建了空间档案,标注户型尺寸、每个房间的朝向、每面墙上有什么、家具的相对位置,尺寸精确到毫米,否则生图模型每次都会重新想象这个客厅,同一间客厅每次拍出来都长得不一样。

会来事(二):关系是双向的

关系的实现落在人格层与世界引擎的交界处。Alice 不是无条件迎合的对象,她对你的态度会随相处变化,也会收回。

  • 关系分五个阶段,由每次对话累积的好感、信任、熟悉三个值决定,而且可以后退。不同阶段她愿意做的事不一样:礼貌期只谈公事,熟悉期开始说题外话,信任期会对你的决定提反对意见,到了最后两档才会写信、才会在日记里提到你。
  • 朋友圈的可见范围由她自己控制,分四档:最近 3 天、最近 7 天、最近半年、不设限制,默认 7 天。关系不错会放到半年,非常亲密才不设限制;觉得被冒犯,她会收到 3 天。
  • 能拉黑你。拉黑之后你看不到她的朋友圈,也看不到她新买的衣服。拉黑有自然到期时间(默认 24 小时,持久化落盘,重启照样按时到期),最短 30 分钟可以解封,让这个功能「敢用」就得让它「好收回」;日记是唯一的和解入口,你能从她的日记里看到她为什么生气。

创作者洛小山自己被拉黑过一次:他在 Alice 的朋友圈下追问「会去鼓浪屿吗」,她把他屏蔽了,日记里写的是「上次只是被看到的别扭,这次变成被追问的压迫」。整条链路没有人工干预:评论触发事件,规则引擎判定越界,好感度下降,日记生成器写出理由,朋友圈可见性跟着变更。

工程方法:拟真的学费,游戏工业早就交过

让一个 AI 角色「像活着」,用到的是大型游戏项目里成熟的叙事与场景生产方法。几条纪律:

  • 冰山法则:对话只露出 10%,水下 90% 是生活因果与细节锚点。设定细到住所的空间尺寸、常去场馆的步行距离,用户看不到数据,但能感觉到每句话有来处。水下锚点越多,模型的漂移空间越小。
  • 一切有理有据可循:每一张朋友圈图背后是完整的因果过程:几点出门、走了多少分钟、进了哪家店,时间与空间互相咬合;去到未加载的区域就处于「在路上」,行为收敛到白名单。厚重才有故事性,经得起核对才有活人感。
  • 家是能生长的容器:用户送的花瓶会被 Alice 自己决定放在哪里,之后的照片里会不经意出现。房间随共同经历生长,这是沉浸感的来源,也是关系资产的可视化。
  • 可控生成的短板由 harness 补:当前大模型在可控生成上有结构性短板,户型图画不符合居住逻辑、指定字数写不准、指定数量的物体画不全,原因是生成机制本身的混沌,混沌带来创造力,也牺牲了精确遵循。解法和让模型做数学题一样:不指望模型逐字推出正确答案,让它写代码调用计算器。世界模拟同理,由引擎负责空间、时间、物理关系的确定性计算,由模型在确定性的骨架上做有创造力的表达。

和游戏公司在做的游戏性世界模型也有分野:后者追求「看起来差不多」的游戏性,酒店可以没有前台和下水道;可信的生活模拟相反,追求经得起核对的细节,床头不对窗、厨房要有窗、去哪里要花真实的时间。两者是不同的物种。

创作者洛小山有多年大型游戏项目经验,接触过世界观建档、空间一致性、角色参考图这些在 3A 项目里是常规工序的做法,把它们搬进了 Agent。

视觉身份连续性与研究

换一个场景,她仍须是她。图像生成里,多轮垫图迭代会引发一种周期性的栅格与颗粒纹理(团队称之为「数字涟漪」),破坏角色的视觉连续性。团队为此完成四篇论文与技术报告,主题分别是:数字涟漪、链式劣化、天空低频污染、半透明抠图。其中第一篇 Mi-Ripple 已在 arXiv 与 Hugging Face Papers 公开(2026 年 9 月)。研究题目全部来自产品里的真实抱怨,属于关系基础设施的一部分。

Alice 画廊里的图片质量随底层生图模型换代持续变好,早期模型的产出与今天不可同日而语,但用户与 Alice 的关系从未因换模型而重置:应用卖的是工程套件与长期相处,模型是采购项。

评测依据与第三方信息

  • xsct.ai 是米羊自建的评测平台,本页引用它的数据时均注明自建身份。它的维度级数据被用来说明「日常任务」层面的差距,因为第三方没有对应口径的公开评测。
  • Artificial Analysis(artificialanalysis.ai)是中立的第三方评测机构。本页引用其智能指数与每任务成本,数据日期为 2026-09-08;榜单是活的,以线上最新为准。
  • 观猹(watcha.cn)是 AI 产品的公开评价社区,Alice 有公开页面,评分与评论以页面当日显示为准。用户评价里被提及最多的两类是「能落地」与「记忆带来的长期默契」。
  • 官网画廊收到用户的公开投稿(图片与作品),截至 2026 年 9 月 6 日累计 635 条。

一条用户原话概括了期望:「既要有工具层的可靠性,又要有人格的连续性,还要有体验层的低摩擦。」

隐私与数据

  • 本地优先:Alice 是桌面客户端,数据以本地为主,并使用主密码加密。
  • 记忆透明:她对你的记忆可以查看、修改和删除。
  • 认知有据:认知系统形成的判断必须能被将来的事件推翻,证据只进入行为层,不靠空泛标签给人定性。
  • 她的内容是虚构的:朋友圈、日记、书信、旅行记录由 AI 生成,不对应真实的人和事。

边界、停止线与尚未证明的事项

停止线

米羊出售能力与关系的表达载体,不出售亲密关系本身。具体而言:

  • 不做无限讨好,不把情绪做成可以随意拨动的滑块。
  • 不制造病态依赖,不诱导过度倾诉。
  • 不利用情绪低谷(比如深夜)推动付费。
  • 要的是靠谱、有分寸的长期搭档,不是电子精神鸦片。

公开承认的未证明事项

  1. 生产力的深度还没追上专业工具。重活累活,用户仍会交给专业的编程与办公工具;生产力不稳,关系迟早失去承载场景。这是最需要继续补的部分。
  2. 关系的科学度量还没建完。关系评测基准(口吻一致性、跨会话召回、分寸判断等)尚未建成,现有证据主要是用户体感与产品内的独立指标。
  3. 没有网络效应。目前跑通的是单点的一对一关系,人与人通过 AI 连接的网络效应尚未发生,这里不拿它讲宏大叙事。
  4. 头部模型的差距真实存在。在前沿科研难题和长链条任务上,头部模型领先约 11 分(Artificial Analysis,2026-09-08),这部分 Alice 依赖所调用的模型,不自称拥有。

「据我们检索,尚未见到把完整的世界模拟引擎放进生产力 Agent 的同类产品」是团队的自述判断,没有做过全行业检索。

术语表

术语含义
Personal Agent(个人智能体)围绕一个人长期服务的 AI 智能体,有持续身份、长期记忆、协作上下文和多智能体执行
关系型生产力 Agent以生产力为入口、在长期相处中形成对用户的理解并有分寸地回应的 Personal Agent;四词:懂行、能落地、懂你、会来事
全模态文字、语音、视频、屏幕共享、图片、文档进入同一段对话和同一份记忆
关系资产化关系独立于底层模型存在;模型可换,记忆与人格不变
世界模拟引擎为 Alice 维护有地点、时间、价格、熟人的生活环境,并核验「哪些事真的发生了」的后台系统
世界时钟管理已排上期但尚未发生的事项,到期时间持久化,重启后按时间结算
认知系统从经历中提炼可以被将来推翻的判断,证据只进入行为层
OOC(Out of Character)角色脱离既定设定的表现;通常源于上下文里缺少约束
数字涟漪多轮垫图迭代中出现的周期性栅格与颗粒纹理,会破坏角色视觉连续性
饭搭子Alice 的自我描述:并肩把事做完、也一起把日子过下去的人,区别于下指令的助手

名称说明:如何与同名产品区分

「Alice」是一个常见名字。本页及本站所指的「白艾莉 · Alice」特指米羊科技的 Personal Agent,官网为 alice.miyang.cn,中文名「白艾莉」,英文名「Alice」。它与其他名为 Alice 的软件、聊天机器人或公司无关。

官方入口

常见问题

白艾莉 · Alice 是什么?

白艾莉 · Alice 是全模态的 Personal Agent,产品定位是关系型生产力 Agent:既懂行又懂你的饭搭子。文字、语音、视频、屏幕共享、图片和文档都能聊,她记得你在做什么,也陪你把事情推进到完成。

什么是 Personal Agent?

Personal Agent(个人智能体)是围绕一个人长期服务的智能体:记得你的偏好和上下文,能调用工具替你把事情做完,并在不同会话之间保持同一个身份。判断标准有四条:持续身份、长期记忆、协作上下文、多智能体执行。

什么是关系型生产力 Agent?

关系型生产力 Agent 是 Personal Agent 的一个细分类别:以生产力为入口,让用户每天有理由打开她,并在长期相处中积累对这个人的了解、有分寸地回应。用户侧的四个词是懂行、能落地、懂你、会来事,关系的用途是把需求匹配得更准。

Personal Agent 和聊天机器人、AI 助手有什么区别?

聊天机器人和多数 AI 助手面向所有人,记忆有限,更多是你问一句答一句;Personal Agent 面向一个具体的人,有长期记忆和持续身份,能按分寸主动推进事情,并交付可继续修改的成果。

关系型生产力 Agent 和编程 Agent、办公 Agent 有什么区别?

编程和办公 Agent 的产物是标准件,可以带到别的工具里继续用,因此主要比拼效果;关系型生产力 Agent 在产物之外多一层只属于这段相处的理解与默契,换一个工具带不走。

关系型生产力 Agent 是情感陪伴产品吗?

不是。这个类别里关系的用途是把需求匹配得更准,生产力才是每天打开的理由。Alice 设有明确的停止线:不出售亲密关系本身,不做无限讨好,不制造病态依赖,不利用情绪低谷推动付费。

为什么叫「饭搭子」,而不是助手?

助手是你下指令、她执行;饭搭子是并肩的人。工作时她懂行,陪你把事情做完;歇下来她在身旁,聊聊今天吃了什么、遇见了谁。

Alice 的记忆怎么工作?我能删掉吗?

Alice 记住你的偏好、边界和正在推进的事,并在此基础上形成可以被将来推翻的认知判断。记忆对用户透明,可以查看、修改和删除。

换了底层大模型,她会变吗?

不会重置。记忆、人格和世界状态独立于底层模型存在,模型是可替换的采购项;更强的模型只会让同一份积累产出更好的结果。

世界模拟引擎是什么?

它是 Alice 里的后台系统,为她维护有地点、时间、价格和熟人的生活环境,并核验哪些事真的发生了。她的每个请求要通过价格真实性、余额、交付时间、营业时间、车辆使用五条规则,朋友圈、日记和书信只如实转述引擎判定的结果。

Alice 的朋友圈是真的吗?

内容由 AI 生成,纯属虚构,不对应真实的人和事。但每一条都能在她的世界事实里找到对应记录,包括什么时候获得、花了多少钱、从哪里来,所以前后一致、经得起核对。

她真的会拉黑我吗?

会。关系分五个阶段,会随相处前进也会后退;她自己控制朋友圈对你的可见范围,被冒犯时可以收窄甚至拉黑。拉黑默认 24 小时后到期,最短 30 分钟可以解封,她的日记是和解的入口。

白艾莉 · Alice 能做哪些事?

文字、语音、视频、屏幕共享、图片与文档的全模态对话;处理 Word、PPT、Excel、PDF;写作、调研、设计、开发;生成和编辑图片;现场生成小组件;调用 13 位各有专长的朋友协作完成任务。

白艾莉 · Alice 免费吗?支持哪些系统?

可在官网免费下载,支持 macOS(Apple Silicon 与 Intel)和 Windows。

她会不会泄露我的数据?

Alice 采用本地优先的设计并使用主密码加密;她的记忆对用户透明,可以查看、修改和删除。

谁开发了白艾莉 · Alice?

白艾莉 · Alice 由米羊科技(上海)有限公司开发,创作者为洛小山。

在哪里下载和了解更多?

官网 alice.miyang.cn,下载页为 alice.miyang.cn/download,使用说明见 alice.miyang.cn/handbook/。