写给分身所有者的说明 · 更新于 2026-07-16
每次有人向你的分身提问,它不会把整个知识库都翻一遍再作答。它先看一份知识库目录——每篇知识页只有一行摘要——从中挑出和这个问题最相关的几篇,把这几篇完整读一遍,再动笔回答。这样既能覆盖到点子上,又不会被无关资料带偏。如果这一步临时不可用,分身会退回到一种更朴素的关键词宽搜(针对中文分词做过专门优化,不会把一整句话当成一个词处理)。不管走哪条路,分身回答时只用它实际读到的内容——如果知识库里确实没有能回答这个问题的资料,它会照实说不知道,而不是凭空编造。
知识库里的每篇页面都带着一个可见性标签,分三档:owner(只有你自己能看)、friends(你确认过的好友能看)、guest(任何来问你分身的人都能看到)。访客不管怎么问,分身都不可能读到 owner 或 friends 档的内容——这道边界不是靠界面上"藏起来"实现的,而是在数据库这一层就已经做了过滤:分身每一次去查资料,查询本身就只被允许拿到对方那个身份该看的那一档。也就是说,就算分身"想"读一篇更高权限的页面,技术上也拿不到。
你上传的文件会先经过一次安全扫描。之后,系统里的"馆员"(一个 AI)会阅读这份源文件,琢磨要不要新建或更新哪些知识页,并把想法整理成一份归档计划——但它只能"提"这份计划,真正落到知识库之前,服务器程序会把计划里的每一条逐一核对(路径合不合规、有没有越权、格式对不对),不通过就会被拦下。源文件本体永远不会被馆员改动。整理这件事每 5 分钟自动巡一轮,你也可以在管理页手动点一下让它立刻处理;如果不想让它自动整理,也可以在设置里关掉,改成手动逐次确认。
上传文件时,系统会扫描内容里是不是混进了密码、API 密钥这类东西,一旦发现会直接拦下,不让它进知识库。就算某次侥幸漏网,馆员在整理归档时也被要求把这类内容剔除,不会原样抄进知识页里。不过技术上的拦截终归是最后一道保险,更稳妥的做法还是从源头避免——不要在和分身的对话里粘贴密码、密钥或其他敏感凭证,聊天记录和上传的资料一样,都不是用来存放这些东西的地方,一旦泄露出去,平台也没有办法帮你收回。
访客和你的分身聊了什么,你是看不到的——每个人和分身的对话都只属于提问的那个人自己,连你这个所有者也不例外。你能看到的,是一份提问日志:谁、在什么时候、问了什么问题,以及每周的一些统计数字,而不是完整的聊天记录。至于你自己找自己的分身聊天,这段对话会保存在云端,换个设备登录也能接着看到,不用担心换手机、换浏览器就丢了。
你自己和自己分身聊完一段(大约半小时没再发消息)之后,系统会自动把这段对话整理成一篇很简单的日志:什么时候聊的、一共几条消息、你大致问过哪些话题——不会收录分身的回答原文。这篇日志存放在你知识库的 _sessions/ 目录下,只有你自己能看到。它不会被馆员当作源文件去整理归档,分身回答别人问题时也不会检索、引用到它。太短、没什么实质内容的几句寒暄不会被记录下来。
这是一个还在小范围试点的功能,默认关闭,由平台方按具体的分身单独开启。开启之后,你本人和自己分身的对话会挂上一块跨会话的记忆——分身会记下你比较稳定的偏好、你对它的纠正,下次聊天时先看一眼这些记忆再回答,不用你每次都重新交代。这块记忆只挂在你自己的会话上,访客的对话永远碰不到它。如果想关闭,联系平台方处理即可。
想了解你的分身被问了什么、用了多少,去管理页看两个标签:Questions 是提问日志——谁、在什么时候、问了什么问题、答没答上,逐条列出;Usage 是用量统计——你的配额使用进度(按百分比显示,不出现金额)和每天的提问数量。这两处只统计"问了什么、答没答上",不会展示访客与分身的完整聊天内容(见第 5 篇)。
账户页(管理页最下面)有导出和删除的入口:导出会把你所有资料打包成一份 zip 下载下来。删除分几个层级——在知识库里删掉某一篇文档,服务器先做的是一个"墓碑"标记(不是立刻物理抹掉,方便本地同步工具知道这篇也该删了);而彻底、不可恢复地清除整个分身或整个账号(包括停止扣费、清空所有相关资料),会按数据权利的流程走一遍,做完就真的没有了。另外,你也可以用 Obsidian 插件或命令行工具,把知识库整份双向同步到自己电脑上——本地和云端互相同步,页面 frontmatter 里的 visibility 字段,是唯一决定谁能看到这一页的开关。