更新日志
应用和 SDK 各自有版本号。每个版本的完整验收记录,都在仓库的 docs/research 目录下。
0.73.0
SDK 0.59.0
记忆不再依赖 Docker,联网搜索可选服务
- “设置 → 记忆”里新增“本地记忆(内置)”:不需要 Docker、向量模型或文本模型,对话原样存在本机一个 SQLite 文件里,按关键词检索。它不理解同义说法,也不跨语言;OpenViking 语义记忆仍可选,两边的记忆互不迁移。
- 在 112 轮真实对话上重放,同一对话里更早的一轮排在第一的占 90%,进入前五的占 98%;样本只有 6 个对话,只说明排序可用。
- 联网搜索和网页读取可在设置里选服务:FastCRW(默认)、Firecrawl、Tavily、Brave、智谱、博查;模型看到的仍是同样两个工具。换服务时不会把原来的密钥带给新服务。其中 Firecrawl(无密钥)和直连读取页面做过真实验证,其余按文档接口写成,只用本地模拟数据测过。
0.72.0
SDK 0.58.0
改文件失败更少,失败原因更清楚
- 读文件时行号与正文之间改用制表符分隔,避免缩进行被多写一个空格。精确匹配失败、但只差一个前导分隔符时,编辑会按这种差异应用并在结果里注明;有多处匹配则拒绝并说明怎么改。在 31 次真实的“找不到旧文本”失败上重放,15 次现在能按原意应用。
- 网页读取失败时,错误信息会说明是否值得重试、可以去哪里找;命令的工作目录被拒绝时也说明它相对的是哪里。
- 系统进化页把工具失败按原因分类(调用有误、环境问题、被拒绝、被中断),只有模型自己的调用错误才会被当成工具描述需要改进;设置页显示这张表。
0.71.0
SDK 0.57.0
界面语言贯穿到报错和命令行,Claude 路径经真实接口验证
- 模型读到的提示、交接说明和工具文字固定为英文,面向你的输出按界面语言;接口返回的错误信息和命令行的帮助、用法与输出也跟随界面语言,你自己的文字、路径和名称原样保留。
- Claude 路径用真实 Anthropic 接口跑完一组探针,全部通过。发现并修正一处:思考块被拒时,日志里指向的消息位置会因工具往返而错位,现在映射回真实位置;恢复动作本身不受影响。
- 0.71.1:在模型设置里移除的模型保存后不再被“拉取模型列表”加回来,重新保存它才会恢复。ChatGPT 订阅登录的图像生成现在提供三个模型,并且真的按你选的模型发出请求(此前总是 gpt-image-2)。
- 没有 WebGL 的环境(关闭或屏蔽了 GPU 加速)里,空状态的背景动画会保持为空,不再因抛错让整个应用白屏;0.70.0 和 0.71.0 受此影响。
0.70.0
SDK 0.56.0
主动发言和项目笔记跟随界面语言
- 宿主写的主动发言文字(今日摘要、对话收尾、欢迎回来、直接修复和后台求助卡片)按界面语言显示,客户端按结构化字段渲染。
- 项目笔记的卡片、选项、原因和接口错误跟随界面语言。
- 记忆服务临时不可用时,交付结果的索引写入不再被记成“已丢失”。
0.69.0
SDK 0.56.0
静音即暂停,用量页只看 token
- 暂停主动发言同时暂停定时任务:静音期间不启动,到点的窗口记为已跳过;解除静音后,仍在一个周期内且任务没变的会原地恢复。静音前已开始的执行,结果只放进收件箱。结果等了超过一个周期才交付的,改放收件箱。
- 用量页只显示 token,不再显示按价格折算的数字,并把探针判断与正常对话分开,最大的运行按 token 排序。
- 定时任务只声明自己能执行的工具;首次请求里任务内容只出现一次,压缩后也保留。
- 回退一轮时,OpenViking 里对应的记忆也一并回滚,远端会话一并删除。
0.68.0
SDK 0.55.0
启动更轻,子代理结果更可靠
- 索引只带界面需要的字段(协议 3):首屏数据从 821 KB 降到约 67 KB,空闲时不再每 5 秒整份重新加载。数字来自 docs/planning/next-phase-plan-20261004.md。
- 子代理的结果一定会回到模型手里;合并采用 mu 式的待合并策略。
- 压缩可以跨边界回退,并带结构化的检查点摘要与文件清单。
- 文件编辑支持一次多处修改,并拒绝覆盖没读过的文件;沙箱更严;记忆页上已确定的损失直接进入历史,摘要失败不再让健康检查一直不通过。
0.67.0
SDK 0.54.0
账目说实话,后台调用更稳
- 内部调用的推理强度:Claude、DeepSeek、Codex 直接用模型默认值;GLM 上 JEV 的选择先只记录,通过付费回放验证后才会启用。
- 用量账目更准确:中止和未报告用量的请求按估算入账,叙述、心智和进化各有自己的用途名。
- 基因的工具和技能名跨代保持不变,进化不再让整段会话缓存失效;前台轮次进行中,不再为它自己的消息另做主动决策。
- 0.67.1:安装包在界面构建比源码旧时会重新构建界面(0.63.2 到 0.67.0 发出的是旧界面)。
0.66.0
SDK 0.53.0
Claude 用 API key 接入,空闲时后台压缩
- Claude 只通过 Anthropic API key 使用:历史只追加不改写,空闲时发保温请求让缓存不过期。
- 空闲时间超过缓存存活期且上下文过半时,后台自动压缩,保留最近 2 轮。
- 缓存已经冷掉时,折叠被取代的上下文副本;心智上下文与协作上下文分开,稳定的部分不再每轮变化。
0.65.0
SDK 0.52.0
记忆证据受保护,定时报告完整送达
- 记忆外发只认显式撤销,别的项目的进化或新建对话不再影响本项目的回执、运行中的工作和待发的定时交付;历史上丢失的证据可以恢复(线上状态副本恢复了 169 个历史行动和 47 份交付证据)。
- 记忆健康分为“未决”和“已知损失”,已知损失可以点“知道了”或“重试”,健康检查不再因它们一直不通过。
- 定时报告的正文完整交付,不再截掉中间;承诺只在改动真正落定后才结算,回退时重新打开。
- Git 操作改为挂起而不等待;删除对话时同时清理心智和基因里的相关内容,删除流程不再卡死。
0.64.0
SDK 0.51.0
它知道你回退了什么,也不再重复干活
- 你回退一轮、丢掉子代理的改动或还原后台改动后,下一轮对话开头会带上“用户撤销了什么”;后台也看得到,不会再提议改回去。
- “本轮交付”和“审阅”改为显示宿主算出的每个文件的净改动,不再把每次编辑片段相加。
- 新 JEV 判断点 work.coverage:后台要做的检查如果只是重复刚做完的、之后也没有新变化,就不再排队。19 个标注样例全部判对。
0.63.0
SDK 0.50.0
工作树隔离、自动合并和整轮回退
- 子代理和后台各自在独立的 Git 工作树里改文件,结束后自动合并回项目;对话可以在新建时选择独立工作树。0.63.3 起对所有 Git 项目开启。
- 合并时你没提交的改动永远是一方,不碰索引、HEAD 和分支,冲突标记不会写进项目文件夹。
- 每一轮都留检查点,“回退本轮”一键还原,还能撤销回退。
- 不是 Git 仓库的项目可以一键初始化:git init、写 .gitignore、提交一次,不加远端。
0.62.0
SDK 0.49.0
像 Claude 一样的改动对比,子代理该用时会用
- “工作区改动”面板按“基准 → 目标”对比:与分支的合并基点、未提交的改动、这个对话的改动或任意本地分支,左边文件树,右边逐个文件的差异。
- 主对话会把能拆开的部分交给子代理并行去做,可以附上你的原话作为需求;上限调整为每轮 12 次、每个对话 4 个、全局 6 个。
0.61.0
文件、进化和工作区改动都能开成面板
- 文件带改动标记,可以只看改过的;布局可以保存;桌面版能在 Finder 里显示文件。
- 任务页卡住的条目可以就地处理:标为完成、放弃,或一次清掉某个项目没做完的条目。
0.60.0
可以自由摆放的工作区和后台任务面板
- 右侧变成可拆分、可拖放的工作区,有预设布局、撤销重做,移动面板不会让终端或浏览器重新加载。
- 后台任务面板按“需要你处理 / 进行中 / 排队 / 已完成”展示每次运行的进度、子代理和用量。
0.59.0
SDK 0.48.0
一次全面的体验打磨,修了 73 个问题
- 草稿、附件在发送、停止或切换对话时不再丢失;运行提示里不再出现工具名、JSON 或英文内部信息。
- 已经完成的轮次和长期规则不再被算成“欠你的事”;急停会恢复它暂停的内容。
0.58.0
SDK 0.47.0
Claude 改为通过 API Key 接入
- Anthropic 不允许在第三方应用里使用 Claude 订阅,订阅只读咨询功能下线;设置里一键切换到 Anthropic API Key 预设。
- 定时任务在各处都以“定时任务「名称」”显示,不再露出内部指令。
0.57.0
SDK 0.46.0
失败的请求留给你重试;ChatGPT 登录能生成图片
- 前台问题失败后,后台不再用自己的模型抢着回答,对话里提供用你选的模型重试。
- ChatGPT 订阅登录可以生成图片(gpt-image-2)和语音转文字;生成的图片直接显示在对话里。
0.56.0
SDK 0.45.0
换到上下文更小的模型也能接着聊
- 压缩改为与 pi 一致:摘要读精简记录,太长就减半重试,回答超长时先压缩再试一次。
- ChatGPT Codex 的流式响应按 pi 的方式读取,订阅模型可以正常使用。
0.55.0
SDK 0.44.0
撤回 AI 文本检测和写作工具
- 0.50.0 到 0.54.0 加入的朱雀检测、相关设置和写作工具全部撤回,恢复到 0.49.2 的做法;研究记录保留在仓库里。
0.50.0
SDK 0.39.0
接入腾讯朱雀 AI 文本检测(0.55.0 已撤回)
- 新增内置技能 ai-detection:写完先检测,只改被标出来的句子,再复查,最多三轮。在两篇以上都管用的改法,会写进项目 AGENTS.md 的“去 AI 味写法”。
- 新建写作项目时,由 JEV 判断文字是不是给读者看的:是就自动装上这个技能,自己看的摘要类项目则不装。
- 在“设置 → 模型 → AI 检测”里可以开关、填密钥、看本月用量。免费额度用完会暂停到下月 1 日,到时自动恢复。
0.49.2
SDK 0.38.2
根据实测结果改进 JEV 的问法
- “能不能写成检查”这道题改成按字面来问,误判从 5 条降到 0 条。
- 合并规则时,把规则全文交给 JEV,不再只给标题和摘要。
0.49.1
SDK 0.38.1
旧的长工具输出只留头尾
- 参考 DeepSeek Harness 的做法,较早的大段工具输出只保留开头和结尾,省下上下文。
- 新增 JEV 探针,方便试验不同的问法。
0.49.0
SDK 0.38.0
少花冤枉 token
- 进化先判断再动笔:不值得写的规则,在调用大模型之前就拦下来。
- 写完的长文本,这一轮结束后就移出上下文。
- 判断请求的缓存前缀更稳定,命中率更高。
0.48.0
SDK 0.37.0
进化学会改旧规则,不再只会往上加
- 新规则先和同类规则比一比:重复的停用,重叠的合并。
- 改写时,旧规则里的每条要求都会保留下来。
0.47.0
SDK 0.36.0
长对话可以手动压缩
- 很长的对话也能手动压缩,还能看到进度。
- 内部标签不会再混进回复里;过期的任务卡片会自动收起。
0.46.0
SDK 0.35.0
先分流,再拿主意
- 每次有动静,先判断该交给谁处理,再做决定;每个决定都注明是谁拍的板。
- 还没得到回答的问题,会被重新提出来。
0.44.0
后台需要你拍板时,直接在对话里问
- 后台遇到需要你决定的事,会回到对话里问你。
- 写入记忆后会自己核对一遍。
0.43.0
侧栏实时显示 Agent 的浏览器
- Agent 操作浏览器时,你能在侧栏实时看到画面。
- 后台做完的东西,直接出现在对话里。
0.42.0
SDK 0.34.2
“完全访问”下不再逐项确认
- 项目权限设为“完全访问”后,前台和后台都能直接读写文件、执行命令。
- 权限申请以卡片形式显示在对话里。
0.39.0
SDK 0.33.0
后台命令进沙箱,后台改动可还原
- 后台命令跑在 macOS 沙箱里:除了项目目录、临时目录和包缓存,别处都写不了。
- 后台改过的每个文件都留了底,可以一键还原;之后又被改过的文件不会被覆盖。
- 要写的内容明显违反你定过的规矩时,会被拦下并说明原因。
0.36.0
SDK 0.30.3
任务页改版
- 参考 OmniFocus 重做了任务页。
- 生成的文字跟着界面语言走。
0.35.5
进化页改成一棵简洁的技能树
- 进化页只显示基因树和每个节点的一句话说明,想看细节再点开。