做不到什么
写在这里,而不是让你后面自己发现。
模型
小的本地模型干这个不如前沿模型。 界面是一样的,推理不是。
通用开源模型手上有文件工具,还是会去用 grep。 给了它结构化的读文件方式,一个
没往这个方向训练过的模型仍然会退回 shell。这是模型的差距,换任何界面都补不上。
这个项目能改变的是可达性,不是聪明程度。
一个不会调用工具的模型,在这里根本干不了活。 它只会聊天。 在投入之前先测一下 —— 五分钟,一个固定任务。
计数
token 数是估算的,从来不是数出来的。 分词器属于模型,而这个程序要跑它从没见过的 模型。ASCII 四字节算一个 token,其余按字算一个:对英文和中文都够近,其他情况偏向多算。
所以下游的一切都是近似的 —— 什么时候压缩对话、什么时候截断工具输出、以及用量那一行 显示的数字。
定时
定时任务和值守只在 OpenCLI 开着的时候运行。 这是本地 agent,不是服务器。必须在 机器睡着时触发的,属于系统自己的调度器。
沙箱
一次后台运行可以写它所在目录里的任何东西。 可写根就是那个目录。不在部门目录里 的运行会被扣住,等你按名字授权 —— 除非审批设成了「从不」,那样什么都不会被扣。
读取在任何沙箱模式下都不受限制。
改动记录
「产物」只列出用 agent 的文件编辑工具做的改动。 它执行的 shell 命令写的文件 ——
heredoc、脚本、git checkout —— 不被追踪,不会出现在那里。改动是真的,列表是不全的。
桌面端
没有代码签名。 系统会警告你,而且它是对的:它确实没法判断是谁做的。 安装那页写了怎么办。
界面
从右往左书写的语言没有做版面。 阿拉伯语、希伯来语、波斯语可以作为翻译文件加进来, 但页面仍然是从左往右排的。那要改样式表,不是改翻译。
升级是指令,不是保证
一个值守的 「什么时候停下来问你」是给模型的义务,不是这个产品去判断的东西 —— 也就是说,它的可靠程度完全等于读它的那个模型。把它写成可核对的: 任何单笔超过 10000,而不是任何异常。