跳至主要内容

做不到什麼

寫在這裡,而不是讓你後面自己發現。

模型

小的本地模型幹這個不如前沿模型。 介面是一樣的,推理不是。

通用開源模型手上有文件工具,還是會去用 grep 給了它結構化的讀文件方式,一個 沒往這個方向訓練過的模型仍然會退回 shell。這是模型的差距,換任何介面都補不上。 這個專案能改變的是可達性,不是聰明程度。

一個不會調用工具的模型,在這裡根本幹不了活。 它只會聊天。 在投入之前先測一下 —— 五分鐘,一個固定任務。

計數

token 數是估算的,從來不是數出來的。 分詞器屬於模型,而這個程式要跑它從沒見過的 模型。ASCII 四字節算一個 token,其餘按字算一個:對英文和中文都夠近,其他情況偏向多算。

所以下游的一切都是近似的 —— 什麼時候壓縮對話、什麼時候截斷工具輸出、以及用量那一行 顯示的數字。

定時

定時任務和值守只在 OpenCLI 開著的時候執行。 這是本地 agent,不是伺服器。必須在 機器睡著時觸發的,屬於系統自己的調度器。

沙箱

一次後臺執行可以寫它所在目錄裡的任何東西。 可寫根就是那個目錄。不在部門目錄裡 的執行會被扣住,等你按名字授權 —— 除非審批設成了「從不」,那樣什麼都不會被扣。

讀取在任何沙箱模式下都不受限制。

改動記錄

「產物」只列出用 agent 的文件編輯工具做的改動。 它執行的 shell 命令寫的文件 —— heredoc、指令碼、git checkout —— 不被追蹤,不會出現在那裡。改動是真的,清單是不全的。

桌面端

沒有程式碼簽名。 系統會警告你,而且它是對的:它確實沒法判斷是誰做的。 安裝那頁寫了怎麼辦。

介面

從右往左書寫的語言沒有做版面。 阿拉伯語、希伯來語、波斯語可以作為翻譯文件加進來, 但頁面仍然是從左往右排的。那要改樣式表,不是改翻譯。

升級是指令,不是保證

一個值守的 「什麼時候停下來問你」是給模型的義務,不是這個產品去判斷的東西 —— 也就是說,它的可靠程度完全等於讀它的那個模型。把它寫成可核對的: 任何單筆超過 10000,而不是任何異常