它憑什麼靠得住

可靠,寫死在架構裡。

一句話

今天的模型像個聰明但靠不住的實習生。DeTars 用六條結構性能力讓它值得託付——不是口頭承諾,是可以當場驗證的機制。

六件事

  • 它自己會想。給它一個目標,它自己拆解、召集專員、盯進度、該等就等、該續就續。怎麼幹是當場想的,不是焊死的腳本。
  • 它打不垮。限流、逾時、休眠、當機——它把每一個當成可繞過去的事實:退避、重試、存檔、續跑。掛著通宵跑,早上看結果。
  • 它不能騙你。「做完了」是一張必須兌現的收據:交付了、有證據、過了複審。每份引用按內容雜湊封印——改一個字立刻失效。
  • 它有免疫系統。它主動抓自己的毛病,把每個變成永久的回歸覆蓋;它甚至兩次抓出了自己檢查工具裡的 bug。
  • 它是你的。住在你電腦裡;學到的每條都要你點頭,且存成你硬碟上的檔案。沒人能像 Rewind、Humane 那樣把它變磚塊。
  • 它不被綁架。哪件事用哪個大腦合適就用哪個——中美前沿模型或你筆電上的本機模型,近 50 家隨便切。引擎自有,不是套別人 API 的殼。

而且它會自我進化

可靠不是一次調出來的,而是複利累積。三個飛輪讓每個版本都更難被打敗。

  • 自我加固。它主動抓自己的毛病,把每個變成永久的回歸覆蓋——每個版本都比上一版更難被難倒。這種可靠性買不到,只能一點點攢出來。
  • 記憶自最佳化。它持續重組、修剪自己的記憶系統,讓檢索隨規模增長依然敏銳——而它記住關於你的每一條,仍要你點頭。
  • 自我擴展。當一個任務需要它沒有的能力時,它會自動生成、安裝並管理自己的 Tool 和 Skill——自主長出新能力,不用等發版。

水面下:撐起這份靠譜的工程

細節你不用懂——但每一樣效果都可驗證,哪怕實作是我們不外傳的核心 IP。

  • 資料庫級寫入紀律,一群 AI 同時幹活也不會互相覆蓋。
  • 證據內容指紋:沒讀過或被改過的資料,引用不了。
  • 快取感知路由讓模型的 KV / 提示快取保持高命中——重複脈絡不重複計費,長任務省下大量 token,模型越降價它越便宜。
  • 百萬字材料先消化成索引,模型還沒看第一個字就備好。
  • 守恆的預算帳本,它無法給自己無限授權或無限燒錢。
  • 一個唯讀的「第二個腦」中途回看整輪,把糾偏餵回去。
  • 分型急救:限流、逾時、被攔各走不同通道。
  • 不可逆動作(下單、外發、敏感憑證)預設鎖死,要你親手授權。