Reasonix is an AI coding agent that stays cheap all day
三句話摘要
Reasonics 是通過凍結提示詞前綴、利用模型緩存來降低長期使用成本的 AI 編碼助手。 Reasonics 通過凍結提示詞前綴來充分利用模型緩存折扣,使長期使用 AI 編碼助手的成本保持低廉且可量化。 無狀態性導致的成本膨脹:AI 模型在消息之間沒有記憶,每次都要重新發送整個對話歷史。隨著會話時間延長,成本以幾何級數增長,這是所有基於消息的 AI 助手面臨的核心問題。
重點整理
重點- 1
無狀態性導致的成本膨脹:AI 模型在消息之間沒有記憶,每次都要重新發送整個對話歷史。隨著會話時間延長,成本以幾何級數增長,這是所有基於消息的 AI 助手面臨的核心問題。
- 2
提示詞緩存的十倍折扣:DeepSeek 等現代模型支持對請求開頭進行緩存,重讀緩存內容的成本僅為新讀的十分之一。但大多數工具因為每輪都改寫開頭(時間戳、工具列表順序、機器掃描),導致緩存失效,無法享受折扣。
- 3
三層精巧的前綴穩定策略:Reasonics 在啟動時固定系統資訊摘要、保持工具列表排序不變、聊天過長時只修剪末尾用佔位符代替,確保請求開頭永不改變。
- 4
可量化的成本優化效果:實際測試顯示緩存命中率達 87%,即十分之九的交互成本降至原價十分之一,用戶可在桌面應用實時看到節省數字不斷累加。
實用技巧與重點
乾貨- 成本節省比例:重讀緩存 = 全價的 1/10
- 緩存前置條件:請求開頭必須逐字完全相同
- Reasonics 三個固定策略:
- 啟動時生成系統資訊摘要(硬體配置、可用工具、Shell 類型),後續重用
- 工具列表保持固定順序,永不重排
- 聊天歷史只修剪末尾,用佔位符代替,需要時才展開
- 實測緩存命中率:87%
- 提供介面:終端、桌面應用、代碼編輯器插件(均由本地同一引擎驅動)
- 兼容性:支持任何提供前綴緩存的 AI 模型(不限 DeepSeek)
- 許可證:MIT 開源
結論
結論“Reasonics 通過凍結提示詞前綴來充分利用模型緩存折扣,使長期使用 AI 編碼助手的成本保持低廉且可量化。”
完整解析
詳細長期運行 AI 編碼助手的成本問題是 Reasonics 要解決的核心課題。傳統 AI 模型在消息之間完全無狀態,每當用戶發送新消息時,助手必須將整個對話歷史重新發送給模型。這個設計看似簡潔,卻帶來嚴重的成本後果:隨著對話時間延長,每一條新消息都要為日益龐大的歷史堆積買單,長時間運行的成本會迅速失控。
Reasonics 的創新在於充分利用現代大模型的提示詞緩存能力。DeepSeek 等模型支持對請求開頭進行緩存儲存,當相同的開頭再次出現時,可以直接讀取緩存而非重新處理,成本僅為正常處理的十分之一。這個十倍折扣本應人人受惠,但大多數現有工具都浪費了這個機會。因為在每一輪對話中,它們都會改寫請求的開頭——添加新時間戳、重新排列工具列表、重新掃描機器配置等。模型看到開頭改變了,就認為這是全新的請求,緩存失效,用戶被迫支付全價。
Reasonics 通過三層精巧的設計來保持請求開頭的完全不變。首先,在啟動時它生成一份關於用戶計算機的資訊摘要,包括硬體配置、可用工具、Shell 類型等,這份資訊一旦寫入就被固定下來並在後續復用,只有在重啟時才會根據實際變化更新。其次,助手允許的操作列表始終保持在固定的順序中,絕不重新排列。第三,當對話變得很長時,Reasonics 採用修剪末尾的策略,用簡潔的佔位符代替較早的對話,只在真正需要時才展開查看原文。這三個策略共同確保了每條新消息的請求開頭都與上一條逐字相同。
Reasonics 還提供實時的成本反饋機制。它運行一套測試任務並追蹤緩存命中率,用戶可以在桌面應用上實時看到這個數字不斷累加。一個典型的工作會話中,緩存命中率可以達到 87%,這意味著大約十分之九的流量享受優惠價格,成本效率顯著提升。軟體提供多種使用方式——終端、桌面應用、代碼編輯器插件——但本質上都驅動同一個本地程序,真正的計算發生在用戶自己的機器上,無需依賴雲端。採用 MIT 開源許可證,任何人都可以自由使用、修改和擴展。
關鍵時刻
Pipeline v2帶時間戳的重點,會在逐字稿層級分析上線後產生。目前請先透過原始影片觀看。
事實查核
Pipeline v2說法查證是下一次管線升級的一部分。KeyFrame 只會顯示它真正能驗證的內容。


