這是什麼?
Tura 是給 coding agent 使用的開源宏執行層。它把「檢查環境、修改多個檔案、建置、測試、lint、讀取媒體」這類多步流程組成單一可重用工作流,目標是減少模型與工具之間的往返,同時保留每一步的可驗證輸出。
基準測試
我們用 DeepSWE 與完整程式庫重寫任務做了可重現測試。測試集記錄 pass rate、實際 token、rounds 與估算成本;不同設定各有取捨,例如 Macro Direct 使用 969 rounds、39/60 通過,而加入 backward reasoning 的版本是 2,017 rounds、48/60 通過。這比只比較單次提示或快取命中更能反映完整任務成本。
專案狀態
- 開源程式碼與測試腳本:https://github.com/Tura-AI/tura
- 完整 benchmark:https://turaai.net/docs#benchmark-current-test-set-record
- 我是 Tura 的維護者;這篇是本人專案分享,不是第三方推薦。

