sid-code长在企业研发环境里的 coding agent
同一个模型,更快、更省、更少返工——而且每一版都能重新量一次。
sid-code 的位置
别人给你一个 agent;
我们给你一个你能改、能量、能审、数据不出门的 agent 底座。
开源社区的技术自由度 + 商业产品的工程完备度,再加一件通用工具不会做的事—— 为你这一家企业的研发环境做适配,并把过程数据留在你自己手里。
同一个底座,两类人拿走的东西不一样
代码与轨迹不出机房,安全审查一次过,不用为合规单独报批
模型不绑死:网关涨价、换供应商、上自研模型,改配置不换工具
你们的规矩能进 harness,团队默认配置一键分发,policy 可管控
过程数据是你们自己的资产:查成本归属、防功能回退、做团队级优化
便宜模型 + 好 harness 一样能干活——工具本身就是变量
花了多少钱、慢在哪一步,一目了然
全开源可改,今天发现的问题今天补,不等厂商排期
你的代码不会进任何人的训练集
凭什么选它 —— 建成即成立,每条都能演示一次
装上就接得上你公司已有的那套东西。
内部网关计费口径、内网 GitLab、企业 SSO、MCP、团队默认配置分发,是按真实企业内网一条条适配出来的,不用先改造企业来适配工具。
团队部署harness 整套可改,模型任你换。
换模型改一行配置,加扩展写一个文件,改内核提一个 PR。你团队的怪规矩今天就能写进 harness,不用等厂商排期。
扩展方式代码和对话不出你的机房。
会话轨迹、评测结果、成本账本全落在自己的基础设施里,不进任何人的训练集。数据在自己手上,才谈得上拿它做优化。
本地落盘每一分钱、每一步决策都查得到。
钱花在哪、慢在哪、agent 为什么走了这一步,事后都能翻出来;发布前跑一遍评测,知道这个版本有没有退步。默认就开着。
轨迹与度量凭什么留下 —— 每条背后都有一个能按版本重算的数字
从你回车到最终答复,这段时间要一版比一版短。
不只看均值——慢尾巴才是真正让人放弃的地方,所以一律按 p95/p99 复算。
首字响应 TTFT · 端到端耗时实测长文同样一件事,少花 token、少花钱。
缓存命中率兜住大头,会话轮数是成本的最大杠杆——两者都在账本里逐轮记着。
单位任务 token 与成本 · cache 命中率成本与用量不是模型更聪明,是同一个模型在这里一次做对的比例更高。
模型聪不聪明不由我们决定;重试、空转、反复改同一个文件这些浪费,由 harness 决定。
一次做对率 · 评测通过率 · 过程病态率过程指标只看正面信号,不拿事故数当指标。
安全是「坏事没发生」,用事故数当指标只会得到一条恒平的曲线,分不清是防线起作用还是运气好。
防线触发率 · 权限匹配正确率 · 人工确认介入率安全边界一条命令装完 · macOS 与 Linux · 不需要 sudo
$curl -fsSL https://www.sid-code.cc/releases/sid-code/install.sh | bash
$sid-code --version# 确认装上了
$sid-code# 配好模型后启动