本地编码
搭建本地编码模型
无限供应。绝对隐私。专为重度用户。token 不掐表,仓库不出门——按软件栈 → 模型 → 硬件决策,或从你桌上那张卡反推。
推荐顺序
找到你的本地编码方案
告诉我你已有的机器,或准备买哪一档。我们匹配能塞进去的栈与模型。URL 会更新,推荐可直接分享。
选项变化时查询串会更新。
常见问题
本地一定比 API 便宜吗?
不一定。本地 token 标价约 $0,但你要付电费、折旧与运维。请用本页的每月回本任务数估算。
为什么 Q4 能进 24GB,长上下文却跑不动?
KV cache 随上下文增长。权重能进卡 ≠ 原生 128K–262K 能进。要单独留 KV 预算。
应该从 vLLM 起步吗?
笔记本不要。先用 Ollama 或 llama.cpp(Apple 用 MLX)。需要专机吞吐时再用 vLLM/SGLang。
AI Hippo 综合榜能代表编码能力吗?
不能。统一榜更像上下文/价格代理。厂商 SWE 表除非标明,否则不是独立 harness 复现。
相关洞察
假设与来源
硬件档是「类」+ 美元参考区间(非街价报价)。显存估算用 curated GGUF 体积 + 按规模的 KV 系数。编码分为手写 SWE/Aider/LiveCode/HumanEval 参考——非 harness 复现。API 任务成本取 OpenRouter 主 listing(若有)。