Qwen3.8 27B (free)限时免费Gemma 4 26B A4B (free)限时免费Gemma 4 31B (free)限时免费Dots3-Note Preview (free)限时免费Inkling (free)限时免费LFM2.5-2.6B (free)限时免费Mistral Nemo输出 $0.030/MLlama 3 8B Lunaris输出 $0.050/MLing 3.0 Flash VL输出 $0.060/MLing 3.0 Flash输出 $0.060/MLlama 3.1 8B Instruct输出 $0.080/MMistral Small 3输出 $0.080/MQwen3.8 27B (free)限时免费Gemma 4 26B A4B (free)限时免费Gemma 4 31B (free)限时免费Dots3-Note Preview (free)限时免费Inkling (free)限时免费LFM2.5-2.6B (free)限时免费Mistral Nemo输出 $0.030/MLlama 3 8B Lunaris输出 $0.050/MLing 3.0 Flash VL输出 $0.060/MLing 3.0 Flash输出 $0.060/MLlama 3.1 8B Instruct输出 $0.080/MMistral Small 3输出 $0.080/M

© 2026 超级智能指数 SuperIntelligence Index · 由 Eumenes 独立运营并保留所有权利|Copyright © 2026 Eumenes. All Rights Reserved.

刷新数据更新Eumenes 网站版权声明

Agent 工具横向对比

按综合评分取前 8 名,逐项对比功能评分、计费模式、协议、优势短板与适合场景。 表格可横向滚动查看。

对比项
Claude Code
Anthropic
Codex CLI
OpenAI
Cline
Cline
Gemini CLI
Google
Aider
Aider AI
Cursor
Anysphere
Continue
Continue
Goose
Block
综合评分93.090.089.088.087.092.084.082.0
计费模式按量计费按量计费免费增值免费增值免费增值免费增值免费增值免费增值
开源协议闭源Apache-2.0Apache-2.0Apache-2.0Apache-2.0闭源Apache-2.0Apache-2.0
仓库级理解
96
———————
工具执行
95
———————
可扩展性
92
———————
人机协作
90
———————
沙箱执行—
94
——————
并行任务—
90
——————
代码审查—
86
——————
开源可控—
92
——————
审批工作流——
96
—————
Plan / Act——
92
—————
MCP 支持——
90
—————
自选模型——
94
—————
免费额度———
95
————
超长上下文———
92
————
MCP 扩展———
90
————
开源———
94
———
94
Git 集成————
96
———
仓库地图————
93
———
模型无关————
95
———
架构图————
84
———
代码库索引—————
93
——
Composer Agent—————
92
——
Tab 补全—————
95
——
编辑器体验—————
94
——
完全开源——————
95
—
自托管后端——————
96
—
多模型——————
90
89
团队配置——————
88
—
通用工具———————
92
可扩展配方———————
88
优势
  • + 代码库级上下文理解
  • + MCP 生态扩展
  • + CI 脚本化非交互运行
  • + 开源可审计
  • + 沙箱隔离更安全
  • + 并行任务吞吐高
  • + 操作透明可控
  • + 完全开源
  • + 模型自由度高
  • + 免费额度实用
  • + 大上下文优势明显
  • + Google 官方维护
  • + 改动可追溯可回滚
  • + 上下文控制优秀
  • + 模型完全开放
  • + 一体化体验最完整
  • + 补全延迟极低
  • + 多文件 Agent 成熟
  • + 数据合规友好
  • + 可接本地模型
  • + 配置自由度高
  • + 通用性强
  • + 大厂维护可信
  • + 开源
短板
  • − 需要自备 API Key
  • − 闭源,无法私有部署
  • − 长任务 token 消耗较高
  • − 生态成熟度略低于 Claude Code
  • − 中文资料相对少
  • − 审批步骤多,效率偏低
  • − 重度任务需频繁确认
  • − 非 Gemini 模型支持较弱
  • − 国内网络需考虑可达性
  • − UI 朴素
  • − 长程自主任务能力一般
  • − 闭源订阅制
  • − 重度用户成本偏高
  • − 自定义 Provider 灵活度下降
  • − 配置门槛较高
  • − 默认体验不如商业产品
  • − 生态成熟度中等
  • − 文档仍在完善
适合场景
大型重构复杂 Bug 定位CI 自动化修复代码库迁移
批量任务安全敏感环境多仓库并行改造自托管需求
谨慎改动生产代码学习 AI 编程多模型对比试验
免费起步超大代码库分析文档与代码问答
重视版本控制的团队小步迭代开发多模型试验
日常主力开发大型前端项目快速原型
内网部署金融政企合规本地模型集成
流程自动化跨系统任务编排需要自托管