RECOMMENDATIONS
选型推荐
每种需求给出前 3 个候选模型,并说明判断依据。所有候选均来自实时榜单,价格随上游更新。
零成本起步
◇ 综合评分 · $0 / 月
- 1Qwen3.8 27B (free)Alibaba · 262K ctx免费89.3
- 2Gemma 4 26B A4B (free)Google · 262K ctx免费88.4
- 3Gemma 4 31B (free)Google · 262K ctx免费88.4
先用免费模型验证需求是否成立,避免在没验证前就付费。免费端点通常有速率限制,批量任务需注意。
日常主力
◑ 性价比指数 · 按量付费
- 1MiMo-V2.6-ProXiaomi · 1M ctx$0.87098.8
- 2MiniMax M3MiniMax · 524K ctx$1.2098.3
- 3GPT-6 Luna ProOpenAI · 1.1M ctx$0.50097.7
能力与成本的平衡点。日常对话、摘要、翻译等任务在性价比榜前列的模型上表现已足够。
编程优先
⌘ 编程指数 · 按量付费
- 1MiMo-V2.6-Pro-UltraSpeedXiaomi · 1M ctx$8.7094.1
- 2MiMo-V2.6-ProXiaomi · 1M ctx$0.87094.1
- 3Qwen3.8 Max PrimeAlibaba · 1M ctx$12.0093.7
代码生成与重构任务对模型能力更敏感,建议在编程榜靠前的模型中选,而不是只看综合分。
Agent / 长程任务
◈ 智能体指数 · 按量付费
- 1Qwen3.8 Max PrimeAlibaba · 1M ctx$12.0095.8
- 2GPT-6.1 Sol ProOpenAI · 1.1M ctx$10.0095.8
- 3GPT-6.1 SolOpenAI · 1.1M ctx$10.0095.8
工具调用、结构化输出与长上下文决定 Agent 能否稳定跑完流程,这三项比单纯的总分更重要。
国产替代
中 综合评分 · 按量付费
- 1MiMo-V2.6-Pro-UltraSpeedXiaomi · 1M ctx$8.7095.2
- 2MiMo-V2.6-ProXiaomi · 1M ctx$0.87095.2
- 3Qwen3.8 Max PrimeAlibaba · 1M ctx$12.0094.2
中文任务与本土生态优先。国产模型在中文理解上的加权评分普遍高于海外同档产品。
长文档 / 大上下文
⤢ 上下文窗口 · 按量付费
- 1Grok 4.20X Ai · 2M ctx$2.502000000.0
- 2Grok 4.20 Multi-AgentX Ai · 2M ctx$2.502000000.0
- 3GPT-6.1 Sol ProOpenAI · 1.1M ctx$10.001050000.0
处理长文档、整仓代码时,上下文窗口往往比总分更关键——超窗会直接截断。
多模态
◉ 多模态指数 · 按量付费
- 1MiMo-V2.6-Pro-UltraSpeedXiaomi · 1M ctx$8.70100.0
- 2MiMo-V2.6-ProXiaomi · 1M ctx$0.870100.0
- 3Gemini Pro Latest~google · 1M ctx$12.00100.0
需要读图、看截图、理解 PDF 时,必须确认模型支持对应的输入模态。
高性价比入门
$ 能力 / 美元 · 严格控成本
- 1Mistral NemoMistral AI · 131K ctx$0.0302243.3
- 2Ling 3.0 Flash VLinclusionAI · 262K ctx$0.0602182.5
- 3Ling 3.0 FlashinclusionAI · 262K ctx$0.0601995.0
每美元能换到多少能力。在调用量大但任务不复杂的场景下,这个指标比绝对能力更有意义。
通用选型原则
- 1. 先用免费模型验证任务是否值得做,再决定要不要上更贵的模型。
- 2. 按任务类型选榜单,不要只看综合总分——编程任务看编程榜,Agent 任务看智能体榜。
- 3. 确认上下文窗口能覆盖你的输入长度,超窗会静默截断,效果会突然变差。
- 4. 需要多模态输入时,务必确认模型声明支持对应输入模态。
- 5. 长链路 Agent 建议开启 prompt caching,输入成本通常能降到 1/5 以下。
- 6. 用 /calculator 按真实用量估算月成本,别用「感觉不贵」做判断。