模型对比
两个或多个模型在同一任务上的差异:基准分、上下文、价格与实际适用场景。
GPT-5.6 Sol vs Terra vs Luna:三档对比与选型指南
GPT-5.6 默认选哪档:日常 Terra,跑量 Luna $0.20/$1.20,难任务 Sol $5/$30。OpenAI 的 @thsottiaux 2026-07-29 帖(2026-08-30 抓取):未削减套餐用量,Sol 消耗快于预期,典型使用大约多撑 18%。
更新于 2026-08-30
GLM-5.3-Flash vs DeepSeek V4 Flash
两个在售 Flash:官方价、1M 窗、MIT;同一端点切换
更新于 2026-08-30
对比 · 都已发布
AA 智指 52 vs 55。每任务 $0.06 vs $1.54。速度 115 vs 69 tok/s。都是 1M 上下文。Flash 开源;Sonnet 是 Claude 默认。
更新于 2026-08-30
2026 下半年 AI 编程模型选型指南
决策框架 + 三大阵营现状 + 本站选型内容导航。
更新于 2026-08-30
AI编程工具评测
更新于 2026-08-27
Kimi K3 vs GPT-5.6 Sol
开源旗舰对闭源旗舰:1.2 分差与一个数量级的价差
更新于 2026-08-22
GLM-5.3 vs Kimi K3
并列开源榜首的两条路线:后训练 vs 大基座
更新于 2026-08-22
GLM-5.2 vs DeepSeek V4 Pro
涨价后的开源旗舰账:谷时 DeepSeek,高峰 GLM
更新于 2026-08-22
Claude Opus 5 vs GPT-5.6 Sol
半个百分点的战争:基准打平后比什么
更新于 2026-08-22
对比 · 都已发布
Opus 5 在多数独立聚合上领先(约 83 vs 80),区间重叠。K3 是 2.8T、1M、原生视觉、$3/$15、开源权重。K3 官方博文称仍落后 Fable 5 与 Sol。
更新于 2026-08-14
V4 Pro 0813 对比 GPT-5.6 Sol
开源 1.7T agent 旗舰对闭源 GPT-5.6 顶档:智能指数 53 对 61,价格 $0.435/$0.87 对 $5/$30。
更新于 2026-08-14
对比 · 同一张表
同一张 HF 表:TB2.1 87.9 vs 88.0,DeepSWE 62.7 vs 70.0,HLE 带工具 60.0 vs 63.0。多数行仍是 Fable;Pro 赢价格和 MIT 权重。
更新于 2026-08-14
Claude Sonnet 5 对比 Sonnet 4.6:API 迁移与升级指南
如何从 Claude Sonnet 4.6 迁移到 Sonnet 5:只需就地替换模型 id,再处理 3 项破坏性变更(自适应思考默认开启,手动思考及非默认的 temperature/top_p/top_k 现在会返回 400),以及新分词器对相同文本多计约 30% token 的影响,还有为什么 Sonnet 4.6 并未退役。
更新于 2026-08-14
Claude Sonnet 5 对比 Opus 4.8:价格、编程与智能体全面对比(2026)
Claude Sonnet 5 与 Opus 4.8 对比:Sonnet 5 便宜约 40%,性能接近 Opus 4.8,但 Opus 4.8 在最难的编程、判断和网络安全任务上仍然领先。规格、诚实基准、定价与路由框架。
更新于 2026-08-14
Claude Sonnet 5 对比 GPT-5.6 与 Gemini 3.1 Pro:一次诚实、不炒作的比较
Anthropic、OpenAI 与 Google 之间没有统一的基准测试——所以请从价格、性价比与可用性去比较 Claude Sonnet 5、GPT-5.6 与 Gemini 3.1 Pro,而不是单一分数。诚实的规格、留白的基准单元格,以及如何用一把 QCode 密钥试用三者。
更新于 2026-08-14
Fable 5 vs Sol 旗舰对比
价格、上下文窗口与跑分口径对比,附 QCode 调用说明
更新于 2026-08-08
GPT-5.6 对比 Claude Opus 4.8 —— 基准测试、定价与状态(2026 年 6 月)| QCode.cc
GPT-5.6 对比 Claude Opus 4.8:两者均已全面开放 —— Terminal-Bench 88.8% vs 78.9%,定价 $5/$30 vs $5/$25。经事实核查的对比,两款均可经 QCode 使用。
更新于 2026-07-19
GPT-5.5 vs Claude 4.8:2026 旗舰 AI 模型深度对比
2026 年两大旗舰模型 GPT-5.5 与 Claude 4.8 对比测评——编码可靠性、长上下文、agentic、多模态、价格、API 性能全方位 benchmark。QCode 提供两者 开发者平台,套餐覆盖多个 CLI 工具。
更新于 2026-07-10
GPT-5.5 vs Claude 4.7:2026 旗舰 AI 模型深度对比
2026 年两大旗舰模型 GPT-5.5 与 Claude 4.7 对比测评——推理、编码、长上下文、多模态、价格、API 性能全方位 benchmark。QCode 提供两者 开发者平台,套餐覆盖多个 CLI 工具。
更新于 2026-07-10
Claude Code vs Cursor: 2026年两大AI编程工具深度对比
Claude Code 与 Cursor 深度对比:模型能力、上下文窗口、执行方式、价格、Agent 能力全面比较,帮你选择最适合的 AI 编程工具
更新于 2026-03-27
AI编程工具对比:Claude Code vs Cursor vs Gemini CLI
深度分析 Claude Code、OpenAI Codex、Cursor 3、Google Antigravity 2.0、GitHub Copilot 等主流 AI 编程工具(2026-08 更新:Cursor 3 Agents Window、Antigravity 五 surface、SpaceX 收购 Cursor)。QCode.cc 一套套餐多 CLI 工具。
更新于 2026-03-26