做了一个九厂 AI 模型横评,选完模型还能继续比渠道价格

查看 70|回复 0
作者:hd264   
现在选 AI API 往往有两个不同的问题:先决定用哪家当前最强的模型,再决定从官方、云厂商还是聚合平台调用它。把同系列旧版本全摆在一起,信息很多,但对实际选型帮助不大。
所以我把页面改成两层:第一层每家只放一个当前可购买的通用领先模型,覆盖 OpenAI 、Anthropic 、Google 、xAI 、DeepSeek 、GLM 、Kimi 、Qwen 和 MiniMax ;第二层进入精确模型后,再比较它的全部 API 渠道。
目前底层数据快照包含:
  • 343 个有价格的模型;
  • 479 个当前可用渠道;
  • 21 家提供商。

    今天 OpenAI 已经发布 GPT-6 Astra ,并将它称为当前最强模型;不过官方文档同时说明,普通 API 和订阅方案要在未来几天才开放。所以页面会显示这条发布状态,但在确认到实际可用渠道前,OpenAI 行暂时保留 GPT-5.6 Sol ,不把“已经发布”写成“现在可买”。
    领先模型的选择规则是:
    [ol]
  • 每家厂商只保留当前可买到的通用模型;
  • 有 Agent Arena 分数时优先按分数选择,没有时才按发布时间;
  • 不把“刚发布”自动等同于“最强”,例如当前数据中 Grok 4.6 更新,但 Grok 4.5 的 Agent 分数更高;
  • 选定模型后再对齐精确模型 ID 比渠道,不混入旧版本;
  • 保留渠道原始结算币种,只在跨渠道排序时换算美元。
    [/ol]
    页面在这里:
    https://aiplans.dev/zh/compare/models?utm_source=v2ex&utm_medium=community&utm_campaign=model_selection_2026_09&utm_content=vendor_leaders
    项目和数据处理逻辑是开源的: https://github.com/x2v-co/aiplans
    我是这个项目的维护者。这次更想收集下面几类反馈:
  • “每厂一个代表模型”的规则是否符合你实际选 API 的方式?
  • 哪家当前代表模型选错了,为什么?
  • 哪些模型别名被错误地合并或拆开了?
  • 国内渠道的币种、地区或支付限制有没有漏记?
  • 缓存和 Batch 价格应该怎样展示才不容易误导?
  • 哪些渠道已经下线,或者价格明显过期?

    如果发现问题,最好附官方定价页或文档链接,我会按来源重新核验。
  • 您需要登录后才可以回帖 登录 | 立即注册

    返回顶部