• 请不要在回答技术问题时复制粘贴 AI 生成的内容
hihihihihi
V2EX  ›  程序员

Reasoning (low/medium/high/xhigh/ultra/max...) 如何选择?

  •  
  •   hihihihihi · 3 days ago · 1298 views

    我之前一直都是顶着 max/ultra 跑,现在模型越来越贵,一个月花了几百美金实在是不够用,开始要审视模型的 token 消耗了

    我看了下 https://artificialanalysis.ai/agents/coding-agents?agents=codex-gpt-5-6-sol-max%2Ccodex-gpt-5-6-sol-high%2Ccodex-gpt-5-6-sol-low%2Ccodex-gpt-5-6-sol-medium%2Ccodex-gpt-5-6-sol-none%2Ccodex-gpt-5-6-sol-xhigh%2Cclaude-code-opus-5-high%2Cclaude-code-opus-5-low%2Cclaude-code-opus-5-max%2Cclaude-code-opus-5-medium%2Cclaude-code-opus-5-xhigh%2Cgrok-build-grok-4-5-high%2Cclaude-code-glm-5-2&coding-agents-token-usage-chart=token-usage

    其实这些模型的 Artificial Analysis Coding Agent Index 差别不大, 但是 Token Usage 差异巨大,导致最终的成本差异也巨大

    https://i.imgur.com/TOMmYvP.png

    https://i.imgur.com/EY0cfYX.png

    https://i.imgur.com/LotPrzn.png

    所以,请问各位大佬,平时 vibecoding ,一般在推理上怎么做选择,到底差异大不大,我自己体感是差异没那么大,难道做 plan 先用强模型,执行用稍微弱一点的?

    5 replies    2026-07-27 11:47:44 +08:00
    hihihihihi
        1
    hihihihihi  
    OP
       3 days ago




    JarvisLee
        2
    JarvisLee  
       3 days ago
    差异不大,每次请求的大部分花费在上下文上
    sakurajiayou
        3
    sakurajiayou  
    PRO
       3 days ago
    我使用的 high ,感觉已经够用了
    fovecifer
        4
    fovecifer  
       3 days ago
    你这个问题可以问 AI ,我偶尔也会问问它,大部分复杂场景,倒数第二档就够了
    lel020
        5
    lel020  
       2 days ago
    我会参考 https://codexradar.com/ 这种外部测试,从上到下找当天看得顺眼的用,实际并没有统一的标准,也不根据实际任务复杂度,
    最近主要用 sol medium/terra max/terra ultra
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   5325 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 48ms · UTC 09:03 · PVG 17:03 · LAX 02:03 · JFK 05:03
    ♥ Do have faith in what you're doing.