多智能体规划几分钟烧光额度,开发者无奈退回Claude旧版
在科技社区 Hacker News 的最新讨论帖中,有开发者分享了自己在日常开发中选用默认 AI 模型的纠结经历。该开发者表示,自己平时主要使用 Claude 处理各项工作,但在尝试用 4 个智能体(Agents)进行移动应用的前期架构规划时,高阶配置频繁在短短几分钟内耗光其最高档(Max)订阅计划的会话额度。
更让人头疼的是,在熬过长达 6 小时的限制等待期重新开始后,又因为缓存失效,不到一分钟内就再次烧掉了 2% 的额度。在额度见底和限流的反复折腾下,该开发者目前将 Opus 4.8 作为主力默认模型,并表示在看到充分的切换理由之前会避开 5 系列,认为 4.8 的能力对自身需求来说已经完全够用。
多智能体协同虽然能拆解复杂任务,但多轮上下文调用和缓存过期带来的额度消耗,确实让不少实际干活的开发者感到肉痛。在实际开发中,顶配模型的高成本与严苛配额常常难以兼顾长期运行,选择“够用且稳”的旧版本反而成了不少人的务实选择。大家平时跑复杂工作流或多 Agent 任务时,默认更倾向于用哪种模型?