返回今日爆点

Gemini 4 Argon 跑分曝光,智能榜第八

Artificial Analysis 刚更新了 Gemini 4 Argon(High)的评测页面,这款 Google 的专有模型在智能指数上拿到 53 分,在 223 个同类模型中排到第 8。作为对比,同类模型的中位数只有 26 分,差距相当明显。不过它的输出也偏啰嗦,评测过程生成了 1.1 亿 token,中位数是 8200 万,属于话多型选手。

价格方面,输入每百万 token 收 2 美元,输出每百万 token 收 10 美元,缓存折扣给到 95%,跑一次智能指数任务平均花 1.99 美元。这个定价在同档位里算中等,不算便宜但也没离谱。模型支持文本和图像输入、输出文本,上下文窗口 100 万 token,约等于 1500 页 A4 纸,推理模式也是开着的。

比较有意思的是它的能力分布。智能指数包含了简报、终端编码、科学代码、人类最后考试、专业文档推理等 10 项评测,Argon 在智能维度拿了 4 分满分里的 4 分,成本维度 3 分,啰嗦程度 3 分。也就是说它聪明是真聪明,但话多也是真话多,用的时候可能得在提示词里多提醒它简洁点。

对于普通用户来说,这个模型目前还处在评测阶段,没有公开的 API 接入渠道,Hacker News 上讨论热度也就 43 分、21 条评论,不算爆款。但考虑到 Google 最近在模型迭代上的节奏,Argon 大概率是下一波 Gemini 更新的前哨。如果定价和缓存折扣能落地到实际产品里,对高频调用场景会挺有吸引力。

现在的问题是,智能指数高不代表实际体验好,尤其它输出 token 偏多,意味着同样任务可能烧更多钱。等正式开放后再看真实表现吧。

柠檬水加盐
柠檬水加盐1级 楼主
直接回复0 / 1000
0