Anthropic 发布 Claude Haiku 5.5,价格最高下调 90%
Anthropic 发布 Claude Haiku 5.5,称这是其最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,对 10 万 token 以内的提示词降价最高达 90%,超过 10 万 token 的提示词价格则贵五倍。
推荐理由:Haiku 5.5 的降价幅度与 token 消耗上升同时出现,读者可据此判断小模型价格战的真实成本结构。
Anthropic 发布 Claude Haiku 5.5,称这是其最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,对 10 万 token 以内的提示词降价最高达 90%,超过 10 万 token 的提示词价格则贵五倍。
推荐理由:Haiku 5.5 的降价幅度与 token 消耗上升同时出现,读者可据此判断小模型价格战的真实成本结构。
GitHub 发布 ReviewBench,一个面向 AI 代码审查智能体的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含来自 187 个开源仓库、覆盖 19 种语言的 219 个 pull request。
推荐理由:GitHub 公开了代码审查基准的构建方法与离线在线信号对照数据,可据此判断评测结果能否预判线上表现。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,后续再面向开发者、企业和消费者推出,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元。
推荐理由:官方给出 Argon 在编码、企业知识与网络安全防御上的基准成绩和分阶段开放路径,可据此判断前沿模型的能力边界与落地节奏。