Anthropic 发布 Claude Sonnet 5.5,更快更便宜并入驻 claude.ai 免费层
Anthropic 发布新模型 Claude Sonnet 5.5,官方称运行速度快 30% 以上、多数任务成本降低最多 30%,定价与 Sonnet 5 相同但各项基准均更优。
推荐理由:作者实测了 Claude Sonnet 5.5 的速度、成本与免费层表现,并与 Opus 5.5 及 ChatGPT 免费层对比,可帮助判断模型选型。
Anthropic 发布新模型 Claude Sonnet 5.5,官方称运行速度快 30% 以上、多数任务成本降低最多 30%,定价与 Sonnet 5 相同但各项基准均更优。
推荐理由:作者实测了 Claude Sonnet 5.5 的速度、成本与免费层表现,并与 Opus 5.5 及 ChatGPT 免费层对比,可帮助判断模型选型。
Anthropic 发布 Claude 5.5 家族第二款模型 Sonnet 5.5,官方称其输出速度比前代快三成以上、按任务成本低最多三成,编码与知识工作多项基准接近 Opus 5.5。
Google DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,3.8 Flash 保持与 3.7 Flash 相同的每百万输入 token 0.75 美元、输出 3.75 美元定价。
推荐理由:原文给出 3.8 Flash 的定价、编码与智能体基准成绩,以及 Cyber 版的安全管控方式,可据此判断其在企业自动化中的定位。
Google DeepMind 今日推出 Gemini 3.7 Flash,定位为迄今最智能的编码与智能体工作负载模型,距离 3.6 Flash 发布仅三周。相比 3.6 Flash,它在编码基准 FrontierCode 1.1(43.6% 对 34.4%)和 DeepSWE v1.1(65.3% 对 49.0%)上显著提升,并改善网页开发与多领域知识推理能力。
推荐理由:原文给出了 3.7 Flash 相比 3.6 Flash 在编码、网页开发和领域推理上的基准提升数据及首发优惠价,可帮开发者判断升级价值与性价比。
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。
推荐理由:官方放出三款Flash模型的token效率、速度与价格数据,可据此评估它们对规模化智能体工作流的实际价值。
Google DeepMind 发布 Gemini 3.5 系列,首批推出 3.5 Flash,主打智能体与编码,今天面向 Gemini 应用、Google 搜索 AI 模式及 Antigravity 等平台开放。
推荐理由:官方给出了 3.5 Flash 的基准成绩和开放渠道,可据此判断它在智能体任务上的速度与成本取舍。