阅读,与值得关注的内容Readance

突发!Claude、GPT同时发布新模型

今天凌晨,OpenAI和Anthropic几乎前后脚更新了模型。

Anthropic 发布 Claude Opus 5.5,OpenAI 则一口气发布 GPT-6 Sol 和 GPT-6 Luna

有点像约好了。


而且两边这次升级的方向都很一致:能力继续涨,但重点开始放在速度、价格和实际干活效率上。

先看Claude Opus 5.5。

这次主要升级了几个地方:

1、Coding 更强了。

Anthropic 重点强调了Agent Coding,尤其是大型代码库、跨文件修改、代码审查、长时间运行任务。

比如 Anthropic 的测试里,让 Opus 5.5 审计和修改一个 20 万行代码库,不到 3 小时完成,而 Opus 5 要跑 20 多个小时。

图像

2、电脑操作和知识工作继续提升。

除了写代码,Opus 5.5 在电脑操作、商业分析、资料研究、数据处理等任务上都有提升,官方甚至直接把它定位成更适合“真正干活”的模型。

3、更快,也更便宜。

这是这次很重要的一个变化。

典型任务成本比 Opus 5降低约40%,输出速度提升超过 30%;Input / Output API 价格也从每百万 Token 5/25 美元降到了 4/20 美元,缓存读取价格更是降低了 60%。

另外,Claude还专门优化了写作体验:回答更直接、更少黑话,也不会像以前一样动不动写一大堆。

再看 GPT-6。

准确来说,这次 OpenAI 发的是 GPT-6 Sol 和 GPT-6 Luna

Astra 继续坐在最上面,Sol 和 Luna 则负责把 GPT-6 的能力真正铺到日常使用里。

GPT-6 Sol更偏专业工作和Coding。

OpenAI 重点升级了专业办公、事实准确性、编程和电脑操作。

其中一个比较明显的变化是幻觉继续下降:OpenAI 称 Sol 在内部事实准确性测试里的错误数量,大约只有上一代的一半。

Coding 也有明显升级,包括复杂软件工程、跨代码库任务,以及更长时间运行的 Coding Agent。

图像

GPT-6 Luna 则继续负责便宜和快。

能力虽然低于 Sol 和 Astra,但它的重点就是让大量日常任务、Agent 调用和后台任务可以低成本运行。

甚至在部分软件工程测试里,Luna 已经能做到接近上一代更高级模型的水平。

GPT-6 这次还有一个挺实用的优化:

说话终于继续“去 AI 味”了。

OpenAI 官方特意提到,新模型会减少黑话、奇怪句式和没什么价值的废话,回答整体会稍微变短,但信息量不会减少。

价格也很猛。

Sol 和 Luna 的 API 价格,相比 GPT-5.6 对应型号的优惠价格,直接再降 50%。

所以我觉得,Claude Opus 5.5 和 GPT-6 这次最值得看的,并不是谁跑分高了几分。

而是两家公司同时在做一件事:

让顶级模型开始变得更快、更便宜、更适合长时间干活。

以前模型发布会,大家拼的是:

“我比你聪明。”

现在已经开始变成:

“我不但聪明,我干活还比你便宜。”

对于Coding、Agent 和 AI 办公来说,降价,可能比多涨几个跑分重要得多。

另外,两家公司的重置福利也都来了,大家抓紧蹬吧。


前往微信阅读全文

内容来自公众号,可前往微信查看原文。

查看作者的更多文章 →