10月7日,旧金山。OpenAI与Anthropic在同一天先后举行发布会,间隔不过几分钟。OpenAI推出GPT-6和Intelligent UI,ChatGPT从纯文本交互升级为可直接操作的界面;Anthropic发布Claude Haiku 5.5,将模型调用成本压缩至上一代的十分之一。两家公司此次更新方向呈现近年来最明显的分化:一个向AI与人交互的产品表现延伸,另一个向AI低成本大规模执行深入。
GPT-6全量推送覆盖ChatGPT超过12亿周活跃用户。付费用户使用GPT-6 Sol,免费和Go用户使用GPT-6 Luna,两个版本均针对日常对话场景做了专门优化。此次发布的重点并非模型本身,而是Intelligent UI。过去ChatGPT以文字回复为主,辅以表格或图片,本质上仍是“写给你看”。Intelligent UI改变了这一逻辑:系统可根据问题类型自主决定用文字、图表、按钮、表单还是完整的可交互工具来回应。例如用户提出“周末想自驾去露营”,系统会直接生成一张标注停靠点和绕行路线的地图;用户要求计算五人聚餐AA费用,系统可即时生成一个小型计算器,修改数字后结果实时更新。
技术层面,这套交互能力基于一套原生可流式传输的组件库和编译器。界面元素随模型生成逐步渲染,无需等待完整回答加载完毕。界面不再是预设的,而是被编译出来的。此外,GPT-6支持“边思考边回答”,推理过程中即可开始返回内容,后续发现再逐步补充。在联网搜索场景下,首字输出等待时间比上一代缩短了44%。这是OpenAI在交互层的一次激进押注:模型能力已足够强,接下来竞争的是如何将这种能力翻译成人能直接使用的产品形态。
同一天,Anthropic走了一条相反的路。Claude Haiku 5.5是Claude 5.5系列的第三款模型,此前已有旗舰Opus 5.5和中型Sonnet 5.5。Haiku 5.5定位明确:高频、低成本任务。价格方面,对于不超过10万token的请求,输入每百万token为0.10美元,输出0.50美元,比上一代Haiku 4.5下降90%,平均运行成本下降约75%。
这一代Haiku的升级不仅在于价格。上一代Haiku 4.5在编程任务Terminal-Bench上的得分为0,Haiku 5.5提升至39.2%;电脑操作测试OSWorld从15.7%跃升至72.4%,超过同级别的GPT-6 Luna(48.9%)。Anthropic首次为Haiku加入可调节推理强度,从Low到Max共五档,开发者可根据任务复杂度灵活分配算力。更值得关注的是定位变化:Anthropic明确Haiku 5.5可作为Opus 5.5和Sonnet 5.5的“子智能体”使用,旗舰模型负责规划和决策,Haiku承担文档整理、电脑操作、数据处理等具体执行任务。旗舰模型调用一次的成本,现在可拆分为“旗舰调用一次加Haiku执行十次”,总成本反而更低。Anthropic同步将Sonnet 5.5的缓存读取价格下调50%,并向Max和Team订阅用户提供月度API积分。这不是单一模型的定价调整,而是一次系统性的成本结构重组。
两家公司做出截然不同选择的背景是,模型本身正在变成大宗商品。OpenRouter数据显示,今年年初Anthropic在企业AI支出中的份额约占四分之三,但到9月份,OpenAI和Anthropic获得的支出份额已大致相当。企业不再绑定单一模型供应商。当模型能力趋同、价格持续下探,单纯的“模型更强”不再是决定性优势,真正的竞争变量转向了模型如何进入真实工作流,以及如何以更低成本完成更多任务。
OpenAI的回应是向上走,抢占用户接触AI的入口。Intelligent UI将ChatGPT变成一个能生成各种工具的通用平台,用户越依赖这个入口,迁移成本就越高。Anthropic的回应则是向下沉,成为最高效的模型供应商,通过把单位任务成本压到极致,让大规模Agent部署在经济上变得可行。一个抢入口,一个拼效率,方向相反,但都在回答同一个问题:当模型不再稀缺,价值在哪里。
经过2026年上半年的发展,Agent商业化竞争模式正逐步浮出水面。2026年全球日活智能体从上一年的2860万个跃升至7940万个,预计2030年将达到22亿个。Agent正在从技术演示走向实际的生产力工具,但能否大规模运行,核心瓶颈并非模型够不够聪明,而是跑不跑得起。Haiku 5.5瞄准的正是Agent执行层的成本问题,让大量因调用成本过高而无法运行的高频任务首次在经济上变得可行。
与此同时,行业里Harness(编排层)概念开始被频繁提及。Harness是模型和业务场景之间的中间层,负责把用户需求拆解成Agent能执行的任务序列,调度不同模型完成不同环节,最终交付可用结果。有研报指出,在基础模型加速商品化的背景下,Harness编排层正在成为产业商业化的高价值新增长极。谁能沉淀业务工作流和上下文路由能力,谁就更接近企业AI落地的核心壁垒。OpenAI的地基是用户和数据,Anthropic的地基是成本和效率,两家巨头的布局本质上都是在为各自的Agent生态打地基。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。