OpenAI推出了GPT-6 Sol和Luna,价格比GPT-5.6降低了50%,但Anthropic发布的Claude Opus 5.5成为当天的焦点。Opus 5.5是Claude 5.5系列的首款模型,性能与Claude Fable 5.1相当,运行成本比Opus 5降低40%。
Opus 5.5在大多数基准测试中优于Fable或挑战Astra,得益于预填充、解码和整体计算效率的大幅提升,尽管在某些前沿任务中存在令牌使用效率的折衷。
此次发布特别强调了写作能力的提升,模型能够将最重要的信息置于前端,并遵循用户设定的写作规则,使长时间对话更易于理解。AINews已开始使用Opus 5.5替代旧模型。

Anthropic还发布了关于大规模多智能体系统的初步研究,展示了效率提升。
主要亮点
- Opus 5.5在大多数任务上表现与Fable 5.1相当,运行成本降低40%。
- 速度提升约30%,订阅用户的会话时长限制增加20%,价格降低使使用限制提升25%。
- Opus 5.5已成为Claude Code和Claude应用的默认模型。
- 未来几周将推出Sonnet 5.5和Haiku 5.5,否认了Haiku停产的传言。
- 安全防护方面,Opus 5.5首次配备了Fable 5.1级别的网络、生物和前沿LLM开发安全措施。
价格与令牌经济
- 令牌价格下调20%,从每百万输入/输出令牌5美元/25美元降至4美元/20美元。
- 由于令牌使用量增加,尤其是在编码任务中,实际成本节约在高强度使用时有所抵消。
- 在最大努力模式下,每任务成本约为5.98美元,接近Opus 5的5.86美元。
基准测试与评估
- Opus 5.5在Anthropic官方基准中全面超越Fable 5.1,并在多数测试中优于GPT-6 Astra。
- 第三方评测显示其在编码、科学、健康和安全防护方面表现优异。
- 在某些任务中,高强度推理反而导致性能下降,建议使用中等强度设置。
写作与行为改进
- 解决了之前模型的写作问题,提升了信息传递的清晰度。
- 取消了输出中的破折号,改进了文本风格。
- 提供了新的提示策略,优化长时间对话的表现。
视觉与代码艺术演示
- 3D理解和建模能力显著提升,模型具备了更好的视觉感知能力。
- 展示了用纯Python代码绘制画作和生成Blender场景的能力。
业界反应
- 支持者称Opus 5.5修复了之前模型的缺陷,用户回归使用。
- 也有质疑声音,担心信任度和价格优势的实际意义。
- 与OpenAI的GPT-6 Sol对比,Opus 5.5在性能上占优,但Sol价格更低。
OpenAI的回应
OpenAI迅速推出了GPT-6 Sol和Luna,继承了GPT-6 Astra的多项改进,价格分别为每百万输入/输出令牌2美元/10美元和0.10美元/0.50美元,约比前代模型便宜50%。这些模型已部署于ChatGPT Work、Codex及API中,Luna也向免费用户开放,但尚未支持聊天模式。
OpenAI强调其成本效益,Sol在自动化基准测试中以约9%的任务成本击败Claude Opus 5最大努力模式,Luna在离线测试中表现优异,成本仅为前代的十分之一。
此外,OpenAI改进了缓存和推理效率,推出了提示缓存仪表盘和诊断API,帮助用户优化长时间运行的智能体性能。
其他技术进展
- DigitalOcean发布了支持Claude Code、Codex和LangGraph风格智能体的托管运行时预览。
- Perplexity通过实际用户数据进行后训练,显著减少工具调用失败。
- 多模态模型方面,Qwen-Image-2.1在社区排行榜表现优异,PixVerse发布实时世界模型,AssemblyAI推出多语言同步语音转文本服务。
社区讨论热点
- Claude Opus 5.5发布引发广泛关注,OpenAI的GPT-6 Sol和Luna紧随其后。
- 数字海洋托管智能体和OpenAI的AI治理标准提案也成为讨论焦点。
- AI成本曲线持续下降,推动行业快速发展。
Reddit社区动态
- Qwen4-27B确认即将发布,社区关注其性能和本地推理能力。
- 阿里巴巴计划推出5万亿至10万亿参数规模的AI模型,配合新AI芯片,目标远超当前本地部署能力。
整体来看,Claude Opus 5.5以其高效能和低成本优势成为AINews的新默认模型,而OpenAI则通过更低价格的GPT-6 Sol和Luna保持市场竞争力。两者在性能和经济性上各有千秋,推动了AI模型的快速迭代与应用普及。

