Anthropic 发布 Claude Opus 5,在第三方评测集 AA-Briefcase 中成为智能体知识工作能力的新标杆。据 Artificial Analysis 公布,该模型在最高效能设置下,不仅性能超越 Claude Fable 5,且单次任务成本降低了 20%。
Fable 5.1 或将于 8 月发布,旨在通过快速迭代直接竞争 GPT-6。据 Pankaj Kumar 披露,该版本目前正处于准备阶段。
Anthropic 正式发布 Claude Opus 5,该模型在保持与 Opus 4.8 相同定价的同时,在代码编写与知识工作能力上达到了新高度,部分指标接近顶级模型 Claude Fable 5。据 Anthropic 官方博文,Claude Opus 5 已成为 Claude Max 的默认模型以及 Claude Pro 平台上的最强模型。
Anthropic 或将于今日发布新一代旗舰模型 Claude Opus 5,其 benchmark 性能预计与 Fable 5 相当,但不会实现超越。
Claude Cowork 发布教导技能新功能,支持用户通过录屏与口述将复杂任务转化为可重复执行的技能。据 Claude AI 官方披露,该功能已集成至 Claude 桌面端应用中。
月之暗面今天已正式发布 Kimi K3 模型,其参数量预计达 2T 至 3T,有望在主流 benchmark 上超越 Anthropic 的 Opus 4.8。据 Financial Times 报道,Kimi K3 将以 open-weight 形式开放下载,挑战美国顶级实验室在最前沿模型上的领先地位。
Kimi K3 或于 7 月 16 日正式发布,该模型定位于 Opus 4.7 级别的编程模型,在部分编程评测中表现优于 GPT 5.5 和 GPT 5.6 Terra。据 X 用户 ChrisSGPT 披露,Kimi K3 目前已在 Beta 站点上线并进入 Arena 评测阶段。
据 社交平台爆料,Anthropic 正在进行 Claude Opus 5 发布的最后准备工作,计划最快于本周内推出。
Claude Code 的 Artifacts 功能现已支持公开分享与多人实时协作编辑,并可通过 Claude Tag 直接创建。据 ClaudeDevs 官方披露,这些更新旨在将 Artifacts 从单纯的个人原型工具转变为可对外发布且支持团队协作的生产力组件。
Anthropic 发布 Claude 反思功能(Reflect) Beta 版,旨在帮助用户通过可视化仪表盘分析 AI 使用习惯,优化人类与 AI 的协作模式。据 Anthropic 官方博文,该功能允许用户回顾过去 1 到 12 个月的使用模式,并结合 4D AI 流畅度框架提升协作技巧。
SpaceXAI 发布 Grok 4.5 模型,在 AutomationBench-AA 自动化评测中取得 51% 的得分,位列全球第一。据 SpaceXAI 官方公告,该模型在维持 Opus-4.8 级性能的同时,大幅降低了单次任务成本,且在处理复杂 SaaS 工作流时展现出极高的 token 效率。
据 社交媒体爆料,OpenAI 的 GPT-6 或将在本月或下个月内提前发布,其底座模型规模较 GPT-5 系列显著增加。同时,Anthropic 的 Fable 5.1 与 DeepSeek V4 GA 也被曝出将近期推出,三家厂商正进入新一轮的模型发布窗口期。