Anthropic 发布 Claude Opus 5:一半价格,九成实力,最强“性价比之王”来了
2026年7月24日Anthropic 正式发布 Claude Opus 5。这是 Opus 家族的一次重大升级——性能大幅跃升价格却一分没涨。Anthropic 对 Opus 5 的定位非常清晰它是一款“体贴且主动”的模型以一半的价格提供接近旗舰 Claude Fable 5 的智能水平。Opus 5 已成为 Claude Max 的新默认模型也是 Claude Pro 上能用到的最强模型。如果说 Fable 5 是 Anthropic 的“性能天花板”那 Opus 5 就是那个让普通开发者和企业真正用得起的“实力派”。一、性能跃升多个基准测试登顶价格一分不涨Opus 5 的亮点可以用一句话概括同样价格性能翻倍。在 Frontier-Bench v0.1 上Opus 5 超越了所有其他模型性能是上一代 Opus 4.8 的两倍多而单任务成本更低。在 CursorBench 3.2 上Opus 5 在最大努力模式下性能达到 Fable 5 峰值得分的 99.5%差距仅 0.5%但单任务成本只有 Fable 5 的一半。知识工作和问题解决类任务同样出色ARC-AGI 3解决新颖问题的推理测试Opus 5 的得分是第二名模型的三倍Zapier AutomationBench端到端完成业务任务的能力Opus 5 的通过率约为第二名模型的 1.5 倍即使在最低努力模式下通过的任务数也超过任何其他模型OSWorld 2.0计算机使用基准Opus 5 在任意给定成本下都优于所有其他模型仅用 Fable 5 三分之一左右的成本就超越了其最佳成绩。在科学研究领域Opus 5 在生命科学评估的每一项上都优于 Opus 4.8涵盖结构生物学、有机化学和生物信息学等领域。最亮眼的是有机化学任务——从光谱数据推断分子结构Opus 5 比 Opus 4.8 高出10.2 个百分点蛋白质相关任务则高出7.7 个百分点。更难得的是这一切性能提升建立在与 Opus 4.8 完全相同的定价之上输入每百万 tokens 5 美元输出每百万 tokens 25 美元。此外Opus 5 还提供 Fast 模式运行速度约为默认的 2.5 倍价格为基准的两倍。二、真实场景验证不只是跑分更是干活利器基准测试之外早期用户的反馈更能说明 Opus 5 的真实水平。案例一看不见图纸自己写视觉管道在一个 Frontier-Bench 任务中Opus 5 拿到一张机器零件的图纸要求编写代码将其重建为 3D FreeCAD 模型。但任务设计者故意没有给模型任何直接查看图纸的方式。Opus 5 的反应是自己写了一套计算机视觉管道从原始像素中提取几何信息然后完整重建了机器零件。它反复成功地完成了这一任务而同等设置下的竞品模型尝试五次均告失败。案例二找到社区补丁遗漏的根因面对一个流行的开源包管理器中的真实 BugOpus 5 找到了根因并修复了社区补丁遗漏的一个边缘情况。而竞品模型只修复了表面症状就报告问题已解决。案例三单会话构建完整市场数据源一家交易公司的工程师用 Opus 5 在单次会话中为一个新交易所构建了完整的市场数据源。之前的模型即使有工程师提供的详尽计划也无法完成这项任务。更令人惊叹的是由于找不到实时数据源做验证Opus 5 自己构建了一个测试工具来检查代码是否正确解析了交易所的数据。其他用户的反馈同样印证了 Opus 5 的实用性ZapierOpus 5 登顶其 AutomationBench 排行榜在端到端客户流失预防任务中达到100% 通过率而之前的模型未能通过LovableOpus 5 在其最难的自主体编码任务上**比 Opus 4.7 提升了 22%**且运行间方差大幅降低一致性更强BoxOpus 5 在数据分析工作流中比 Opus 4.8 提升 **11%**在尽职调查工作流中提升 **17%**某金融模型测试Opus 5 在所有努力水平上平均准确率比 Opus 4.8 高出 9 个百分点同时**减少了三分之一的对话轮次和工具调用耗时缩短 60%**。三、对齐与安全Anthropic 史上最“听话”的模型强大的能力往往伴随着更大的风险。Anthropic 在安全方面的投入是 Opus 5 另一个值得关注的亮点。在部署前的自动化行为审计中Opus 5 成为 Anthropic 迄今对齐程度最高的模型。它比 Opus 4.8、Sonnet 5 和 Fable 5 都更好地遵守了 Claude 的宪法原则欺骗行为发生率最低最不容易被诱骗滥用在避免可能产生难以逆转副作用方面也是 Anthropic 最安全的模型。在风险能力方面Opus 5并未推进生物研究和攻击性网络安全等具有双重用途的高风险能力前沿。虽然由于通用能力的提升Opus 5 在发现软件漏洞方面已接近 Mythos 5但在将漏洞转化为实质性网络威胁的利用开发方面仍远远落后于 Mythos 5。安全防护方面Opus 5 的分类器拦截频率预计**比 Fable 5 低约 85%**——这意味着在日常使用中用户被安全策略“误伤”的概率大幅降低。在 Claude.ai、Claude Code 和 Claude Cowork 中被标记的请求会默认回退到 Opus 4.8。对于已加入网络安全验证计划的企业和研究人员可立即获得限制更少的 Opus 5 版本。在生物学方面Opus 5 已成为Anthropic 公开发布的最强科研模型。此次发布后Fable 5 上被拦截的生物学相关请求将路由到 Opus 5 而非 Opus 4.8。四、两大更新开发者体验再升级伴随 Opus 5 的发布Anthropic 还推出了两项 Beta 功能1. 对话中工具变更开发者现在可以在对话过程中更改 Claude 可用的工具而无需使提示缓存失效。这意味着长对话中的工具切换更加灵活高效。2. API 自动回退用户可以选择让被安全分类器标记的请求自动路由到另一个模型。开启后API 请求默认始终路由到最佳可用模型而不是被直接拦截。五、给创业者的实战建议1. 重新算一笔“性能/成本”账Opus 5 的核心价值在于以 Opus 4.8 的价格获得接近 Fable 5 的性能。对创业公司而言这意味着可以在不增加推理成本的前提下将产品中的 AI 能力提升一个档次。如果你之前因为 Fable 5 的成本望而却步现在正是重新评估技术选型的时候。2. 充分利用“努力程度”调节Opus 5 支持不同级别的“努力程度”设置用户可以在智能度和 Token 消耗之间灵活调节。对创业公司来说这意味着可以根据任务复杂度动态调配资源——简单任务用低努力模式省钱复杂任务切高努力模式保质量。这种灵活性在控制成本方面价值巨大。3. 安全不再是“拦路虎”Opus 5 的安全拦截频率比 Fable 5 低约 85%。对开发者来说这意味着在日常编码和业务自动化场景中被安全策略打断的概率大幅降低。如果你之前因为 Fable 5 的“过度防护”而感到困扰Opus 5 可能是更好的日常选择。4. 科研创业者这是目前最好的公开发布模型Opus 5 已成为 Anthropic 公开发布的最强科研模型。对于生物医药、化学信息学等领域的创业公司这是一个值得重点评估的选项。尤其是有机化学和蛋白质相关任务上的显著提升可能直接转化为研发效率的质变。5. 关注“自动回退”带来的稳定性API 自动回退功能意味着即使某个请求被安全分类器拦截系统也能自动路由到备选模型继续工作。对构建生产级应用的创业者来说这大幅提升了系统的鲁棒性——不再因为单次拦截而导致整个流程中断。写在最后Claude Opus 5 的发布传递了一个清晰的信号大模型竞争正在从“谁更强”转向“谁更值得用”。Fable 5 代表了智能的巅峰但 Opus 5 代表了智能的普及。它以一半的价格提供了接近顶级的性能让更多开发者和企业能够真正将前沿 AI 能力融入日常工作流。正如一位早期用户所言“Opus 5 是 Opus 家族自 4.5 以来最大的飞跃。”而对普通用户来说更重要的或许是另一句话“更聪明的模型不应该只属于出得起高价的人。”关键词标签#Claude Opus 5 #Anthropic #大模型 #AI编程 #性价比 #开发者工具 #AI安全 #API #创业 #AI模型对比

相关新闻

如何在Blender中完美导入MMD模型:MMD Tools完整使用指南 [特殊字符]

如何在Blender中完美导入MMD模型:MMD Tools完整使用指南 [特殊字符]

如何在Blender中完美导入MMD模型:MMD Tools完整使用指南 🎭 【免费下载链接】blender_mmd_tools MMD Tools is a blender addon for importing/exporting Models and Motions of MikuMikuDance. 项目地址: https://gitcode.com/gh_mirrors/bl/blender_…

2026/7/31 7:30:23 阅读更多 →
信号完整性量化评估:过冲与下冲的测量、标准与LVCMOS实例优化

信号完整性量化评估:过冲与下冲的测量、标准与LVCMOS实例优化

1. 信号完整性中的“毛刺”问题:过冲与下冲 在数字电路设计,尤其是高速信号传输领域,我们常常会听到“信号质量”这个词。对于硬件工程师和信号完整性工程师来说,评估信号质量就像医生看心电图,波形上任何一点异常的“…

2026/7/31 7:29:23 阅读更多 →
DS1302/DS1307不起振?深入解析RTC寄存器配置与系统化排查

DS1302/DS1307不起振?深入解析RTC寄存器配置与系统化排查

1. 问题引入:一个看似简单却令人抓狂的“玄学”故障 如果你玩过单片机或者嵌入式开发,大概率接触过DS1302或DS1307这类经典的实时时钟芯片。它们价格低廉、接口简单,是给系统提供精准时间基准的“老将”。但正是这种看似简单的芯片&#xff0…

2026/7/31 7:29:23 阅读更多 →

最新新闻

C++实现高斯混合模型:从概率原理到高性能代码实战

C++实现高斯混合模型:从概率原理到高性能代码实战

1. 项目概述:从聚类难题到概率模型的跨越在数据处理和机器学习的日常工作中,我们常常会遇到这样的场景:给你一堆看起来混在一起的数据点,比如不同品种鸢尾花的花瓣尺寸、用户行为日志的混合模式,或者图像中颜色相近但属…

2026/7/31 8:05:35 阅读更多 →
【YOLO26创新改进】CVPR 2026顶会 | 独家频域创新改进篇 | 利用AFFN自相关前馈网络模块,在频域强化周期能量,通过门控深度卷积筛选有效信息,适合小目标检测、图像分割、图像增强任务

【YOLO26创新改进】CVPR 2026顶会 | 独家频域创新改进篇 | 利用AFFN自相关前馈网络模块,在频域强化周期能量,通过门控深度卷积筛选有效信息,适合小目标检测、图像分割、图像增强任务

一、本文介绍 ⭐本文在YOLO26中引入AFFN自相关前馈网络,可通过频域功率谱与空间自相关建模特征中的重复纹理和周期结构,强化目标轮廓、规则纹理及弱响应区域,同时抑制随机噪声和无关背景。将其部署于骨干网络或颈部特征融合阶段,有助于提升小目标、低对比度目标及复杂背景…

2026/7/31 8:05:35 阅读更多 →
Android应用签名全解析:从原理到实战,解决APK签名不一致问题

Android应用签名全解析:从原理到实战,解决APK签名不一致问题

1. 从一次发布失败说起:为什么签名不是小事那天下午,我正准备把一个调试好的APK发给测试同事,结果对方死活装不上,系统提示“安装包签名不一致,无法覆盖安装”。我第一反应是:“不可能啊,我就在…

2026/7/31 8:05:35 阅读更多 →
IO缓冲流

IO缓冲流

学习内容 缓冲流 文章目录学习内容前言一、字节缓冲流BufferedOutputStream:字节缓冲输出流构造:使用:BufferedInputStream:字节缓冲输出流构造:使用:二、字符缓冲流字符缓冲输出流:BufferedWriter构造方法字符缓冲输…

2026/7/31 8:05:35 阅读更多 →
BFS算法在游戏寻路中的应用:从原理到HUD-Asteroids实战

BFS算法在游戏寻路中的应用:从原理到HUD-Asteroids实战

1. 从“HUD-Asteroids”说起:一个算法与游戏结合的经典场景看到“HUD-Asteroids”这个标题,很多朋友可能会有点懵。HUD(平视显示器)和Asteroids(小行星)这两个词,一个来自游戏UI设计&#xff0c…

2026/7/31 8:05:35 阅读更多 →
字节跳动ToB业务大调整:飞书与豆包整合,能否补上B端AI办公短板?

字节跳动ToB业务大调整:飞书与豆包整合,能否补上B端AI办公短板?

7月30日上午,字节跳动发布内部邮件,宣布飞书与豆包产品团队整合,飞书GTM团队与火山引擎团队整合。这是字节ToB业务最大调整,标志其B端业务走向大一统。业务整合详情飞书与豆包产品团队整合为新的豆包产品团队,由赵祺负…

2026/7/31 8:04:34 阅读更多 →

日新闻

物理复制比逻辑复制好在哪?数据库复制原理详解

物理复制比逻辑复制好在哪?数据库复制原理详解

数据库复制是把主库数据同步到备库的机制,分为逻辑复制和物理复制两种。逻辑复制传输的是 SQL 语句或行变更事件,物理复制传输的是存储引擎底层的物理日志。阿里云 PolarDB(云原生数据库)采用物理复制,在同步延迟、数据…

2026/7/31 0:00:34 阅读更多 →
BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirrors/bi/Bilib…

2026/7/31 0:00:34 阅读更多 →
有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

当前,游戏行业的“DataAI融合”已从概念验证进入价值落地阶段。根据IDC 2025年数据,中国AI游戏云市场规模已达18.6亿元;同时,游戏研发环节AI渗透率高达86%,生成式AI内容普及率超过50%。面对庞大的市场,游戏…

2026/7/31 0:00:34 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/31 1:03:03 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/31 4:19:39 阅读更多 →

月新闻