当前位置:

首页 > 硬件相关 > Claude Opus 4.7 发布:更费token了,用户评价两极

Claude Opus 4.7 发布:更费token了,用户评价两极

Claude Opus 4.7全面上线:编程能力飞跃,但“升级”代价几何? 4月17日,Anthropic正式宣布其最新旗舰模型Claude Opus 4.7全面开放使用。与上一代的Opus 4.6相比,这次更新在高级软件工程领域带来了显著进步,同时多模态视觉能力也大幅增强,能够产出更高质量的界面设

Claude Opus 4.7全面上线:编程能力飞跃,但“升级”代价几何?

4月17日,Anthropic正式宣布其最新旗舰模型Claude Opus 4.7全面开放使用。与上一代的Opus 4.6相比,这次更新在高级软件工程领域带来了显著进步,同时多模态视觉能力也大幅增强,能够产出更高质量的界面设计、演示文稿等内容。

价格方面,Opus 4.7维持了与4.6相同的定价策略:每百万输入token收费5美元,每百万输出token收费25美元。然而,事情并非表面看起来那么简单。

Anthropic在官方公告中明确指出了一个关键变化:新的分词器会导致相同文本内容的token数量变为原来的1.0到1.35倍。在API单价不变的前提下,这意味着实际使用成本隐性地上涨了10%至35%。这无疑给开发者们的预算规划提了个醒。

消息一出,不少用户连夜进行了测试。从社交平台上的反馈来看,社区对Opus 4.7的评价呈现出明显的两极分化。

大部分用户认可其在编程能力上的提升,但在文案撰写、日常对话沟通等方面,吐槽的声音则相当集中。

Claude Opus 4.7主要能力提升

根据官方发布的数据,在编码与复杂推理方面,Opus 4.7的表现更为严谨和一致。它能够自行验证输出结果,这让处理那些长期运行、多步骤的复杂任务变得更为可靠。有用户反馈称,过去需要密切监督的复杂编码工作,现在可以更放心地交给Opus 4.7去执行。模型能够精确遵循指令,并在最终汇报前主动进行自我检查。

视觉能力是另一大亮点。Opus 4.7支持更高分辨率的图像输入,其长边最大可达2,576像素(约375万像素),这是前代模型的3倍以上。这一提升使得模型能够处理依赖精细视觉细节的任务,例如读取密集的屏幕截图、从复杂图表中提取数据,或者进行像素级的参考比对。

需要特别注意的一点是,Opus 4.7开始严格按字面意思理解并执行指令。这意味着,为旧模型编写的提示词可能会产生意想不到的结果——因为旧模型往往会进行宽松解释或自动跳过部分内容。用户需要据此重新审视和调整自己的提示词与工具链。

内部测试表明,Opus 4.7在专业领域表现更出色。它像是一位更高效的金融分析师,能够生成严谨的分析模型和更专业的演示文稿,并实现更紧密的任务整合。在第三方评估基准GDPval-AA(涵盖金融、法律等领域的经济价值知识工作)上,Opus 4.7也达到了业界最先进的水平。

此外,模型在利用基于文件系统的记忆方面变得更聪明了。它能够在多轮、长时间的工作中记住重要笔记,并在后续的新任务中直接调用这些记忆,从而减少了前期需要输入的上下文信息量。

安全性方面,Opus 4.7配备了自动检测和拦截功能,旨在阻止涉及禁止或高风险网络安全用途的请求。Anthropic同时表示,安全专业人士若需将模型用于合法的网络安全目的,如漏洞研究、渗透测试等,可以申请加入新推出的“网络验证计划”。

总体而言,Opus 4.7在安全性上与4.6版本相似:在欺骗、谄媚、协助滥用等令人担忧的行为上发生率较低。在诚实性和抵御恶意“提示注入”攻击方面,新模型优于旧版;但在某些特定方面,例如对受管制物质给出过于详细的减害建议,则表现略有退步。

新增xhigh级别选择,更费token了

根据Anthropic的官方博客,Opus 4.7还同步更新了一系列新功能:

首先,在原有的“high”(高)和“max”(最大)努力级别之间,新增了一个“xhigh”(极高)级别。这为用户在处理困难问题时,提供了更精细的权衡选项,以在推理质量和响应延迟之间做出选择。

在Claude Code中,所有计划的默认努力级别已提升为“xhigh”。对于编码和智能体用例,官方建议从“high”或“xhigh”级别开始测试。

除了支持更高分辨率图像外,Anthropic还公开测试了“任务预算”功能。开发者可以通过设定预算,来引导Claude在较长的运行过程中合理分配token开销。

Claude Code新增了/ultrareview命令,该命令会启动一个专门的代码审查会话,通读代码变更并标记出那些需要细心审查才能发现的bug和设计问题。Pro和Max用户目前可以免费试用3次。

此外,“自动模式”已向Max用户开放。在该模式下,Claude可以代为做出一些权限决定,从而以更少的中断运行更长的任务,同时控制相关风险。

值得注意的是,Opus 4.7虽然是4.6的直接升级版,但有两点变化会显著影响token使用量,必须提前规划:

第一,新的分词器改进了文本处理方式,但同样的输入内容可能会被映射为更多的token,比例大约在1.0到1.35倍之间,具体取决于内容类型。

第二,在更高的努力级别下,模型的思考量会增加,尤其是在智能体场景的后续交互轮次中,Opus 4.7会产生更多的输出token。

用户可以通过调整努力级别参数、设置任务预算,或者在提示词中要求模型回答更简洁来控制token消耗。Anthropic的内部测试显示,在其内部的编码评估中,所有努力级别的token使用效率均有所提升。

用户评价两极

对于Opus 4.7的编程能力,多数实际体验过的用户都给出了肯定评价,承认其能力确实更为强大。

然而,让不少用户感到措手不及的,是token消耗的激增。有用户直言,官方通篇强调视觉提升,却只字不提这玩意儿消耗token的速度堪比喝水。用同一张设计稿进行测试,Opus 4.7的输入token数量直接飙升至Opus 4.6的3倍多。

更令人关注的是,Opus 4.7在某些能力上出现了不升反降的情况。

在长上下文信息检索方面,Opus 4.6的评分能达到78.3%,而Opus 4.7直接掉到了32.2%。Anthropic对此的解释是,新模型在遇到信息缺失时会直接报错,而不再像以前那样进行“脑补”。但用户实际测试下来发现,即便信息明明白白地存在于上下文中,它也可能遗漏。这对于依赖长文档工作的法律、金融等领域用户而言,需要格外谨慎。

Opus 4.7的联网搜索和智能体能力也出现了轻微下降。其智能搜索评测BrowseComp的分数从Opus 4.6的83.7%降至79.3%,与GPT-5.4(89.3%)的差距被进一步拉大。

被吐槽最多的,莫过于Claude Opus 4.7文风的突变。

许多文字工作者反映,Opus 4.7现在满嘴都是“稳稳接住”、“压实闭环”这类互联网大厂黑话,破折号使用混乱,续写的内容也显得干巴巴。用户无奈吐槽:“以前是用它来改文案,现在光是修改它生成的文案就要花两倍时间。”

最后,模型的思考过程被隐藏了。Opus 4.7默认不再输出推理摘要,用户若想了解其内在逻辑,必须手动添加命令。对于复杂任务,一旦出错,你根本无从知晓它是在哪一步思考上出现了偏差,导致排查问题的成本翻倍。有人认为这是官方为防止技术被“蒸馏”而采取的措施,但此举无疑牺牲了开发者的调试体验。

总而言之,Opus 4.7并非一次无痛的平滑升级。如果你的核心应用场景并非硬核编程,那么不妨先观望一下。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
硬件相关 AI
相关文章 更多
荣耀MagicOS 11发布计划与Agent Harness架构解析
荣耀MagicOS 11发布计划与Agent Harness架构解析

荣耀MagicOS 11定于9月15日发布,作为行业首个商用系统级Agent Harness架构的操作系统,Magic 9系列将首发搭载。新版YOYO支持最长上百步长程任务及40余项条件触发,10月开启Beta预览版招募。

华强北手机全线涨价:涨幅400-1500元,存储成本推高售价
华强北手机全线涨价:涨幅400-1500元,存储成本推高售价

华强北销售商反馈,年初以来主流手机品牌基本全线涨价,涨幅最低400元,最高达1000-1500元。涨价主因是全球存储芯片及电容等元器件成本上升,运行内存与机身存储价格涨幅超100%。尽管整体市场承压,国产折叠屏手机1-8月销量约450万台(新形态超135万台,同比增29%),AI手机成为厂商发力重点。

索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口
索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口

索尼发布WH-1000XM4C头戴式降噪耳机,复刻了XM4的经典四向折叠便携设计。该机型在保留QN1处理器和30小时续航的基础上,全面升级了USB-C高速充电、无损音频直连、蓝牙多点连接及AI降噪通话功能,旨在满足对便携性有极高要求的用户群体。

OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析
OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析

OpenAI GPT-6 Astra 模型通过 MCP 协议与 SourcePauseTool 控制《传送门》游戏,完成 3336 次工具调用并自主通关。实验耗时约 24 小时,API 成本约 571 美元,展示了多模态 AI 在 3D 解谜领域的突破性进展。

AI重构企业业务架构:超聚变“智企”范式核心解析
AI重构企业业务架构:超聚变“智企”范式核心解析

本文解析超聚变在2026数博会发布的“智企”范式,重点阐述如何通过Token生产平台(Token Factory)与企业业务本体建模,实现从简单AI工具调用到企业应用架构系统性重构的演进。文章详细拆解了智能体编排、数字孪生及生态协同等关键技术路径,为AI时代企业数字化转型提供可落地的参考方案。

南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破
南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破

南京邮电大学“光擎智算”团队联合南京大学,攻克GaN基Micro-LED器件技术,成功搭建实验室级光计算验证系统。团队自主研发的5×5 Micro-LED光电计算阵列芯片已进入流片封装阶段,实现了图像识别等算力任务验证,推动光计算技术从理论走向工程落地。

微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案
微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案

微软于9月5日推出Project Zenith,旨在为Windows 11开发者提供更高效的AI开发体验。该项目目前仅支持配备超过64GB统一内存及250GB/s内存带宽的特定硬件,首发适配AMD Ryzen AI Halo设备。通过此项目,开发者可在本地运行参数超过300亿的AI模型,后续将分阶段扩展至更多合作伙伴设备。

贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析
贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析

9月3日,贵州省住建厅与贝壳集团在贵阳签署《旅居产业发展战略合作框架协议》,旨在打造全国旅居样板。合作涵盖平台建设、标准共建、人才培育、存量资产盘活及品牌推广五大维度,依托贝壳近600家门店及4000余名经纪人资源,强化贵州旅居服务供给,促进房地产市场平稳健康发展。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。