📰 研报摘要
查看全文 ➔本次会议由华福证券分析师分享对 Anthropic 新发布的 Claude Opus 5 模型的测评结果。会议认为 Opus 5 在维持上一代(Opus 4.8)定价的同时,能力显著提升,在终端智能体编码、业务流程自动化及电脑操作等 13 项测试中表现出色,多项指标领先于 Fab 5 并大幅超越 GPT-4.5 SO。成本效果分析显示,Opus 5 在达到相近效果时,单次任务成本显著低于 Fab 5。在实际案例测试中,Opus 5 在存储工艺流程分析、打车软件及 Word 编辑器编程、金融三表投研判断等方面展现出更强的决策能力、自我检查机制和上下文理解能力。整体而言,Opus 5 通过提高性价比降低了高能力模型的任务成本,其能力已逼近甚至在部分维度超越顶级模型。