NBA焦点:最新战报与分析
JRS看球吧PC版,作为行业内的资深平台,自2012年起便致力于为全球体育爱好者提供最全面、最及时的赛事信息与直播服务。我们深知用户对高质量体育内容的需求,因此不断优化平台功能,确保每一位用户都能在这里找到心仪的赛事。
详情了解
发布于 2026年7月1日,由 JRS看球吧 团队
美国时间9月1日,Anthropic正式推出Claude Fable 5.1和Claude Mythos 5.1。
这两款模型采用相同的底层架构,区别在于安全策略不同。Fable 5.1现已全面开放,支持Pro、Max、Team和Enterprise用户,同时可通过Claude API及各大云平台进行访问。Mythos 5.1则通过审核机制,仅面向部分网络安全和生命科学领域的专业用户开放,目前覆盖范围仍非常有限。
Fable 5.1的输入和输出定价保持不变,但缓存读取费用下调了75%。根据Anthropic的估算,典型工作负载的总成本相比Fable 5降低约25%,而复杂编码和高度代理化任务的成本最多可减少约45%。
此外,Anthropic推出了Enterprise Frontier Safeguards(EFS),允许企业将相关数据存储在自己掌控的云基础设施中。对于符合条件的客户,在EFS正式上线前,也可使用Fable 5.1的零数据保留模式。
在模型性能方面,Fable 5.1在编码、科学研究、知识工作及业务自动化等测试中的表现均优于Fable 5。Anthropic还公布了早期客户的实际应用案例,涉及长时间运行的机器学习任务、软件故障排查以及浏览器智能体任务。
01 一项科研Agent测试,得分是GPT-5.6 Sol的2.3倍
Anthropic对Fable 5.1的定位发生了显著变化:模型需要自主处理更长时间、更复杂的任务,并在执行过程中持续检查结果、调用工具并调整路径。
Anthropic公布的测试结果显示,在Terminal-Bench-Science 0.1中,Fable 5.1得分为52.6%,是GPT-5.6 Sol(22.4%)的两倍多,而Fable 5和Opus 5分别为24.7%和29.0%。该测试评估的是AI智能体在科学研究任务中的能力,模型需在终端环境中完成连续的研究工作。
在Terminal-Bench 4.0中,Fable 5.1得分为55.8%,高于Fable 5的42.0%和Opus 5的52.3%。若放宽安全限制,使用相同底层模型的Mythos 5.1得分进一步提升至60.9%,成为该测试中成绩最高的版本。
类似的提升也出现在知识工作和业务自动化任务中。Fable 5.1在GDPval-AA v2中获得1853分,高于Opus 5的1824分和Fable 5的1723分;在AutomationBench中得分为31.4%,而Fable 5和Opus 5分别为17.1%和26.9%;在CursorBench 3.2.0中则达到73.4%。
这些测试结果反映出的变化是,模型能够在更长的任务链条中保持工作状态。Anthropic公布的早期客户案例也进一步印证了这一点。
投资公司Millennium曾遇到一个极为罕见的软件崩溃问题,大约每运行100万次才发生一次。该问题困扰团队四五年之久,此前使用的模型均未能找出原因。最终,Fable 5.1对外部供应商的软件库进行了反汇编,并将结果与系统崩溃时留下的核心转储文件进行比对,最终定位到该软件库中的一个Bug。
Ramp测试的则是一项持续运行的机器学习任务。Fable 5.1在无人值守的情况下运行了38小时,重新检查此前得到的结果后,判断其中存在标签造成的误差,并进一步启动了6项实验。实验运行一夜后,模型返回了新的结果以及下一步建议。
还有一些任务更接近企业日常使用场景。Browserbase让Fable 5.1执行浏览器智能体任务,在其最困难的一项测试中完成率达到82%,高于Opus 5的74%和Fable 5的57%。Jane Street Capital则表示,在内部测试中,Fable 5.1解决的编码问题多于Fable 5和Opus 5,而且在长时间、多步骤任务中,输出仍然比较容易理解。
从这些案例来看,Fable 5.1需要处理的已不再是一个问题对应一个答案。一次任务可能从读取资料开始,经过代码分析、工具调用、实验验证,再回到前面的结果重新判断,最终形成可交付的结果。
科研任务是Anthropic此次重点展示的另一类应用。
其中最值得关注的是蛋白质设计。现代药物研发中,许多药物需要先找到能与人体内特定目标结合的蛋白质。Anthropic让Mythos 5.1使用开源蛋白质设计和折叠工具完成设计,再将模型生成的结果交由两家外部机构进行实验验证。
在12个目标上,Mythos 5.1生成的设计中,接近50%最终被验证为有效结合剂。Anthropic表示,目前蛋白质设计中的典型命中率大约为10%至15%。
在其中三个目标上,模型设计出的结合剂结合能力达到此前Adaptyv Bio蛋白质设计竞赛最佳设计的10倍。
这项测试的意义在于,模型承担的工作已涉及实验之前的设计环节。它可以根据目标生成方案,再利用现有的蛋白质设计和折叠工具进行计算,最后将候选结果交给实验人员验证。
Anthropic还公布了一个计算建模案例。Fable 5.1利用NASA麦哲伦号任务30多年前获取的雷达图像,以及覆盖金星约五分之一范围的已有地图,训练神经网络,重新生成了覆盖金星约三分之一范围的高分辨率高程图。
新地图可呈现约2至3公里尺度的细节,原有地图的分辨率约为10至20公里,同时高度测量准确度最多提高25%。Anthropic计划在NASA的VERITAS任务和ESA的EnVision任务开展后续工作前,以Creative Commons许可证公开这张地图。
计算生物学方面,Mythos 5.1将重点放在计算效率上。
科研人员经常需要在GPU上反复运行专门的机器学习模型,而计算速度直接影响实验进度。Mythos 5.1通过编写定制GPU内核,并缓存中间结果,将7个开源深度学习模型的推理速度提高了最高2.5倍,且输出结果保持一致。
这些模型包括ChromBPNet、Flashzoi、Enformer、Profluent-E1、ProGen2和不同规模的Evo2。根据Anthropic的估算,在基因组范围的分析中,优化后的模型可减少30%至60%的GPU成本。
Anthropic表示,这类优化过去通常需要性能工程团队花费数周完成,而Mythos 5.1只用了几天,且仅使用公开的源代码。相关优化计划后续开源。
02 相同底层模型 两套安全机制
Fable 5.1和Mythos 5.1虽然是同一个模型,但使用范围并不相同。
Fable 5.1现已面向所有平台提供,包括AWS、Google Cloud和Microsoft Azure,开发者也可通过Claude API调用claude-fable-5-1。
在安全策略方面,Anthropic此次重点调整了网络安全和生命科学领域的限制。
网络安全方面,Fable 5.1现在可以帮助用户发现软件漏洞,用于防御性安全工作。Anthropic表示,与此前Fable 5使用的网络安全防护相比,新的防护机制在Claude Code中的平均干预次数减少约60%。
生命科学领域则仍采取更严格的方式。普通用户涉及研究和开发的生命科学任务仍会被转向Opus模型,而专业人员可通过生命科学验证计划申请Mythos 5.1的访问权限。该计划已与美国政府合作,并已有首批参与者。
Mythos 5.1还将通过网络安全验证计划向经过审核的网络安全人员开放。Claude Security目前也已由Mythos 5.1提供支持,用于扫描代码库中的漏洞并提出供人工审核的修复方案。
与此同时,Anthropic也强化了数据隐私和企业安全机制。
新的Enterprise Frontier Safeguards,即EFS,可让企业将数据存放在自己控制的云基础设施中,而非Anthropic的系统里。默认情况下,涉及人工审核的工作也由企业自行完成。EFS将从今年秋季开始分阶段推出,在正式支持之前,符合条件的企业可使用Fable 5.1的零数据保留模式。
Anthropic表示,EFS是在与100多家企业合作后开发的,参与企业覆盖金融、医疗、制造、电信、法律、零售和公共部门等领域。
从这次发布来看,Fable 5.1的升级集中在几个非常具体的地方:代码能力更强,长任务更稳定,科研任务开始出现实际案例,缓存读取价格下降,同时企业可获得更明确的数据控制方式。
对普通用户来说,最直接的变化可能是模型处理复杂任务时更容易持续完成工作;对企业来说,成本下降和数据保留机制则降低了长期使用的门槛。Anthropic也通过Mythos 5.1将更强的网络安全和生命科学能力交给经过审核的专业用户。
Fable 5.1由此成为Anthropic当前面向生产环境的主力模型之一,而科研和高风险专业场景,则被单独放入Mythos 5.1的受控访问体系。
03 缓存价格降了75%
Fable 5.1此次调整的不只是模型能力和安全机制,还有使用成本。
Anthropic保留了Fable 5.此前的标准API价格,输入每百万Token 10美元,输出每百万Token 50美元,没有直接降低基础价格。但缓存读取价格从每百万Token 1美元降至0.25美元,降幅达到75%。
Anthropic按照2026年8月的实际使用情况测算,典型工作负载的整体成本可降低约25%。对于高度Agent化、缓存读取占比较高的任务,成本降幅更高。
不过,第三方测评机构Artificial Analysis的测试显示,缓存价格下降并不意味着每项任务的实际成本都会下降。其数据显示,在最高推理强度下,Fable 5.1完成一次Intelligence Index任务的平均成本为3.76美元,比Fable 5高20%。主要原因是Fable 5.1使用的输出Token约为Fable 5的1.7倍。
缓存价格下调仍然带来了明显的成本节省。Artificial Analysis测算,缓存读取降价平均为每项任务节省约1.40美元,这一变化主要体现在智能体测试中,因为这类任务会反复读取此前已经处理过的上下文。
如果将推理强度从最高档调整到xhigh,Fable 5.1的Intelligence Index得分为65,单项任务成本降至2.72美元,比最高强度低1.04美元。不过,这一成本仍高于Opus 5在最高推理强度下2.34美元的水平。
因此,Fable 5.1的成本变化并非简单的“价格下降”。Anthropic降低了缓存读取这一项费用,但模型在复杂任务中消耗的输出Token更多,最终每项任务的成本还取决于具体的调用方式和推理强度。
此外,Fable 5.1还支持批量处理。对于异步任务,输入和输出价格可降至每百万token 5美元和25美元。美国境内专用推理的价格系数为1.1倍,网页搜索价格为每1000次10美元,网页抓取不单独收费。
Anthropic也给出了不同模型之间的价格对比。Opus 5的输入和输出价格分别为5美元和25美元,缓存读取为0.50美元;Sonnet 5则分别为2美元、10美元和0.20美元。
Fable 5.1的普通输入和输出价格仍高于这两款模型,但缓存读取价格已低于Opus 5,仅比Sonnet 5高0.05美元。
本文来自微信公众号“腾讯科技”,作者:值得关注的,36氪经授权发布。
2026年7月1日 上午09:15
我们深耕体育行业多年,积累了丰富的赛事资源和用户口碑。JRS看球吧PC版不仅提供实时的NBA直播,还涵盖世界杯直播等全球顶级赛事,确保您能第一时间掌握最新动态,感受体育的无限魅力。
回复
JRS看球吧PC版,作为行业内的资深平台,自2012年起便致力于为全球体育爱好者提供最全面、最及时的赛事信息与直播服务。我们深知用户对高质量体育内容的需求,因此不断优化平台功能,确保每一位用户都能在这里找到心仪的赛事。
详情了解
我们的服务覆盖全球范围内的热门体育赛事,包括但不限于NBA、足球五大联赛、电子竞技等。通过JRS看球吧PC版,用户可以轻松获取一手直播资讯,紧随赛场动态,不错过任何精彩瞬间。我们不仅仅是信息的搬运工,更是体育文化的传播者。
详情了解
除了实时赛事直播和资讯,JRS看球吧PC版还提供专业的赛事分析报告和高清赛事回放。无论是赛前的战术解读,还是赛后的精彩集锦,我们都力求为用户带来沉浸式的观赛体验。我们相信,深度内容是连接用户与体育的最佳桥梁。
详情了解