Anthropic的新《神鬼寓言》版本更便宜,限制更少

周二,Anthropic发布了Fable和Mythos 5.1,这是该公司最先进的人工智能模型的孪生版本。除了性能升级之外,新的《Fable》版本还包括旨在降低代币成本和模型保护措施的误报限制的更改。
与之前的Mythos模型一样,Mythos 5.1仅适用于从事网络安全或生命科学研究的注册Anthropic合作伙伴。 《神鬼寓言5.1》是无限制版本,从今天开始可在云平台或通过Anthropic API获取。
最重要的变化之一是Anthropic之前报道的零数据保留,允许客户在自己的基础设施上运行Anthropic模型而不会出现数据流出。此前由于安全问题,《神鬼寓言》无法使用一项高隐私服务(称为“企业前沿保障”),现在将于6月份向用户推出。值得注意的是,系统仍将监控代理或人类用户的滥用情况,但客户将控制监控的方式。
作为公告的一部分,Anthropic向客户保证他们的数据没有被不当访问。 “Anthropic在未经明确许可的情况下从未对企业数据进行过培训,也永远不会,”公告中写道。
与Anthropic版本一样,新模型在一系列基准测试中创下了记录,包括Terminal-Bench 4.0(针对基于CLI的编码)和Humanity’s Last Exam(针对一般推理)。 Anthropic还在模型发布前发布了三项新颖的科学发现,包括定制GPU优化和据现有照片组装的高分辨率金星地图。
与之前的版本一样,这些型号都配有详细的系统卡,以最简单的方式解释了它们的功能。该系统卡将Mythos评为“低风险”,因为它与自动化人工智能开发(人工智能自我改进)相关,有些人认为这是人类失去控制的触发因素。它表示,“其加速内部人工智能研发进度的能力符合当前趋势。”
就一般不当行为而言,Mythos比Opus更容易出现这种情况,这可能是由于其功能增强的缘故。
“与Opus 5相比,Mythos 5.1在整体错位行为方面略有回归,并且比Mythos 5和Claude Sonnet 5有所改进,”系统卡上写道。 “它比Opus 5更容易配合人类滥用,并更容易接受无法验证的授权声明,但与以前的模型相比,它不太可能忽视明确的约束、幻觉输入或错误地声称已完成任务。”