IT之家8月8日消息,美国人工智能(885728)初创企业Anthropic昨日发布博文称,公司正在更新Claude Fable5模型的生物安全防护机制,大幅减少误拦截现象发生。如今Fable5用户提出生物学相关问题后,系统的降级情况将更少发生。
据 Anthropic官方测试数据,本次更新使生物学相关问答的降级现象减少了85%,Fable5现在可以处理更广泛的生物学任务。
Anthropic表示,某些恶意用户会使用Fable5模型进行生物武器研究等高风险活动。因此公司为了防范这种现象发生,专门为Claude设置了安全分类器(safety classifiers),用于检测用户是否要求Fable5执行受保护的生物学任务,或者生成有害内容。
如今Anthropic调整了安全分类器的工作机制,让它能够更准确地区分无害问题和高风险问题。
不过为了防范持续的AI风险,Fable5仍会限制专业生物学研究和药物开发相关请求。
