分享好友 资讯首页 频道列表

安全枷锁下的最强AI:Claude Fable 5 为何连基础生物题也答不上?

2026-06-11 22:3410150

Anthropic 近日正式发布了其最新一代人工智能模型Claude Fable5。作为公司目前面向大众开放的最强 AI,它在生物学、网络安全等领域的潜力备受期待。然而,这款模型在实际使用中却表现出一种“选择性失忆”:即便面对高中水平的基础生物学问题,它也往往拒绝回答,并主动将请求转接给其前代旗舰模型Claude Opus4.8。

这种现象并非源于模型能力的缺失,而是 Anthropic 出于极高安全标准所做的刻意限制。作为Mythos级模型,Claude Fable5具备极强的高阶任务处理能力,同时也伴随着显著的滥用风险。在开发与上线过程中,Anthropic 将生物学领域视为安全红线的重中之重,其防护策略甚至到了“矫枉过正”的地步。

在实际测试中,这种保守策略的副作用显而易见。无论是关于细胞线粒体功能的科普、花粉症成因的探讨,还是哮喘药物原理等无害医学常识,Claude Fable5均予以驳回。甚至连埃博拉病毒这类公共卫生相关话题,也触发了其屏蔽机制。这种“无差别拦截”导致原本具备学术价值和科普意义的交流被迫中断。

Anthropic 对此回应称,此举核心目的是为了防范恶意用户利用先进 AI 从事高风险生物研究,例如开发生物武器。公司发言人帕鲁尔・马赫什瓦里表示,为了让模型能够尽早上线,团队选择了极端保守的防护路线,并承认目前存在较多的识别误判。

对比来看,Claude Fable5在化学与网络安全领域的限制则显得更加灵活。虽然它会拒绝提供炸药制造工艺或炭疽杆菌培养方式等危险信息,但对于氯气用途、密码安全及物理学原理等中性技术问题,模型能够正常作答。只有在涉及剧毒物质等极端场景时,它才会调用上一代模型进行辅助处理。

目前,Anthropic 正致力于优化识别机制以减少误判,并计划在未来针对生物医学领域的专业用户,推出能够解锁这些限制的特定版本,旨在平衡科研效率与社会安全。这一“受限发布”模式,或许正是当前顶尖 AI 模型在追求强大性能与严苛安全之间寻找平衡的一个缩影。

反对 0
举报 0
收藏 0
打赏 0
评论 0
豆包视频通话功能升级 接入SeedRealtime大模型实现实时自然交互
豆包视频通话功能升级 接入SeedRealtime大模型实现实时自然交互

0评论2026-08-061820

企业AI基础设施搭建:算力之外,还需打通哪些关键环节?
企业AI基础设施搭建:算力之外,还需打通哪些关键环节?

0评论2026-08-06654

Cloudflare 开源 AI 智能体工作空间:让每个员工都能零代码搭建专属工作流
Cloudflare 开源 AI 智能体工作空间:让每个员工都能零代码搭建专属工作流

0评论2026-08-06798

英报告:AI模型测试现潜在有害行为,收紧网络权限成当务之急
英报告:AI模型测试现潜在有害行为,收紧网络权限成当务之急

0评论2026-08-061050

三星电子发布CXL 3.2内存模组MD310:256GB容量助力AI与数据分析提速
三星电子发布CXL 3.2内存模组MD310:256GB容量助力AI与数据分析提速

0评论2026-08-051047

出口额同比激增487.9%!天津机器人“出海”狂飙,底气从何而来?
出口额同比激增487.9%!天津机器人“出海”狂飙,底气从何而来?

0评论2026-08-052434

英伟达黄仁勋:AI新征程聚焦机器人 自动驾驶成关键突破口
英伟达黄仁勋:AI新征程聚焦机器人 自动驾驶成关键突破口

0评论2026-08-051392

科技赋能公园管理!72台智能机器人“入职”14家市属公园
科技赋能公园管理!72台智能机器人“入职”14家市属公园

0评论2026-08-05954

OpenAI新模型Astra攻克10道数学难题成本2000美元 学术规范隐忧浮现
OpenAI新模型Astra攻克10道数学难题成本2000美元 学术规范隐忧浮现

0评论2026-08-042123

OpenAI 一口气降价 80%,GPT-5.6 Luna 性价比反超 DeepSeek V4 Pro
OpenAI 一口气降价 80%,GPT-5.6 Luna 性价比反超 DeepSeek V4 Pro

0评论2026-08-01841