热门AI工具推荐

焚书AI多模型聚合平台
AI多模型聚合平台( Claude 系列、GPT 系列)支持聊天、搜索、图片、视频、音乐等多种功能;聚合了 Claude 系列(如 Sonnet 5、Opus 5 等)、Gemini 系列、GPT 系列、DeepSeek(搜索模式默认调用 DeepSeek V4 Pro)以及通义千问、Kimi 等数十款国内外主流模型。
AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

Anthropic:Fable 5生物误拦截降85%

时间:2026年8月7日 地点:美国加利福尼亚州旧金山(Anthropic 总部) 人物:Anthropic 安全团队;Anthropic 分类器工程团队;Claude Fable 5 用户 事件详情: Anthropic 于 8 月 7 日发布《Improving Fable 5's biology safeguards》官方公告,宣布对 Claude Fable 5 的生物学安全分类器进行重写。Anthropic 表示,重写分类器的「宪法」、引入更详细的善意用途示例、邀请内外专家反馈、用更新后的训练数据重训分类器、验证仍能在有害与双重用途研究内容上触发回退——这一系列操作使生物学相关请求的 fallback 率在测试中下降约 85%。具体到各产品界面,Claude.ai 总回退量预计下降约 67%、Cowork 下降 55%、Claude Code 下降 17%、Claude Platform 下降 7%。Fable 5 用户在解释化验结果、理解症状、学习生物学等日常健康与教育请求上将显著减少被自动切换到 Opus 5 的频率,医疗专业人员在临床任务上也能获得 Fable 5 更多支持。 背景: Fable 5 生物学回退机制源于 6 月 9 日的发布。Anthropic 当时为 Fable 5 配置了网络安全、生物学、化学以及蒸馏企图四大类安全分类器,分类器被触发时请求会切换到能力次之的 Opus 5。发布时安全阈值设定偏保守,Anthropic 明确表示预期在不到 5% 的会话中触发回退。生物学覆盖范围最广,源于 Mythos 级模型在部分复杂生物任务上可超越专家、对另一些任务可提供操作支持的能力评估——Anthropic 系统卡将 Fable 5 能力归为「CB-1」级别(可显著帮助具备基础技术背景的人完成已知武器相关流程),但未达到「CB-2」级别(替代全球稀缺的世界级专家开发新型生物武器)。官方引用美国情报界 2026 年度威胁评估报告,该报告警示合成生物学和基因编辑等生物技术进步可能催生新型生物威胁,并指出多个国家行为体可能维持活跃的进攻性生物与化学武器项目。 影响: - 用户体验显著改善:日常健康问题、化验结果解读、症状理解、生物学教育等高频场景的回退率大幅下降,Claude.ai 总回退量下降约 67%,广受诟病的「无害问题被错误切换」问题获系统性缓解 - 病毒学、毒理学、分子设计等明确双重用途领域继续强制回退到 Opus 5,Anthropic 明确表示 Fable 5 仍「不适合用于专业生物学研究与药物开发」,这部分能力将通过「trusted access」可信访问通道逐步开放给经过验证的生物学家 - Anthropic 公开了各产品界面回退率基线(67%/55%/17%/7%),为后续分类器迭代提供可量化的外部监督指标;公司表示安全分类器精修是持续工作,剩余安全裕度内的误报将持续存在 - 安全治理范式深化:Anthropic 以「先保守后放宽」的姿态将 Fable 5 推向市场、承担六周高误报代价、再通过透明数据公布修订结果,把模型发布过程构建为可测量、可问责的治理文档;这与 OpenAI 在 Astra 上对 Preparedness Framework 的应用形成对比,标志前沿模型安全治理从「发布即结束」向「发布即治理」转变 总结: Anthropic 此次生物学分类器更新既是一次产品改进,也是一份治理文档。Fable 5 发布时采取几乎全数拦截的保守策略、以约六周高误报为代价换取提前数周至数月对一般用户的开放,现在通过重写分类器宪法、扩大善意用途识别、用 updat训练数据重训、并邀请内外专家反馈,得出可公开测量的 fallback 下降比例——85% 是总平均数,分到各产品界面是 67%、55%、17%、7%。剩余约束仍卡在双重用途专业研究上,Anthropic 选择通过 trusted access 通道而非公开分类器来处理这部分流量。Anthropic 在博文中写明,下一步开放给外部观察者的正是这套可衡量的 fallback 数值——「fallback 率」将成为后续安全分类器迭代的硬基准,也是行业能否在「安全」与「可用」之间找到可持续平衡的关键指标。 参考来源: - https://www.anthropic.com/news/improving-fable-5-s-biology-safeguards - https://www.unite.ai/anthropic-retunes-fable-5s-biology-safeguards-cutting-blocked-queries-85/ - https://releasebot.io/updates/anthropic/anthropic - https://x.com/claudeai/status/2085563808773189680 - https://explainx.ai/blog/fable-5-biology-safeguards-update-august-2026 - https://www-cdn.anthropic.com/d00db56fa754a1b115b6dd7cb2e3c342ee809620.pdf - https://www.dni.gov/files/ODNI/documents/assessments/ATA-2026-Unclassified-Report.pdf - https://www.toutiao.com/w/1872831042606282/