热门AI工具推荐

AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
StepClaw阶跃AI桌面伙伴龙虾Agent智能体
StepClaw是阶跃星辰推出的本地和云端的AI龙虾助手,通过一键部署让普通用户也能拥有7×24小时在线、可自主执行任务的AI数字工作伙伴。
基于OpenClaw架构打造的AI助手平台,核心优势包括云端一键部署、沙箱隔离安全运行、全面接入企业微信/钉钉/飞书三大主流IM工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
墨刀AIAI原型设计平台
墨刀AI是一款能通过一句话描述或图片,快速生成可交互原型、PRD文档及各类图表的一站式智能产品设计协作平台。
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

Claude Code/Opus 5双降智 工程师认错

时间:2026-08-24 地点:美国旧金山(Anthropic 总部) 人物:开发者 argofowl、科技博主 Chubby、Claude Code 工程师 Thariq Shihipar 事件详情:开发者 argofowl 在排查 Claude Code 输出异常时,从 API 真实请求日志中发现,Claude Code 2.1.237 把用户选定的"high"最高推理档,映射到了 10/100,与"low"档相同。Anthropic 工程师 Thariq Shihipar 承认这是从 Claude Code 2.1.236 开始、为 Fable 5 会话设计的"压缩 effort 数值刻度"A/B 测试,并未公开告知用户。此外,Opus 5 被多位用户和博主 Chubby 指出存在明显降级——敷衍了事、频犯低级错误、被指出后只会机械回复"你说得对,是我疏忽了"。在被网友追问下,Thariq 公开承认 Opus 5 是个"表现很不稳定"的模型,团队将其列为最高优先级处理。 背景:Anthropic 此前为 Claude Opus 5 打出综合得分 82.72、SWE-bench Pro 79.2%、Terminal-Bench 86.7% 等亮眼跑分,但用户体感与评测分数严重脱钩。同时,Anthropic 早在 7 月就发文称 Opus 5 上线后删除了 Claude Code 80% 以上的系统提示词,在编码评测上无明显下滑。 影响:事件撕开大模型行业的核心暗伤——版本更新成为不透明黑箱,服务端可随时进行 A/B 测试、量化方案、模型路由与推理资源调整,开发者只能靠体感判断,且难以证伪。这场风波把"跑分 vs 体感"脱钩、信任契约缺失的问题摆上台面,给整个行业敲响警钟。 总结:Anthropic 工程师承认 Claude Code 暗中调整推理档映射是 A/B 测试,声称不影响模型性能;但 Opus 5 被官方承认为"表现不稳定"。这一风波暴露大模型作为基础设施的稳定性危机,让业界重新审视跑分与体感、版本透明与回滚机制的缺失。 参考来源: 1. https://www.36kr.com/p/3952772295474564 2. https://www.kucoin.com/news/flash/anthropic-admits-fault-as-claude-code-and-opus-5-face-performance-issues 3. https://news.marsbit.co/20260824091409583371.html 4. https://x.com/trq212/status/2091252347913773169 5. https://www.blocktempo.com/anthropic-removed-80-percent-claude-code-system-prompt-context-engineering 6. https://www.toutiao.com/article/7666489406554997284