#OpenAI · AI 短帖与讨论

#OpenAI 10 帖
精选回答

这个话题下写得比较实的几条回答,点进去看它所在的讨论。

这报告最值钱的是承认了权限边界和检测延迟,但没提具体修复成本。我挺好奇沙箱隔离这块,实际部署时怎么接进现有工作流的,有说吗?
酷酷冰红茶 · OpenAI 发布 Hugging Face 安全事件完整调查报告:
最新短帖
会飞的荧 ·
Introducing Unsloth Desktop 🦥 首款可在本地运行并训练模型的桌面应用。 • 开源。支持 Mac、Windows 和 Linux • 支持 MLX、扩散图像/视频、音频、GGUF • 将 Claude Code 和 Codex 连接到本地 LLM • 工具调用准确率提升 50%,具备自愈能力 + 沙箱代码执行 • 支持 CPU + 多 GPU 配置 — NVIDIA、AMD、Intel、Mac • 模型训练速度提升 2 倍,显存占用减少 70% • 私有网络搜索、深度研究、RAG、MCP 以及导出(NVFP4、GGUF) • 使用 Unsloth 的 OpenAI 兼容 API 和云端模型 • 远程安全部署 LLM 并随时随地访问 • Unsloth Desktop 现已在 和 GitHub 上线 • GitHub: • 博客与指南: GitHub: github.com/unslothai/unsl… 官网: unsloth.ai/docs/desktop
显示更多 话题来源 @UnslothAI · 43W阅读 · ❤️3537
哇!是牛来 ·
OpenAI 现在比 Anthropic 开放多了 现在能在 Claude Code 里调用 Codex 帮你审查代码 省得我来回复制了,还想自己写一个来着,没想到官方的就来了 Open AI 出了一个官方插件,可以帮你在 Claude Code 里调用 Codex 总共支持 3 个命令: /codex:review 运行标准的只读 Codex 审查 /codex:adversarial-review 运行可引导的挑战性审查,可以质疑实现逻辑 /codex:rescue 直接将任务交给 Codex 处理 /plugin marketplace add openai/codex-plugin-cc /plugin install codex-codex
显示更多 话题来源 @op7418 · 3W阅读 · ❤️143
我不是小布丁 ·

兄弟们,这个Agent 让科研狗大喜啊
MATLAB 居然直接杀进 Agentic AI 战场,而且一出手就端出了最硬核的解决方案:
MATLAB Agentic Toolkit正式发布
它不是简单加个 ChatGPT 插件,而是把 Claude Code、OpenAI Codex 等顶级 agent 直接“武装”成 MATLAB/Simulink 原生专家:

  • 实时连接本地 MATLAB 会话,agent 可以直接执行、测试、调试代码
  • 内置 MathWorks 专家级 Skill 库(代码规范、Live Script 生成、App 构建、测试框架、代码现代化…)
  • 自动安装 MCP Core Server + 技能库,配置零门槛

GitHub: github.com/matlab/matlab-…

显示更多 话题来源 @berryxia · 7W阅读 · ❤️450
菠萝与大西瓜 ·

mattpocock/skills v1
我们现在是有史以来第19大星级仓库
sh下载量达1350万次
-文档:社区最大的要求
记录了每项技能,并解释了主要流程+故障排除

  • Claude插件:通过Claude的官方市场安装
  • Codex支持:通过agent/openai

yaml文件提供全面的Codex支持
-/烧烤现在会问你一轮又一轮的问题,而不是一个接一个
-/prototype现在使用HTML而不是TUI来构建逻辑原型-更易于共享且更丰富
-/writing-for-agents从/writing-great-skills重命名,用于您的代理阅读的任何内容( AGENTS
md ,系统提示,文档)
-/WIZARD:厌倦了配置基础设施

显示更多 话题来源 @mattpocockuk · 34W阅读 · ❤️4458
菠萝与大西瓜 ·
本周 GitHub 飙升的 10 大 AI 开源项目: 1,mattpocock/skills 本周增长最快的项目,新增 10,651 Star 它把 TDD、调试、需求梳理、代码评审等工程经验做成了可组合的 Agent Skills,可以装进 Claude Code、Codex 等编程 Agent hallmark 专门处理 AI 生成网页的“模板味” 它会从页面结构、配色、字体和布局入手,再经过 57 项检查,减少 Claude Code、Cursor、Codex 生成千篇一律的 SaaS 页面 orca 一个管理并行 Coding Agents 的开发环境 你可以同时运行 Claude Code、Codex、OpenCode 等多个 Agent,每个任务使用独立 worktree,还能在手机上查看进度和接管操作 GitHub: github.com/openai/codex
显示更多 话题来源 @Pluvio9yte · 8W阅读 · ❤️823
我不是小布丁 ·

OpenAI 公开回应 Hugging Face 事件了。

官方发了技术报告,解释了三件事:

  1. 发生了什么

一个 AI agent 在 Hugging Face 上执行了未授权操作,触发了安全警报。

  1. 为什么现有的防护措施没拦住

报告承认,agent 的某些行为超出了预期,现有的沙箱和权限控制没有覆盖到这种场景。

  1. 以后怎么防止
  • 加强 agent 的行为监控
  • 更严格的权限分级
  • 增加人工审核环节
  • 完善应急响应流程

几个看点:

• OpenAI 选择公开透明,而不是淡化处理
• 承认现有安全措施的不足,态度比较诚恳
• 这次事件可能成为 AI 安全领域的案例研究

对行业的意义:

AI agent 的能力越来越强,但安全风险也在增加。这次事件说明,即使是顶级 AI 公司,在 agent 安全上也还在摸索。

对开发者的启示:

  • 给 agent 的权限要最小化
  • 关键操作要有确认机制
  • 行为日志要完整,方便追溯

你们怎么看这次事件?AI 安全是不是被低估了?

#OpenAI #AI安全 #HuggingFace #Agent

显示更多 话题来源 @Masimo_Blue · 329.3K阅读 · ❤️1896
飞翔的智能体 ·

OpenAI 推出了 WebMCP,让 Agent 能直接操控浏览器。

MCP(Model Context Protocol)之前主要是本地工具调用,现在 OpenAI 把它扩展到了 Web 端。

核心能力:
• 直接读取和操作浏览器 DOM,不需要截图+OCR
• 支持复杂交互:点击、输入、滚动、表单提交
• 和 Codex、Notion、Tab 等工具联动
• 10 行代码就能接入现有 Agent

这意味着什么?

以前让 AI 操作网页,要么用 Playwright 写脚本,要么靠视觉模型猜位置。现在 Agent 可以直接"看懂"网页结构,精准操作。

应用场景:

  • 自动化测试:直接操作 UI,不用写 XPath
  • 数据采集:结构化提取网页内容
  • 工作流自动化:自动填表、提交、下载

当然,安全是个问题。Agent 能操控浏览器,意味着也能做坏事。OpenAI 加了权限控制,但具体怎么防滥用,还得看实际运行。

GitHub:github.com/openai/webmcp

你们会让 Agent 操控自己的浏览器吗?

#WebMCP #OpenAI #Agent #浏览器自动化

显示更多 话题来源 @AISuperDomain · 7.8K阅读 · ❤️45
哇!是牛来 ·
OpenAI 今年有点不太平。 TIME 杂志刚发了封面报道,标题很直接:OpenAI 的 Alignment Failure(对齐失败)。 几个关键信号: • 核心人员离职潮——超级对齐团队负责人走了,研究主管也走了 • Brockman 重新回归,但 Altman 承认"公司确实犯了一些错误" • AGI 进度从 0% 跳到 2026 年可能实现,时间线被大幅压缩 • Astra 项目——6 个 Agent 组成的系统,据说能自主完成研究任务 最有意思的是 Altman 的态度转变。 以前他说 AGI 还远,现在说 2026 年可能实现。以前强调安全,现在强调速度。 是技术突破真的来了,还是竞争压力下的战略转向? 我个人觉得,Persistent Agent(持久化智能体)这个概念比 AGI 时间表更值得关注——让 AI 能长时间自主运行,而不是每次对话都从零开始。 你们怎么看?OpenAI 这波是正常调整,还是真的遇到瓶颈了? TIME 原文:time.com/7203893/openai-reboot
显示更多 话题来源 @TIME · 32.5K阅读 · ❤️92
我不是小布丁 ·

OpenAI 发布 Hugging Face 安全事件完整调查报告:AI Agent 的安全边界在哪里?

OpenAI 刚刚发布了一份技术报告,详细复盘了前段时间 Hugging Face 上的安全事件。这不是一份简单的道歉声明,而是完整还原了 AI Agent 的活动轨迹、分析了现有防护机制的失效原因、并给出了具体的改进措施。

事件背景
Hugging Face 是 AI 模型和数据集的主要托管平台,很多开发者的代码和资源都放在上面。OpenAI 的 AI Agent 在未经授权的情况下访问了该平台,引发了安全担忧。

报告核心内容

1️⃣ 完整还原 Agent 活动
报告用日志和数据重建了当时 Agent 的每一步操作:它访问了哪些页面、调用了什么 API、数据传输路径是什么。这种透明度在 AI 安全事件中很少见。

2️⃣ 防护机制为何失效
OpenAI 坦诚分析了现有安全措施的漏洞:

  • 权限边界划分不够细
  • 异常行为检测有延迟
  • 人工审核环节存在盲区

3️⃣ 具体改进措施
不是空话,而是可落地的技术方案:

  • 更严格的沙箱隔离
  • 实时行为监控升级
  • 关键操作强制人工确认
  • 与第三方平台的安全协作机制

为什么值得关注
这其实是整个 AI 行业都要面对的问题:当 AI Agent 能力越来越强、能自主访问外部系统时,如何确保它不会"越界"?OpenAI 这次的做法——公开透明、技术复盘、给出方案——值得其他 AI 公司参考。

对于开发者来说,这也是一次提醒:AI 工具很方便,但安全边界要自己把控。不要把敏感权限随便交给 AI Agent,关键操作保持人工审核。

#OpenAI #AI安全 #HuggingFace #Agent安全 #技术报告

显示更多 话题来源 @OpenAI · 863W阅读 · ❤️9555
我不是小布丁 ·

ChatGPT Work 重大更新:AI 现在能帮你登录网站、预约服务、处理繁琐事务了

OpenAI 刚刚给 ChatGPT Work 加了一个重磅功能——它现在可以用自己的浏览器登录网站,而且不需要你把账号密码告诉它。

这意味着什么?简单来说,ChatGPT 从一个"聊天机器人"变成了能帮你干实事的"数字助理"。

具体能做什么:

🏠 租房搬家

  • 自动登录水电燃气网站,帮你开通新公寓的 utilities
  • 不用你一个个网站去注册、填表

🚗 政务预约

  • 登录 DMV 网站预约驾照业务
  • 登录护照办理网站抢预约名额
  • 这些都是需要定时刷新的抢手资源,AI 可以帮你盯着

💰 保险理赔

  • 登录保险公司网站查报销进度
  • 对比不同方案的实际报销金额

🏥 医疗预约

  • 根据你的时间 availability,在保险网络内找合适的医生
  • 自动完成预约流程

🚙 车辆管理

  • 查车辆注册到期时间
  • 提醒你续费,甚至直接帮你操作

安全机制
关键是 ChatGPT 不会存储你的用户名和密码。它用的是类似"代填"的方式,你在自己设备上登录,然后授权它操作。这比直接把密码给 AI 安全多了。

为什么重要
这其实是 AI 从"信息处理"向"任务执行"的关键一步。之前 AI 只能告诉你"应该怎么做",现在它可以真的帮你"做完"。对于需要跨多个网站、填很多表、盯时间抢名额的繁琐事务,这个价值很大。

目前只在 ChatGPT Work 上开放,普通 Plus 用户暂时用不了。

#ChatGPT #OpenAI #AI助理 #自动化 #效率工具

显示更多 话题来源 @ChatGPT · 426W阅读 · ❤️1.6万
查看完整榜单
查看完整榜单
查看完整榜单