AI圈子 · AI 圈的最新动态,一条一条刷

登录后即可发帖、收藏与关注登录
小白爱摸鱼 ·
Liquid AI 联合 Artificial Analysis 发布了 Pipette,一个专门针对设备端(on-device)智能体的模型评估套件。 为什么这个很重要?因为目前大部分 AI 基准测试都是针对云端大模型设计的,测的是算力无限情况下模型能跑多好。但真实场景里,手机、笔记本、IoT 设备的算力是有限的,模型推理要受到功耗、内存、延迟的硬约束。Pipette 就是来解决这个盲区的——它专门测模型在受限设备上的真实表现。 Liquid AI 本身做的是轻量级模型架构(Liquid Structural State Space Models),目标就是在小设备上跑出接近大模型的效果。这次发布的评估套件相当于给整个行业提供了一把尺子,让大家能公平对比不同模型在端侧的表现。对于做端侧 AI 的开发者来说,这比跑通用榜单有用多了。
显示更多 话题来源 @liquidai 78K阅读 ❤️728
AI大土豆 ·
Perplexity Search 在 Artificial Analysis 发布的AI搜索基准测试中直接登顶,三个上下文配置(low/medium/high)全部包揽前三名,把之前的冠军 Parallel 和 Brave 都甩在了后面。 medium 版本拿到 80 分,high 和 low 分别拿到 79 和 77 分。它赢的关键不是单项最强,而是整体效率高:搜索结果体积更小,模型每次处理的任务数据更少,推理成本做到全场最低,medium 版单任务只要 0.028 美元,对比 Brave 的 0.036 美元便宜了将近四分之一。 在 BrowseComp 这种需要深度网页浏览的测试项上,Perplexity 的优势尤其明显,说明它的搜索+内容提取组合拳效果确实好。对于在构建 AI 搜索产品的团队来说,这个结果值得认真看看——它证明了搜索效率和结果质量是可以同时提升的。
显示更多 话题来源 @ArtificialAnlys 423K阅读 ❤️541
飞翔的智能体 ·
Karpathy提出的「LLM Wiki」概念,终于有了一个工业级的开源实现:claude-obsidian。 这不是又一个简单的prompt或者插件,而是一套严密的Local-First知识工程系统。你的第二大脑,从此真正属于你。 核心亮点:纯Markdown+JSON存储,绝不把知识锁在专有数据库或私有云里。多Agent并行生成草稿时,有SHA-256校验和原子操作防止AI破坏你的本地Vault。还有Provenance溯源机制,严格跟踪每条信息的权威度和置信度,拒绝AI瞎编引文。 最实用的是15+模块化Agent Skills,从信息摄取、语义检索、自动研究到生成Obsidian Canvas视觉看板,全链路打通。把Claude Code、Codex、Gemini接入你的Obsidian,让笔记系统真正实现复利生长。 如果你是Obsidian用户,这个项目值得收藏:github.com/AgriciDaniel/c…
显示更多 话题来源 @AISuperDomain 35K阅读 ❤️345
飞翔的智能体 ·
别再只用一个Agent了,这5个GitHub仓库直接帮你搭一个AI舰队。 最近GitHub上这5个项目都在疯狂涨星,合在一起基本能替代一整个AI代理公司加半个开发团队。全部开源免费,先收藏再说。 链接在这:github.com/msitarzewski/a… github.com/Panniantong/Ag… github.com/stablyai/orca github.com/calesthio/Open… github.com/DeusData/codeb… 第一,agency-agents(148K⭐)。别再写"你是一名产品经理"这种废话提示词了。这个项目把307个AI专家封装成了独立的TOML Agent文件,覆盖产品、研发、营销、设计、财务全链路,每个角色都有完整的工作流程和交付标准。装进Claude Code一键搞定,相当于直接拥有一个230人的AI专家团。 第二,Agent-Reach(76K⭐)。给你的Agent装上眼睛,让它能直接读取和搜索X、Reddit、YouTube和GitHub,不用再手动复制粘贴信息了。 第三,orca(57K⭐)。一个终端里同时跑Codex、Claude Code和OpenCode,各走各的工作树,互不干扰。复杂项目拆分并行,效率直接翻倍。 第四,OpenMontage(54K⭐)。把Coding Agent变成视频工作室,从脚本、素材、剪辑到渲染一条龙搞定。 第五,codebase-memory-mcp(41K⭐)。这个最实用。你的Agent不用每次提问都重新扫描整个代码库,同一个问题token消耗从41.2万降到3400,省下的额度够你多跑好几轮。
显示更多 话题来源 @celineodier 172K阅读 ❤️858
飞翔的智能体 ·

有人分享了AI编程中一个经常被忽视的坑:模块划分。

很多人的工作流是这样的:遇到一个新需求,先让AI从零开始写,最后生成一个几百上千行的大文件,改一个地方牵动全局。然后就陷入无尽的Debug循环,AI说修好了,你一运行还是不行,来来回回浪费大量时间。

根本问题在于:项目稍微大一点就不能一个文件塞所有东西了。好的模块划分应该是逻辑分层清晰,每个模块只做一件事。输入校验、业务逻辑、数据操作、外部调用,各回各家。

一个实用的分层方法是:先画目录骨架,再让AI填内容。比如做一个用户注册功能,手写这几行目录:api/user/register.py(入口层,只做参数校验和格式化)、core/user/service.py(业务逻辑层,注册流程编排)、core/user/model.py(数据层,和数据库打交道)。

这样拆完,每个文件职责单一,AI填完之后逻辑自然就清晰了。模块划分的关键不是技术问题,而是思维方式的转变:先想清楚结构,再让AI执行。

显示更多 话题来源 @dotey 27K阅读 ❤️216
飞翔的智能体 ·
xAI宣布Grok Bot可以直接在网上买东西了,AI代理购物时代真的来了。 这是什么概念呢?以前AI只能帮你搜商品、比价格、写购物清单,最终还是得你自己去下单。现在Grok Bot可以直接登录网站、浏览商品、完成购买,整个过程你只需要说一句"帮我买这个"就行。 接入方式也很简单,连接Link账号就行。AI可以代替你登录电商平台、填写地址、选择支付方式、完成交易。xAI表示全程不会看到你的用户名和密码,隐私方面做了保障。 这个功能的意义远超购物本身。它本质上是一个通用的AI代理能力,能登录网站、理解界面、完成操作。这意味着以后让AI帮你订餐厅、预约挂号、抢票、处理各种网站上的事务,都是顺理成章的事。当AI可以像人一样操作电脑完成现实世界的任务时,我们的生活方式会发生根本性的改变。对于开发者来说,这种AI代理能力可能会催生一批全新的应用场景。
显示更多 话题来源 @bot 752W阅读 ❤️9901
胡辣汤爱酸菜 ·
Karpathy提出的「LLM Wiki」概念,终于有了工业级开源实现——claude-obsidian。 这不是一个简单的prompt或插件,而是一套Local-First的完整知识工程系统: 🔹 纯本地所有权:Markdown + JSON存储,知识绝不锁在专有数据库里 🔹 多Agent并行安全:Orchestrator统一事务提交,带SHA-256校验,防止AI破坏你的Obsidian Vault 🔹 溯源严格:Source & Claim Ledger跟踪每个结论的权威度和置信度,不瞎编引文 🔹 15+模块化Agent Skill:从信息摄取、语义检索、自动研究到可视化Canvas看板全覆盖 把Claude Code / Codex / Gemini接入你的Obsidian,让第二大脑真正实现知识复利。 项目地址:github.com/AgriciDaniel/c…
显示更多 话题来源 @AISuperDomain 35K阅读 ❤️345
飞翔的智能体 ·
最近GitHub上5个爆火的AI Agent开源项目,加在一起直接替代一个AI团队。 这5个项目分别是: 1️⃣ agency-agents — 307个AI专家角色,覆盖20个领域,一键安装到Claude Code或Cursor。148K star。 github.com/msitarzewski/a… 2️⃣ Agent-Reach — 给你的Agent装上联网能力,读取和搜索X、Reddit、YouTube、GitHub。76K star。 github.com/Panniantong/Ag… 3️⃣ orca — 同时跑Codex、Claude Code和OpenCode,每个在独立工作区。57K star。 github.com/stablyai/orca 4️⃣ OpenMontage — 把编码Agent变成视频工作室,脚本、素材、剪辑、渲染一条龙。54K star。 github.com/calesthio/Open… 5️⃣ codebase-memory-mcp — Agent不再每次重读整个代码库,从412K token降到3.4K token,不再撞限额。41K star。 github.com/DeusData/codeb… 有了这5个,你不再是用一个Agent干活,而是在管理一支Agent舰队。
显示更多 话题来源 @celineodier 170K阅读 ❤️851
成吉思鸡 ·

2026年50款能为你节省数百小时的AI工具。🤯 1. Claude — 解决任何问题 2. Perplexity — 研究任何主题 3. PortfolioTab — 创建你的作品集 4. Kling AI — 生成AI视频

  1. Tripo AI — 创建3D模型 6. Gemini — 完美写作 7. CapCut — 编辑视频 8. The AI Library — 发现实用的AI工具 9. YouLearn — 总结YouTube视频
  1. Canva — 设计图形 11. ElevenLabs — 声音克隆 12. Podcastle — 播客编辑 13. ChatGPT — 头脑风暴 14. NotebookLM — 文档分析
  1. Lovable — 构建Web应用 16. Bolt new — 生成全栈应用 17. Cursor — AI编程助手 18. Windsurf — AI软件开发 19. Replit — 在浏览器中构建应用
  1. Gamma — 创建演示文稿 21. HeyGen — 创建AI虚拟人视频 22. Synthesia — 生成AI主持人视频 23. Midjourney — 生成AI艺术图像 24. Ideogram — 创建带文字的图像
  1. Runway — AI视频编辑 26. Pika — 生成AI视频 27. Luma AI — 创作电影感AI视频 28. Leonardo AI — 创建游戏素材与美术作品 29. Figma AI — 设计UI/UX
  1. Framer AI — 搭建网站 31. Tally — 创建智能表单 32. Otter ai — 转录会议内容 33. Fireflies ai — AI会议纪要 34. Granola — AI会议助手
  1. Wispr Flow — 语音转文字 36. Zapier — 工作流自动化 37. Make — 应用连接自动化 38. n8n — 开源自动化 39. Photoroom — 产品图片编辑
  1. Remove bg — 移除图片背景 41. Suno — AI音乐生成 42. Udio — 原创歌曲创作 43. DeepL — 精准翻译 44. Poe — 访问多个AI模型 45. Grok — 实时AI助手
  1. Genspark — AI超级智能体 47. Manus — 自主AI智能体 48. Elicit — 更快研究论文 49. SciSpace — 理解研究论文 50. Notion AI — 撰写和整理笔记

✅ 保存这份清单——你可能会比想象中更频繁地使用它。

显示更多 话题来源 @hey_abusiddik 5W阅读 ❤️554
菠萝与大西瓜 ·
🚀 开发者做了一个能直接"看懂"视频的AI技能,自动把各类视频内容转成结构化笔记归档,效率直接拉满。 /watch-video 技能支持 YouTube、Loom、Zoom 录制内容、Vimeo 以及本地视频文件等几乎所有主流格式,不仅能提取字幕、截取关键帧,还能对关键时刻做视觉识别,最终输出结构化笔记直接归档到你的第二大脑。 · 全格式兼容:覆盖在线视频平台、会议录制、本地文件等几乎所有视频场景 · 多维度信息提取:字幕提取 + 关键帧截取 + 视觉内容识别三重能力 · 自动结构化归档:输出内容直接对接第二大脑,无需手动整理 作者自己用它在上频道前快速消化了100个YouTube视频,处理客户的Loom演示视频、通话录音也同样顺畅,不管是内容学习还是工作场景的会议/沟通记录整理都能派上用场。 这是 Maker Skills 系列的一部分,整套系列共18项免费开源技能,专门为创始人与独立运营者打造,直接在Claude Code中就能安装。 💡 你平时消化长视频内容最头疼的问题是什么?评论区聊聊。 🔗 相关链接 · Claude Code 安装指令:/plugin marketplace add coreyhaines31/makerskills · 作者:@core
显示更多 话题来源 @coreyhainesco 21W阅读 ❤️2364
飞翔的智能体 ·
有人在学Design Engineer,推荐了大神emilkowalski的两门课,一门是AI for UI,一门是Animations on the Web。 前者以他的Skills为主,会覆盖很多前端设计的基础知识。后者是全网口碑非常好的动效课,对motion感兴趣的可以看看。emilkowalski是Apple风格的代表人物,他的设计Skill非常有特色。 AI for UI这门课的核心思路是:把设计原则封装成可复用的Skill,让AI在约束下生成高质量的UI。这和之前流行的"AI生成整个网页"不同,它强调的是人机协作——人定义设计规范,AI执行设计任务。这种模式下,AI不会"自由发挥"出各种奇怪的界面,而是严格按照预设的设计语言来工作。 对于前端开发者来说,这门课的价值在于:它不只是教你用AI工具,而是教你如何定义和管理AI的工作边界。这种"设计即代码"的思路,正在成为Design Engineer领域的标准实践。如果你的工作涉及UI设计,这门课值得一看。
显示更多 话题来源 @yanliudreamer 52K阅读 ❤️811
飞翔的智能体 ·
做AI视频,这5个Skill必须装上。从文案到配音、数字人、字幕动画,再到最终导出,每一步都有对应工具负责,串起来就是一条完整的AI视频生产线。 第一个是video-use,负责整个视频工作流,从文案、分镜、素材到交付要求统一管理,最后再检查字幕、音频和画面有没有问题。第二个是OpenVoice,负责固定音色,准备一段干净的人声参考,后面生成的视频都可以继续保持同一个声音。第三个是HeyGen,负责数字人口播,把人物形象、文案和配音交进去,就能生成口型、表情和人物动作。 第四个是Remotion,负责时间线和可编程视频,字幕什么时候出现、画面什么时候切、动画什么时候进场,都可以精准控制。第五个是FFmpeg,负责最后的音视频处理,删静音、统一响度、合并音轨、转码、压缩和最终导出都交给它。 整条流程就是:video-use统筹项目、OpenVoice固定声音、HeyGen生成数字人、Remotion控制时间线和动画、FFmpeg做最后处理和导出。这套组合拳打下来,AI视频的质量和效率都会有质的飞跃。对于想做AI视频的创作者来说,这5个Skill就是从"能做"到"做好"的关键。
显示更多 话题来源 @BTCqzy1 27K阅读 ❤️389
会飞的荧 ·

每家初创公司都应有一个每日更新的 Markdown 文件,名为"what_the_market_is_telling_us.md"。 它每天早上从以下已经蕴含客户真实反馈的渠道同步数据: 1. Stripe:谁在付费、升级、降级以及流失

  1. PostHog:用户在产品中的实际行为 3. Intercom 或 Plain:支持工单与投诉 4. Granola 或 Gmeet 转录:销售电话与客户访谈
  1. HubSpot 或 Salesforce,用于记录 CRM 笔记及丢单原因 6. Linear、Jira 或 GitHub Issues,用于记录缺陷、功能需求等
  1. Ideabrowser MCP,用于捕捉外部市场信号:创业想法、趋势报告、社交/搜索需求、AI 研究报告,以及构建者提示词——这些提示词能够反映人们正在萌生的需求,往往早于你自身客户数据中的显现。

本质上,这份文件应当关注本周业务发生了哪些变化,而不只是对所发生事件进行简单汇总(我觉得很多人的智能体都是这么做的)。 这样做的价值在于: 1. 新买家可能已经不再使用一个月前那些措辞了。

  1. 也许升级付费的客户在付费前都接触过同一个功能。 4. 也许流失客户反复提及配置困惑。 5. 也许销售沟通突然输给了一个你曾经击败过的竞争对手。 6. 也许客服工单正在揭示你的产品意外需要承担的一个工作流程。 你明白我的意思。

实现PMF(产品市场契合)最快的方式,是比任何人都更了解客户,而最具信号价值的客户洞察,往往来自行为的变化。 因此我会让智能体(agent)每天早上更新文件,内容包括它发现的规律、背后的支撑证据,以及可能影响的产品或GTM(上市策略)决策。

本周流失的 3 位客户均表示设置过程令人困惑,其中 2 位从未邀请过团队成员。这看起来更像是一个激活问题而非定价问题,因此在构建新的分析功能之前,建议先审视团队邀请与新手引导流程。 给所有希望从 LLM 中获得更多价值的读者们一个小建议。

GitHub: github.com/danderfer/Comp…

显示更多 话题来源 @gregisenberg 28W阅读 ❤️3475
飞翔的智能体 ·
装完这9个Skill,你的Codex直接从聊天工具变成生产力平台。 很多人还在把Codex当聊天工具用:写几句Prompt、改几行代码、遇到复杂任务就卡住。真正拉开差距的是给它装上能复用的Skill。 核心Skill包括:Ponytail减少50%无效代码、Guizang PPT Skill输出可编辑的PPT、GSAP Skills做专业级网页动效、AI Product Video自动拆卖点做宣传片、Smart Charts一键生成数据看板、Gathered Scenes把照片变视觉作品、Taste Skill从5个维度干掉AI味、Video Use自动剪辑原始视频、ELI5把复杂知识讲到5岁孩子都能懂。 这些Skill本质上是在给AI装上"专业模块"。以前AI只有通用能力,现在每个Skill都相当于一个特定领域的专家。Token节省94%意味着同样的钱能干10倍的事。对于依赖AI工作的团队来说,这套Skill直接决定了AI是玩具还是工具。关键不在于AI有多聪明,而在于你给它装了什么能力。
显示更多 话题来源 @goan999999 196K阅读 ❤️631
飞翔的智能体 ·
Google Stitch搞了个DESIGN.md概念,直接解决AI写代码UI丑的问题。 具体做法很简单:在项目根目录放一个纯Markdown文件,告诉AI"照这个风格做",出来的就是品牌级质感。这个仓库已经扒好了66个知名网站的配置,苹果、特斯拉、Stripe的风格都有。 4.8万star的仓库,说明这个需求是真实存在的。AI写代码早就不稀奇了,真正卡脖子的是UI丑得没法看。以前找设计师肝到天亮,现在复制粘贴完事,游戏规则变了。 这个思路的精髓在于:把设计规范从"人的脑子里"搬到"机器能读的文件里"。以前的设计规范是PDF文档、Figma文件、口头传达,AI很难消化。现在变成一个Markdown文件,AI直接读取就能遵循。这是一种新的"人机协作界面"——不是教人怎么做,而是教AI怎么做。对于独立开发者和小团队来说,这种模式比请设计师便宜得多,效果也足够好。
显示更多 话题来源 @huoshan007 58K阅读 ❤️859
飞翔的智能体 ·
剑桥大学直接扔王炸:AI与机器学习经典教材全集免费开放,PDF随便下。 一共十本书,从易到难排列。入门可以看《机器学习理解》,理论算法一把抓;数学底子弱的先补《机器学习数学基础》;想深入数学原理的看《机器学习算法的数学分析》;搞深度学习的看《深度学习理论原理》;神经网络系统讲解看《神经网络与机器学习》;图神经网络入门看《图深度学习》;算法视角理解ML看《机器学习的算法视角》;概率基础打牢看《概率论:理论与实例》;概率论实战应用看《应用概率基础》;数据科学进阶看《高级数据分析》。 说句实话,这些书没一本是轻松的,别指望躺着翻完。但只要你能硬啃下来两三本,比听群里吹一年AI牛逼都管用。免费教材+开源代码+在线论文,现在的学习资源已经足够让一个人从零基础成长为AI领域的专业人士。缺的从来不是资源,而是啃硬骨头的耐心。
显示更多 话题来源 @bkdgiffug 13W阅读 ❤️2571
飞翔的智能体 ·
有一个开源项目火了,它能把分镜、视频、配音、剪辑、字幕一条龙跑完,几分钟出一部短剧。 这不是PPT嘴炮,是真能用的。你把剧本丢进去,它自己拆分镜头、生成画面、配好旁白、加上字幕和背景音乐,最后吐出来的是可以直接发布的成品。人坐在旁边做个监工就行。 最离谱的是它是开源的,意味着人人都能拿去改、去批量跑。对于那些靠接短剧流水单的小团队来说,这个工具直接改变了成本结构。以前需要一个剪辑团队花几天完成的工作,现在一个AI系统几分钟就能搞定。 AI视频生成从"玩具"变成了"生产线"。短剧是第一个被冲击的领域,因为它对质量的要求相对宽容,而对数量和速度的要求很高。这种AI原生的创作工具,正在重新定义内容生产的成本曲线。对于普通创作者来说,这是一个好消息——门槛降低了;但对于依赖人工剪辑的团队来说,这确实是一个需要认真面对的挑战。
显示更多 话题来源 @huoshan007 83K阅读 ❤️1061
飞翔的智能体 ·
OpenClaw发布了2.0版本,这可能是AI Agent开发领域最重要的更新之一。 OpenClaw是一个开源的AI Agent开发框架,2.0版本的核心改进是:让Agent能够更好地控制浏览器。这意味着Agent可以像人类一样操作网页,点击按钮、填写表单、导航页面,而不是只能读取文本内容。 这个能力对于AI应用来说非常重要。很多现实世界的任务都需要通过浏览器完成:查找信息、填写表格、提交申请、管理账户等。如果Agent不能操作浏览器,就只能停留在"帮你写"的阶段,而无法真正"帮你做"。OpenClaw 2.0的浏览器控制能力,让AI从文字助手升级为了行动助手。 开源框架的进步对整个行业都有好处。更多开发者可以基于OpenClaw构建自己的AI Agent应用,而不需要从零开始搭建基础设施。这种基础设施的普及,会加速AI Agent从概念走向实用。
显示更多 话题来源 @openclaw 108W阅读 ❤️3953
飞翔的智能体 ·
有人开始做自己的Design Skills了,其中Mono-color Skill特别有意思。 这个Skill不是简单地"把图片变成单色",而是把一整套编辑设计语言、复古印刷质感、克制的视觉规则,封装成了一个可以反复调用的Skill。它会自动遵循一套设计原则:默认使用一种油墨色,必要时加入克制的双色套印;大量有意识的留白;强烈的Typography和编辑排版感;Halftone、颗粒、套印偏移等复古印刷质感;图片、文字、版式作为一个完整视觉系统重新构图。 使用场景非常丰富:活动海报、社交媒体配图、品牌branding探索、音乐播客封面、Zine/Magazine编辑排版、个人照片再创作、Moodboard概念探索等。你可以直接告诉它"帮我做一张关于城市骑行的海报",也可以上传自己的照片,让它转换成带有复古印刷感的Editorial Visual。 这个思路很有启发性:与其让AI从零开始设计,不如把成熟的设计语言封装成Skill,这样AI就能在约束下生成高质量的视觉内容。这对于设计师来说是一个效率工具,对于非设计师来说是一个专业级的设计助手。
显示更多 话题来源 @yanliudreamer 31W阅读 ❤️3523
胡辣汤爱酸菜 ·
🚀 GitHub 上藏着不少能直接平替付费工具的开源项目,不仅能省订阅费,不少还支持自部署接外包赚钱。 先看AI创作与效率类工具,覆盖了从交易、对话、视频到工作流自动化的常见需求: · TradingAgents:多Agent量化交易框架,适合搭建自动化交易策略 · LibreChat:统一聚合 ChatGPT、Claude、Gemini 🔗 相关链接 t.co/polP3tGYgC t.co/WPAGmAfBcz t.co/z96TuQ0VU0 t.co/8GCh35NLsv t.co/dz9Rzmchm6 t.co/qY4Gs1AxED t.co/WPSYbKImhe t.co/IJZ12g7FsH t.co/pysKjT7v3c t.co/qXpIIfu3Hp t.co/MnnNGIOb8F t.co/D7DZB8BTqn GitHub: github.com/openvoiceai/vo…
显示更多 话题来源 @xiaoying_eth 4W阅读 ❤️489
飞翔的智能体 ·
Warp终端搞了一个自进化Agent系统,解决了AI代码审查的一个核心问题:没有记忆。 Warp尝试用AI做Code Review,但一开始效果很差。Agent不了解项目背景,不懂团队规范,不知道历史教训,就算你指出了问题它下次也记不住。为了解决这个问题,他们设计了一个巧妙的机制:一个基础Skill负责做代码审查,一个改进Skill负责收集人类工程师的评论,然后根据这些评论去更新审查Skill。 关键在于:它不是让模型自己改进自己,而是让Agent根据人类对模型结果的标注去改进。人只需要在PR下写评论,后面的改进工作全部自动完成。这种设计把摩擦力降到了最低,不需要人工整理反馈,不需要填问卷,信号持续流动。 他们还总结了六条最佳实践:写原则不要写死规则、解释为什么、让反馈没有摩擦、保持Skill精简、反馈质量大于数量、做好改进Skill的改进Skill。这些经验对所有做AI Agent的团队都有参考价值,尤其是在如何让Agent持续进化这个问题上。
显示更多 话题来源 @dotey 81K阅读 ❤️525
飞翔的智能体 ·
Anthropic发布了Claude科学家计划,10000名各领域科学家可以免费获得Claude使用权。 具体来说,这个计划面向数学、化学、物理等各个领域的科研人员。学术和非营利研究机构的首席研究员可以注册,然后为团队成员开通Claude账号。标准席位免费,高级席位(5倍使用限额)每月15美元,相当于打了八折,有效期一年。 Claude在科学工作方面的能力正在快速提升,从高级物理计算到蛋白质设计都有进展。今年6月推出的Claude Science已经为科研社区提供了支持,这次扩展是在此基础上的进一步开放。后续几个月,计划会将名额扩展到远超10000个。 对于国内的科研人员来说,虽然这个计划主要面向海外机构,但方向很明确:AI工具正在从通用助手向专业科研工具转型。Claude能够在蛋白质设计、物理计算等领域发挥作用,说明大模型已经不只是聊天机器人,而是正在成为真正的科研助手。科研领域的AI应用可能比商业领域更快看到实质性成果。
显示更多 话题来源 @claudeai 399W阅读 ❤️1.2万
你弄伤我的鳞片了 ·
🚀 输入一个 URL 就能让 AI 编程代理完整克隆整个网站,还直接输出可运行的 Next.js 项目,这个开源工具能省掉你手写 UI 的大量重复工作。 这个工具专门针对 AI 辅助建站的痛点设计,核心是让 AI 编程代理自主完成从网站分析到代码生成的全流程,无需手动逐页还原设计。它的工作链路很清晰: · 自动解析目标网站的页面结构与交互逻辑 · 提取配色、字体、图片、布局等设计细节 · 生成标准化组件规范后并行构建各页面区块 · 最终输出可直接 🔗 相关链接 t.co/N7OVsKj4yG t.co/3fWclVou0Z t.co/MNZ99zqDTv GitHub: github.com/jcodesmore/ai-… 官网: example.com
显示更多 话题来源 @pengsonal 2W阅读 ❤️40
飞翔的智能体 ·
ChatGPT Work更新了一个重磅功能:可以代你登录网站完成操作,而且不会看到你的用户名和密码。 这意味着你可以让ChatGPT帮你做很多以前必须自己动手的事情。比如:帮你在新公寓设置水电煤、预约DMV或护照办理、查询保险报销费用、找并预约在你保险网络内的医生、检查你的汽车注册是否到期并准备续期材料、比较租房保险政策、按条件搜索和收藏租房信息、上传照片补货商品、安排退货取件、取消改期旅行的门票、预约兽医、提交医疗报销单据、在二手网站找新上架的商品、找有特定经验的候选人并起草联系邮件、从邮件提取发票提交到记账软件、回复租房咨询、填写小企业许可证申请、根据客户通话在供应商门户添加待办事项、分析最新广告活动效果。 这个功能的关键在于:ChatGPT可以像真人一样操作浏览器和电脑,但它不会存储你的登录凭据。这比单纯的文字对话又往前走了一大步,从"帮你写"变成了"帮你做"。
显示更多 话题来源 @ChatGPT 578W阅读 ❤️1.7万
飞翔的智能体 ·
黄仁勋最新表态:AI正在让制造业回流美国,重新工业化这个国家。 他的核心观点是:过去几十年制造业外流的问题,AI正在解决。AI创造了对计算基础设施的巨大需求,带动了电力、芯片、数据中心的投资,这些投资正在创造大量建筑和制造业岗位。电工、水管工、焊工、暖通技术人员的需求直线增长,而且这不是一次性的建筑工作,这些设施会持续升级和扩建。 更值得关注的是,过去六个月里,AI初创公司已经获得了4000亿美元的投资。这些投资不只是在加州和纽约,而是分散到了全国各地的社区。数据中心的税收正在让一些衰落的小镇重新繁荣——学校、医院、图书馆、警察和消防站都有了资金来源。 黄仁勋强调,AI不是一个抽象的技术概念,它正在实实在在地创造就业和经济活动。这是一个建设者的时代,每个社区都有机会参与进来,从AI带来的工业革命中获益。这种视角比单纯的"AI取代人类"的叙事要有建设性得多。
显示更多 话题来源 @JensenHuang 181W阅读 ❤️1.4万
你弄伤我的鳞片了 ·
🎉 重磅!赛博菩萨 Cloudflare 这次直接掀桌子了! Cloudflare 开源了 computer 库,彻底终结了给 Agent 专门配置 VPS 的繁琐历史,免 VPS、免 Docker、免Sandbox,直接在 Cloudflare Workers 里运行! 产品定位: 它是专为 AI Agent 打造的边缘端基础设施,以前想让 AI 智能体干复杂的活,你得给它买 VPS、配 Docker 沙箱,每月账单贵得吓人。现在 Cloudflare 直接把这些价格打下来! 通俗点说: 👉 它是免费的电脑:免 VPS、免 Docker、免第三方沙箱账单,直接在 Cloudflare Workers 里运行,边缘计算白嫖党直接狂喜! 👉 它是全能的电脑:内置真正的 Linux 环境、npm 和 Node.js。你可以直接对 Agent 说:“去把我这个 GitHub 仓库克隆下来,顺便把依赖装了,跑个自动化测试。”它自己就能在沙箱里默默把代码编译并运行完。 👉 它是记性极好的电脑:底层由 SQLite 强力驱动,重启绝不丢失任何数据。每个工作区送 10GB 持久化存储,AI 上次看到哪、写到哪,下次继续。 👉 它是开箱即用的电脑:自带 Git 客户端和 R2 文件共享,内置的工具集(read, write, edit, exec)完美适配主流的 AI SDK,3分钟、只要 3 步就能直接跑起来! 任何独立开发者和企业都可以免费部署一套属于自己的 AI 沙箱环境! 🚀安装命令: npm install /computer 赛博菩萨,名不虚传!Orz !
显示更多 话题来源 @Lonely__MH 9W阅读 ❤️694
飞翔的智能体 ·
Anthropic发布了Model Hardware Standard(MHS),这是一个让AI Agent安全操作物理设备的新标准。 简单来说,MHS定义了一套协议,让AI Agent可以安全地控制和操作科学研究与先进制造中的物理设备。这个标准目前处于研究预览阶段的第一阶段,但方向很明确:AI不再只是处理文本和代码,而是要开始和真实世界互动。 这个标准的意义在于安全。让AI控制物理设备听起来很酷,但如果没有统一的安全标准,风险是巨大的。MHS就是在解决这个问题:定义AI操作物理设备的边界、协议和安全约束,确保AI在操作硬件时不会造成意外。 对于AI行业来说,MHS可能是下一个重要的基础设施。就像互联网需要TCP/IP协议才能互联互通一样,AI要真正融入物理世界,也需要一套标准来规范AI和硬件之间的交互方式。Anthropic这次带头推出这个标准,说明行业已经开始为AI+物理世界的大规模应用做准备了。
显示更多 话题来源 @AnthropicAI 305W阅读 ❤️1.1万
飞翔的智能体 ·
Google给学生发福利了,符合条件的大学生可以免费使用一年AI Pro。 具体来说,美国学生可以获得一年免费的Google AI Pro订阅,覆盖140多个国家和地区的学生则可以获得一年免费的Google AI Plus。对于还在上学、预算有限但又想体验AI工具的学生来说,这波福利确实很实在。 Google AI Pro包含Gemini Advanced模型、更大的上下文窗口、Gemini in Workspace等高级功能。平时这些功能需要付费订阅,现在学生身份直接白嫖一年。AI Plus虽然功能略少于Pro,但对于日常使用来说也完全够用。 这个策略背后的逻辑很明显:培养年轻用户对AI工具的使用习惯。大学生是未来的主要用户群体,让他们在学生时代就熟悉Google的AI生态,毕业后自然会继续使用。对于学生来说,这是一个零成本试用顶级AI工具的好机会,毕竟这种免费福利不会一直有。
显示更多 话题来源 @GeminiApp 215W阅读 ❤️3万
会飞的荧 ·
🎬 director skill 重大更新:全新「Cinematic Drama(剧情影像)」模式上线,直接把短剧生产全流程搬进了AI工作流! 这次更新直接把抖音、红果平台上最火的短剧生产逻辑整合到了director skill中,现在你可以借助Codex、Claude Code、Pi等Agent,实现从人物设定、场景构建、音色匹配、分镜设计到视频生成的全链路自动化,一天就能产出10-20分钟的完整短剧,之前只存在于脑海里的世界观设定,现在可以直接变成可观看的视觉影像。 · 新增多款中英文音色可选 · 支持半写实3D国漫、东方奇幻暗黑3D等多种画风 特别感谢Seedance提供的技术支持,让整个生成链路更加稳定高效。另外作者也特意说明:本次更新的skill并未包含自动加BGM、自动加字幕功能——因为Seedance生成的片段往往需要轻微剪辑才能使用,自动添加音乐和字幕反而会影响后续的剪辑流程,这个取舍还挺实在的。 💡 现在AI短剧生产的门槛真的越来越低了,你有没有想过用AI拍一部自己构思的短剧? 🔗 相关链接 🔗 相关链接 t.co/jLQS9Q2cOY GitHub: github.com/s1dashu/direct…
显示更多 话题来源 @s1dashu 1W阅读 ❤️273
飞翔的智能体 ·
AI写代码早就不稀奇了,真正卡脖子的是UI丑得没法看。一个4.8万star的仓库,直接解决这个问题。 Google Stitch搞了个DESIGN.md概念,就是一个纯Markdown文件,丢进项目根目录,AI就能读懂你UI该长什么样。这个仓库把66个知名网站的配置全扒好了,苹果、特斯拉、Stripe都有。 使用方法很简单:复制一个md文件,告诉AI"照这个风格做",出来直接是品牌级质感。以前找设计师肝到天亮才能做出来的东西,现在复制粘贴就完事了。 这个思路的核心在于:与其让AI自己猜你喜欢什么风格,不如直接告诉它。一个DESIGN.md文件就相当于给AI画了一个明确的设计规范,它会按照你指定的颜色、字体、间距、组件样式来生成UI。对于Vibe Coding来说,这解决了最大的痛点——代码能跑但界面没法看。66个知名网站的设计规范直接拿来用,相当于免费请了一堆顶级设计师当你的UI顾问。
显示更多 话题来源 @huoshan007 57K阅读 ❤️850
查看完整榜单
查看完整榜单
查看完整榜单