Codex手搓监控AI分析器,400个视频定位凌晨3点戴帽人

朋友家里被盗了,去物业调监控,总共400多个视频文件,累计20多个小时的录像。这要人眼看,不得看到猴年马月? 我直接用Codex手搓了一个监控视频AI分析器,整个流程全自动: 先把视频丢进去,自动抽帧转图片。然后用ffmpeg把那些静态画面(比如一直对着空走廊的)全过滤掉,只保留有变化的片段。最后把筛选出来的画面拼成16宫格,扔给GPT-5.6-Luna去分析。 为什么选GPT-5.6-Luna?便宜啊。这种批量分析的任务,用贵的模型跑几个小时钱包受不了。Luna价格低,干这种活正合适。 跑了大概三四个小时,直接定位到了关键画面——凌晨3点有个戴帽子的人在楼道里晃悠。拿着这个截图去报警,效率拉满。 整个工具没考虑UI,纯命令行能用就行。但说实话,这种场景下美观不重要,能快速出结果才是王道。 以前觉得AI只能写写代码聊聊天,这次是真的用它解决了一个现实问题。400个视频要是靠人看,至少得两三天,还容易漏掉关键帧。AI几分钟扫完一轮,该过滤的过滤,该标注的标注。 有类似需求的可以参考这个思路,不一定非要用GPT,本地的视觉模型也能干这事。关键是抽帧+过滤+分析这套流程,框架搭好了换模型很容易。
话题来源 @xuanyuanzhifeng 93.4K阅读 ❤️455 x.com/…↗ 已改写,非原文转载
18 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单