跑了13小时的GPT-6 Astra地狱难度测试,专门测试它应对专业系统性任务到底啥水平。
测试结果:
5项任务总得分:60/100(及格线),消耗token:2.1亿
各项任务评分:
- 使用行业软件建模,复原度 70%
- 建筑微电影质量 75%
- 可交付施工图完成度 40%
- 展示图/Diagram 质量 60%
- 使用生成式AI做风格化短片 55%
测试条件:
- 输入:单图+提示词
- 要求:传统流程+软件
- 运行时长:>12h
- 消耗token:2.10亿
交付结果(对应视频演示):
- Rhino 建筑模型
- Grasshopper 帆面分格
- 离线空间漫游
- BIM 模型
- 一套 CAD 图纸
- 2张 A1 建筑分析
- 2张 A1 项目展板
- 一段3min建筑短片(建模+渲染+剪辑)
- 一段2min以建筑为背景的悬疑短片(建模+AI视频生成)
- 点云修正
- 建筑资料研究
- 总体任务书
- 3组独立曲面修正
核心亮点:
- 效率提升:以前做这种级别的测试,专业团队至少要花几周时间。
- 成本降低:现在一个人用GPT-6 Astra就能搞定。
- 质量提升:效果相当惊艳,细节处理到位。
- 实用性强:这个案例展示了在建筑领域的实际应用价值。
技术亮点:
- 行业软件:使用Rhino、Grasshopper等专业软件。
- 全流程覆盖:从建模到渲染到剪辑,全流程覆盖。
- token消耗:2.1亿token,测试规模宏大。
- 时间成本:13小时完成,省95%时间。
实际使用场景:
- 建筑设计:用GPT-6 Astra进行建筑设计,提高效率。
- 影视制作:用GPT-6 Astra进行影视制作,提高效率。
- 工程设计:用GPT-6 Astra进行工程设计,提高效率。
- 教育培训:用GPT-6 Astra进行教育培训,提高效率。
这个案例真的太实用了,GPT-6 Astra 13小时地狱难度测试:5项任务总分60/100,未来可期。
17 浏览 0 评论
0 反应













