热门AI工具推荐

焚书AI多模型聚合平台
AI多模型聚合平台( Claude 系列、GPT 系列)支持聊天、搜索、图片、视频、音乐等多种功能;聚合了 Claude 系列(如 Sonnet 5、Opus 5 等)、Gemini 系列、GPT 系列、DeepSeek(搜索模式默认调用 DeepSeek V4 Pro)以及通义千问、Kimi 等数十款国内外主流模型。
AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

GPT-6 Astra首次开真车跑通134米锥桶赛道

时间:2026 年 9 月 21 日(DrivingBench 公布测试结果),9 月 24 日至 27 日中英文媒体广泛报道 地点:美国加州湾区一处空旷私人停车场 人物:独立研究项目 DrivingBench 由 Aditya Ramabadran、Simon Mahns、Tobias Gessler 三位湾区研究者创建;测试模型来自 OpenAI(GPT-6 Astra、GPT-5.6 Sol)、Anthropic(Claude Fable 5.1)和 xAI(Grok 4.6) 事件详情:DrivingBench 是一个独立基准测试平台,研究者在一辆 2022 款丰田卡罗拉上安装 999 美元的 comma four 设备,通过 OBD-C 接口接入 CAN 总线,由开源辅助驾驶系统 openpilot 执行底层转向、油门和制动。模型通过 MCP(模型上下文协议)工具接收两路摄像头画面、车速和方向盘角度,再发出三类指令:observe()(观察环境)、set_motion()(设定方向、转向幅度、速度与持续时间)、stop_now()(立即刹车)。赛道全长 134.7 米,由锥桶在停车场划出,含左转入口、直道缓弯、连续右转与终点锥桶停车区,速度上限 3.5 米/秒(约 8 英里/小时),车内始终有一名持证安全员守在制动踏板旁。 测试结果:GPT-6 Astra 成为四款模型中唯一完整跑完全程的选手。第二次尝试耗时 5 分 22 秒,发 24 条运动指令,平均时速 0.94 英里(约 1.5 公里/小时)。Claude Fable 5.1 最好成绩 45%,Grok 4.6 仅 11%,GPT-5.6 Sol 最低只有 6%。Astra 全程消耗约 660 万 token,按当时 API 价格折算成本约 7.74 美元,连同硬件一起两次尝试总成本约 9.75 美元。 研究者注意到一个细节:GPT-6 Astra 一度会拒绝驾驶真车,即便被告知是空旷停车场、有限速、有安全员,仍以安全理由拒绝执行。当开发者把 MCP 工具名改为 "DrivingBench Sandbox"(驾驶测试沙盒)后,拒绝行为明显减少。 背景:特斯拉 FSD、Waymo 等自动驾驶系统依赖数十亿英里真实驾驶数据与专门训练的端到端模型。本次 DrivingBench 测试是首次让通用大语言模型——未经任何驾驶数据专门训练——在真实物理世界中控制汽车。三位湾区研究者通过 comma 硬件和 MCP 协议把通用 LLM 接进真车 CAN 总线,整个实验框架已在 GitHub 开源(MIT 协议),完整行驶轨迹、视频与日志同步发布在 Hugging Face 数据集 drivingbench/drivingbench-traces。所有测试在 2026 年 9 月 17 日的同一场会话中完成。 影响:通用大模型第一次具备了端到端驾驶的感知-规划-控制闭环能力,但同时也暴露了云端 LLM 的三大瓶颈:1)延迟——聊天模型一次决策要经过图像上传、推理、回传链路,专业驾驶模型以 20Hz 更新指令,云端 LLM 像"每隔几秒才看一眼手机的司机",无法应对动态路况;2)成本——折算每英里约 92.47 美元,是同距离燃油成本的 500 倍;3)安全判断——模型可被工具命名诱导绕过自身防御。短期内通用 LLM 不会直接替代 Robotaxi 或量产城市 NOA,但行业已开始探索 VLA(视觉-语言-动作)模型,把云端 LLM 的语义能力与车端专用小模型结合,国内商汤、元戎启行等已有量产案例。 总结:DrivingBench 不是一个自动驾驶的里程碑,更像一次工程秀——GPT-6 Astra 用 5 分 22 秒、134.7 米、7.74 美元证明自己能在封闭停车场"摸到方向盘",但距离真正上路仍隔着延迟、成本、车规级安全三座大山。这一实验更大的意义在于,给业界提供了一个开源、可复现的真车评测基线,迫使 VLA 路线与端到端方案正面回应"通用 AI 是否能开真车"这一长期悬而未决的问题。 参考来源: 1. https://www.tmtpost.com/8153325.html 2. https://wallstreetcn.com/articles/3782542 3. https://huggingface.co/datasets/drivingbench/drivingbench-traces 4. https://github.com/aditya-ramabadran/drivingbench_harness_v1 5. https://officechai.com/ai/driving-bench-gpt-6-astra-becomes-first-model-to-drive-a-real-car-through-a-course 6. https://www.trendingtopics.eu/gpt-6-astra-drives-real-car-drivingbench/ 7. https://auto.sina.cn/2026-09-25/detail-iniszfeh9708723.d.html 8. https://www.ic.work/article/gpt-6-astra-drives-toyota-corolla-in-drivingbench-eval 9. https://k.sina.com.cn/article_3172142827_bd130eeb01901d2vw.html 10. http://ai-tldr.dev/releases/drivingbench-llms-drive-a-corolla