时间:2026-09-09
地点:Hacker News / 网络
人物:独立研究员 wsxiaoys(Stolen Thoughts 论文作者)、阿里巴巴 Qwen 团队(被指方)、OpenAI(GPT-5.5 Pro 提供方)
事件详情:独立 AI 安全研究员 wsxiaoys 于 2026 年 9 月 9 日在 Hacker News 发布最新研究,通过"推理预填"(reasoning prefill)实验发现,阿里巴巴 Qwen3.8 A95B 模型可能基于 OpenAI GPT-5.5 Pro 的推理输出进行训练。
实验在 45 道测试题(15 STEM、15 非 STEM、15 合成谜题)上展开:先用 GPT-5.5 Pro 解题,提取其推理链前 1% 内容,再注入到 Qwen3.8 A95B 推理通道开头。结果显示,Qwen3.8 在未被预填时与 GPT-5.5 Pro 可见答案重合度仅 16.79%,预填后跃升至 34.97%,绝对提升 18.18 个百分点,远超 DeepSeek V4 Flash(-1.17 pp)与 Kimi K3(+4.54 pp)等其他开源模型。
该显著响应被解读为 Qwen3.8 可能直接学习过 GPT-5.5 Pro 的推理输出,或训练数据中包含高度相关的蒸馏样本。值得注意的是,Qwen3.8 0902 版本训练时间晚于 Stolen Thoughts 论文公开(2026-08-10),意味着模型可能接触过公开解密的 GPT-5.5 Pro 推理痕迹。
背景:本次实验是 wsxiaoys 与合作者 2026 年 8 月 Stolen Thoughts 论文的 v1.1 扩展。该论文首创"加密推理回传"技术,可解密 OpenAI、Anthropic 等闭源模型的推理链内容。v1.1 版本专门以 GPT-5.5 Pro 作为教师模型重新评估开源模型蒸馏痕迹。
阿里巴巴 Qwen 团队此前多次否认模型蒸馏指控,强调 Qwen3.8 系列采用全自研路径,使用独家数据训练 2.4 万亿参数规模。
影响:实验为闭源大模型蒸馏争议提供可量化证据。如果 Qwen3.8 真的学习过 GPT-5.5 Pro 推理痕迹,将进一步加剧开源阵营与闭源实验室间的知识产权矛盾,并对 AI 训练数据合规性提出新挑战。
总结:wsxiaoys 的实验揭示 Qwen3.8 与 GPT-5.5 Pro 之间异常高的推理响应重叠度,+18.18 pp 的数据远超 DeepSeek、Kimi 等同类开源模型。这一发现可能源于蒸馏训练,也可能源于相似数据来源。无论如何,开源大模型与闭源前沿模型之间的训练数据合规边界,正成为 AI 行业下一个关键争议焦点。
参考来源:
- Hacker News 讨论:https://news.ycombinator.com/item?id=49630026
- 实验原始 Gist:https://gist.github.com/wsxiaoys/e0286dc6bb624ff5fdf49e7f4c528ba3
- Stolen Thoughts 论文:https://stolen-thoughts.com/paper.pdf
- 阿里巴巴 Qwen 官方博客:https://qwen.ai/blog?id=qwen3.8
- Hugging Face Qwen3.8 模型页:https://huggingface.co/Qwen/Qwen3.8-2.4T-A95B
- Reddit r/LocalLLM 讨论:https://www.reddit.com/r/LocalLLM/comments/1vv0neo/qwen_38_blows_mind_and_this_time_its_real/









