Qwen3.8-Flash 今日发布

阿里通义千问开源125B大模型,训练成本降九成,性能逼近Claude Opus 4.8

LLM大模型 部分免费

Qwen3.8-Flash 是阿里巴巴通义千问团队于2026年8月发布的开源大语言模型,采用全新下一代(Next)架构,主模型参数125B,叠加51B的N-gram Embedding记忆库,每个Token仅激活6B参数。这种稀疏激活设计使得模型在保持高性能的同时大幅降低计算成本。性能方面,Qwen3.8-Flash超越Claude Opus 4.6,接近Opus 4.8,但推理成本大幅低于两者。训练成本下降九成,源于架构创新与训练数据工程的双重突破。上下文长度达32,768原生,支持通过YaRN技术扩展至131,072 Token。支持双模式切换:思考模式(Think Mode)用于复杂推理、数学、代码任务;非思考模式用于快速对话与通用任务。全面开源,支持SGLang、vLLM、Ollama、LMStudio、MLX-LM、llama.cpp等主流推理框架。开发者可通过Hugging Face transformers或SGLang/vLLM快速部署,支持OpenAI兼容API调用。Qwen3.8-Flash创下模型效率全球新基准,代表阿里通义千问在开源大模型领域的技术突破。

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论