Qwen3.8-Flash

阿里通义千问于2026年8月27日正式发布的最新一代多模态大模型,定位为「极致性价比」的前沿模型

LLM大模型 部分免费

Qwen3.8-Flash 是阿里通义千问于2026年8月27日正式发布的最新一代多模态大模型,定位为「极致性价比」的前沿模型。该模型以千亿级总参数实现了对Claude Opus 4.6的性能超越,同时通过全新Next架构将训练成本降至上一代产品的九分之一。Qwen3.8-Flash 原生支持百万级上下文窗口,能够一次性处理超长文档、完整代码仓库与复杂多轮对话,在编程辅助、智能体协作、图文理解等高频场景中表现尤为突出。模型同时兼容OpenAI与Anthropic主流接口协议,可无缝接入Claude Code、Codex等开发者工具,帮助开发者轻松构建高并发AI应用与智能工作流。在真实办公场景测试中,千问办公标准模式(基于Qwen3.8-Flash)的单任务生成速度提升约100%,Token消耗平均减少75%,这意味着用户用同样的积分可完成近4倍的任务量。价格方面,千问AI平台输入仅0.8元/百万Tokens,输出2.7元/百万Tokens,缓存命中更可低至0.1元/百万Tokens,极大降低了长文档处理与高频Agent调用场景的边际使用成本。技术架构上,Qwen3.8-Flash 采用自研的GDN(门控DeltaNet)与QSA(千问稀疏注意力)混合注意力机制:GDN负责将历史信息高效压缩至固定大小的循环状态中,QSA则通过微块级轻量索引器精准检索全局上下文,两者协同实现「高效记忆」与「精准检索」的兼顾。此外,该模型还引入门控残差(GR)将单条信息通道扩展为四条并行分支,配合N-gram Embedding参数扩展技术,使模型在极低计算开销下获得更大的参数容量。Qwen3.8-Flash现已全面上线千问AI平台对外提供API服务,同时权重已在Hugging Face与魔搭社区开源,供全球开发者下载研究。该模型被视为下一代千问大模型Qwen4架构的雏形,其技术路线代表了大模型在「性能—成本—速度」不可能三角上的最新突破。

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论