探索索引返回模型
Qwen3.8-27B
阿里云通义千问团队开源的 27B 参数量稠密多模态大模型。模型基于 Qwen3.5 基础架构构建,采用 48 层线性注意力与 16 层门控注意力的混合注意力设计,内置投机解码 MTP 草稿头与思考模式,原生支持 262K 上下文(可扩展至 1M Token),专为单卡本地部署与长程 Agentic 任务深度优化。
阿里云通义千问团队开源的 27B 参数量稠密多模态大模型。模型基于 Qwen3.5 基础架构构建,采用 48 层线性注意力与 16 层门控注意力的混合注意力设计,内置投机解码 MTP 草稿头与思考模式,原生支持 262K 上下文(可扩展至 1M Token),专为单卡本地部署与长程 Agentic 任务深度优化。