Today for AI
返回热点榜
tools热度 11.3°

AI 聚簇研判事件 · 2026/10/7

微软 GitHub Copilot 引入本地推理:MAI Code 1.1 Flash MoE 模型在 Surface Laptop Ultra 达 63 TPS

Microsoft Adds Local Inference to GitHub Copilot with MAI Code 1.1 Flash MoE Model

1 篇报道存证1 家独立信源交叉印证持续跟踪至 2026/10/7 22:17:08
全景综述与最新动态
1 家信源交叉印证

微软宣布 GitHub Copilot 将于本月底支持本地 AI 模型推理,允许开发者在云端与设备端模型间自动或手动切换。此次更新引入了专为本地部署优化的“混合专家”模型 MAI Code 1.1 Flash(总参数 1370 亿,活跃 68 亿),在 Surface Laptop Ultra 上实测解码吞吐量最高可达每秒 63 词元。

最新动向/微软宣布 GitHub Copilot 将于本月底支持本地 AI 模型推理,允许开发者在云端与设备端模型间自动或手动切换。此次更新引入了专为本地部署优化的“混合专家”模型 MAI Code 1.1 Flash(总参数 1370 亿,活跃 68 亿),在 Surface Laptop Ultra 上实测解码吞吐量最高可达每秒 63 词元。

TIMELINE报道时间线

共 1 篇 · 最新优先
  1. IT之家 · 智能时代T2·78 分

    微软 GitHub Copilot 引入本地推理:MAI Code 1.1 Flash MoE 模型在 Surface Laptop Ultra 达 63 TPS

    原文标题:GitHub Copilot 不再纯云端 AI 模型:Surface Laptop Ultra 本地推理吞吐量最高每秒 63 词元

    • GitHub Copilot 将支持本地推理,提供自动编排或强制设备端两种模式。
    • 推出专用本地模型 MAI Code 1.1 Flash,采用 MoE 架构(137B 总参/6B 激活)及量化推测解码技术。
    • 在 Surface Laptop Ultra 硬件上,该模型实现 40-63 TPS 的解码吞吐量,显著优化内存占用。
微软 GitHub Copilot 引入本地推理:MAI Code 1.1 Flash MoE 模型在 Surface Laptop Ultra 达 63 TPS | AI 聚簇事件研判 | Today for AI