01 发生了什么

微软表示,GitHub Copilot 将自动判断某项任务应由设备端模型处理,还是交给云端规模模型,该功能计划于2026年10月底前推出。同时,微软AI 描述了本地量化版 MAI Code 1.1 Flash,称其体积为53GB,比Bfloat16云端版本小80%。

02 关键细节

  • 微软表示,设备端与云端模型之间的自动分配计划于2026年10月底前推出。
  • 微软称,本地量化版 MAI Code 1.1 Flash 体积为53GB。在Surface Laptop Ultra上,256k上下文时峰值内存为75.5GB。
  • SWE-Bench Verified 测试中,设备端量化版得分70.80%,云端版为72.6%。这些是微软自述结果,未经独立验证。
  • 本地推理并不会让Copilot会话离线。内置文件工具由代理框架依据策略检查,但并非操作系统级隔离。

03 为什么重要

对于在受支持Windows电脑上使用Copilot的开发者而言,部分任务可能在本地运行(受内存限制),其余任务则交由云端处理,无需手动选择基础设施。不过,文中的体积和性能数据目前仍是厂商的说法。

04 适合谁

软件开发人员及评估本地AI编程工具的团队。

原始来源Microsoft