01 发生了什么
微软表示,GitHub Copilot 将自动判断某项任务应由设备端模型处理,还是交给云端规模模型,该功能计划于2026年10月底前推出。同时,微软AI 描述了本地量化版 MAI Code 1.1 Flash,称其体积为53GB,比Bfloat16云端版本小80%。
02 关键细节
- 微软表示,设备端与云端模型之间的自动分配计划于2026年10月底前推出。
- 微软称,本地量化版 MAI Code 1.1 Flash 体积为53GB。在Surface Laptop Ultra上,256k上下文时峰值内存为75.5GB。
- SWE-Bench Verified 测试中,设备端量化版得分70.80%,云端版为72.6%。这些是微软自述结果,未经独立验证。
- 本地推理并不会让Copilot会话离线。内置文件工具由代理框架依据策略检查,但并非操作系统级隔离。
03 为什么重要
对于在受支持Windows电脑上使用Copilot的开发者而言,部分任务可能在本地运行(受内存限制),其余任务则交由云端处理,无需手动选择基础设施。不过,文中的体积和性能数据目前仍是厂商的说法。
04 适合谁
软件开发人员及评估本地AI编程工具的团队。
原始来源Microsoft