Microsoft 正式发布了可在本地运行的编程 AI 模型 MAI-Code-1.1-Flash,开发者可通过自有硬件设备离线运行 AI 代理程序。该模型采用 3-bit 量化技术降低内存需求,同时保持完整的 256K 上下文窗口。

性能表现与技术参数
根据 Microsoft 官方数据,量化后的版本在 SWE-Bench Verified 和 Terminal-Bench 2.1 基准测试中的代码生成能力与全精度模型相当。相比此前发布的 MAI-Code-1.0,新版本实现了 25% 的 token 流加速,同时完成相同任务所需的 token 数量减少 25%。
硬件配置门槛
模型对硬件的要求较为严苛,Microsoft 建议配备超过 120GB 的 RAM 才能获得理想运行效果。大部分普通 PC 难以满足这一需求,这使得本地部署体验主要面向高端开发工作站。
集成与应用场景
MAI-Code-1.1-Flash 现已可供下载并在本地运行,同时计划于本月底通过 GitHub Copilot 应用程序、GitHub Copilot CLI 和 Visual Studio Code 提供实验性访问权限。演示环节中,该模型在飞行模式状态下成功展示了完全无需联网即可完成代码补全的能力。
via Neowin