微软推出 MAI Code1.1Flash,GitHub Copilot 将支持本地与云端混合推理
微软宣布,GitHub Copilot 将于 10 月底前支持本地 AI 模型,开发者可在云端和设备端模型间切换,也可交由系统自动调度。新款 MoE 模型 MAI Code1.1Flash 总参数量为 1370 亿,激活参数量为 68 亿。微软称,量化和投机解码技术旨在降低内存占用并提升设备端响应速度。该模型将率先搭载于配备 NVIDIA RTX Spark 硬件的新款 Surface Laptop Ultra。Copilot CLI、Copilot 应用和 Visual Studio Code 可通过 Windows ML 或兼容 OpenAI 的端点调用本地模型。微软表示,集成的容器隔离机制有助于保障代码执行安全。
本文来源:AIbase,仅供学习参考,版权归原作者所有。