微软推出Copilot混合推理架构:云端、本地模型可自动切换 本月底上线
  • 鹿角
  • 2026年10月08日 07:47
  • 0

快科技10月8日消息,微软宣布,GitHub Copilot将在本月底前支持本地AI模型推理,开发者可在云端模型与设备端模型之间自动或手动切换。

GitHub Copilot是微软推出的AI编程助手,可集成于Visual Studio Code、CLI等工具,根据代码上下文生成补全、解释或重构建议。

目前,GitHub Copilot依赖云端托管模型,由协调器根据性能、成本与准确性路由请求。

微软计划在本月底扩展该机制,允许Copilot自动选择云端模型与本地AI模型,并在后台协调推理任务。

微软为GitHub Copilot用户提供两种模式:自动编排,或强制使用设备端模型。用户可在GitHub Copilot CLI、Copilot应用与Visual Studio Code中设置偏好。

本地模型选择支持指定提供程序、模型或端点。开发者可通过Windows ML选择MAI Code 1.1 Flash,或连接OpenAI兼容的本地端点,并选用其暴露的模型。

微软同时推出MAI Code 1.1 Flash“混合专家”模型,总参数1370亿,活跃参数68亿,并采用量化与推测解码技术优化响应速度与内存占用。

在Surface Laptop Ultra上的实测显示,该模型在复杂任务中的峰值内存使用率、Token利用率与处理速度均显著提升。解码吞吐量测试显示,当提示长度从2K到256K Token时,吞吐量介于每秒40至63个词元。

微软推出Copilot混合推理架构:云端、本地模型可自动切换 本月底上线

文章纠错

  • 好文点赞
  • 水文反对

此文章为快科技原创文章,快科技网站保留文章图片及文字内容版权,如需转载此文章请注明出处:快科技

观点发布 网站评论、账号管理说明
热门评论
查看全部评论
相关报道

最热文章排行查看排行详情

邮件订阅

评论0 | 点赞0| 分享0 | 收藏0