产业观察🔥8.0
GitHub Copilot 不再纯云端 AI 模型:Surface Laptop Ultra 本地推理吞吐量最高每秒 63 词元
📋总体概括
微软在旧金山发布会上宣布,GitHub Copilot 将于本月底前支持本地 AI 模型推理,开发者可在 Visual Studio Code、Copilot 应用与 CLI 中选择自动编排或强制设备端模型,由协调器在云端与本地模型之间路由请求。官方数据显示 Surface Laptop Ultra 本地推理吞吐量最高可达每秒 63 个词元。这是 Copilot 首次摆脱纯云端架构,标志着 AI 编程助手开始向端云混合方向演进,对离线场景、延迟与成本控制均有实际意义。
⚡关键信息
- ▸微软宣布 GitHub Copilot 本月底前支持本地 AI 模型推理,摆脱纯云端架构
- ▸用户可在自动编排与强制设备端模型两种模式间选择,覆盖 VS Code、CLI 与 Copilot 应用
- ▸Surface Laptop Ultra 本地推理吞吐量最高达每秒 63 词元
- ▸协调器将根据性能、成本与准确性在云端与本地模型间自动路由推理任务
- ▸发布于旧金山发布会,时间为太平洋时间 10 月 7 日上午 10 点
🔥犀利点评
端云混合才是 AI 编程助手的终局形态——云端的智力上限加本地的延迟和隐私优势,微软终于把这条路线跑通了。每秒 63 词元的吞吐对代码补全这种短文本高频任务完全够用,本地兜底还能给云成本降温。但别高兴太早:本地小模型的代码质量与云端旗舰模型仍有肉眼可见差距,所谓自动路由,大概率还是云端吃肉、本地喝汤。真正的看点是 NPU 生态能否借 Copilot 的默认支持真正起飞。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →