GitHub Copilot 编排三连发:computer use 直接操作桌面应用,dynamic workflows 把多 agent 流程写成代码
GitHub Copilot 公测 computer use(直接操作桌面应用)与 dynamic workflows(把多 agent 流程写成代码);同批 4 个模型退役、code review 开放官方 API。
2026-10-07 · GitHub Blog 官方 changelog(2026-10-02,一手核对)+ GitHub 官方 October '26 enterprise roundup
发布 2026-10-07核实 2026-10-07要点
- Computer use 进入 public preview(2026-10-01):Copilot CLI 与 Copilot app(macOS / Windows)可直接操作桌面应用——读可访问的应用内容与视觉上下文、点击控件、输入与编辑文本、按键、滚动、拖拽、跨应用流转,面向没有 API、没有 CLI、也没有 MCP 的老旧与 GUI-only 软件。
- Dynamic workflows 同日公测:面向 Copilot CLI / Copilot app / Copilot SDK,把多 agent 流程写成代码。一个 workflow 是定义在 Copilot 扩展里的程序,支持串行 / 并行、阶段间结构化交接、子 agent 互相校验、可暂停恢复的 checkpoint。
- HydraFusion 从 CLI 扩到 VS Code 1.140+ 与 Copilot app(2026-09-30,research preview):官方表述是它不是单个模型,而是编排多个模型,按任务在 Single / Cascade / Critique 三种执行模式里选。
- 4 个模型于 2026-10-02 退役(官方 changelog 一手核对):Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code、Claude Opus 4.7;官方建议替代分别为 Gemini 3.8 Flash、Gemini 3.8 Flash、Kimi K3、Claude Opus 5.5。
- Copilot code review 开放 REST 与 GraphQL API(2026-10-02,GA):可为每次请求设置 review effort level;同时 Balanced 成为默认 effort level,且该默认自 2026-09-28 起已生效。
- GPT-6.1 Sol 进入 Copilot(2026-09-29):随 OpenAI 发布 GA 并逐步推送,用于 agentic coding 与终端工作流;GitHub 早期测试称它「用明显更少的 token 与步骤完成任务」。
- 来源层级声明:computer use 与 dynamic workflows 两条本站未能直接打开 GitHub 官方 changelog 原始页面(github.blog/changelog 列表为 JS 渲染),依据两条二手转引的逐句引用交叉核对;引号内为官方原文引述。模型退役、review API、HydraFusion、GPT-6.1 Sol 四段为一手来源。
背景与分析
从「选哪个模型」到「怎么把模型串起来」
Copilot 这一周的四个动作,指向同一件事:它的竞争维度从模型货架移到了编排层。
最典型的是 HydraFusion。它在模型选择器里占一个位置,但官方明说 "rather than being a single model, it orchestrates multiple models"。三种执行模式的分工很清楚:
| 模式 | 流程 | 适用场景 |
|---|---|---|
| Single | 一个模型直接解 | 简单、明确的任务 |
| Cascade | 高效模型起草 → 质量闸门校验 → 不合格才升级到更强模型 | 成本敏感且质量有下限的任务 |
| Critique | A 模型起草 → 另一模型家族的只读 critic 评审 → 起草者改一次 | 需要「第二意见」的高价值输出 |
Cascade 是这三种里最值得抄走的思路——它把「先用便宜的试,不行再上贵的」从一句经验变成了产品里的默认路径。自己搭 agent 的团队,这个模式现在就能照搬。
Dynamic workflows:把编排从「提示词里的临时指挥」变成工程资产
这条比 computer use 更值得工程团队关注,关键在它与 /fleet 的分工:
/fleet | Dynamic workflows | |
|---|---|---|
| 分工谁定 | Copilot 每次自行规划 | 写死在代码里 |
| 每次是否一致 | 不一定 | 同一条流程每次照跑 |
| 能否版本化 / 进 CI | 否 | 能 |
| 调用方式 | 会话内斜杠命令 | 终端 copilot workflow run |
这是「让模型自己想办法」与「把办法固定下来」的分水岭。 一旦流程能进版本库,它就有了 review、回滚与责任归属——这也是多 agent 协作从演示走向生产的必要条件。
另外两个设计细节值得注意:阶段之间传递结构化结果(不是靠自然语言转述),以及子 agent 互相校验 + checkpoint 暂停等人复核。后者正面回应的是 2026 下半年最真实的一个痛点——评审疲劳:机器互审负责发现问题,人只在 checkpoint 上做决策。
代价也很直接:程序化执行不再逐次弹授权。权限、工具 / 仓库 / 命令范围、用量上限必须提前配好,否则一次配错会跟着流程反复执行。
Computer use:能力跨度最大,也是最需要先做决策的一条
能让 agent 操作没有 API、没有 CLI、也没有 MCP 的软件(大量企业内部系统与老客户端都属此类),这在能力上是实质跨越。官方的自我保护设计也算到位:执行前请求批准、"always allow" 列表可复查、macOS 需授予辅助功能与屏幕录制权限、组织可通过托管设置禁用。
但官方自己留了两句提醒:它可能点错控件,也可能被屏幕上的内容带偏,因此「不能替代人的判断」。第二句尤其关键——屏幕内容正是提示注入的投递面(见 提示注入):一个能读取屏幕并据此行动的 agent,等于把「不可信输入」的入口从仓库文件扩展到了整个桌面。
模型退役与 review 默认档:两条必须复核账单的变更
模型退役这条,本站 2026-09-12 周报预告过,如今按官方原文落地。官方原文:"As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions)"。
| 已退役模型 | 官方建议替代 |
|---|---|
| Gemini 3.5 Flash | Gemini 3.8 Flash |
| Gemini 3.6 Flash | Gemini 3.8 Flash |
| Kimi K2.7 Code | Kimi K3 |
| Claude Opus 4.7 | Claude Opus 5.5 |
官方另注 "No action is required to remove the deprecated models",但 Copilot Enterprise 管理员可能需要在模型策略里启用替代模型才能在选择器中看到它们。
review effort 默认改为 Balanced 这条更容易被漏掉:它自 2026-09-28 起已生效,影响新建与既有的仓库与组织(显式选 Lite 的被尊重)。默认档变重 = 每次评审消耗更多额度,有成本看板的团队建议复核 09-28 之后的账单。
待核实:第三方汇总站称另有 6 个模型(含 GPT-5.5、GPT-5 mini、Grok 4.5 等)将于 2026-10-19 退役。本站核对的 2026-10-02 官方 changelog 条目中只有上表 4 个,不予采信,待官方公告后回炉。
AI 之家 观点
其一,Copilot 正在把自己从「模型入口」改造成「执行环境」。 模型选择、编排、桌面操作、CI 集成四件事同时推进,说明 GitHub 判断的护城河不在「接了哪些模型」——那部分是任何 IDE 都能抄的——而在「工作流停在哪一层」。
其二,Cascade(先便宜后升级)是这个季度最值得复制的 agent 设计模式。 它把成本与质量的权衡从「拍脑袋选一个模型」变成了「写一条带闸门的路径」。对自建 agent 的团队,这比再等一个更强模型更快见效。
其三,computer use 应该先做「开不开」的决策,再谈「怎么用」。 它把 agent 的可达范围从仓库扩到了整台桌面,而提示注入的投递面也随之扩大到屏幕内容。企业侧建议的做法是:先在受控机器、受控账号上开,且把它纳入与「给员工开管理员权限」同级的审批。
其四,程序化执行让「权限配置」从运行时问题变成部署时问题。 dynamic workflows 不再逐次弹授权,好处是能进 CI,坏处是一次配错的 blast radius 会跟着流程反复放大。配 workflow 时的检查项应当与配生产服务对齐:最小权限、明确范围、用量上限、审计日志。
其五,模型退役已经在按季度节奏执行。 9-22 上架 5 个新模型、10-02 退役 4 个旧模型——写死模型 ID 的脚本与内部工具,现在应当按季度做一次存活检查,而不是等它某天报错。
相关阅读
- 概念:Agent 沙箱 · 提示注入 · 智能体编程 · AI 代码编辑器 · Computer use
- 工具:GitHub Copilot · Claude Code · Codex CLI · Cursor
- 模型:Claude Opus 5.5 · Kimi K3 · GPT-6 Sol
来源
- Selected models in GitHub Copilot deprecated(GitHub Blog 官方 changelog,2026-10-02) — 一手来源,4 个模型退役与替代建议以此为准
- Copilot code review: API support and new default effort level(GitHub Blog 官方 changelog,2026-10-02) — 一手来源,REST/GraphQL API 与 Balanced 默认档以此为准
- October '26 enterprise roundup(GitHub 官方) — 一手来源,HydraFusion 扩至 VS Code / app、GPT-6.1 Sol 上架、自动模型选择分档
- my2cents.ai《Microsoft AI Updates: October 2, 2026》 — 二手来源,computer use 与 dynamic workflows 的官方措辞转引
- AIToolTier《GitHub Copilot Review 2026》 — 二手来源,与上一源交叉核对;其「10-19 再退役 6 个模型」的说法本站未采信
本条由 AI 之家 编辑部整理,未做一手实测(未在本机验证 computer use 与 dynamic workflows)。待确认项:① computer use 与 dynamic workflows 两条未能直接打开官方 changelog 原始页面,细节为两条二手转引交叉核对,引号内为官方原文引述;② 「10-19 再退役 6 个模型」未获官方确认;③ 各能力的可用套餐与灰度范围请以官方文档为准;④ dynamic workflows 的具体 DSL / 文件格式本站未核实。欢迎在 反馈邮箱 反馈更新。