跳到主内容

GitHub Copilot 编排三连发:computer use 直接操作桌面应用,dynamic workflows 把多 agent 流程写成代码

GitHub Copilot 公测 computer use(直接操作桌面应用)与 dynamic workflows(把多 agent 流程写成代码);同批 4 个模型退役、code review 开放官方 API。

2026-10-07 · GitHub Blog 官方 changelog(2026-10-02,一手核对)+ GitHub 官方 October '26 enterprise roundup

发布 2026-10-07核实 2026-10-07

要点

  • Computer use 进入 public preview(2026-10-01):Copilot CLI 与 Copilot app(macOS / Windows)可直接操作桌面应用——读可访问的应用内容与视觉上下文、点击控件、输入与编辑文本、按键、滚动、拖拽、跨应用流转,面向没有 API、没有 CLI、也没有 MCP 的老旧与 GUI-only 软件。
  • Dynamic workflows 同日公测:面向 Copilot CLI / Copilot app / Copilot SDK,把多 agent 流程写成代码。一个 workflow 是定义在 Copilot 扩展里的程序,支持串行 / 并行、阶段间结构化交接、子 agent 互相校验、可暂停恢复的 checkpoint。
  • HydraFusion 从 CLI 扩到 VS Code 1.140+ 与 Copilot app(2026-09-30,research preview):官方表述是它不是单个模型,而是编排多个模型,按任务在 Single / Cascade / Critique 三种执行模式里选。
  • 4 个模型于 2026-10-02 退役(官方 changelog 一手核对):Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code、Claude Opus 4.7;官方建议替代分别为 Gemini 3.8 Flash、Gemini 3.8 Flash、Kimi K3、Claude Opus 5.5。
  • Copilot code review 开放 REST 与 GraphQL API(2026-10-02,GA):可为每次请求设置 review effort level;同时 Balanced 成为默认 effort level,且该默认自 2026-09-28 起已生效。
  • GPT-6.1 Sol 进入 Copilot(2026-09-29):随 OpenAI 发布 GA 并逐步推送,用于 agentic coding 与终端工作流;GitHub 早期测试称它「用明显更少的 token 与步骤完成任务」。
  • 来源层级声明:computer use 与 dynamic workflows 两条本站未能直接打开 GitHub 官方 changelog 原始页面(github.blog/changelog 列表为 JS 渲染),依据两条二手转引的逐句引用交叉核对;引号内为官方原文引述。模型退役、review API、HydraFusion、GPT-6.1 Sol 四段为一手来源。

背景与分析

从「选哪个模型」到「怎么把模型串起来」

Copilot 这一周的四个动作,指向同一件事:它的竞争维度从模型货架移到了编排层。

最典型的是 HydraFusion。它在模型选择器里占一个位置,但官方明说 "rather than being a single model, it orchestrates multiple models"。三种执行模式的分工很清楚:

模式流程适用场景
Single一个模型直接解简单、明确的任务
Cascade高效模型起草 → 质量闸门校验 → 不合格才升级到更强模型成本敏感且质量有下限的任务
CritiqueA 模型起草 → 另一模型家族的只读 critic 评审 → 起草者改一次需要「第二意见」的高价值输出

Cascade 是这三种里最值得抄走的思路——它把「先用便宜的试,不行再上贵的」从一句经验变成了产品里的默认路径。自己搭 agent 的团队,这个模式现在就能照搬。

Dynamic workflows:把编排从「提示词里的临时指挥」变成工程资产

这条比 computer use 更值得工程团队关注,关键在它与 /fleet 的分工:

/fleetDynamic workflows
分工谁定Copilot 每次自行规划写死在代码里
每次是否一致不一定同一条流程每次照跑
能否版本化 / 进 CI否能
调用方式会话内斜杠命令终端 copilot workflow run

这是「让模型自己想办法」与「把办法固定下来」的分水岭。 一旦流程能进版本库,它就有了 review、回滚与责任归属——这也是多 agent 协作从演示走向生产的必要条件。

另外两个设计细节值得注意:阶段之间传递结构化结果(不是靠自然语言转述),以及子 agent 互相校验 + checkpoint 暂停等人复核。后者正面回应的是 2026 下半年最真实的一个痛点——评审疲劳:机器互审负责发现问题,人只在 checkpoint 上做决策。

代价也很直接:程序化执行不再逐次弹授权。权限、工具 / 仓库 / 命令范围、用量上限必须提前配好,否则一次配错会跟着流程反复执行。

Computer use:能力跨度最大,也是最需要先做决策的一条

能让 agent 操作没有 API、没有 CLI、也没有 MCP 的软件(大量企业内部系统与老客户端都属此类),这在能力上是实质跨越。官方的自我保护设计也算到位:执行前请求批准、"always allow" 列表可复查、macOS 需授予辅助功能与屏幕录制权限、组织可通过托管设置禁用。

但官方自己留了两句提醒:它可能点错控件,也可能被屏幕上的内容带偏,因此「不能替代人的判断」。第二句尤其关键——屏幕内容正是提示注入的投递面(见 提示注入):一个能读取屏幕并据此行动的 agent,等于把「不可信输入」的入口从仓库文件扩展到了整个桌面。

模型退役与 review 默认档:两条必须复核账单的变更

模型退役这条,本站 2026-09-12 周报预告过,如今按官方原文落地。官方原文:"As of today, October 2, 2026, we have deprecated the following models across all GitHub Copilot experiences (including Copilot Chat, inline edits, ask and agent modes, and code completions)"。

已退役模型官方建议替代
Gemini 3.5 FlashGemini 3.8 Flash
Gemini 3.6 FlashGemini 3.8 Flash
Kimi K2.7 CodeKimi K3
Claude Opus 4.7Claude Opus 5.5

官方另注 "No action is required to remove the deprecated models",但 Copilot Enterprise 管理员可能需要在模型策略里启用替代模型才能在选择器中看到它们。

review effort 默认改为 Balanced 这条更容易被漏掉:它自 2026-09-28 起已生效,影响新建与既有的仓库与组织(显式选 Lite 的被尊重)。默认档变重 = 每次评审消耗更多额度,有成本看板的团队建议复核 09-28 之后的账单。

待核实:第三方汇总站称另有 6 个模型(含 GPT-5.5、GPT-5 mini、Grok 4.5 等)将于 2026-10-19 退役。本站核对的 2026-10-02 官方 changelog 条目中只有上表 4 个,不予采信,待官方公告后回炉。

AI 之家 观点

其一,Copilot 正在把自己从「模型入口」改造成「执行环境」。 模型选择、编排、桌面操作、CI 集成四件事同时推进,说明 GitHub 判断的护城河不在「接了哪些模型」——那部分是任何 IDE 都能抄的——而在「工作流停在哪一层」。

其二,Cascade(先便宜后升级)是这个季度最值得复制的 agent 设计模式。 它把成本与质量的权衡从「拍脑袋选一个模型」变成了「写一条带闸门的路径」。对自建 agent 的团队,这比再等一个更强模型更快见效。

其三,computer use 应该先做「开不开」的决策,再谈「怎么用」。 它把 agent 的可达范围从仓库扩到了整台桌面,而提示注入的投递面也随之扩大到屏幕内容。企业侧建议的做法是:先在受控机器、受控账号上开,且把它纳入与「给员工开管理员权限」同级的审批。

其四,程序化执行让「权限配置」从运行时问题变成部署时问题。 dynamic workflows 不再逐次弹授权,好处是能进 CI,坏处是一次配错的 blast radius 会跟着流程反复放大。配 workflow 时的检查项应当与配生产服务对齐:最小权限、明确范围、用量上限、审计日志。

其五,模型退役已经在按季度节奏执行。 9-22 上架 5 个新模型、10-02 退役 4 个旧模型——写死模型 ID 的脚本与内部工具,现在应当按季度做一次存活检查,而不是等它某天报错。

相关阅读

来源

本条由 AI 之家 编辑部整理,未做一手实测(未在本机验证 computer use 与 dynamic workflows)。待确认项:① computer use 与 dynamic workflows 两条未能直接打开官方 changelog 原始页面,细节为两条二手转引交叉核对,引号内为官方原文引述;② 「10-19 再退役 6 个模型」未获官方确认;③ 各能力的可用套餐与灰度范围请以官方文档为准;④ dynamic workflows 的具体 DSL / 文件格式本站未核实。欢迎在 反馈邮箱 反馈更新。

相关对比

Aider vs Claude Code:终端 AI 编程双雄怎么选

Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。

Cursor vs Aider:GUI IDE 还是 CLI?2026 对比

Cursor vs Aider 2026 选型对比:GUI IDE vs Git 原生 CLI,从 Composer vs Architect 双模型、Tab 补全、多模型 BYOK、价格计费、开源与否和适合人群判断,帮开发者选对。Cursor 是闭源 VS Code fork 月费 $20,Aider 是开源 Apache-2.0 CLI 自带 API key。

Augment Code vs Cursor:企业 AI 编程怎么选?Context Engine vs AI IDE 对比

Augment Code vs Cursor 2026 选型对比:Context Engine 全仓索引的企业 AI 平台 vs SpaceX 收购的 AI IDE 天花板,从形态、Context 覆盖、长任务、价格、合规、中文支持和适合人群 8 个维度判断,帮你选对企业 AI 编程工具。

Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比

Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)

Claude Code vs Crush 2026 选型对比:Anthropic 官方 CLI Agent(Claude only + 长任务最稳 + MCP 一等公民)vs Charmbracelet 开源 TUI Agent(多模型 mid-session 切换 + LSP + FSL-1.1-MIT)。从模型、长任务、生态、价格、国内可用性帮你选对终端 AI 编程工具。

相关评测