
Devin Desktop 是 Cognition 推出的下一代 IDE——以 Windsurf 为基础,但围绕 Cognition 所称的「智能体指挥中心」从头重构。它专为管理智能体而非单纯结对编程的工程师而设计。本指南全面介绍 Devin Desktop 的功能,并说明 AnyCap 如何在几分钟内为工作区中的每个智能体添加媒体生成能力。
Devin Desktop 是什么?
Devin Desktop 是 Cognition 对一个日益普遍问题的解答:如何管理多个 AI 智能体并行处理代码库的不同部分?
它从 Windsurf(Cognition 收购的 AI 驱动 IDE)演化而来,并将 Devin(Cognition 的自主 AI 软件工程师)直接集成到 IDE 界面。核心理念:不再是每次与一个 AI 结对编程,Devin Desktop 为大规模智能体管理而设计。
Cognition 在发布时直接描述了这一转变:"与我们合作的顶尖工程师不只是与一个智能体结对编程。他们用智能体来规划工作、将任务委派给云端智能体、审查进度,并决定哪些内容进入生产环境。"
Devin Desktop 正是为这个世界而生。
Devin Desktop 核心功能
智能体指挥中心
智能体指挥中心是 Devin Desktop 的核心特色。它将智能体管理置于中心位置——不是侧边栏或弹窗,而是主要工作界面。
在指挥中心,您可以:
- 在单一看板上查看所有运行中的智能体(本地和云端)
- 实时跟踪智能体的进度、输出和状态
- 向特定智能体分配任务、代码上下文和需求
- 审查和合并智能体生成的 Pull Request
- 在智能体之间切换而不丢失上下文或状态
对于并行运行多个智能体的团队来说,这是对浏览器标签页或终端会话切换的质的飞跃。
Spaces:智能体团队的共享上下文
Spaces 是 Devin Desktop 解决多智能体协调问题的方案。当多个智能体处理相关任务时,它们通常需要共享代码、决策或中间结果。缺乏协调时,它们会重复工作或产生冲突输出。
Spaces 为相关智能体提供共享上下文层——让智能体可以在彼此工作的基础上继续推进,而不是从头开始或相互矛盾。
典型配置:一个智能体规划新功能,第二个实现后端,第三个编写测试,第四个负责前端。Spaces 保持四者同步,并让彼此了解对方的进度。
多智能体看板视图
Devin Desktop 的看板视图让并行智能体工作一目了然,轻松管理。每张任务卡显示:
- 哪个智能体负责该任务
- 当前状态(进行中、已阻塞、等待审查)
- 最近输出的预览
- 已用时间
这种可见性决定了能否有效运行三个并行智能体,而非只是期望它们产出兼容的结果。
ACP 协议:对第三方智能体开放
Devin Desktop 支持智能体客户端协议(ACP),这意味着它不仅限于 Devin 智能体。任何 ACP 兼容的智能体都可以在 Devin Desktop 内与 Devin 并行运行——共享相同的看板视图、Spaces 上下文和审查工作流。
实际上,这意味着团队可以为开发生命周期的不同环节接入专业智能体:测试智能体、安全审查智能体、文档智能体,以及——借助 AnyCap——媒体生成智能体。
完整 IDE 兼容性
Devin Desktop 基于 Windsurf/VS Code 基础,完全兼容您的现有配置:
- 所有 VS Code 扩展继续正常工作
- 快捷键完全保留
- LSP、终端和 Git 集成正常运行
- 无需从当前编辑器工作流迁移
智能体管理层叠加在您已熟悉的 IDE 之上,而不是取而代之。
多模型架构
Devin 旨在为每项任务使用最适合的模型,而不是绑定到单一底层模型。这体现在架构上:Devin Desktop 在智能体层面与模型无关,根据每项任务的复杂性和性质路由到不同的 AI 模型。
缺口:没有媒体生成
Devin Desktop 在软件开发方面覆盖完善。缺少的是媒体。智能体无法生成图像、UI 原型或任何视觉资产。没有视频演示,没有音频,没有 CDN 发布,也没有实时网络访问的内置机制。
对于只需要智能体编写和发布代码的团队,这不是问题。但大多数产品最终都需要主图、演示片段或一批社交媒体图片——而目前,智能体必须停下来将任务交回给人类。
连接 AnyCap
AnyCap 是一个智能体 CLI,为 Devin Desktop 智能体添加图像生成、视频制作、音频合成、网络搜索和文件发布功能。Devin Desktop 智能体作为任务的一部分运行 shell 命令——一旦在系统上安装并认证 AnyCap,工作区中的每个智能体都可以直接调用它。
智能体命令返回本地文件路径和 CDN URL,生成的媒体可直接融入链式工作流。构建功能的智能体可以生成主图,获取 CDN URL,并在 PR 描述中引用它,或通过 Spaces 传递给另一个智能体——中间无需人工介入。
图像生成
从任何智能体会话生成产品原型、主图、UI 资产集、社交媒体图形和插图。AnyCap 支持 15+ 图像模型——FLUX Pro、Ideogram、Stable Diffusion XL、Recraft 等——让您的智能体为每项任务选择合适的风格。
视频制作
使用 Veo 3、Kling、Runway、Wan 和其他领先视频模型生成产品演示视频、短视频社交内容、动画预览和解说内容。构建落地页的智能体可以在编写代码的同一会话中生成主视频。
音频与音乐
为应用、视频或内容项目生成配音、背景音乐、音效和音频资产。AnyCap 同时支持语音合成和音乐生成模型。
网络搜索与抓取
为智能体提供实时网络访问。Devin Desktop 智能体可以搜索实时网络、抓取竞争对手页面、阅读最新文档,并根据最新数据采取行动——无需手动收集信息。
文件发布
将生成的资产上传到云存储并立即获得可分享的 CDN 链接。智能体可以在代码中引用 AnyCap 托管的文件,通过 Spaces 传递给其他智能体,或在 Pull Request 描述中展示。
在 Devin Desktop 中设置 AnyCap
第一步:安装 AnyCap CLI
npm install -g anycap
anycap login
这就是完整的设置。Devin Desktop 智能体运行 shell 命令——一旦在系统上安装并认证 AnyCap,工作区中的每个智能体都可以调用它。
第二步:验证是否正常运行
打开任意智能体会话并输入:
"使用 AnyCap 生成一张测试图片:一个简单的渐变正方形。"
智能体通过 shell 运行 anycap image generate 并返回文件路径和 CDN URL。现在,Devin Desktop 工作区中的每个智能体都具备完整的媒体生成能力。
示例工作流
构建落地页的 Devin 智能体可以编写 HTML、CSS 和 JavaScript,生成主图,制作 10 秒演示视频,并开启包含所有内容的 PR——代码与资产之间无需人工交接。
营销内容:智能体读取您的更新日志,生成 LinkedIn 轮播图集,撰写文案,并交付一个可直接发布的完整包。QA 文档:智能体生成关键用户流程的带注释截图,撰写文档,并在 Wiki 中链接。
客户项目:智能体可以根据项目简报生成精美的原型和简短的解说视频,让您在功能开发之前就有内容可以展示。
Devin Desktop 速览
| 功能 | 详情 |
|---|---|
| 基础 IDE | Windsurf(VS Code 兼容) |
| 主要 AI 模型 | Devin(Cognition SWE-1 系列) |
| 多模型路由 | 是——每项任务使用最优模型 |
| 协议支持 | MCP + ACP |
| 智能体可见性 | 看板视图,实时状态 |
| 第三方智能体 | 任何 ACP 兼容智能体 |
| 下载 | devin.ai/download |
| AnyCap 集成 | CLI 工具,一次安装 |
立即开始
Devin Desktop 可从 Cognition 下载。AnyCap 五分钟内即可连接,无需自定义代码。