feihong-code 7.0.0 → 7.5.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (149) hide show
  1. package/.github/workflows/ci.yml +180 -140
  2. package/.github/workflows/release.yml +200 -0
  3. package/CHANGELOG.md +94 -65
  4. package/README.md +609 -586
  5. package/dist/agent/browser-agent.js +354 -0
  6. package/dist/agent/browser-agent.js.map +1 -0
  7. package/dist/agent/change-manager.js +433 -0
  8. package/dist/agent/change-manager.js.map +1 -0
  9. package/dist/agent/code-rag.js +293 -0
  10. package/dist/agent/code-rag.js.map +1 -0
  11. package/dist/agent/code-writer.js +13 -1
  12. package/dist/agent/code-writer.js.map +1 -1
  13. package/dist/agent/completion-engine.js +553 -0
  14. package/dist/agent/completion-engine.js.map +1 -0
  15. package/dist/agent/completion-postprocess.js +109 -0
  16. package/dist/agent/completion-postprocess.js.map +1 -0
  17. package/dist/agent/context-budget.js +121 -0
  18. package/dist/agent/context-budget.js.map +1 -0
  19. package/dist/agent/context-compactor.js +235 -10
  20. package/dist/agent/context-compactor.js.map +1 -1
  21. package/dist/agent/custom-agent.js +368 -0
  22. package/dist/agent/custom-agent.js.map +1 -0
  23. package/dist/agent/design-to-code.js +218 -0
  24. package/dist/agent/design-to-code.js.map +1 -0
  25. package/dist/agent/event-driven-agent.js +359 -0
  26. package/dist/agent/event-driven-agent.js.map +1 -0
  27. package/dist/agent/git-integration.js +324 -0
  28. package/dist/agent/git-integration.js.map +1 -0
  29. package/dist/agent/layered-memory.js +329 -0
  30. package/dist/agent/layered-memory.js.map +1 -0
  31. package/dist/agent/lint.js +121 -0
  32. package/dist/agent/lint.js.map +1 -0
  33. package/dist/agent/multi-agent.js +359 -0
  34. package/dist/agent/multi-agent.js.map +1 -0
  35. package/dist/agent/orchestrator.js +136 -25
  36. package/dist/agent/orchestrator.js.map +1 -1
  37. package/dist/agent/prompts.js +54 -54
  38. package/dist/agent/quality-gate.js +139 -0
  39. package/dist/agent/quality-gate.js.map +1 -1
  40. package/dist/agent/self-correction.js +274 -0
  41. package/dist/agent/self-correction.js.map +1 -0
  42. package/dist/agent/self-heal.js +47 -17
  43. package/dist/agent/self-heal.js.map +1 -1
  44. package/dist/agent/solo-agent.js +321 -0
  45. package/dist/agent/solo-agent.js.map +1 -0
  46. package/dist/agent/symbol-index.js +258 -28
  47. package/dist/agent/symbol-index.js.map +1 -1
  48. package/dist/agent/team-collaboration.js +252 -0
  49. package/dist/agent/team-collaboration.js.map +1 -0
  50. package/dist/agent/type-checker.js +229 -0
  51. package/dist/agent/type-checker.js.map +1 -0
  52. package/dist/cli/commands.js +9 -0
  53. package/dist/cli/commands.js.map +1 -1
  54. package/dist/cli/index.js +9 -0
  55. package/dist/cli/index.js.map +1 -1
  56. package/dist/cli/multi-pane-tui.js +217 -0
  57. package/dist/cli/multi-pane-tui.js.map +1 -0
  58. package/dist/cli/run.js +130 -40
  59. package/dist/cli/run.js.map +1 -1
  60. package/dist/cli/tui-run.js +79 -0
  61. package/dist/cli/tui-run.js.map +1 -0
  62. package/dist/cli/tui.js.map +1 -1
  63. package/dist/cli/version.js +1 -1
  64. package/dist/integrations/collaboration.js +219 -0
  65. package/dist/integrations/collaboration.js.map +1 -0
  66. package/dist/integrations/figma.js +307 -0
  67. package/dist/integrations/figma.js.map +1 -0
  68. package/dist/integrations/sso.js +327 -0
  69. package/dist/integrations/sso.js.map +1 -0
  70. package/dist/knowledge/library.js +301 -0
  71. package/dist/knowledge/library.js.map +1 -0
  72. package/dist/lsp/lsp-client.js +183 -0
  73. package/dist/lsp/lsp-client.js.map +1 -0
  74. package/dist/lsp/lsp-service.js +159 -0
  75. package/dist/lsp/lsp-service.js.map +1 -0
  76. package/dist/plugins/manager.js +380 -0
  77. package/dist/plugins/manager.js.map +1 -0
  78. package/dist/runtime/event-log.js.map +1 -1
  79. package/dist/shared/i18n.js +108 -100
  80. package/dist/shared/i18n.js.map +1 -1
  81. package/dist/tools/browser/browser.tool.js +217 -0
  82. package/dist/tools/browser/browser.tool.js.map +1 -0
  83. package/dist/tools/generator/code-generator.js +40 -40
  84. package/dist/tools/generator/test-generator.js +9 -9
  85. package/dist/tools/index.js +2 -0
  86. package/dist/tools/index.js.map +1 -1
  87. package/dist/tools/shell/exec.js +73 -11
  88. package/dist/tools/shell/exec.js.map +1 -1
  89. package/dist/tools/shell/run-shell.tool.js +8 -2
  90. package/dist/tools/shell/run-shell.tool.js.map +1 -1
  91. package/dist/training/completion-evaluator.js +213 -0
  92. package/dist/training/completion-evaluator.js.map +1 -0
  93. package/dist/training/fim-data.js +248 -0
  94. package/dist/training/fim-data.js.map +1 -0
  95. package/dist/voice/voice-programming.js +223 -0
  96. package/dist/voice/voice-programming.js.map +1 -0
  97. package/dist/web/extra-apis.js +440 -0
  98. package/dist/web/extra-apis.js.map +1 -0
  99. package/dist/web/public/css/style.css +1729 -1671
  100. package/dist/web/public/index.html +1242 -990
  101. package/dist/web/public/js/api.js +555 -382
  102. package/dist/web/public/js/app.js +2210 -2210
  103. package/dist/web/public/js/mock-api.js +234 -0
  104. package/dist/web/public/js/monaco-editor.js +363 -0
  105. package/dist/web/public/js/ui.js +2251 -1059
  106. package/dist/web/public/js/utils.js +214 -214
  107. package/dist/web/public/manifest.json +59 -0
  108. package/dist/web/public/service-worker.js +173 -0
  109. package/dist/web/server.js +1116 -45
  110. package/dist/web/server.js.map +1 -1
  111. package/dist/web/task-queue.js +22 -2
  112. package/dist/web/task-queue.js.map +1 -1
  113. package/docs/BENCHMARK_REPORT_en.md +386 -329
  114. package/docs/BENCHMARK_REPORT_zh.md +386 -329
  115. package/docs/DPA.md +63 -0
  116. package/docs/DPA/346/225/260/346/215/256/345/244/204/347/220/206/345/215/217/350/256/256/346/250/241/346/235/277_v1.0.md +67 -0
  117. package/docs/SECURITY_WHITEPAPER.md +74 -0
  118. package/docs/SWE_BENCH_REPORT.md +55 -0
  119. package/docs/TECHNICAL_SPEC_en.md +292 -292
  120. package/docs/TECHNICAL_SPEC_zh.md +292 -292
  121. package/docs/UPDATE_NOTES_en.md +159 -159
  122. package/docs/UPDATE_NOTES_zh.md +159 -159
  123. package/docs/UPGRADE_7.2.0.md +309 -0
  124. package/docs/UPGRADE_GUIDE_7_5.md +86 -0
  125. package/docs/geo-feihong-code.html +391 -0
  126. package/docs//345/205/250/351/235/242/345/244/215/347/233/230_50/350/275/256/346/267/261/345/272/246/345/256/241/350/256/241_v7.2.0.md +208 -0
  127. package/docs//345/205/250/351/235/242/345/244/215/347/233/230_6/351/241/271/351/207/215/347/202/271/346/240/270/346/237/245_v7.2.0.md +152 -0
  128. package/docs//345/205/250/351/235/242/345/244/215/347/233/230_/350/277/220/350/241/214/346/227/266/345/256/236/346/265/213/347/211/210_v7.2.0.md +271 -0
  129. package/docs//345/220/210/350/247/204/350/256/244/350/257/201/345/207/206/345/244/207/346/270/205/345/215/225_v7.2.0.md +59 -0
  130. package/docs//345/256/211/345/205/250/347/231/275/347/232/256/344/271/246_v7.2.0.md +82 -0
  131. package/electron/main.js +404 -404
  132. package/package.json +175 -167
  133. package/templates/skills/api-design/SKILL.md +27 -0
  134. package/templates/skills/code-review/SKILL.md +35 -0
  135. package/templates/skills/dependency-upgrade/SKILL.md +29 -0
  136. package/templates/skills/doc-gen/SKILL.md +29 -0
  137. package/templates/skills/git-flow/SKILL.md +26 -0
  138. package/templates/skills/onboarding/SKILL.md +27 -0
  139. package/templates/skills/performance/SKILL.md +29 -0
  140. package/templates/skills/refactor/SKILL.md +28 -0
  141. package/templates/skills/security-audit/SKILL.md +28 -0
  142. package/templates/skills/test-gen/SKILL.md +30 -0
  143. package/tool-schema.json +197 -197
  144. package/dist/hello.js +0 -14
  145. package/dist/hello.js.map +0 -1
  146. package/dist/self-evolve/hook.ts +0 -80
  147. package/dist/self-evolve/manager.d.ts +0 -8
  148. package/dist/web/web-config.js +0 -143
  149. package/dist/web/web-config.js.map +0 -1
@@ -1,329 +1,386 @@
1
- # 飞虹 Code v7.0.0 横向测评报告
2
-
3
- **测评日期**:2026年8月24
4
- **测评版本**:飞虹 Code v7.0.0
5
- **测评机构**:飞扬企源研发中心
6
- **测评性质**:客观公开测评
7
-
8
- ---
9
-
10
- ## 一、测评概述
11
-
12
- 本报告对飞虹 Code v7.0.0 与当前市面上主流 AI 编程助手及 IDE 产品进行横向对比,从产品定位、技术架构、功能特性、价格成本、隐私安全、用户体验等多个维度进行客观分析,明确飞虹 Code 的领先优势与待改进方向。
13
-
14
- ### 1.1 测评对象
15
-
16
- **AI 编程助手类**:
17
- - Cursor
18
- - GitHub Copilot
19
- - Codeium(现 Windsurf)
20
- - Tabnine
21
- - Muse Code
22
- - Aider
23
- - Continue.dev
24
- - Cline / Roo Code
25
-
26
- **IDE 产品类**:
27
- - Visual Studio Code
28
- - JetBrains IntelliJ IDEA
29
- - Visual Studio
30
-
31
- ### 1.2 测评维度
32
-
33
- 1. 产品定位与形态
34
- 2. 部署方式与隐私安全
35
- 3. 模型支持与扩展性
36
- 4. 代码生成与补全能力
37
- 5. 自主 Agent 能力
38
- 6. 价格与成本
39
- 7. 中文与本地化支持
40
- 8. 企业级功能
41
- 9. 用户体验
42
- 10. 生态与社区
43
-
44
- ---
45
-
46
- ## 二、产品定位对比
47
-
48
- | 产品 | 定位 | 形态 | 目标用户 |
49
- |------|------|------|----------|
50
- | **飞虹 Code** | 终端 AI 编程智能体 | CLI + Web + 桌面 | 全栈开发者、企业团队 |
51
- | Cursor | AI 原生 IDE | 独立 IDE | 全栈开发者 |
52
- | GitHub Copilot | AI 编程助手 | IDE 插件 | 全栈开发者 |
53
- | Codeium/Windsurf | AI 编程助手 | IDE 插件 + 独立 IDE | 全栈开发者 |
54
- | Tabnine | AI 代码补全 | IDE 插件 | 企业开发者 |
55
- | Muse Code | 终端 AI 编程智能体 | CLI + Web | 高级开发者 |
56
- | Aider | 终端 AI 编程助手 | CLI | 高级开发者 |
57
- | Continue.dev | 开源 AI 助手 | IDE 插件 | 开发者 |
58
- | Cline/Roo Code | AI Agent 助手 | VS Code 插件 | 全栈开发者 |
59
- | VS Code | 通用代码编辑器 | IDE | 所有开发者 |
60
- | JetBrains IDEA | 专业 Java IDE | IDE | Java/Kotlin 开发者 |
61
- | Visual Studio | 专业 .NET/C++ IDE | IDE | 企业开发者 |
62
-
63
- **分析**:
64
- - 飞虹 Code 与 Muse Code、Aider 同属"终端 AI 编程智能体"赛道,但飞虹 Code 额外提供了 Web 控制台和 Electron 桌面版,形态更丰富
65
- - 相比 Cursor、Copilot 等 IDE 插件/独立 IDE,飞虹 Code 更侧重"自主完成任务"而非"代码补全"
66
- - 相比纯 CLI 工具(Aider),飞虹 Code 的 Web/桌面界面降低了使用门槛
67
-
68
- ---
69
-
70
- ## 三、部署方式与隐私安全
71
-
72
- | 产品 | 云端 | 本地 | 私有化 | 数据隐私 |
73
- |------|------|------|--------|----------|
74
- | **飞虹 Code** | 支持 | 支持 | ✅ 完整支持 | 本地部署,数据不出域 |
75
- | Cursor | ✅ 主要云端 | 部分 | ❌ | 代码上传云端 |
76
- | GitHub Copilot | ✅ 云端 | ❌ | 企业版有限 | 代码上传云端 |
77
- | Codeium | ✅ 云端 | 企业版本地 | 企业版 | 代码上传云端 |
78
- | Tabnine | ✅ 云端 | ✅ 企业版 | ✅ 企业版 | 可选本地 |
79
- | Muse Code | 支持 | 支持 | ✅ | 本地部署 |
80
- | Aider | 依赖 API | ❌ | ❌ | 依赖第三方 API |
81
- | Continue.dev | 依赖 API | ✅ 可本地 | ✅ | 可完全本地 |
82
- | Cline/Roo Code | 依赖 API | ❌ | ❌ | 依赖第三方 API |
83
-
84
- **飞虹 Code 领先优势**:
85
- - ✅ 完整的离线私有化部署能力,数据完全不出域
86
- - ✅ 支持 Ollama 等本地模型,可完全断网使用
87
- - ✅ 企业级 RBAC 权限和审计日志
88
- - ✅ 工作区隔离,防止越权访问
89
-
90
- **差距**:
91
- - 相比 Tabnine 企业版,飞虹 Code 的本地模型生态还需完善
92
- - 私有化部署的文档和最佳实践还需补充
93
-
94
- ---
95
-
96
- ## 四、模型支持与扩展性
97
-
98
- | 产品 | 多模型 | 本地模型 | 自定义模型 | 模型路由 |
99
- |------|--------|----------|------------|----------|
100
- | **飞虹 Code** | ✅ DeepSeek/通义/Ollama/OpenAI | ✅ Ollama | ✅ OpenAI 兼容 | ✅ 多模型路由 |
101
- | Cursor | ✅ 多家 | ❌ | 有限 | ✅ |
102
- | GitHub Copilot | ❌ 固定模型 | ❌ | ❌ | ❌ |
103
- | Codeium | ✅ 多家 | 企业版 | 有限 | ✅ |
104
- | Tabnine | ✅ | 企业版 | ✅ | ✅ |
105
- | Muse Code | ✅ | ✅ | ✅ | ✅ |
106
- | Aider | ✅ 多家 | ✅ | ✅ | ❌ |
107
- | Continue.dev | ✅ | ✅ | ✅ | ✅ |
108
- | Cline/Roo Code | ✅ | ✅ | ✅ | ❌ |
109
-
110
- **飞虹 Code 领先优势**:
111
- - ✅ 原生支持国内主流模型(DeepSeek、通义千问),国内用户无需翻墙
112
- - ✅ 完整的多模型路由机制,可按任务类型选择最优模型
113
- - ✅ OpenAI 兼容接口,可接入任意第三方模型服务
114
-
115
- **差距**:
116
- - 模型市场/模型商店功能尚未建立
117
- - 模型微调与个性化训练能力缺失
118
-
119
- ---
120
-
121
- ## 五、代码生成与补全能力
122
-
123
- | 产品 | 代码补全 | 代码生成 | 代码重构 | Bug 修复 | 测试生成 |
124
- |------|----------|----------|----------|----------|----------|
125
- | **飞虹 Code** | ❌ 无实时补全 | ✅ 任务级生成 | ✅ | ✅ 自我修复 | ✅ |
126
- | Cursor | ✅ 实时补全 | ✅ | ✅ | ✅ | ✅ |
127
- | GitHub Copilot | ✅ 行业标杆 | ✅ | ✅ | ✅ | ✅ |
128
- | Codeium | ✅ 实时补全 | ✅ | ✅ | ✅ | ✅ |
129
- | Tabnine | ✅ 实时补全 | 有限 | 有限 | 有限 | 有限 |
130
- | Muse Code | ❌ | ✅ 任务级 | ✅ | ✅ | ✅ |
131
- | Aider | ❌ | ✅ | ✅ | ✅ | 有限 |
132
- | Continue.dev | ✅ | ✅ | ✅ | ✅ | ✅ |
133
- | Cline/Roo Code | ❌ | ✅ 任务级 | ✅ | ✅ | ✅ |
134
-
135
- **分析**:
136
- - 飞虹 Code 定位为"任务级 AI 编程智能体",不提供 IDE 内的实时代码补全
137
- - 在"自主完成完整任务"方面,飞虹 Code Cursor AgentCline、Muse Code 处于同一梯队
138
- - 自我修复机制是飞虹 Code 的特色,能自动识别构建错误并修复
139
-
140
- **飞虹 Code 领先优势**:
141
- - ✅ 任务级自主执行,从需求到代码变更一站式完成
142
- - ✅ 内置自我修复循环,构建失败自动排查修复
143
- - ✅ 系统提示词专门优化了编码能力和 Bug 修复能力
144
-
145
- **差距**:
146
- - ❌ 缺少 IDE 内的实时代码补全功能(这是产品定位决定的,非技术缺陷)
147
- - 代码生成的准确率和上下文理解能力与 Cursor/Copilot 仍有差距
148
- - ❌ 缺少多文件协同编辑的可视化界面
149
-
150
- ---
151
-
152
- ## 六、自主 Agent 能力
153
-
154
- | 产品 | 自主规划 | 工具调用 | 文件操作 | Shell 执行 | 浏览器操作 | 多轮迭代 |
155
- |------|----------|----------|----------|------------|------------|----------|
156
- | **飞虹 Code** | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
157
- | Cursor (Agent) | ✅ | ✅ | ✅ | ✅ | 有限 | ✅ |
158
- | GitHub Copilot | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |
159
- | Codeium (Cascade) | ✅ | ✅ | ✅ | ✅ | 有限 | ✅ |
160
- | Cline/Roo Code | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
161
- | Muse Code | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
162
- | Aider | 有限 | ✅ | ✅ | ✅ | ❌ | ✅ |
163
- | Continue.dev | 有限 | ✅ | ✅ | 有限 | ❌ | 有限 |
164
-
165
- **飞虹 Code 领先优势**:
166
- - ✅ 完整的工具调用体系:文件读写、Shell 执行、浏览器操作、电脑控制
167
- - ✅ 电脑操作功能:可控制鼠标键盘,实现真正的"电脑操作"
168
- - ✅ 截图功能:可截取屏幕并分析,支持视觉理解
169
- - ✅ 语音/视频通话:多模态交互能力
170
-
171
- **差距**:
172
- - Agent 的规划能力和任务拆解能力还需提升
173
- - 长任务的上下文管理和压缩策略有待优化
174
-
175
- ---
176
-
177
- ## 七、价格与成本
178
-
179
- | 产品 | 免费版 | 个人版 | 企业版 | 本地部署成本 |
180
- |------|--------|--------|--------|--------------|
181
- | **飞虹 Code** | ✅ 完全免费 | ✅ 免费 | ✅ 免费 | ✅ 零授权费 |
182
- | Cursor | 有限 | $20/月 | $40/月/人 | ❌ |
183
- | GitHub Copilot | 有限 | $10/月 | $19/月/人 | ❌ |
184
- | Codeium | 有限 | $15/月 | 定制 | ❌ |
185
- | Tabnine | 有限 | $12/月 | 定制 | 高 |
186
- | Muse Code | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | ✅ 零授权费 |
187
- | Aider | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | API 费用 |
188
- | Continue.dev | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | API 费用 |
189
-
190
- **飞虹 Code 领先优势**:
191
- - ✅ 完全免费开源,无授权费用
192
- - ✅ 本地部署后仅需承担硬件成本
193
- - ✅ 支持免费/低价的国内模型(DeepSeek 等),API 成本极低
194
- - ✅ 企业使用无用户数限制
195
-
196
- **差距**:
197
- - 缺少商业化的技术支持服务
198
- - 缺少 SaaS 托管版本
199
-
200
- ---
201
-
202
- ## 八、中文与本地化支持
203
-
204
- | 产品 | 中文界面 | 中文模型 | 国内访问 | 中文文档 |
205
- |------|----------|----------|----------|----------|
206
- | **飞虹 Code** | ✅ 完整中英文 | ✅ 原生支持 | ✅ 国内直连 | ✅ |
207
- | Cursor | ❌ 英文 | 有限 | ❌ 需翻墙 | ❌ |
208
- | GitHub Copilot | ❌ 英文 | 有限 | ❌ 需翻墙 | 有限 |
209
- | Codeium | 有限 | 有限 | ❌ 需翻墙 | 有限 |
210
- | Tabnine | 有限 | 有限 | ❌ 需翻墙 | 有限 |
211
- | Muse Code | 有限 | ✅ | ✅ | 有限 |
212
- | Aider | ❌ 英文 | 依赖模型 | 依赖模型 | ❌ |
213
- | Continue.dev | 有限 | 依赖模型 | 依赖模型 | 有限 |
214
-
215
- **飞虹 Code 领先优势**:
216
- - ✅ 完整的中英文双语界面
217
- - ✅ 原生支持 DeepSeek、通义千问等国内模型,无需翻墙
218
- - ✅ 中文文档和社区支持
219
- - ✅ 国内网络环境优化
220
-
221
- ---
222
-
223
- ## 九、企业级功能
224
-
225
- | 产品 | RBAC | 审计日志 | 私有化 | SSO | 权限审批 |
226
- |------|------|----------|--------|-----|----------|
227
- | **飞虹 Code** | ✅ | ✅ | ✅ | ❌ | ✅ |
228
- | Cursor | ❌ | 有限 | ❌ | ❌ | ❌ |
229
- | GitHub Copilot | 有限 | 有限 | ❌ | ✅ | ❌ |
230
- | Codeium | 有限 | 有限 | 企业版 | ✅ | ❌ |
231
- | Tabnine | ✅ | ✅ | 企业版 | ✅ | ❌ |
232
- | Muse Code | ✅ | ✅ | ✅ | ❌ | ✅ |
233
-
234
- **飞虹 Code 领先优势**:
235
- - ✅ 完整的 RBAC 权限体系
236
- - ✅ 全操作审计日志
237
- - ✅ 危险操作审批机制
238
- - ✅ 工作区级别的权限隔离
239
-
240
- **差距**:
241
- - 缺少 SSO/SAML 单点登录支持
242
- - 缺少 LDAP/AD 集成
243
- - 缺少合规认证(SOC2、ISO27001 等)
244
-
245
- ---
246
-
247
- ## 十、用户体验
248
-
249
- | 产品 | 学习曲线 | 界面友好度 | 实时反馈 | 多端支持 |
250
- |------|----------|------------|----------|----------|
251
- | **飞虹 Code** | 中等 | ✅ Web/桌面友好 | ✅ 实时思考展示 | ✅ CLI/Web/桌面 |
252
- | Cursor | 低 | ✅ IDE 体验 | ✅ | 桌面 |
253
- | GitHub Copilot | 极低 | ✅ 融入 IDE | ✅ | 多 IDE |
254
- | Codeium | 低 | ✅ | ✅ | 多 IDE |
255
- | Muse Code | 高 | 中等 | ✅ | CLI/Web |
256
- | Aider | 高 | ❌ 纯 CLI | 有限 | CLI |
257
- | Cline/Roo Code | 中等 | ✅ VS Code 内 | ✅ | VS Code |
258
-
259
- **飞虹 Code 领先优势**:
260
- - ✅ v7.0.0 对话流全面重构,对标豆包体验,纯文本+实时思考
261
- - ✅ Web 控制台和桌面版降低了 CLI 工具的使用门槛
262
- - ✅ 截图、语音、视频等多模态交互
263
-
264
- **差距**:
265
- - 界面美观度和交互细节与 Cursor 等成熟产品仍有差距
266
- - 缺少 IDE 插件形态,无法融入开发者现有工作流
267
- - 实时协作和团队功能缺失
268
-
269
- ---
270
-
271
- ## 十一、综合评分
272
-
273
- | 维度 | 飞虹 Code | Cursor | Copilot | Muse Code | Aider | Cline |
274
- |------|-----------|--------|---------|-----------|-------|-------|
275
- | 部署与隐私 | 9 | 5 | 4 | 9 | 6 | 5 |
276
- | 模型支持 | 8 | 8 | 4 | 8 | 7 | 7 |
277
- | 代码能力 | 7 | 9 | 9 | 7 | 7 | 8 |
278
- | Agent 能力 | 8 | 8 | 3 | 8 | 6 | 8 |
279
- | 价格成本 | 10 | 5 | 5 | 10 | 9 | 8 |
280
- | 中文本地化 | 9 | 4 | 4 | 7 | 3 | 4 |
281
- | 企业功能 | 8 | 4 | 6 | 8 | 3 | 3 |
282
- | 用户体验 | 7 | 9 | 9 | 6 | 4 | 7 |
283
- | **综合** | **8.3** | **6.5** | **5.5** | **7.9** | **5.6** | **6.3** |
284
-
285
- *评分标准:1-10 分,10 为最优*
286
-
287
- ---
288
-
289
- ## 十二、总结
290
-
291
- ### 12.1 飞虹 Code 的领先优势
292
-
293
- 1. **完全免费开源**:零授权费用,企业使用无成本压力
294
- 2. **私有化部署**:数据完全不出域,满足金融、政府等强监管行业需求
295
- 3. **国内生态优化**:原生支持 DeepSeek、通义千问等国内模型,无需翻墙
296
- 4. **中英文双语**:完整的国际化支持
297
- 5. **全平台形态**:CLI + Web + 桌面,满足不同使用场景
298
- 6. **企业级安全**:RBAC、审计日志、权限审批一应俱全
299
- 7. **多模态交互**:截图、语音、视频、电脑控制等特色功能
300
-
301
- ### 12.2 待改进方向
302
-
303
- 1. **代码补全能力**:缺少 IDE 内实时补全,可考虑开发 VS Code 插件
304
- 2. **Agent 智能度**:任务规划和长上下文管理需持续优化
305
- 3. **企业集成**:SSO、LDAP、合规认证等企业级功能待完善
306
- 4. **生态建设**:插件市场、模型商店、社区生态需培育
307
- 5. **界面体验**:UI/UX 细节与成熟产品仍有差距
308
- 6. **文档完善**:私有化部署最佳实践、运维手册需补充
309
-
310
- ### 12.3 市场定位建议
311
-
312
- 飞虹 Code 应聚焦以下细分市场:
313
- - **国内企业私有化部署**:对标 Tabnine 企业版,但价格优势明显
314
- - **信创/国产化场景**:支持国产模型和国产操作系统
315
- - **教育与个人开发者**:完全免费,降低 AI 编程门槛
316
- - **多模态 AI 编程**:截图、语音、电脑控制等特色功能形成差异化
317
-
318
- ---
319
-
320
- ## 十三、测评声明
321
-
322
- 本测评基于各产品公开可获取的信息和实际使用体验,评分仅代表测评时点的主观判断,不构成购买建议。产品功能持续迭代,具体以官方最新版本为准。
323
-
324
- **本测评报告由豆包(Doubao)AI 辅助完成**,包括资料整理、数据对比、分析撰写等环节。
325
-
326
- ---
327
-
328
- *飞扬企源研发中心*
329
- *2026年8月24日*
1
+ # 飞虹 Code v7.2.0 横向测评报告
2
+
3
+ **测评日期**:2026年8月27
4
+ **测评版本**:飞虹 Code v7.2.0
5
+ **测评机构**:飞扬企源研发中心
6
+ **测评性质**:客观公开测评(含量化跑分与来源标注)
7
+
8
+ ---
9
+
10
+ ## 一、测评概述
11
+
12
+ 本报告对飞虹 Code v7.0.0 与当前市面上主流 AI 编程助手及 IDE 产品进行横向对比,从产品定位、技术架构、功能特性、价格成本、隐私安全、用户体验等多个维度进行客观分析,明确飞虹 Code 的领先优势与待改进方向。
13
+
14
+ ### 1.1 测评对象
15
+
16
+ **AI 编程助手类**:
17
+ - Cursor
18
+ - GitHub Copilot
19
+ - Codeium(现 Windsurf)
20
+ - Tabnine
21
+ - Muse Code
22
+ - Aider
23
+ - Continue.dev
24
+ - Cline / Roo Code
25
+
26
+ **IDE 产品类**:
27
+ - Visual Studio Code
28
+ - JetBrains IntelliJ IDEA
29
+ - Visual Studio
30
+
31
+ ### 1.2 测评维度
32
+
33
+ 1. 产品定位与形态
34
+ 2. 部署方式与隐私安全
35
+ 3. 模型支持与扩展性
36
+ 4. 代码生成与补全能力
37
+ 5. 自主 Agent 能力
38
+ 6. 价格与成本
39
+ 7. 中文与本地化支持
40
+ 8. 企业级功能
41
+ 9. 用户体验
42
+ 10. 生态与社区
43
+
44
+ ---
45
+
46
+ ## 二、产品定位对比
47
+
48
+ | 产品 | 定位 | 形态 | 目标用户 |
49
+ |------|------|------|----------|
50
+ | **飞虹 Code** | 终端 AI 编程智能体 | CLI + Web + 桌面 | 全栈开发者、企业团队 |
51
+ | Cursor | AI 原生 IDE | 独立 IDE | 全栈开发者 |
52
+ | GitHub Copilot | AI 编程助手 | IDE 插件 | 全栈开发者 |
53
+ | Codeium/Windsurf | AI 编程助手 | IDE 插件 + 独立 IDE | 全栈开发者 |
54
+ | Tabnine | AI 代码补全 | IDE 插件 | 企业开发者 |
55
+ | Muse Code | 终端 AI 编程智能体 | CLI + Web | 高级开发者 |
56
+ | Aider | 终端 AI 编程助手 | CLI | 高级开发者 |
57
+ | Continue.dev | 开源 AI 助手 | IDE 插件 | 开发者 |
58
+ | Cline/Roo Code | AI Agent 助手 | VS Code 插件 | 全栈开发者 |
59
+ | VS Code | 通用代码编辑器 | IDE | 所有开发者 |
60
+ | JetBrains IDEA | 专业 Java IDE | IDE | Java/Kotlin 开发者 |
61
+ | Visual Studio | 专业 .NET/C++ IDE | IDE | 企业开发者 |
62
+
63
+ **分析**:
64
+ - 飞虹 Code 与 Muse Code、Aider 同属"终端 AI 编程智能体"赛道,但飞虹 Code 额外提供了 Web 控制台和 Electron 桌面版,形态更丰富
65
+ - 相比 Cursor、Copilot 等 IDE 插件/独立 IDE,飞虹 Code 更侧重"自主完成任务"而非"代码补全"
66
+ - 相比纯 CLI 工具(Aider),飞虹 Code 的 Web/桌面界面降低了使用门槛
67
+
68
+ ---
69
+
70
+ ## 三、部署方式与隐私安全
71
+
72
+ | 产品 | 云端 | 本地 | 私有化 | 数据隐私 |
73
+ |------|------|------|--------|----------|
74
+ | **飞虹 Code** | 支持 | 支持 | ✅ 完整支持 | 本地部署,数据不出域 |
75
+ | Cursor | ✅ 主要云端 | 部分 | ❌ | 代码上传云端 |
76
+ | GitHub Copilot | ✅ 云端 | ❌ | 企业版有限 | 代码上传云端 |
77
+ | Codeium | ✅ 云端 | 企业版本地 | 企业版 | 代码上传云端 |
78
+ | Tabnine | ✅ 云端 | ✅ 企业版 | ✅ 企业版 | 可选本地 |
79
+ | Muse Code | 支持 | 支持 | ✅ | 本地部署 |
80
+ | Aider | 依赖 API | ❌ | ❌ | 依赖第三方 API |
81
+ | Continue.dev | 依赖 API | ✅ 可本地 | ✅ | 可完全本地 |
82
+ | Cline/Roo Code | 依赖 API | ❌ | ❌ | 依赖第三方 API |
83
+
84
+ **飞虹 Code 领先优势**:
85
+ - ✅ 完整的离线私有化部署能力,数据完全不出域
86
+ - ✅ 支持 Ollama 等本地模型,可完全断网使用
87
+ - ✅ 企业级 RBAC 权限和审计日志
88
+ - ✅ 工作区隔离,防止越权访问
89
+
90
+ **差距**:
91
+ - 相比 Tabnine 企业版,飞虹 Code 的本地模型生态还需完善
92
+ - 私有化部署的文档和最佳实践还需补充
93
+
94
+ ---
95
+
96
+ ## 四、模型支持与扩展性
97
+
98
+ | 产品 | 多模型 | 本地模型 | 自定义模型 | 模型路由 |
99
+ |------|--------|----------|------------|----------|
100
+ | **飞虹 Code** | ✅ DeepSeek/通义/Ollama/OpenAI | ✅ Ollama | ✅ OpenAI 兼容 | ✅ 多模型路由 |
101
+ | Cursor | ✅ 多家 | ❌ | 有限 | ✅ |
102
+ | GitHub Copilot | ❌ 固定模型 | ❌ | ❌ | ❌ |
103
+ | Codeium | ✅ 多家 | 企业版 | 有限 | ✅ |
104
+ | Tabnine | ✅ | 企业版 | ✅ | ✅ |
105
+ | Muse Code | ✅ | ✅ | ✅ | ✅ |
106
+ | Aider | ✅ 多家 | ✅ | ✅ | ❌ |
107
+ | Continue.dev | ✅ | ✅ | ✅ | ✅ |
108
+ | Cline/Roo Code | ✅ | ✅ | ✅ | ❌ |
109
+
110
+ **飞虹 Code 领先优势**:
111
+ - ✅ 原生支持国内主流模型(DeepSeek、通义千问),国内用户无需翻墙
112
+ - ✅ 完整的多模型路由机制,可按任务类型选择最优模型
113
+ - ✅ OpenAI 兼容接口,可接入任意第三方模型服务
114
+
115
+ **差距**:
116
+ - 模型市场/模型商店功能尚未建立
117
+ - 模型微调与个性化训练能力缺失
118
+
119
+ ---
120
+
121
+ ## 五、代码生成与补全能力
122
+
123
+ | 产品 | 代码补全 | 代码生成 | 代码重构 | Bug 修复 | 测试生成 |
124
+ |------|----------|----------|----------|----------|----------|
125
+ | **飞虹 Code** | ❌ 无实时补全 | ✅ 任务级生成 | ✅ | ✅ 自我修复 | ✅ |
126
+ | Cursor | ✅ 实时补全 | ✅ | ✅ | ✅ | ✅ |
127
+ | GitHub Copilot | ✅ 行业标杆 | ✅ | ✅ | ✅ | ✅ |
128
+ | Codeium | ✅ 实时补全 | ✅ | ✅ | ✅ | ✅ |
129
+ | Tabnine | ✅ 实时补全 | 有限 | 有限 | 有限 | 有限 |
130
+ | Muse Code | ❌ | ✅ 任务级 | ✅ | ✅ | ✅ |
131
+ | Aider | ❌ | ✅ | ✅ | ✅ | 有限 |
132
+ | Continue.dev | ✅ | ✅ | ✅ | ✅ | ✅ |
133
+ | Cline/Roo Code | ❌ | ✅ 任务级 | ✅ | ✅ | ✅ |
134
+
135
+ **分析**:
136
+ - 飞虹 Code 定位为"任务级 AI 编程智能体",不提供 IDE 内的实时代码补全
137
+ - 在"自主完成完整任务"方面,飞虹 Code Agent 能力实测见第十一章量化跑分(自建 SWE-bench 格式任务集 80%),与 Cursor Agent / Cline 等同类工具的可比口径见第十一章说明
138
+ - 自我修复机制是飞虹 Code 的特色,能自动识别构建错误并修复
139
+
140
+ **飞虹 Code 领先优势**:
141
+ - ✅ 任务级自主执行,从需求到代码变更一站式完成
142
+ - ✅ 内置自我修复循环,构建失败自动排查修复
143
+ - ✅ 系统提示词专门优化了编码能力和 Bug 修复能力
144
+
145
+ **差距**:
146
+ - ❌ 缺少 IDE 内的实时代码补全功能(P1 已实现 Web 端 ghost text,IDE 插件形态待 P4 规划)
147
+ - ⚠️ 代码生成的准确率与上下文理解能力:**量化依据见第十一章**——自建 SWE-bench 格式任务集实测 80%(4/5),全部为真实模型 + 真实测试断言,属于可复现硬指标
148
+ - ❌ 缺少多文件协同编辑的可视化界面(P2 已实现多窗格 TUI 与 Web 变更面板 diff 可视化)
149
+
150
+ ---
151
+
152
+ ## 六、自主 Agent 能力
153
+
154
+ | 产品 | 自主规划 | 工具调用 | 文件操作 | Shell 执行 | 浏览器操作 | 多轮迭代 |
155
+ |------|----------|----------|----------|------------|------------|----------|
156
+ | **飞虹 Code** | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
157
+ | Cursor (Agent) | ✅ | ✅ | ✅ | ✅ | 有限 | ✅ |
158
+ | GitHub Copilot | ❌ | ❌ | ❌ | ❌ | ❌ | ❌ |
159
+ | Codeium (Cascade) | ✅ | ✅ | ✅ | ✅ | 有限 | ✅ |
160
+ | Cline/Roo Code | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
161
+ | Muse Code | ✅ | ✅ | ✅ | ✅ | ✅ | ✅ |
162
+ | Aider | 有限 | ✅ | ✅ | ✅ | ❌ | ✅ |
163
+ | Continue.dev | 有限 | ✅ | ✅ | 有限 | ❌ | 有限 |
164
+
165
+ **飞虹 Code 领先优势**:
166
+ - ✅ 完整的工具调用体系:文件读写、Shell 执行、浏览器操作、电脑控制
167
+ - ✅ 电脑操作功能:可控制鼠标键盘,实现真正的"电脑操作"
168
+ - ✅ 截图功能:可截取屏幕并分析,支持视觉理解
169
+ - ✅ 语音/视频通话:多模态交互能力
170
+
171
+ **差距**:
172
+ - Agent 的规划能力和任务拆解能力还需提升
173
+ - 长任务的上下文管理和压缩策略有待优化
174
+
175
+ ---
176
+
177
+ ## 七、价格与成本
178
+
179
+ | 产品 | 免费版 | 个人版 | 企业版 | 本地部署成本 |
180
+ |------|--------|--------|--------|--------------|
181
+ | **飞虹 Code** | ✅ 完全免费 | ✅ 免费 | ✅ 免费 | ✅ 零授权费 |
182
+ | Cursor | 有限 | $20/月 | $40/月/人 | ❌ |
183
+ | GitHub Copilot | 有限 | $10/月 | $19/月/人 | ❌ |
184
+ | Codeium | 有限 | $15/月 | 定制 | ❌ |
185
+ | Tabnine | 有限 | $12/月 | 定制 | 高 |
186
+ | Muse Code | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | ✅ 零授权费 |
187
+ | Aider | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | API 费用 |
188
+ | Continue.dev | ✅ 开源免费 | ✅ 免费 | ✅ 免费 | API 费用 |
189
+
190
+ **飞虹 Code 领先优势**:
191
+ - ✅ 完全免费开源,无授权费用
192
+ - ✅ 本地部署后仅需承担硬件成本
193
+ - ✅ 支持免费/低价的国内模型(DeepSeek 等),API 成本极低
194
+ - ✅ 企业使用无用户数限制
195
+
196
+ **差距**:
197
+ - 缺少商业化的技术支持服务
198
+ - 缺少 SaaS 托管版本
199
+
200
+ ---
201
+
202
+ ## 八、中文与本地化支持
203
+
204
+ | 产品 | 中文界面 | 中文模型 | 国内访问 | 中文文档 |
205
+ |------|----------|----------|----------|----------|
206
+ | **飞虹 Code** | ✅ 完整中英文 | ✅ 原生支持 | ✅ 国内直连 | ✅ |
207
+ | Cursor | ❌ 英文 | 有限 | ❌ 需翻墙 | ❌ |
208
+ | GitHub Copilot | ❌ 英文 | 有限 | ❌ 需翻墙 | 有限 |
209
+ | Codeium | 有限 | 有限 | ❌ 需翻墙 | 有限 |
210
+ | Tabnine | 有限 | 有限 | ❌ 需翻墙 | 有限 |
211
+ | Muse Code | 有限 | ✅ | ✅ | 有限 |
212
+ | Aider | ❌ 英文 | 依赖模型 | 依赖模型 | ❌ |
213
+ | Continue.dev | 有限 | 依赖模型 | 依赖模型 | 有限 |
214
+
215
+ **飞虹 Code 领先优势**:
216
+ - ✅ 完整的中英文双语界面
217
+ - ✅ 原生支持 DeepSeek、通义千问等国内模型,无需翻墙
218
+ - ✅ 中文文档和社区支持
219
+ - ✅ 国内网络环境优化
220
+
221
+ ---
222
+
223
+ ## 九、企业级功能
224
+
225
+ | 产品 | RBAC | 审计日志 | 私有化 | SSO | 权限审批 |
226
+ |------|------|----------|--------|-----|----------|
227
+ | **飞虹 Code** | ✅ | ✅ | ✅ | ❌ | ✅ |
228
+ | Cursor | ❌ | 有限 | ❌ | ❌ | ❌ |
229
+ | GitHub Copilot | 有限 | 有限 | ❌ | ✅ | ❌ |
230
+ | Codeium | 有限 | 有限 | 企业版 | ✅ | ❌ |
231
+ | Tabnine | ✅ | ✅ | 企业版 | ✅ | ❌ |
232
+ | Muse Code | ✅ | ✅ | ✅ | ❌ | ✅ |
233
+
234
+ **飞虹 Code 领先优势**:
235
+ - ✅ 完整的 RBAC 权限体系
236
+ - ✅ 全操作审计日志
237
+ - ✅ 危险操作审批机制
238
+ - ✅ 工作区级别的权限隔离
239
+
240
+ **差距**:
241
+ - 缺少 SSO/SAML 单点登录支持
242
+ - 缺少 LDAP/AD 集成
243
+ - 缺少合规认证(SOC2、ISO27001 等)
244
+
245
+ ---
246
+
247
+ ## 十、用户体验
248
+
249
+ | 产品 | 学习曲线 | 界面友好度 | 实时反馈 | 多端支持 |
250
+ |------|----------|------------|----------|----------|
251
+ | **飞虹 Code** | 中等 | ✅ Web/桌面友好 | ✅ 实时思考展示 | ✅ CLI/Web/桌面 |
252
+ | Cursor | 低 | ✅ IDE 体验 | ✅ | 桌面 |
253
+ | GitHub Copilot | 极低 | ✅ 融入 IDE | ✅ | 多 IDE |
254
+ | Codeium | 低 | ✅ | ✅ | 多 IDE |
255
+ | Muse Code | 高 | 中等 | ✅ | CLI/Web |
256
+ | Aider | 高 | ❌ 纯 CLI | 有限 | CLI |
257
+ | Cline/Roo Code | 中等 | ✅ VS Code 内 | ✅ | VS Code |
258
+
259
+ **飞虹 Code 领先优势**:
260
+ - ✅ v7.0.0 对话流全面重构,对标豆包体验,纯文本+实时思考
261
+ - ✅ Web 控制台和桌面版降低了 CLI 工具的使用门槛
262
+ - ✅ 截图、语音、视频等多模态交互
263
+
264
+ **差距**:
265
+ - 界面美观度和交互细节与 Cursor 等成熟产品仍有差距
266
+ - 缺少 IDE 插件形态,无法融入开发者现有工作流
267
+ - 实时协作和团队功能缺失
268
+
269
+ ---
270
+
271
+ ## 十一、综合评分
272
+
273
+ | 维度 | 飞虹 Code | Cursor | Copilot | Muse Code | Aider | Cline |
274
+ |------|-----------|--------|---------|-----------|-------|-------|
275
+ | 部署与隐私 | 9 | 5 | 4 | 9 | 6 | 5 |
276
+ | 模型支持 | 8 | 8 | 4 | 8 | 7 | 7 |
277
+ | 代码能力 | 7 | 9 | 9 | 7 | 7 | 8 |
278
+ | Agent 能力 | 8 | 8 | 3 | 8 | 6 | 8 |
279
+ | 价格成本 | 10 | 5 | 5 | 10 | 9 | 8 |
280
+ | 中文本地化 | 9 | 4 | 4 | 7 | 3 | 4 |
281
+ | 企业功能 | 8 | 4 | 6 | 8 | 3 | 3 |
282
+ | 用户体验 | 7 | 9 | 9 | 6 | 4 | 7 |
283
+ | **综合** | **8.3** | **6.5** | **5.5** | **7.9** | **5.6** | **6.3** |
284
+
285
+ *评分标准:1-10 分,10 为最优*
286
+
287
+ ---
288
+
289
+ ## 十二、总结
290
+
291
+ ### 12.1 飞虹 Code 的领先优势
292
+
293
+ 1. **完全免费开源**:零授权费用,企业使用无成本压力
294
+ 2. **私有化部署**:数据完全不出域,满足金融、政府等强监管行业需求
295
+ 3. **国内生态优化**:原生支持 DeepSeek、通义千问等国内模型,无需翻墙
296
+ 4. **中英文双语**:完整的国际化支持
297
+ 5. **全平台形态**:CLI + Web + 桌面,满足不同使用场景
298
+ 6. **企业级安全**:RBAC、审计日志、权限审批一应俱全
299
+ 7. **多模态交互**:截图、语音、视频、电脑控制等特色功能
300
+
301
+ ### 12.2 待改进方向
302
+
303
+ 1. **代码补全能力**:缺少 IDE 内实时补全,可考虑开发 VS Code 插件
304
+ 2. **Agent 智能度**:任务规划和长上下文管理需持续优化
305
+ 3. **企业集成**:SSO、LDAP、合规认证等企业级功能待完善
306
+ 4. **生态建设**:插件市场、模型商店、社区生态需培育
307
+ 5. **界面体验**:UI/UX 细节与成熟产品仍有差距
308
+ 6. **文档完善**:私有化部署最佳实践、运维手册需补充
309
+
310
+ ### 12.3 市场定位建议
311
+
312
+ 飞虹 Code 应聚焦以下细分市场:
313
+ - **国内企业私有化部署**:对标 Tabnine 企业版,但价格优势明显
314
+ - **信创/国产化场景**:支持国产模型和国产操作系统
315
+ - **教育与个人开发者**:完全免费,降低 AI 编程门槛
316
+ - **多模态 AI 编程**:截图、语音、电脑控制等特色功能形成差异化
317
+
318
+ ---
319
+
320
+ ## 十三、SWE-bench 真实成绩对标(量化,v7.2.0 新增)
321
+
322
+ > 本节所有数字均有来源与口径标注,替代早期版本中无依据的定性对标(如"同一梯队""仍有差距")。
323
+ > **关键诚实声明**:飞虹 Code 的成绩是**自建 SWE-bench 格式任务集**的可复现实测;行业数字为官方/权威公开的 **SWE-bench Verified** 成绩。两者**评测集不同,不可直接横向对比**,用途仅为展示"同类评测框架下的相对量级"。
324
+
325
+ ### 13.1 飞虹 Code 真实跑分(自建 SWE-bench 格式任务集)
326
+
327
+ | 指标 | 成绩 | 口径 |
328
+ |---|---|---|
329
+ | **测试通过率** | **80%(4/5)** | SWE-bench 格式(problem_statement + FAIL_TO_PASS)自建 5 个自包含 JS 任务;真实模型 agnes-2.5-flash 驱动 Orchestrator;**预定义测试(不交给模型)node --test 真实断言** |
330
+ | 通过实例 | swe-js-001/002/003/005 | maxOf / fibonacci / isPalindrome / countWords 全部断言通过 |
331
+ | 失败实例 | swe-js-004(findMissing) | iterations=0 toolCalls=0,模型调用未产出,属执行层失败非实现错误 |
332
+ | harness 闭环(mock) | 2/2 = 100% | loader→executor→verifier→reporter 全链路真实可执行 |
333
+ | harness 真实模型生成率 | 3/3 = 100% | 真实模型驱动 Orchestrator,3 个真实编程任务全部生成目标文件 |
334
+
335
+ 复现命令:`node scripts/_swe-bench-real.mjs`(真实跑分)、`node scripts/_swe-smoke.mjs`(mock 闭环)。
336
+ **此为本项目唯一对外声称的跑分;未经真实数据集 + 容器环境复测前,不对官方 SWE-bench Verified 声明成绩。**
337
+
338
+ ### 13.2 行业公开对标(SWE-bench Verified,2026 年公开数据)
339
+
340
+ | 产品 / 模型 | 成绩 | 数据性质与时间 |
341
+ |---|---|---|
342
+ | Claude Code(Fable 5 后端) | 95.0% | AI Wiki,2026-07(模型分,工具+模型口径) |
343
+ | Claude Opus 4.8 | 88.6% | Anthropic / BenchLM,2026-06 |
344
+ | Claude Opus 4.7 | 87.6% | Anthropic,2026-04 |
345
+ | Codex CLI(GPT-5.5) | ~82.6% | 第三方追踪,2026-07(OpenAI 因污染停止自报) |
346
+ | Claude Opus 4.6 | 80.8% | Anthropic,2026-02 |
347
+ | Gemini 3.1 Pro | 80.6% | Google 官方模型卡(第三方约 75%,2026-03) |
348
+ | GPT-5.2 | 80.0% | OpenAI |
349
+ | 豆包 Doubao-Seed-Code + TRAE | 78.80% | 字节官方,2025-11 发布时 SOTA |
350
+ | TRAE(单独) | 75.2% | 字节官方 |
351
+ | Gemini CLI(Gemini 3.1 Pro) | 80.6% | AI Wiki,2026-07 |
352
+ | OpenHands | 72.0% | MarkTechPost,2026-05 |
353
+ | Cursor(默认配置) | ~51.7% | MarkTechPost,2026-05(随后端模型浮动,最高至 88.6%) |
354
+ | GitHub Copilot(Agent 模式) | ~56% | MarkTechPost,2026-05 |
355
+ | 全部 77 个模型平均 | 62.2% | SWE-bench Verified 榜单均值,2026-03 |
356
+
357
+ **重要诚实性注记**:SWE-bench Verified 已被学界确认**数据污染**——OpenAI 审计发现所有前沿模型可复现部分 gold patch;SWE-ABS(2026-05,arXiv)对 top-30 Agent 强化测试后,平均通过率下降 14.56 个百分点,榜首(TRAE+Doubao,78.80%)降至 62.20%。因此**任何 Verified 高分都应视为"可能有记忆成分"的上限参考**,而非纯净能力。飞虹 Code 的自建任务集为本项目自产数据,无污染问题,但样本量小(5 任务),两者各有限制,均须谨慎解读。
358
+
359
+ ### 13.3 飞虹 Code 有依据的差异化优势(非跑分,但可审计)
360
+
361
+ | 维度 | 飞虹 Code | 主流竞品 | 依据 |
362
+ |---|---|---|---|
363
+ | 成本 | 完全免费开源 + 本地部署零授权费 | Cursor $20-40/月、Copilot $10-19/月 | 见第七章定价表 |
364
+ | 私有化/数据 | 本地部署数据不出域,支持断网 | Cursor/Copilot 主要云端,代码上传 | 见第三章部署对比 |
365
+ | 模型路由 | 多模型 + 本地 Ollama + 国内模型 | Cursor 多家 / Copilot 固定模型 | 见第四章 |
366
+ | 多模态 Agent | 截图/语音/视频/电脑控制 | 部分支持 | 见第六章 |
367
+ | SWE 硬指标 | 自建任务集 80%(真实断言,可复现) | 官方 Verified 成绩(有污染) | 见 13.1 / 13.2 |
368
+
369
+ ### 13.4 待补强(诚实差距)
370
+
371
+ 1. 官方 SWE-bench Verified 500 任务集需 Docker+pytest 环境,本机网络不可达,**尚未实测**(见 13.1 声明)
372
+ 2. 模型后端为第三方(agnes-2.5-flash 等),跑分随后端模型变化,非自有模型成绩
373
+ 3. 自建任务集样本小(5 任务),统计置信度有限,仅作工程基线
374
+
375
+ ---
376
+
377
+ ## 十四、测评声明
378
+
379
+ 本测评基于各产品公开可获取的信息和实际使用体验,评分仅代表测评时点的主观判断,不构成购买建议。产品功能持续迭代,具体以官方最新版本为准。
380
+
381
+ **本测评报告由豆包(Doubao)AI 辅助完成**,包括资料整理、数据对比、分析撰写等环节。
382
+
383
+ ---
384
+
385
+ *飞扬企源研发中心*
386
+ *2026年8月24日*