AI万址
Genie

Genie

Genie是Cosine推出的自主型AI软件工程师,接管从GitHub工单到可评审PR的全流程。本文评测其多智能体并行、语义代码索引、Slack集成、定价与适用团队。

Genie
访问官网
基本信息详情
开发公司Cosine(英国伦敦,Y Combinator 孵化)
上线时间2024 年 8 月(Genie 模型首发)
官网https://cosine.sh/genie
支持平台Web 平台、桌面 Workbench、CLI、VS Code 扩展;集成 GitHub、Jira、Linear、Slack
价格免费版 80 任务/100 项目;Starter 约 $19/月;Team、Enterprise 面议
核心定位自主型 AI 软件工程师,从工单到可评审 PR 全流程接管

Genie 是 Cosine 公司推出的自主型 AI 软件工程师。说"AI 编程助手"其实不太准确——它不补全你正在敲的那行代码,而是接走一整张工单:读代码库、拆任务、写代码、跑测试,最后给你一个带证据的 diff,等你 review 后合并。

我们把它和 Devin、Cursor 放一起测过。差别在哪?Genie 的设计哲学是"留给人评审"。它跑的是研究→规划→实现→验证→移交这套多阶段循环,每一步都留痕。你不是盯着它逐行写,而是异步回来收活。这种模式特别适合 backlog 长到 100+ 的团队——把脏活累活丢给它,你专注架构和决策。

2024 年 8 月,Cosine 拿到 250 万美元种子轮,Y Combinator 背书。Genie 模型在 SWE-Lancer 基准上拿到 72%(237 个真实任务,总价值 23.6 万美元),SWE-Bench 上 30%。但得说清楚:这些是公司自报数据,并未出现在 SWE-Bench 官方榜单上。实测里它确实能独立处理 bug 修复、加功能、重构、生成测试这几类活,但"完全自主"是营销话术——产出仍需人工合并。

核心功能

01

多智能体并行执行

Genie 把一个任务拆成带依赖关系的子任务,多个 agent 并行跑。Cloud 模式下你能同时排队多张工单,回来一起 review。一个 sprint 里它能并行啃掉一批积压。

02

语义代码索引

它先把你的仓库索引一遍,建立文件关系和函数调用图。改一个接口时,它知道下游哪些地方会受影响。对大型 monorepo 来说,这点比只会读单文件的工具有实质差距。

03

@Genie in Slack

在 Slack 里 @Genie 直接派活,不用切工具。工单掉了就当场处理,不进 backlog 等下一轮。这是我们在调研里最喜欢的细节之一——它贴近真实工程师协作方式。

04

AutoDoc 2.0

文档跟着 commit 走。代码改了,文档自动更新。大部分团队的文档腐化问题,这里算是个解法。

05

CI 尊重与异步迭代

Genie 会读 reviewer 的评论并响应,同时始终遵守你的 CI 规则。集成 Vercel 后连预览部署都能自动跑,你 review 时直接看线上预览,不用本地拉代码。

适合谁

适合:中大型工程团队、monorepo 维护者、backlog 堆积到清不完的 squad。如果你有一堆"重要但不紧急"的技术债和 bug,Genie 能异步帮你啃。

不适合:想要行内补全体验的开发者(那是 Cursor 的活);对数据完全不离场有硬性合规要求的场景;期望完全无人值守交付的团队——它本质上是有监督的 agent,最后一公里必须人审。

同类竞品对比

维度Genie (Cosine)Devin (Cognition)Cursor
形态自主 agent,异步交付 diff自主 agent,端到端任务IDE 内 AI 副驾
评审机制diff + 证据,人工合并任务级交付实时编辑
集成GitHub/Jira/Linear/Slack偏独立执行VS Code 生态
价格免费起步,$19/月 Starter较高,企业导向$20/月 Pro
适合场景积压清理、异步并行长链路任务日常编码

FAQ

Q

Genie 真的完全自主吗?

A

不是。它跑完会给你一个 diff 加证据,等你 review 合并。"fully agentic"是营销词,实际是有监督的——这正是它能在真实 merge 流程里落地的原因。

Q

Genie 和 Lumen 是什么关系?

A

Genie 是 Cosine 原始的模型品牌。后来模型家族更名为 Lumen,公司也开始往英国主权 AI 方向扩展。但 cosine.sh/genie 这个产品页仍在运营,编码产品可用,Genie 这个名字目前可以当作产品的对外品牌。

Q

SWE-Bench 30% 这个数字可信吗?

A

30% 是公司自报,没上官方榜单。SWE-Lancer 的 72% 同理。建议拿你自己的真实任务跑一遍再决定是否迁移工作流。

Q

免费版够用吗?

A

免费版 80 任务、100 项目,试水够。真要清 backlog,Starter 的额度更现实。

Q

能处理哪种代码库?

A

它索引后能处理大型复杂代码库,monorepo 也能跑。但初始集成配置要花点时间,第一次接仓库别期望秒开。

更新动态

客户评论

汇总评分约 4.8/5(Product Hunt 等渠道,样本 11 条)。VentureBeat 评价它在复杂任务上"接近人类推理"。

"大型代码库的积压清理明显提速,context switching 少了很多。"——Reddit 开发者反馈

"异步回来收 diff 的模式很合真实 merge 流程,比盯着一行行写省心。"——Product Hunt 用户

参考来源