开源、免费:谷歌甩出AI编程王炸 每天1000次请求,硬刚Claude Code
智东西6月25日消息,刚刚,谷歌最新发布开源AI智能体Gemini CLI,这款开源智能体将Gemini的能力直接接入终端,能够提供轻量化的Gemini访问通道。Gemini CLI支持通过自然语言实现代码编写、问题调试及工作流优化,还可以作为多功能本地工具,完成内容生成、问题解决、深度研究及任务管理等各类任务。
个体开发者可以通过个人谷歌账号登录获取免费的Gemini Code Assist许可。该许可包含Gemini 2.5 Pro访问权限、100万token的上下文窗口以及60次/分钟、1000次/天的免费请求量。
需要同时运行多个智能体或指定模型的专业开发者,可以选择使用谷歌AI Studio/Vertex AI密钥(按用量计费)或者购买Gemini Code Assist标准版/企业版许可。
▲Gemini CLI免费试用额度(图源:谷歌博客)
01 .
支持自然语言编程
Gemini CLI全流程辅助开发者
对开发者而言,命令行界面(CLI)不仅是工具,更是“主战场”。终端的效率性、普适性与可移植性使命令行界面成为核心生产力工具,开发者对集成AI辅助功能的需求也与日俱增。
Gemini CLI(预览版)可以从代码理解、文件操作到命令执行与动态故障排查的全流程辅助开发者,该工具支持通过自然语言实现代码编写、问题调试及工作流优化。
其核心能力源自以下内置工具:
1、联网搜索:通过谷歌搜索获取网页内容,为模型提供实时外部上下文;
2、协议扩展:支持模型上下文协议(MCP)及捆绑扩展,持续增强功能;
3、指令定制:根据个性化需求和工作流调整提示词模板;
4、脚本集成:支持非交互式调用,实现任务自动化与现有工作流对接。
不只是编程,Gemini CLI还可以作为多功能本地工具,完成内容生成、问题解决、深度研究及任务管理等各类任务,例如使用Veo和Imagen制作关于一只橘猫在澳大利亚冒险故事的短视频:
Gemini CLI采用Apache 2.0开源协议,开发者可随时审查代码实现、验证安全机制。该工具基于MCP等标准构建,支持通过GEMINI.md文件配置系统提示词,并提供个人/团队两级设置。全球开发者可以通过提交漏洞报告、功能建议、安全强化方案及代码优化(GitHub仓库已开放),实现社区共建。
02 .
共享技术底座
Gemini Code Assist可一键调用智能体模式
谷歌此前推出的AI编程助手Gemini Code Assist,现已与Gemini CLI共享技术底座。在VS Code中启用智能体模式后,用户可以输入任意提示词至聊天窗口,Code Assist将自动执行测试编写、错误修复、功能开发、代码迁移等任务,并且还能够基于复杂提示构建多步骤实施方案,自动修正失败路径,并提供解决方案。
Gemini Code Assist的智能体模式现已在Insider通道中免费向所有用户开放(包括免费版、标准版和企业版)。
03 .
结语:谷歌开发者战略蓝图明晰
谷歌此次发布的Gemini CLI开源项目,标志着AI技术向开发者工具领域的进一步渗透。其与Gemini Code Assist的技术底座共享,以及与VS Code等主流开发工具的深度集成,也展现出谷歌在构建AI开发者生态方面的系统性布局。
当前AI辅助开发工具市场竞争日趋激烈,GitHub、Copilot等产品已占据一定市场份额。开源智能体Gemini CLI的推出,既体现了谷歌在AI技术落地应用方面的探索,其对开发者工具市场的战略蓝图逐渐明晰。
继 2 月的 Claude Code 和 4 月的 OpenAI Codex CLI 之后,谷歌也在 6 月推出了 Gemini CLI。至此,三大 AI 实验室都已发布了各自的“终端智能体”工具——这类 CLI 工具可以读取、修改文件,并在终端中代表用户执行命令。
估计不少人原本以为这类终端工具会一直是一个小众方向,但现在看来这是低估了它的潜力——不少开发者每月在 Claude Code 上的花费高达数百美元 甚至是数千美元,说明这个“小众市场”其实比预想中大得多、也重要得多。
相对 Claude Code,谷歌在价格方面可谓“豪横”:
使用个人 Google 账号登录,即可免费获得 Gemini Code Assist 许可。这将解锁 Gemini 2.5 Pro 模型和百万 token 上下文窗口。在此次预览期间,谷歌提供业界最宽松的调用配额:每分钟最多 60 次、每天最多 1000 次请求,全部免费。
目前来看,社区对 Gemini CLI 的关注重点集中在其超大免费配额上。评论者直言:“太夸张了,这会给 Anthropic 带来巨大压力。”“确实如此——如果这些调用限制是真的而且免费,那终于有真正的竞争了。”
与 Claude Code 不同,Gemini CLI 和 OpenAI Codex CLI 一样是开源的(使用 Apache 2.0 许可)。并且 Gemini CLI 在不到一天的时间里,获得了 15.1k 星。
Gemini CLI 提供的功能包括代码编写、问题调试、项目管理、文档查询以及代码解释。它还连接了 MCP(模型上下文协议)服务器,具备 Agentic AI 能力。
CLI 工具的优势在于,它可以与任何编辑器或 IDE 搭配使用,而不局限于特定插件支持的工具;同时还支持多实例并发运行。部分开发者也认为,命令行交互效率更高。
Gemini CLI 支持 Mac、Linux(包括 ChromeOS)和 Windows 平台。与 Claude Code 或 Codex 不同的是,Windows 上为原生实现,无需依赖 Windows 子系统(WSL)。开发者可以通过在项目根目录添加一个名为 gemini.md 的文本文件来自定义上下文和参数。谷歌高级工程师 Tayor Mullen 表示,当 CLI 检测到“值得长期保存的细节”时,也会自动将其写入该文件。
因为整体开源,所以我们还可以看到它的 system prompt。
一如既往,这份系统提示词不仅定义了工具行为,也是一份非常精炼准确的使用文档。比如它对代码注释的原则是:
注释: 请谨慎添加注释,重点说明“为什么”要这么做,尤其是处理复杂逻辑时,而不是解释“做了什么”。只有在确实能提升可读性或用户明确要求时,才添加高价值注释。请勿修改与你更改无关的注释,也绝不要通过注释与用户交流或说明你的更改。
系统默认使用的技术栈也颇有参考价值。
如果用户没有指定技术偏好,默认建议如下:
Web 前端: React(JavaScript/TypeScript)+ Bootstrap CSS,结合 Material Design 设计规范;
后端 API: Node.js + Express.js 或 Python + FastAPI;
全栈应用: Next.js(React/Node.js)+ Bootstrap + Material Design,或 Python(Django/Flask)+ React/Vue.js 前端;
命令行工具(CLI): Python 或 Go;
移动 App: Compose Multiplatform(Kotlin)或 Flutter(Dart),用于跨平台开发;也支持 Jetpack Compose(Android)或 SwiftUI(iOS)原生开发;
3D 游戏: HTML/CSS/JavaScript + Three.js;
2D 游戏: HTML/CSS/JavaScript。
胜过专用,
Gemini CLI 靠什么?
Gemini CLI 接入的是谷歌最先进的编码与推理模型 Gemini 2.5 Pro,具备代码理解、文件操作、命令执行和动态故障排查等能力,全面提升命令行的使用体验。用户可以通过自然语言编写代码、调试问题,并优化工作流程。
不仅如此,Gemini CLI 还能基于 MCP 调用其他谷歌服务,在终端中生成图像或视频,实现从编码到创作的一体化体验。
在发布会上展示的一体化演示和背后的技术理念,其实揭示了 Gemini CLI 的关键定位——它不仅是一个写代码的工具,而是一个连接多模态智能、打通编码与创作的“终端智能体”。这一理念也体现在背后所依赖的 Gemini 2.5 Pro 模型选择上。
值得注意的是,Gemini 2.5 Pro 本身并不是为代码任务特别训练的“代码专用模型”,而是一个覆盖更广泛能力边界的通用模型。那么,为何谷歌没有像某些竞争对手那样,专门为 Gemini CLI 打造一个定制化的代码模型?在一场深度访谈中,产品负责人 Connie Fan 和研究负责人 Danny Tarlow 分享了他们的思考。
Connie Fan 表示,虽然特定任务确实可以从专用模型中受益,例如 Cursor 训练的代码补全模型“在非常窄的用例里做得非常好”,但她强调,对于大多数现实世界中的开发任务而言,编码需求往往不局限于代码本身。
例如她提到的一个经典“vibe check”请求:“帮我做一个泰勒·斯威夫特歌曲排行榜 app”——这就需要模型不仅懂代码,还要理解上下文、具备常识,甚至有些 UI/UX 审美。“这些常识背后其实是用户真实的编程需求”,她总结说,“大多数通用任务,并不能从一个纯代码模型中受益。”
Danny Tarlow 则进一步指出:“代码专用模型到底意味着什么?‘代码’已经不仅仅是代码本身,它涵盖了软件开发过程中的各种环节,涉及多种信息源,有些专属于代码,有些则不是。如果只强化代码能力而削弱其他能力,反而会限制模型的表现。我们更倾向于通用模型上的协同发展,寻求不同能力之间的融合和平衡,打造一个‘通才型’模型,这才是更优的发展路径。”
实际上,现在已经有越来越多开发者开始注意到 Gemini 2.5 Pro 在代码生成和理解方面的显著提升。
在 Claude 长期占据主导的讨论氛围中,不少人也开始发出“Gemini 要逆袭了吗?”、“Google 要翻盘了吗?”的声音。社交媒体上,有用户分享了一些开发体验:在一个约 50 万行代码规模的项目中,使用 Claude Code 生成的代码质量“远远不如 CLI + Gemini 2.5 Pro”,要达到同等效果,Claude 需要开发者全程盯着。
还有开发者表示,在 Trae 上使用 Gemini 2.5 Pro 编程的完成率已经大幅超过 Claude 3.7。也有开发者表示 Gemini 修复 bug 的速度明显快于 Claude Code。
一个 3D 渲染的处理问题,让 Claude Code 修了两个小时的 bug 还没解决,结果问 Gemini 2.5 Pro,只用了 5 分钟就搞定了。感觉对于那些看起来难度比较高的问题,可以先让 Gemini 写好详细的说明书,然后再让 Claude Code 按照它来实现,这种组合用法可能会挺不错的。
这些反馈表明,过去一年,谷歌在代码能力上的提升已经进入“质变期”。 Gemini 编码产品负责人 Connie Fan 表示,Gemini 2.5 Pro 之所以能获得良好口碑,关键在于两个方面的系统性演进:“数据”和“方法论”。
从数据的角度看,“代码仓库上下文”变得非常关键。现在模型的目标不再只是做简单的代码补全,而是要理解并修改分布在多个文件、涉及多个模块的大型代码库:“模型要能完成那些你如果花一小时坐下来,在熟悉的代码库上下文中亲自去做的复杂改动。”
为了让模型真正理解这些上下文,谷歌也开始系统性地挖掘内部工程师资源。
其中还包括 Jeff Dean 这样的一些人,“他们代表了一种‘能力新等级’的标准,”Connie 直言,“我们拥有世界上最聪明、最出色、有时也最有主见的十几万工程师。”借助他们在不同语言、技术栈、经验水平上的反馈,谷歌能够覆盖更广泛的使用场景,提升模型在“专业开发者细腻口味”上的匹配能力。“我们过去其实并没有很好地利用这一点,但现在我们开始真正这样做了,而且效果非常惊人。”
从研究角度看,Gemini 团队并未将全部筹码押在“单一大上下文窗口”的方案上,而是探索双路线:一方面持续扩展上下文长度,另一方面发展具有自主搜索、推理能力的 agentic 编程模型,模型以代理的形式与用户交互,甚至具备一定程度的自主性。
正如研究负责人 Danny Tarlow 所描述:
“如果我们把你(人类开发者)丢进一个大代码库里,你会怎么做?你会用代码搜索、看文件结构、点来点去,读点代码再搜索其他信息。agentic 模型就模仿了这种方式。”
更有趣的是,当模型成功处理一个百万行代码库时,用户会感受到一种“魔法般”的惊喜。而这正是 Gemini 2.5 Pro 所在意的方向:不仅是模拟人类的工作方式,更是突破人类经验限制,发展出“非人类”的全新解法。
正因如此,不少开发者开始转而重视起谷歌在这场 AI 编程竞赛中的回归。Gemini 是否“翻盘”尚未可知,但“赶超”的信号,正在越来越清晰。
![]() |
![]() |
![]() |
![]() |
![]() |
![]() |
![]() |
![]() |
感动 | 同情 | 无聊 | 愤怒 | 搞笑 | 难过 | 高兴 | 路过 |
相关文章
-
没有相关内容