您现在的位置：Botrun机器人网>> Bot信息 AI技术>>正文内容

开源、免费：谷歌甩出AI编程王炸每天1000次请求，硬刚Claude Code

作者：未知来源：botrun.cn 发布时间：2025年06月26日点击数： 10

智东西6月25日消息，刚刚，谷歌最新发布开源AI智能体Gemini CLI，这款开源智能体将Gemini的能力直接接入终端，能够提供轻量化的Gemini访问通道。Gemini CLI支持通过自然语言实现代码编写、问题调试及工作流优化，还可以作为多功能本地工具，完成内容生成、问题解决、深度研究及任务管理等各类任务。

个体开发者可以通过个人谷歌账号登录获取免费的Gemini Code Assist许可。该许可包含Gemini 2.5 Pro访问权限、100万token的上下文窗口以及60次/分钟、1000次/天的免费请求量。

需要同时运行多个智能体或指定模型的专业开发者，可以选择使用谷歌AI Studio/Vertex AI密钥（按用量计费）或者购买Gemini Code Assist标准版/企业版许可。

▲Gemini CLI免费试用额度（图源：谷歌博客）

01 .

支持自然语言编程

Gemini CLI全流程辅助开发者

对开发者而言，命令行界面（CLI）不仅是工具，更是“主战场”。终端的效率性、普适性与可移植性使命令行界面成为核心生产力工具，开发者对集成AI辅助功能的需求也与日俱增。

Gemini CLI（预览版）可以从代码理解、文件操作到命令执行与动态故障排查的全流程辅助开发者，该工具支持通过自然语言实现代码编写、问题调试及工作流优化。

其核心能力源自以下内置工具：

1、联网搜索：通过谷歌搜索获取网页内容，为模型提供实时外部上下文；

2、协议扩展：支持模型上下文协议（MCP）及捆绑扩展，持续增强功能；

3、指令定制：根据个性化需求和工作流调整提示词模板；

4、脚本集成：支持非交互式调用，实现任务自动化与现有工作流对接。

不只是编程，Gemini CLI还可以作为多功能本地工具，完成内容生成、问题解决、深度研究及任务管理等各类任务，例如使用Veo和Imagen制作关于一只橘猫在澳大利亚冒险故事的短视频：
Gemini CLI采用Apache 2.0开源协议，开发者可随时审查代码实现、验证安全机制。该工具基于MCP等标准构建，支持通过GEMINI.md文件配置系统提示词，并提供个人/团队两级设置。全球开发者可以通过提交漏洞报告、功能建议、安全强化方案及代码优化（GitHub仓库已开放），实现社区共建。

02 .

共享技术底座

Gemini Code Assist可一键调用智能体模式

谷歌此前推出的AI编程助手Gemini Code Assist，现已与Gemini CLI共享技术底座。在VS Code中启用智能体模式后，用户可以输入任意提示词至聊天窗口，Code Assist将自动执行测试编写、错误修复、功能开发、代码迁移等任务，并且还能够基于复杂提示构建多步骤实施方案，自动修正失败路径，并提供解决方案。
Gemini Code Assist的智能体模式现已在Insider通道中免费向所有用户开放（包括免费版、标准版和企业版）。

03 .

结语：谷歌开发者战略蓝图明晰

谷歌此次发布的Gemini CLI开源项目，标志着AI技术向开发者工具领域的进一步渗透。其与Gemini Code Assist的技术底座共享，以及与VS Code等主流开发工具的深度集成，也展现出谷歌在构建AI开发者生态方面的系统性布局。

当前AI辅助开发工具市场竞争日趋激烈，GitHub、Copilot等产品已占据一定市场份额。开源智能体Gemini CLI的推出，既体现了谷歌在AI技术落地应用方面的探索，其对开发者工具市场的战略蓝图逐渐明晰。

继 2 月的 Claude Code 和 4 月的 OpenAI Codex CLI 之后，谷歌也在 6 月推出了 Gemini CLI。至此，三大 AI 实验室都已发布了各自的“终端智能体”工具——这类 CLI 工具可以读取、修改文件，并在终端中代表用户执行命令。

估计不少人原本以为这类终端工具会一直是一个小众方向，但现在看来这是低估了它的潜力——不少开发者每月在 Claude Code 上的花费高达数百美元甚至是数千美元，说明这个“小众市场”其实比预想中大得多、也重要得多。

相对 Claude Code，谷歌在价格方面可谓“豪横”：

使用个人 Google 账号登录，即可免费获得 Gemini Code Assist 许可。这将解锁 Gemini 2.5 Pro 模型和百万 token 上下文窗口。在此次预览期间，谷歌提供业界最宽松的调用配额：每分钟最多 60 次、每天最多 1000 次请求，全部免费。

目前来看，社区对 Gemini CLI 的关注重点集中在其超大免费配额上。评论者直言：“太夸张了，这会给 Anthropic 带来巨大压力。”“确实如此——如果这些调用限制是真的而且免费，那终于有真正的竞争了。”

与 Claude Code 不同，Gemini CLI 和 OpenAI Codex CLI 一样是开源的（使用 Apache 2.0 许可）。并且 Gemini CLI 在不到一天的时间里，获得了 15.1k 星。

Gemini CLI 提供的功能包括代码编写、问题调试、项目管理、文档查询以及代码解释。它还连接了 MCP（模型上下文协议）服务器，具备 Agentic AI 能力。

CLI 工具的优势在于，它可以与任何编辑器或 IDE 搭配使用，而不局限于特定插件支持的工具；同时还支持多实例并发运行。部分开发者也认为，命令行交互效率更高。

Gemini CLI 支持 Mac、Linux（包括 ChromeOS）和 Windows 平台。与 Claude Code 或 Codex 不同的是，Windows 上为原生实现，无需依赖 Windows 子系统（WSL）。开发者可以通过在项目根目录添加一个名为 gemini.md 的文本文件来自定义上下文和参数。谷歌高级工程师 Tayor Mullen 表示，当 CLI 检测到“值得长期保存的细节”时，也会自动将其写入该文件。

因为整体开源，所以我们还可以看到它的 system prompt。

一如既往，这份系统提示词不仅定义了工具行为，也是一份非常精炼准确的使用文档。比如它对代码注释的原则是：

注释：请谨慎添加注释，重点说明“为什么”要这么做，尤其是处理复杂逻辑时，而不是解释“做了什么”。只有在确实能提升可读性或用户明确要求时，才添加高价值注释。请勿修改与你更改无关的注释，也绝不要通过注释与用户交流或说明你的更改。

系统默认使用的技术栈也颇有参考价值。

如果用户没有指定技术偏好，默认建议如下：

Web 前端： React（JavaScript/TypeScript）+ Bootstrap CSS，结合 Material Design 设计规范；

后端 API： Node.js + Express.js 或 Python + FastAPI；

全栈应用： Next.js（React/Node.js）+ Bootstrap + Material Design，或 Python（Django/Flask）+ React/Vue.js 前端；

命令行工具（CLI）： Python 或 Go；

移动 App： Compose Multiplatform（Kotlin）或 Flutter（Dart），用于跨平台开发；也支持 Jetpack Compose（Android）或 SwiftUI（iOS）原生开发；

3D 游戏： HTML/CSS/JavaScript + Three.js；

2D 游戏： HTML/CSS/JavaScript。

胜过专用，

Gemini CLI 靠什么？

Gemini CLI 接入的是谷歌最先进的编码与推理模型 Gemini 2.5 Pro，具备代码理解、文件操作、命令执行和动态故障排查等能力，全面提升命令行的使用体验。用户可以通过自然语言编写代码、调试问题，并优化工作流程。

不仅如此，Gemini CLI 还能基于 MCP 调用其他谷歌服务，在终端中生成图像或视频，实现从编码到创作的一体化体验。

在发布会上展示的一体化演示和背后的技术理念，其实揭示了 Gemini CLI 的关键定位——它不仅是一个写代码的工具，而是一个连接多模态智能、打通编码与创作的“终端智能体”。这一理念也体现在背后所依赖的 Gemini 2.5 Pro 模型选择上。

值得注意的是，Gemini 2.5 Pro 本身并不是为代码任务特别训练的“代码专用模型”，而是一个覆盖更广泛能力边界的通用模型。那么，为何谷歌没有像某些竞争对手那样，专门为 Gemini CLI 打造一个定制化的代码模型？在一场深度访谈中，产品负责人 Connie Fan 和研究负责人 Danny Tarlow 分享了他们的思考。

Connie Fan 表示，虽然特定任务确实可以从专用模型中受益，例如 Cursor 训练的代码补全模型“在非常窄的用例里做得非常好”，但她强调，对于大多数现实世界中的开发任务而言，编码需求往往不局限于代码本身。

例如她提到的一个经典“vibe check”请求：“帮我做一个泰勒·斯威夫特歌曲排行榜 app”——这就需要模型不仅懂代码，还要理解上下文、具备常识，甚至有些 UI/UX 审美。“这些常识背后其实是用户真实的编程需求”，她总结说，“大多数通用任务，并不能从一个纯代码模型中受益。”

Danny Tarlow 则进一步指出：“代码专用模型到底意味着什么？‘代码’已经不仅仅是代码本身，它涵盖了软件开发过程中的各种环节，涉及多种信息源，有些专属于代码，有些则不是。如果只强化代码能力而削弱其他能力，反而会限制模型的表现。我们更倾向于通用模型上的协同发展，寻求不同能力之间的融合和平衡，打造一个‘通才型’模型，这才是更优的发展路径。”

实际上，现在已经有越来越多开发者开始注意到 Gemini 2.5 Pro 在代码生成和理解方面的显著提升。

在 Claude 长期占据主导的讨论氛围中，不少人也开始发出“Gemini 要逆袭了吗？”、“Google 要翻盘了吗？”的声音。社交媒体上，有用户分享了一些开发体验：在一个约 50 万行代码规模的项目中，使用 Claude Code 生成的代码质量“远远不如 CLI + Gemini 2.5 Pro”，要达到同等效果，Claude 需要开发者全程盯着。

还有开发者表示，在 Trae 上使用 Gemini 2.5 Pro 编程的完成率已经大幅超过 Claude 3.7。也有开发者表示 Gemini 修复 bug 的速度明显快于 Claude Code。

一个 3D 渲染的处理问题，让 Claude Code 修了两个小时的 bug 还没解决，结果问 Gemini 2.5 Pro，只用了 5 分钟就搞定了。感觉对于那些看起来难度比较高的问题，可以先让 Gemini 写好详细的说明书，然后再让 Claude Code 按照它来实现，这种组合用法可能会挺不错的。

这些反馈表明，过去一年，谷歌在代码能力上的提升已经进入“质变期”。 Gemini 编码产品负责人 Connie Fan 表示，Gemini 2.5 Pro 之所以能获得良好口碑，关键在于两个方面的系统性演进：“数据”和“方法论”。

从数据的角度看，“代码仓库上下文”变得非常关键。现在模型的目标不再只是做简单的代码补全，而是要理解并修改分布在多个文件、涉及多个模块的大型代码库：“模型要能完成那些你如果花一小时坐下来，在熟悉的代码库上下文中亲自去做的复杂改动。”

为了让模型真正理解这些上下文，谷歌也开始系统性地挖掘内部工程师资源。

其中还包括 Jeff Dean 这样的一些人，“他们代表了一种‘能力新等级’的标准，”Connie 直言，“我们拥有世界上最聪明、最出色、有时也最有主见的十几万工程师。”借助他们在不同语言、技术栈、经验水平上的反馈，谷歌能够覆盖更广泛的使用场景，提升模型在“专业开发者细腻口味”上的匹配能力。“我们过去其实并没有很好地利用这一点，但现在我们开始真正这样做了，而且效果非常惊人。”

从研究角度看，Gemini 团队并未将全部筹码押在“单一大上下文窗口”的方案上，而是探索双路线：一方面持续扩展上下文长度，另一方面发展具有自主搜索、推理能力的 agentic 编程模型，模型以代理的形式与用户交互，甚至具备一定程度的自主性。

正如研究负责人 Danny Tarlow 所描述：

“如果我们把你（人类开发者）丢进一个大代码库里，你会怎么做？你会用代码搜索、看文件结构、点来点去，读点代码再搜索其他信息。agentic 模型就模仿了这种方式。”

更有趣的是，当模型成功处理一个百万行代码库时，用户会感受到一种“魔法般”的惊喜。而这正是 Gemini 2.5 Pro 所在意的方向：不仅是模拟人类的工作方式，更是突破人类经验限制，发展出“非人类”的全新解法。

正因如此，不少开发者开始转而重视起谷歌在这场 AI 编程竞赛中的回归。Gemini 是否“翻盘”尚未可知，但“赶超”的信号，正在越来越清晰。