Lovable 和 Windsurf 跻身使用 Gemini-Powered Google Cloud 基础设施的 AI 初创公司
已更新:6月18日

为什么这很重要
在 Google Cloud Next 2025 上,该公司强调 AI 初创公司 Lovable 和 Windsurf 目前正通过 Google Cloud 基础设施在 Gemini 2.5 Pro 上运行 AI 编码工作负载。这一简短的发布不仅仅是一个营销时刻:它标志着云服务提供商正如何将大模型、硬件和开发者工具打包成开箱即用的平台,以便初创公司能够快速采用。
对于初创公司创始人和工程负责人来说,实际的启示非常直接:供应商正将生成式代码视为一等公民工作负载。Google Cloud 的这一举措——通过 Next 2025 的产品演示和媒体报道得到加强——将新的 Gemini 2.5 Pro 模型系列与 Ironwood 产品、推理端点和 MLOps 集成等托管服务联系起来,旨在减少团队构建编码助手和自动化代码工作流时的操作摩擦。了解 TechRadar 对 Next 发布会和产品定位的现场报道。
这在三个方面至关重要。首先,它影响工程速度:当模型托管、自动扩展和可观测性作为托管服务提供时,初创公司可以更快地原型化并扩展以代码为中心的 AI。其次,它塑造了供应商竞争——像 Lovable 和 Windsurf 这样的成功案例是 Google Cloud 希望吸引更多初创公司脱离 AWS 和 Azure 的营销信号。第三,它标志着 Gemini 2.5 Pro 的采用路径已超越实验阶段,进入商业条款下的生产级编码工作负载。总结这些客户新增情况的报道也出现在 行业综述和专注于初创公司的媒体报道中.
Lovable 和 Windsurf 正在使用的 Gemini 驱动型 Google Cloud 功能

针对代码工作负载的 Gemini 2.5 Pro 模型集成
Google Cloud 将 Gemini 2.5 Pro 定位为专为重型代码生成工作负载量身定制的模型系列,Next 2025 的公告强调,Lovable 和 Windsurf 等初创公司已将其代码助手和代码推理流水线迁移到该模型层级。Dataconomy 的报道明确指出 Gemini 2.5 Pro 是为这些新客户提供支持的模型。在实践中,模型集成意味着初创公司可以访问托管推理端点和 SDK,这些工具旨在输入代码提示、接收结构化输出并运行评估循环,而无需管理原始模型二进制文件。
Ironwood 和托管 AI 功能
Ironwood 被呈现为一套平台功能,结合了优化的硬件分配、自动扩缩逻辑和模型运维(model ops)集成,旨在降低部署大型模型的运营成本。Google 在 Next 大会上的演讲将基于 Ironwood 的服务框架描述为推理端点、监控和持续评估的支柱,适用于生成式 AI 工作负载 —— 从而有效地将 MLOps 的部分环节从定制化工程工作转变为托管产品。TechRadar 对 Next 2025 的现场报道指出了演示和主题演讲中的这些产品主题。
洞察:对于初创公司而言,托管平台改变了风险评估逻辑 —— 你以牺牲部分控制权为代价,换取更快的上市时间和早期阶段更少的运维人员需求。
面向初创公司的工具链和开发者体验
Google Cloud 不仅仅提供原始模型和算力。该公司还捆绑了用于代码生成、测试和评估的预构建流水线,以及针对初创公司的开发者 SDK 和入驻支持。云初创公司计划旨在通过额度支持、合作伙伴集成和技术协助来加速入驻流程,以便团队在投入持续支出之前验证产品与市场的匹配度。
这种组合至关重要:初创公司通常需要快速的迭代周期、自动化评估工具(单元测试生成、Lint 检查、语义检查)以及对模型漂移的可观测性 —— 而一个将模型托管、CI 流水线和告警系统缝合在一起的平台能更好地满足所有这些需求。
核心结论: Google Cloud 正在为 代码 AI 初创公司 销售一套打包好的开发者体验 —— 使用 Gemini 2.5 Pro 进行推理,使用 Ironwood 保证运行时可靠性,并通过初创公司计划实现快速入驻。
Google Cloud 上 Gemini 2.5 Pro 的规格与性能详情

Gemini 2.5 Pro 为代码生成带来了什么
与之前的 Gemini 版本相比,Gemini 2.5 Pro 被定位为具有更大容量和推理优化的 Pro 级模型。虽然 Google 在引用的文章中尚未发布详尽的公开基准测试,但在 Next 2025 的产品简报和演示中,强调了专门针对代码任务的更低延迟和更高吞吐量——当交互式编码助手需要实时响应时,这类改进至关重要。TechRadar 的现场报道记录了这些演示声明和产品定位。
需要明确的是,“Pro 级”意味着架构规模(更多参数和训练数据)、分词器(tokenizer)和解码改进(减少幻觉并提高代码正确性)以及用于更快自回归解码的优化运行时路径的结合。这些是常用于提升代码模型性能的技术手段,也是 2.5 Pro 叙事的核心。
基础设施规格与自动扩缩容
性能表现既取决于模型改进,也取决于基础设施。Google Cloud 将 Gemini 2.5 Pro 部署在托管的 GPU/TPU、用于模型权重的网络存储以及根据需求匹配推理能力的自动扩缩容功能之上。Ironwood 在此充当编排层——将请求路由到适当配置的加速器,并在流量高峰期间调整资源池。Google Cloud 的初创公司和生成式 AI 博客系列描述了初创公司正在采用的托管推理和 MLOps 集成。
弹性对于代码工作负载至关重要,因为流量具有突发性:产品演示期间的交互式使用或大型内部测试套件的运行可能会导致使用量在数分钟或数小时内激增。托管式自动扩缩(Managed autoscaling)减轻了对持续过度配置的需求,同时保持了最终用户的响应速度。
性能权衡与客户实证
公开报道强调了实际的权衡:迁移到 Google Cloud 上 Gemini 2.5 Pro 的初创公司报告称,与旧版 Gemini 变体相比,代码生成的响应速度和吞吐量更高,但这些文章中并未披露确切的数据(如单次请求延迟或每秒 token 数)。已有记录的是客户的采用情况和积极的轶事反馈:转向托管式 Gemini 端点简化了运营,并提高了指定初创公司从原型到生产的速度。Dataconomy 的报道总结了这些采用细节。
在运营方面,团队可以预见:
使用专业级推理引擎可获得更低的交互延迟。
在跨托管端点进行批处理或并行化请求时,吞吐量得到提升。
需要调整成本控制,因为高吞吐量的代码生成可能会增加云端支出。
核心结论:Gemini 2.5 Pro 结合 Ironwood 支持的自动扩缩容,在交互性能与运维简便性之间找到了平衡点——但团队仍需针对成本和可观测性进行架构设计。
Gemini 驱动的 Google Cloud 的准入资格、发布时间线及价格信号
针对初创企业的发布背景与可用性
Lovable 和 Windsurf 的加入是在 2025 年 9 月的 Google Cloud Next 活动期间宣布的,这表明 Gemini 2.5 Pro 与 Ironwood 支持的服务组合已通过 Google Cloud 的既有渠道向初创企业开放。公开声明和针对初创企业的博客文章将其定位为推动托管式生成式 AI 栈 进一步向早期公司普及的更广泛举措的一部分。
访问通常遵循计划注册、合作伙伴推荐或与 Google Cloud 销售团队的直接商业洽谈。公告暗示这些并非仅限 beta 测试的实验;它们属于正式发布(GA)的产品层级,尽管提供了定制化的入门引导。
准入资格、支持路径及实际入门引导
初创企业可以预期几种注册路径:通过 Google Cloud 初创企业计划直接签约、通过 ISV 或系统集成商进行的合作伙伴主导型集成,或者如果初创企业的用量需求较高,则采用类似企业的定制合同。初创企业计划通常包括额度、技术指导和优先支持,以加速迁移和验证。
实际的入门引导包括针对测试套件验证模型输出、与 CI/CD 集成,以及为推理调用建立可观测性。Google Cloud 的托管服务旨在通过提供预构建的评估流水线和检测工具来缩短这一路径。
价格信号与谈判预期
关于 Lovable 和 Windsurf 获胜的公开报道并未公布 Gemini 2.5 Pro 的每小时或每 token 定价。相反,报告强调了包含额度、数量折扣和定制合同的协商企业/初创公司协议。来自新闻聚合器和 CMS 帖子的报道重申,Pro 级模型的定价通常由销售决定,并根据使用情况和合同条款而异。请参阅 CMS Article Factory 关于这些客户公告的报道。
对于初创公司规划:
在初始采用期间,预计需要就额度和批量定价进行谈判。
围绕 token 数量、推理延迟要求和预期并发量构建成本模型。
利用 Google Cloud 初创公司资源来降低初始支出,并在扩展前验证架构。
洞察:早期试点是获得优惠定价的最强杠杆;在谈判时应携带具体的用量预测和分阶段扩展计划。
Gemini on Google Cloud 的对比情况及其在实践中的意义

与早期 Gemini 版本的区别及竞争定位
Gemini 2.5 Pro 代表了在早期 Gemini 版本基础上的增量但有意义的进步:更大的模型容量、优化的推理路径以及更深层的部署平台集成。Next 大会的媒体报道及后续报告将 2.5 Pro 定位为面向生产工作负载的性能导向层级,而早期版本则更多是对广泛多模态能力的探索。TechCrunch 关于 AI 初创公司如何推动 Google Cloud 增长的报道,将这些产品升级置于商业语境中。。
在竞争对手面前,Google Cloud 推出了差异化的组合方案:集成模型托管、Ironwood 编排以及初创公司入驻计划。AWS 和 Azure 依然是强劲的对手:各自拥有深厚的企业关系、广泛的服务生态系统以及自有的模型托管产品。分析师指出,虽然 Google Cloud 的宣传强调开发者体验和代码任务的模型易用性,但 AWS 和 Azure 可能在定价灵活性、更广泛的合作伙伴生态系统或现有企业合同方面胜出。追踪云竞争和 AI 采用趋势的媒体对这些行业动态进行了综合报道。Complete AI Training 总结了 Google Cloud 在招揽初创客户方面的战略性胜利。。
Lovable 和 Windsurf 的实践:入驻故事与开发者影响
Lovable 和 Windsurf 引用的用例集中在代码生成、自动化代码审查和产品内编码助手。这些工作负载展示了一类特定的生成式 AI 应用,其中延迟、正确性和确定性行为至关重要。Dataconomy 的报道强调了这些初创公司如何利用基于 Gemini 的端点来处理编码工作负载。
报告中提到的开发者生产力提升包括:
更快的迭代:团队可以测试模型驱动的功能,而无需管理模型服务基础设施。
简化的 MLOps:内置端点和监控减少了模型版本控制和回滚的工程工作量。
运营收益:得益于自动扩缩容和托管运行时,与容量配置错误相关的运营事件更少。
从产品角度来看,发布编码助手需要稳健的评估:单元测试生成、安全 lint 检查以及精确的 API 级输出。Google Cloud 的捆绑工具减少了这些组件的集成时间。
对 Google Cloud 及更广泛生态系统的业务影响
Lovable 和 Windsurf 等客户的成功为 Google Cloud 提供了两个战略目标。首先,它们验证了 Gemini/ Ironwood 技术栈在以开发者为核心的初创公司群体中的产品市场契合度。其次,它们创建了案例研究,以影响更大型的企业交易,在这些交易中,类似的编码 AI 用例可能会在全企业范围采用之前先进行小规模测试。IndexBox 和 TechCrunch 的报道将这些胜利置于 Google Cloud 更广泛的增长叙事中,这表明初创公司对云业务收入的增长势头做出了实质性贡献。
即便如此,这些只是早期的商业指标,而非长期主导地位的证明。市场份额的动态将继续反映各云平台之间的定价、合作伙伴生态系统以及跨产品集成。
核心结论:在 Google Cloud 上选择 Gemini 是在高度集成、以开发者为中心的平台与 AWS 和 Azure 提供的更广泛生态系统或定价方案之间进行权衡。
FAQ —— 关于采用 Gemini 驱动的 Google Cloud 的实际问题

像 Lovable 和 Windsurf 这样的初创公司可以立即访问 Gemini 2.5 Pro 吗?
报道显示,入驻大约发生在 Google Cloud Next 2025 前后,可以通过云平台的初创公司计划、合作伙伴渠道或直接的商业合作进行访问。立即访问可能仍需要注册或达成协议。查看有关这些客户公告和 Google Cloud 初创公司宣传的报道。
Gemini 2.5 Pro 在代码生成方面提供了哪些具体的性能提升?
公开文章强调了在演示和客户报告中延迟的降低和吞吐量的提高,但尚未发布详细的基准测试数据。与实验中使用的早期 Gemini 模型实例相比,预计交互响应速度会有所提高,扩展特性也会更好。TechRadar 在 Next 2025 上捕捉到了产品和演示声明。
Gemini 2.5 Pro 在 Google Cloud 上如何计费?
Pro 级模型的定价通常需要协商。新闻报道和行业总结指出,初创公司通常会获得额度、批量折扣和定制的合同条款,而不是透明的按小时公开定价。初创公司应计划联系 Google Cloud 销售或合作伙伴渠道以获取商业条款。请参阅 CMS Article Factory 关于客户成功案例的报道中的背景信息。
Google Cloud 如何处理生产级代码生成系统的扩展和模型运维(model ops)?
Google Cloud 利用 Ironwood、托管推理端点和 MLOps 集成来自动执行大模型推理的自动扩展、路由和可观测性。这些服务旨在处理突发性的代码生成工作负载,同时提供模型版本控制和监控功能。Google Cloud 的生成式 AI 初创公司博客解释了通常提供的运营工具。
初创公司是否应该选择 Google Cloud 上的 Gemini,而非 AWS 或 Azure 的选项?
这取决于优先级。Google Cloud 上的 Gemini 强调集成的开发者工具、托管模型运维以及针对代码工作负载的高性能 Pro 层级。AWS 和 Azure 可能在定价灵活性、现有企业生态系统或特定集成方面更具优势。团队在做出决定前,应进行试点测试以衡量延迟、单次推理成本和集成摩擦。TechCrunch 对云竞争和初创公司采用情况的分析为这一决策提供了背景参考。
团队在采用由 Gemini 驱动的服务时,应规划哪些运营风险?
运营风险包括高吞吐量工作负载带来的意外成本、对单一云提供商模型服务的依赖,以及需要通过稳健的测试来捕捉代码生成中的模型退化。采用分阶段发布、合成负载测试和多账号成本控制可以降低这些风险。来自 Google Cloud 的相关产品工具可以简化此过程中的可观测性。Dataconomy 和 Google Cloud 初创公司文章概述了采用注意事项和入驻支持。
Gemini 驱动的 Google Cloud 初创公司的未来前景
短期来看,像 Lovable 和 Windsurf 这样的成功案例证实了 Google Cloud 的战略——即结合 Gemini 2.5 Pro、Ironwood 编排和对初创公司友好的入门流程——在开发者工具细分市场中引起了共鸣。这些早期采用者展示了一条可预测的路径:在托管端点上孵化功能,通过额度支持和试点项目验证产品市场匹配度,然后在需求稳定时进行规模化。
展望未来两到三年,预计会出现几个合理的进展。首先,模型托管选择将变得更加模块化:初创公司可能会要求混合部署,将敏感数据保留在私有集群中,同时利用公有云推理进行扩展。其次,来自 AWS 和 Azure 的竞争压力将加速价格竞争,并创造更丰富的跨云工具,促使云提供商为专业级模型提供更清晰、基于使用量的定价。第三,MLOps 将进一步针对代码工作负载进行专业化,在模型生命周期中集成更多针对正确性、安全 lint 检查和许可证合规性检查的自动化评估工具。
这些趋势伴随着权衡。托管平台缩短了上市时间,但增加了供应商锁定风险,并可能掩盖单次调用的经济成本。性能声明——即使有演示视频支持——也很少能完整说明每种工作负载的真实情况。初创公司必须在速度与灵活性之间取得平衡,以便在经济或监管约束发生变化时,能够移动或以多云架构设计其推理路径。
对于构建者和技术领导者来说,实际姿态应该是机会主义的务实。在 Gemini 2.5 Pro 上运行简短且经过良好监测的试点,以衡量延迟、吞吐量和错误模式。利用这些实验作为商业谈判中争取额度和可预测定价的筹码。并将 MLOps 规范(版本控制、测试、可观测性)作为任何部署计划的核心,以免模型升级或退化演变成产品事故。
最终,Lovable 和 Windsurf 的发布不仅仅是公关:它们是更广泛市场实验的证明点,即关于代码生成模型将如何作为服务交付。在未来几年,随着模型、运行时和定价的成熟,获胜者将是那些将清晰的实证评估与产品纪律相结合的团队,以及那些在不隐瞒经济成本的情况下提供一致性能的云平台。如果你正在构建面向开发者的 AI,现在是智能试点、快速学习并利用这些经验来协商技术架构和商业条款的时机,从而让你在没有意外的情况下实现规模化。



