首页/Gemini API

Gemini开发工具下载Google最新GenAI SDK,支持Interactions API与多语言调用

Gemini API 是 Google 官方提供的开发工具包,集成最新 GenAI SDK,支持 Python、JavaScript、Go、Java 等多语言调用,助开发者快速构建 AI 应用。

gemini-api.py
$ pip install google-genai
Successfully installed google-genai v3.6.0
$ import google.genai as genai
$ client = genai.Client(api_key="YOUR_API_KEY")
$ response = client.models.generate_content(
model="gemini-3.6-flash",
contents="Hello, Gemini!"
)
Response: Hello! How can I assist you today?
↳ Model: gemini-3.6-flash | Latency: 0.8s

多语言 SDK 支持

Gemini API 提供官方 SDK,覆盖主流编程语言,开箱即用

🐍
Python
📜
JavaScript
Java
🔷
Go
🌐
REST API
🟢
Node.js
🔶
C#
🔵
PHP

API 核心能力

Gemini API 提供完整的 AI 能力接口,支持多模态、多轮对话与函数调用

💬

生成式对话

通过 generateContent 接口发送提示词,获取 AI 生成的高质量文本回复。支持多轮上下文对话,保持连贯的对话记忆。

🖼️

多模态输入

同时发送文本、图像、音视频内容进行联合推理。支持图片问答、图表理解、视觉推理等多种多模态任务。

📡

函数调用 (Function Calling)

定义工具函数,让 Gemini 智能决定何时调用外部 API。实现 RAG、数据库查询、代码执行等复杂 AI 工作流。

📜

上下文窗口

Gemini 3.1 Pro 支持 200 万 Token 超长上下文,可一次性处理整本书籍、代码库或长篇文档。

🔄

流式输出

启用 stream=True 获取实时流式响应,边生成边展示,用户体验更流畅。支持 SSE 和 WebSocket 两种方式。

🎯

Interactions API

全新交互式 API,支持更自然的多轮任务执行、进度反馈与中途干预,适合构建复杂 AI Agent 工作流。

🔒

安全过滤

内置内容安全过滤机制,支持自定义安全阈值。可按类别(Hate、Harassment、Sexual、Dangerous)独立配置。

📊

使用量统计

实时查看 API 调用量、Token 消耗、错误率等详细数据。支持导出使用报告,便于成本分析与预算控制。

代码示例

简单几行代码即可接入 Gemini API

Python
JavaScript
Go
from google import genai
from google.genai import types

# 初始化客户端
client = genai.Client(api_key="YOUR_API_KEY")

# 多模态内容生成
response = client.models.generate_content(
model="gemini-3.6-flash",
contents=[
types.Content(
role="user",
parts=[
types.Part(text="分析这张图片"),
types.Part(image=types.Image(
gcs_uri="gs://bucket/image.png"
))
]
)
],
config=types.GenerateContentConfig(
temperature=0.7,
max_output_tokens=2048
)
)
print(response.text)

定价方案

灵活透明的按量计费,适合各种规模的项目

免费

Free Tier

$0
每月
  • Gemini 3.6 Flash
  • 150 RPM 请求限制
  • 150万输入 tokens/月
  • 150万输出 tokens/月
  • 社区支持
获取 API Key
企业

Enterprise

定制
联系销售
  • 无限用量配额
  • 专属模型调优
  • 私有化部署
  • 99.9% SLA 保障
  • 专属客户经理
联系销售

快速开始

四步完成开发环境配置

1

获取 API Key

在 Google AI Studio 注册账号,创建 API Key,用于身份验证

2

安装 SDK

使用 pip / npm / go get 等包管理器安装对应语言的 SDK

3

发送请求

调用 generate_content 接口发送提示词,获取 AI 回复

用户评价

来自开发者社区的真实反馈

"Gemini API 的 Python SDK 设计得非常优雅,两行代码就能完成接入。相比 OpenAI 的接口,Gemini 的多模态支持原生集成,不需要额外处理图片转 base64 的麻烦。"

林志豪
某电商平台 技术负责人

"用 Gemini 的 Function Calling 做了 RAG 系统,效果超出预期。200万 Token 的上下文窗口可以一次塞入整个文档库,不需要做复杂的分块策略。"

陈思远
某 AI 创业公司 CTO

"Interactions API 是个惊喜。构建多轮 Agent 时,它的状态管理和中间干预能力让复杂工作流的实现难度降低了很多。文档写得也很清楚。"

王明
某 SaaS 公司 后端工程师

"Gemini 的定价在同类产品中很有竞争力。Flash 模型的性价比尤其高,批量处理客服工单分析这种高频场景,用 Gemini 比用 Claude 便宜了一半。"

张伟
某客服系统 开发工程师

常见问题

关于 Gemini API 开发工具的常见问题

Gemini API 支持哪些编程语言?SDK 如何安装?
Gemini API 提供官方 SDK 支持 Python、JavaScript(Node.js)、Go、Java 四种语言。此外还提供标准 REST API(HTTP + JSON),理论上任何支持 HTTP 请求的语言都可以接入。安装方式分别为:Python 使用 pip install google-genai;JavaScript 使用 npm install @google/generative-ai;Go 使用 go get google.golang.org/genai 或通过 gosum 安装;Java 使用 Maven/Gradle 添加对应依赖。各语言的 SDK 均提供完整的类型提示和详细文档。
Gemini API 的请求频率限制(RPM)和 Token 限制是多少?
免费层(Free Tier)限制为每分钟 150 次请求(RPM),每月 150 万输入 tokens 和 150 万输出 tokens。付费层(Pay-as-you-go)提升至 1500 RPM,按实际使用的 token 数量计费。不同模型的限制可能不同:Gemini 3.6 Flash 为默认配额,Gemini 3.1 Pro 限额较低,Deep Think 模型需要单独申请配额。如需更高限额,可在 Google AI Studio 中提交配额提升申请。
Interactions API 和普通的 generate_content API 有什么区别?
Interactions API 是 Gemini 新一代的交互式 API,专为复杂 AI Agent 工作流设计。相比 generate_content,Interactions API 支持:多轮任务的中途干预(允许用户在任务执行过程中插入指令);任务状态持久化(无需自行管理对话上下文);分步执行与确认机制(高风险操作可配置需用户确认);进度回调与事件流(实时接收任务执行状态)。适用于需要长期运行、多次工具调用、复杂决策树的 Agent 场景。
API 调用时如何处理图片和音视频等多模态内容?
Gemini 原生支持多模态输入。在 SDK 中可以通过以下方式传递多模态内容:Python SDK 使用 google.genai.types.Part 对象,可传入 text(文本)、inline_data(原始字节数据)或 gcs_uri(Google Cloud Storage 路径)。支持的图片格式包括 JPEG、PNG、WebP、GIF(静态帧)、HEIC,最大单张 20MB。视频支持 MP4、MPEG-TS,最大 50MB,时长不超过 3 分钟。音频支持 WAV、MP3、AAC,最大 15MB。在一次请求中可同时包含多种格式的内容。
Function Calling(函数调用)如何使用?有什么限制?
Function Calling 允许您定义自定义工具函数,Gemini 会根据用户意图智能决定调用哪个函数。首先在请求中通过 tools 参数声明函数定义(使用 OpenAPI Schema 格式)。Gemini 分析后会在响应中返回函数名称和参数(但不执行函数)。您在自己的代码中执行函数后,将结果通过后续请求传回给 Gemini,Gemini 再基于结果生成最终回答。目前最多支持 128 个函数定义,函数结果 token 上限为 32,768。
Gemini API 的数据安全和隐私政策是怎样的?上传的内容会被用于训练吗?
Google 明确承诺:用户通过 API 上传的内容不会被用于改进 Gemini 模型或任何 Google 产品。所有通过 API 处理的数据仅在请求期间使用,处理完成后即被丢弃(符合 Google 数据处理协议 DPA)。企业用户可签署数据处理协议并选择数据驻留区域。API 调用支持 VPC Service Controls,可在 Google Cloud 上建立安全边界,防止数据外泄。
如何监控 API 使用量和成本?有哪些计费细节需要注意?
Google AI Studio 和 Google Cloud Console 提供详细的使用量仪表盘,可查看实时和历史调用量、Token 消耗、平均延迟等指标。计费按输入和输出 token 分别计费,以每百万 tokens 为单位。需要注意:即使请求内容为空,只要调用了 API 就会产生基础费用;上下文缓存(caching)功能可以降低重复内容的成本;批量请求(batch)有单独的定价。建议设置预算警报避免意外超支。
Gemini API 支持私有化部署吗?企业版有哪些专属功能?
Gemini API 支持私有化部署(Gemini Enterprise on Vertex AI),部署在企业自有 Google Cloud 环境或私有数据中心。所有数据完全在企业内部流转,满足严格的合规要求。企业版专属功能包括:专属模型配额和优先排队;模型微调(Fine-tuning)服务;高级安全控制(VPC、CMEK、客户管理的加密密钥);99.9% SLA 保障;专属技术支持团队;自定义模型版本锁定。私有化部署需要与 Google 销售团队联系获取报价。

立即获取 Gemini API 开发工具

集成 Google 最新 GenAI SDK,支持多语言调用与 Interactions API,快速构建 AI 应用。

⬇ 下载开发工具