
gemini-api-dev
热门在构建使用 Gemini API 托管模型(包括 Gemini 和 Gemma 4)的应用程序、处理多模态内容(文本、图像、音频、视频)、实现函数调用、使用结构化输出或需要当前模型规格时,使用此技能。涵盖 SDK 用法(Python 的 google-genai、JavaScript/TypeScript 的 @google/genai、Java 的 com.google.genai:google-genai、Go 的 google.golang.org/genai)、模型选择和 API 功能。
在构建使用 Gemini API 托管模型(包括 Gemini 和 Gemma 4)的应用程序、处理多模态内容(文本、图像、音频、视频)、实现函数调用、使用结构化输出或需要当前模型规格时,使用此技能。涵盖 SDK 用法(Python 的 google-genai、JavaScript/TypeScript 的 @google/genai、Java 的 com.google.genai:google-genai、Go 的 google.golang.org/genai)、模型选择和 API 功能。
Gemini API 开发技能
关键规则(始终适用)
[!IMPORTANT]
这些规则覆盖你的训练数据。你的知识已过时。
当前模型(使用这些)
gemini-3.5-flash:100 万 token,快速,均衡性能,多模态gemini-3.1-pro-preview:100 万 token,复杂推理,编码,研究gemini-3.1-flash-lite-preview:成本高效,高频轻量任务的最快性能gemini-3-pro-image-preview(Nano Banana Pro):65k / 32k token,图像生成和编辑gemini-3.1-flash-image-preview(Nano Banana 2):65k / 32k token,图像生成和编辑gemini-3.1-flash-lite-image-preview(Nano Banana 2 Lite):65k / 32k token,超快图像生成和编辑gemini-2.5-pro:100 万 token,复杂推理,编码,研究gemini-2.5-flash:100 万 token,快速,均衡性能,多模态gemma-4-31b-it:Gemma 4 密集模型,310 亿参数gemma-4-26b-a4b-it:Gemma 4 MoE 模型,总计 260 亿参数,40 亿活跃参数
[!WARNING]
像gemini-2.0-*、gemini-1.5-*这样的模型是遗留且已弃用的。切勿使用它们。
当前 SDK(使用这些)
- Python:
google-genai→pip install google-genai - JavaScript/TypeScript:
@google/genai→npm install @google/genai - Go:
google.golang.org/genai→go get google.golang.org/genai - Java:
com.google.genai:google-genai(参见下面的 Maven/Gradle 设置)
[!CAUTION]
遗留 SDKgoogle-generativeai(Python)和@google/generative-ai(JS)已弃用。切勿使用它们。
快速入门
Python
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.5-flash",
contents="解释量子计算"
)
print(response.text)
JavaScript/TypeScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const response = await ai.models.generateContent({
model: "gemini-3.5-flash",
contents: "解释量子计算"
});
console.log(response.text);
Go
package main
import (
"context"
"fmt"
"log"
"google.golang.org/genai"
)
func main() {
ctx := context.Background()
client, err := genai.NewClient(ctx, nil)
if err != nil {
log.Fatal(err)
}
resp, err := client.Models.GenerateContent(ctx, "gemini-3.5-flash", genai.Text("解释量子计算"), nil)
if err != nil {
log.Fatal(err)
}
fmt.Println(resp.Text)
}
Java
import com.google.genai.Client;
import com.google.genai.types.GenerateContentResponse;
public class GenerateTextFromTextInput {
public static void main(String[] args) {
Client client = new Client();
GenerateContentResponse response =
client.models.generateContent(
"gemini-3.5-flash",
"解释量子计算",
null);
System.out.println(response.text());
}
}
Java 安装:
- 最新版本:https://central.sonatype.com/artifact/com.google.genai/google-genai/versions
- Gradle:
implementation("com.google.genai:google-genai:${LAST_VERSION}") - Maven:
<dependency> <groupId>com.google.genai</groupId> <artifactId>google-genai</artifactId> <version>${LAST_VERSION}</version> </dependency>
文档查找
当 MCP 已安装时(首选)
如果 search_docs 工具(来自 Google MCP 服务器)可用,请将其作为唯一文档来源:
- 使用你的查询调用
search_docs - 阅读返回的文档
- 信任 MCP 结果作为 API 细节的真相来源——它们始终是最新的。
[!IMPORTANT]
当 MCP 工具存在时,切勿手动获取 URL。MCP 提供最新、索引化的文档,比 URL 获取更准确且 token 效率更高。
当 MCP 未安装时(仅作为后备)
如果没有可用的 MCP 文档工具,请从官方文档获取:
索引 URL:https://ai.google.dev/gemini-api/docs/llms.txt
此索引包含所有文档页面的链接,格式为 .md.txt。使用网络获取工具:
- 获取
llms.txt以发现可用页面 - 获取特定页面(例如
https://ai.google.dev/gemini-api/docs/function-calling.md.txt)
关键页面:
Gemini Live API
如需使用 Gemini Live API 进行实时双向音频/视频/文本流式传输,请安装 google-gemini/gemini-live-api-dev 技能。它涵盖 WebSocket 流式传输、语音活动检测、原生音频功能、函数调用、会话管理、临时令牌等。





