> ## Documentation Index
> Fetch the complete documentation index at: https://docs.anyfast.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Gemini 3.8 Flash

> 通过原生 Gemini API 调用 Google Gemini 3.8 Flash，适用于长周期软件工程、自主智能体和复杂多模态工作流。

Gemini 3.8 Flash 是 Google 面向长周期软件工程、自主智能体和复杂企业工作流的正式版 Flash 模型。AnyFast 通过原生 Gemini `generateContent` API 提供服务，稳定模型 ID 为 `gemini-3.8-flash`。

## 核心能力

* **100 万 Token 上下文** - 最多 1,048,576 个输入 Token 和 65,536 个输出 Token
* **多模态输入** - 支持文本、图片、视频、音频和 PDF 输入，输出文本
* **长周期编码** - 面向复杂的多文件工程任务和迭代验证
* **自主智能体** - 改进多步规划、确定性工具执行和失败循环恢复能力
* **工具能力** - Function Calling、代码执行、Google 搜索、Google 地图、网址上下文和 Computer Use（预览）
* **结构化输出** - 根据指定的响应 Schema 生成 JSON
* **思考等级** - 支持 `low`、`medium` 和 `high`，默认值为 `medium`
* **缓存与处理选项** - 上游支持上下文缓存、Batch API、Flex inference 和 Priority inference

## 模型规格

| 属性          | 取值                 |
| ----------- | ------------------ |
| 模型 ID       | `gemini-3.8-flash` |
| 发布阶段        | 正式可用（GA）           |
| 发布日期        | 2026 年 9 月 2 日     |
| 输入          | 文本、图片、视频、音频和 PDF   |
| 输出          | 文本                 |
| 输入 Token 上限 | 1,048,576          |
| 输出 Token 上限 | 65,536             |
| 默认思考等级      | `medium`           |

## 快速示例

<CodeGroup>
  ```bash cURL theme={null}
  curl "https://www.anyfast.ai/v1beta/models/gemini-3.8-flash:generateContent?key=YOUR_API_KEY" \
    -H "Content-Type: application/json" \
    -d '{
      "contents": [
        {
          "role": "user",
          "parts": [{ "text": "审查这个重试方案，找出竞态条件并给出安全的实现计划。" }]
        }
      ],
      "generationConfig": {
        "thinkingConfig": {
          "thinkingLevel": "medium"
        },
        "maxOutputTokens": 2048
      }
    }'
  ```

  ```python Python theme={null}
  import requests

  response = requests.post(
      "https://www.anyfast.ai/v1beta/models/gemini-3.8-flash:generateContent",
      params={"key": "YOUR_API_KEY"},
      json={
          "contents": [{
              "role": "user",
              "parts": [{"text": "审查这个重试方案，找出竞态条件并给出安全的实现计划。"}],
          }],
          "generationConfig": {
              "thinkingConfig": {"thinkingLevel": "medium"},
              "maxOutputTokens": 2048,
          },
      },
  )
  response.raise_for_status()
  print(response.json()["candidates"][0]["content"]["parts"][0]["text"])
  ```
</CodeGroup>

## 思考等级

根据延迟要求和任务难度选择思考等级：

| 等级       | 推荐用途                     |
| -------- | ------------------------ |
| `low`    | 对延迟敏感的聊天、起草、事件响应和快速分析    |
| `medium` | 默认值；需要平衡延迟和推理能力的编码及智能体任务 |
| `high`   | 高难度编码、数学、工具编排和复杂多步推理     |

<Warning>
  Gemini 3.8 Flash 不支持 `minimal`，传入该值会返回错误。请使用 `low`、`medium` 或 `high`。
</Warning>

<Note>
  Gemini 3.8 Flash 在困难的长周期任务中可能使用更多推理 Token，因为模型会拆分步骤、迭代调用工具并验证中间结果。不需要此类验证的工作流可以使用 `low`。
</Note>

## AnyFast 实测行为

以下行为已在 AnyFast 国际节点完成验证：

* `low`、`medium` 和 `high` 思考等级可用；传入 `minimal` 会返回 HTTP 400。
* 一个多模态请求可同时传入文本、图片、视频、音频和 PDF。
* Function Calling、代码执行、Google 搜索、Google 地图、网址上下文、Computer Use、结构化输出、停止序列、系统指令和安全设置均可用。
* 当前端点尚未开放文件搜索；传入 `tools[].fileSearch` 会返回 HTTP 400。
* 请求以模型轮次结尾，或最后一个用户内容为空时，会返回 HTTP 400。

## 对话与工具要求

* 不要预填模型响应。对话必须以非空的 `user` 轮次结束。
* 在工具工作流中回传对话历史时，必须保留模型返回的每个 `thoughtSignature`。
* `functionResponse` 必须包含函数 `name`。当前 AnyFast 路由允许省略 `id` 和 `response`；模型返回 `id` 或工具已有结果时，建议一并回传。
* 多模态素材应放在相应的内容或函数响应载荷内。

## 参数说明

| 参数                                              | 类型      | 必填 | 说明                                                                                                |
| ----------------------------------------------- | ------- | -- | ------------------------------------------------------------------------------------------------- |
| `key`                                           | string  | 是  | 查询参数中的 API 密钥                                                                                     |
| `contents`                                      | array   | 是  | 包含文本或多模态内容的对话轮次                                                                                   |
| `systemInstruction`                             | object  | 否  | 包含 `parts` 数组的系统指令                                                                                |
| `generationConfig.thinkingConfig.thinkingLevel` | string  | 否  | `low`、`medium`（默认）或 `high`                                                                        |
| `generationConfig.maxOutputTokens`              | integer | 否  | 最大输出 Token 数，上限 65,536                                                                            |
| `generationConfig.responseMimeType`             | string  | 否  | 输出 MIME 类型，例如 `application/json`                                                                  |
| `generationConfig.responseSchema`               | object  | 否  | 用于结构化输出的 JSON Schema                                                                              |
| `generationConfig.stopSequences`                | array   | 否  | 命中后停止生成的字符串列表                                                                                     |
| `tools`                                         | array   | 否  | Function Calling 声明，或 `googleSearch`、`googleMaps`、`urlContext`、`codeExecution`、`computerUse` 内置工具 |
| `toolConfig`                                    | object  | 否  | 所选工具的函数调用或检索配置                                                                                    |
| `safetySettings`                                | array   | 否  | 按安全类别配置拦截阈值                                                                                       |

<Card title="API 参考" icon="code" href="/zh/api-reference/model-api/google/gemini-3.8-flash">
  查看 Gemini 3.8 Flash 的交互式 API 参考。
</Card>

## 官方参考

* [Gemini 3.8 Flash 模型页面](https://ai.google.dev/gemini-api/docs/models/gemini-3.8-flash?hl=zh-cn)
* [Gemini 3.8 Flash 更新说明](https://ai.google.dev/gemini-api/docs/generate-content/latest-model?hl=zh-cn)
* [Gemini 思考机制](https://ai.google.dev/gemini-api/docs/thinking?hl=zh-cn)

<script src="/public/feedback.js" />
