generateContent API 提供服务。
核心能力
- 100 万 token 上下文 - 最多 1,048,576 个输入 token 和 65,536 个输出 token
- 多模态输入 - 支持文本、图片、视频、音频和 PDF 输入,输出文本
- 智能体执行 - 使用更少的推理步骤、对话轮次和工具调用完成多步工作流
- 编码 - 改进生产级代码生成、指令遵循和诊断行为
- 空间推理 - 改进图表解读、视觉蓝图转换和复杂布局推理
- 工具能力 - 函数调用、代码执行、文件搜索、Google 搜索、Google 地图、网址上下文、结构化输出和 Computer Use(预览)
- 思考等级 - 默认为
medium,复杂任务可使用high
快速示例
API 变更
请求不能以非空的model 角色轮次结尾。对话必须以非空的 user 轮次结束,否则 API 返回 HTTP 400。
参数说明
API 参考
查看 Gemini 3.6 Flash 的交互式 API 参考。