工具介绍
核心功能
Google Gemini API 是开发者调用 Gemini 模型的官方入口。通过 AI Studio 可以创建密钥、试验提示词和查看请求,程序则可使用 SDK 或 REST 接入文本、图片、视频等多模态输入。部分模型支持长上下文、结构化输出、工具调用和流式响应。
模型能力、速率、地区和可用性会随版本变化。开发者应依据官方模型文档选择适合的上下文、延迟和安全设置。
适合场景
应用可以用 Gemini 做文档问答、图像理解、代码辅助、结构化抽取和 Agent 工具调用。原型阶段适合在 AI Studio 比较提示词,生产阶段则应建立自己的评测、缓存和错误处理层。
对多模态任务先准备真实样本,检查图片、视频和长文档在目标模型上的识别差异。
使用边界
模型可能出现幻觉、拒答或对图像细节判断错误,API 不负责业务权限和最终动作。上传内容需符合 Google 的数据与安全政策,敏感资料要先进行分类和脱敏。
模型更新可能改变输出和额度,线上应用应固定版本、监控成本并提供降级方案。
常见问题
Google Gemini API 与 AI Studio 是什么关系?
AI Studio 是试验和管理入口,API 与 SDK 则用于把 Gemini 接入程序。
能处理图片和视频吗?
Gemini 的多模态模型支持多种输入,具体格式和限制以当前模型文档为准。
生产环境要设置哪些保护?
至少要管理密钥、额度、超时、输出验证、敏感数据和模型版本。