学完能做什么 / 解决什么问题
通过本教程,你将掌握:
- 在 Google AI Studio 中创建并测试 Gemini 模型提示词
- 将调试好的提示词一键导出为 API 代码,部署到生产环境
- 处理多模态输入(文本、图像、音频)并解析模型输出
- 配置安全设置与参数,避免常见调用错误
前置条件
- 拥有一个 Google 账号(Gmail 即可)
- 浏览器:Chrome / Firefox / Edge 最新版本
- 网络环境:能访问
aistudio.google.com(部分地区需科学上网) - 基本了解:什么是 API 和 JSON 格式
分步操作
步骤1:进入 Google AI Studio 并登录
- 打开浏览器,访问
https://aistudio.google.com/ - 点击右上角 Sign in,使用你的 Google 账号登录
- 登录后,页面自动跳转到 Get API key 或 Start prompting 界面
预期结果:看到主界面,左侧为模型选择区,右侧为提示词输入区。
步骤2:选择模型并配置参数
- 在左侧面板 Model 下拉菜单中,选择
Gemini 1.5 Pro 或 Gemini 1.5 Flash(推荐 Flash 用于快速测试) - 点击 Temperature 滑块,设置值为
0.7(默认值,适合创意生成;如需精确答案,设为 0.1) - 可选:设置 Max output tokens 为
2048(控制输出长度)
注意事项:
Temperature 越高,输出越随机;越低,输出越确定- 不同模型支持的最大 token 数不同,Gemini 1.5 Pro 支持 1M tokens
步骤3:输入提示词并测试
- 在右侧文本框输入你的提示词,例如:
请用中文解释什么是量子计算,字数不超过200字。
- 如需添加多模态输入:
- 点击文本框下方的 + 按钮,选择 Upload file 上传图片或音频
- 或直接粘贴图片 URL
- 点击 Run 按钮(或按
Ctrl+Enter)
预期结果:几秒后,下方输出区显示模型生成的文本。如果上传了图片,模型会基于图片内容作答。
失败排查:
- 若输出为空或报错
403,检查 API 密钥是否有效(见步骤4) - 若输出截断,增大 Max output tokens 值
步骤4:获取 API 密钥并导出代码
- 点击界面右上角 Get API key 按钮
- 在弹出的窗口中,点击 Create API key → 选择 Create API key in new project
- 复制生成的密钥(格式类似
AIzaSy...),保存到安全位置 - 回到主界面,点击 Get code 按钮(位于输出区上方)
- 选择语言:Python 或 cURL(推荐 Python 用于后端集成)
- 复制生成的代码片段,其中已包含你的 API 密钥和模型参数
注意事项:
- API 密钥有免费额度(每分钟 60 次请求,每天 1,000 次)
- 不要将密钥提交到公开代码仓库
步骤5:部署到生产环境
- 将复制的代码粘贴到你的 Python 项目文件中(例如
app.py) - 安装依赖:
pip install google-generativeai - 运行脚本:
python app.py - 验证输出:控制台应打印模型返回的文本
预期结果:代码无报错,输出与 AI Studio 中测试结果一致。
常见问题
| 问题 | 原因 | 解决方案 |
|---|
API 返回 429 Too Many Requests | 超出免费额度 | 等待 1 分钟后再试,或升级付费计划 |
| 模型输出包含敏感内容 | 安全设置过高 | 在 AI Studio 左侧 Safety settings 中降低阈值 |
| 中文回答质量差 | 提示词未指定语言 | 在提示词开头明确写 请用中文回答 |
| 图片上传后模型忽略 | 图片格式不支持 | 仅支持 JPEG、PNG、GIF、WebP,且单张 < 20MB |
适用边界
- 免费版:仅支持文本、图片、音频输入,不支持视频流
- 付费版(Gemini API 按量计费):支持视频帧分析、更大上下文窗口
- 不适用于:实时语音对话(需使用 Google Cloud Speech-to-Text)
想比较Suno、Udio、Lyria、Eleven Music、MiniMax、Stable Audio等主流AI音乐工具的歌曲、配乐、商用版权和API,可以查看:2026 AI音乐生成专题 →