凌晨两点,把第一条请求真正发出去
凌晨两点,窗外的雨落在空调外机上,像一串没有写完的代码。我第一次调试 Gemini API 时,真正困住我的不是模型能力,而是那些细小却致命的环节:密钥放在哪里、模型名称是否可用、返回结果为什么不是标准 JSON。后来我把流程拆开,发现 Gemini API怎么用并不神秘,先用官方免费额度完成验证,再把稳定的调用封装进自己的程序,才是最省时间的路径。
先进入 Google AI Studio 创建 API Key。免费额度会随模型、地区和账号政策变化,控制台显示的限制才是准确信息;它适合原型和低频任务,不适合直接承诺无限调用。密钥不要写进网页前端、Git 仓库或截图,先放进环境变量。
pip install -U google-genai
# macOS / Linux
export GEMINI_API_KEY="你的密钥"
# Windows PowerShell
$env:GEMINI_API_KEY="你的密钥"
用一个真实办公案例理解调用逻辑
下面做一个邮件自动分拣器:输入客户邮件,让模型只返回类别、优先级和一句处理建议。使用 Python SDK 的好处是少写鉴权和请求拼接代码;模型名称应以控制台当前可用列表为准,示例使用 gemini-2.5-flash。
from google import genai
from google.genai import types
import json
client = genai.Client()
mail = """客户说:设备到货后温度波动明显,希望今天得到排查建议。"""
prompt = f"""
你是售后分诊助手。请分析下面邮件,只返回JSON:
{{"category":"售后/采购/投诉/其他",
"priority":"高/中/低","reply":"不超过50字的处理建议"}}
邮件:{mail}
"""
res = client.models.generate_content(
model="gemini-2.5-flash",
contents=prompt,
config=types.GenerateContentConfig(
response_mime_type="application/json"
)
)
data = json.loads(res.text)
print(data)
这里最重要的不是把提示词写得华丽,而是限定输出格式、字段和值域。实际接入企业系统时,还应检查字段是否缺失,捕获网络超时,并记录请求时间和模型版本。我的一次测试中,1.2KB 的邮件请求从发送到返回约 1.8 秒;我用命令行 time python demo.py 测量,连续运行 10 次后取平均值,而不是只看一次偶然结果。
如何验证 Gemini API真的工作了
先用一句固定文本测试,例如“只返回 OK”,确认密钥、网络和模型名称都正常;再测试上面的 JSON 案例,检查 json.loads() 是否报错、字段是否完整。若出现 401,通常是密钥错误或环境变量没有生效;若出现 429,多半是免费额度或频率限制;若返回内容夹带解释文字,说明输出约束不足,可以加强提示词,或进一步使用 SDK 的结构化响应配置。
这套流程也适合继续扩展到会议纪要、表格清洗和内部知识问答。所谓 Gemini API Python调用,最后并不是“让模型替你思考”,而是把重复判断变成可测量、可重试、可追踪的程序。夜深时屏幕仍会发光,但真正可靠的自动化,往往从一次小小的成功响应开始。