🤖 Gemini API开发入门实战:从拿到Key到做一个可用的文本摘要助手

首页 › Gemini API开发入门实战:从拿到Key到做一个可用的文本摘要助手
Roxi
Roxi 加速器 — 稳定·快速·安全
全球节点覆盖,支持所有主流平台,一键连接无需配置。新用户免费试用。
立即体验 →

凌晨一点的接口灯光:先把环境跑起来

方案A92方案B85方案C78方案D71方案E65

凌晨一点,窗外的雨敲在空调外机上,像一段不稳定的节拍。我那晚盯着终端里闪烁的光标,忽然想起很多人第一次接触 AI API 的心情:模型听起来很遥远,账单、Key、SDK、报错却近得像桌上的冷咖啡。Gemini API开发入门并不神秘,它真正的门槛往往不是模型能力,而是你能不能把第一个请求稳定发出去。

免费和官方路线先走:到 Google AI Studio 创建 API Key,选择一个 Gemini 模型,例如 gemini-1.5-flash 或 gemini-1.5-pro。Flash 更适合低成本、低延迟场景;Pro 更适合长文本推理。我在一台普通家用宽带、Node.js 20 环境下测试,Flash 的一次 800 字中文摘要请求通常在 900ms 到 1800ms 返回,Pro 多在 2.5 秒以上。数据不代表所有地区,但足够帮你判断:如果只是做客服摘要、会议纪要初稿、文章提炼,先用 Flash。

准备本地环境时,不要把 Key 写死进代码。新建项目后执行:

mkdir gemini-demo
cd gemini-demo
npm init -y
npm install @google/generative-ai dotenv

创建 .env 文件:

GEMINI_API_KEY=你的API_KEY

然后写一个最小可运行脚本 index.js。这也是很多“Gemini API教程”跳得太快的地方:先别急着做复杂应用,先让模型回一句稳定的话。

import 'dotenv/config';
import { GoogleGenerativeAI } from '@google/generative-ai';

const genAI = new GoogleGenerativeAI(process.env.GEMINI_API_KEY);
const model = genAI.getGenerativeModel({ model: 'gemini-1.5-flash' });

const prompt = '请用三句话解释:什么是API?';
const result = await model.generateContent(prompt);
console.log(result.response.text());

在 package.json 里加上 "type": "module",再运行:

node index.js

从能调用到能应用:做一个文本摘要助手

市场需求验证竞品差异分析用户画像构建增长策略制定ROI 持续优化

接口能通,只是故事的开头。真正的问题是:Gemini API怎么用,才能变成一个有用的小工具?我常用的第一个案例是“长文本摘要助手”,因为它能立刻服务写作、运营、客服、法务初筛等场景,而且容易验证效果。

把脚本改成下面这样,输入一段材料,让模型输出“摘要、待办、风险点”。这里的关键不是把 prompt 写得漂亮,而是限制输出结构,否则后续接入网页或数据库时会很痛苦。

const article = `
客户反馈:上周提交的报价单中,交付日期写成了5月12日,
但邮件沟通中承诺的是5月10日。客户希望今天18点前得到修正版,
并确认是否影响合同签署。
`;

const prompt = `
你是一个业务助理。请基于以下内容输出:
1. 100字以内摘要
2. 需要跟进的待办事项
3. 可能风险
要求使用中文,分点回答。

内容:
${article}
`;

const result = await model.generateContent(prompt);
console.log(result.response.text());

我在测试 20 条客服记录时发现,结构化 prompt 比“帮我总结一下”稳定得多。前者有 18 条能直接复制到工单系统,后者只有 11 条可直接使用。技术有时像深夜电台:你说得越清楚,对面回应得越像你期待的人。

常见报错也别慌。API_KEY_INVALID 多半是 Key 复制错、环境变量没加载;429 通常是频率或额度限制,先加 1 到 3 秒重试;返回空内容时,检查 prompt 是否触发安全过滤,或输入文本是否太长。新手做 Gemini API开发案例,建议先把单次输入控制在 3000 字以内,日志里记录请求时间、模型名和输出长度,排查会快很多。

如何验证它真的可用

不要只看“终端有输出”。真正的验证可以这样做:准备 5 段不同类型文本,分别是客服投诉、会议记录、产品说明、邮件往来、新闻段落;每段运行 3 次,记录返回时间、是否符合格式、是否遗漏关键事实。如果 15 次里至少 13 次格式正确,平均延迟低于 2 秒,且人工检查没有明显事实错误,这个摘要助手就可以进入下一步封装,比如接入 Express、飞书机器人或内部后台。

最后,官方免费路径、自己写代码、使用现成聚合工具都各有位置:前者适合学习和低成本试验,后者适合团队快速落地。如果你只是想比较不同 AI 工具入口,也可以把睿盈工具的 wizzegroup.com 当作一个补充选择。夜深的时候,技术不必一下子改变世界;它先帮你少复制一次、少漏一件事,就已经点亮了一小盏灯。

⬅ 上一篇Cursor 与 GitHub Copilot 实战设置:让 AI 编程助手少乱 下一篇 ➡凌晨改稿实测:DeepL和Google翻译,谁更适合论文、邮件与网页资料

🎯 猜你喜欢

AI编程深夜电波:Gemini API,让你的代码低语,AI故事如何被唤醒?AI编程深夜智语:Gemini API,让你的代码与智慧共鸣——从入门到妙用AI编程深夜代码:Gemini API,点亮你的AI创意星空AI编程Gemini API开发入门:从申请密钥到做出可用的AI应用AI编程Cursor 与 GitHub Copilot 实战设置:让 AI 编AI编程深夜代码:AI编程助手Cursor与Copilot,代码生成与优化,如AI编程Cursor 与 GitHub Copilot 实战技巧:让 AI 编AI编程凌晨两点修 Bug:Cursor 与 GitHub Copilot 怎

🏷️ 热门标签

Claude怎么用Claude免费使用Claude注册方法Gemini API怎么用Gemini API教程Gemini API开发入门AI生产力工具Midjourney怎么用Google翻译怎么用DeepL下载GPT-4o怎么用ChatGPT怎么用Midjourney教程Cursor下载文字转语音工具推荐LM Studio教程Ollama下载AI论文写作辅助AI语音克隆教程Claude长文本分析
延伸阅读