把长材料变成明确字段
Flash-Lite 针对文档解析和简单提取优化,可将报告、记录或说明文本整理为字段、分类和摘要。任务中写清字段定义、缺失值规则与输出格式,比笼统要求全面分析更贴合它的定位;需要机器消费结果时,可结合结构化输出并做类型校验。

在选型前明确容量、输入输出与调用方式。
原生规格描述模型能力;本平台的图文请求与文件会话分别使用对应入口,容量数字不代表每次请求的可用额度。
了解 gemini-3.5-flash-lite 能为你的工作带来什么。
Flash-Lite 针对文档解析和简单提取优化,可将报告、记录或说明文本整理为字段、分类和摘要。任务中写清字段定义、缺失值规则与输出格式,比笼统要求全面分析更贴合它的定位;需要机器消费结果时,可结合结构化输出并做类型校验。
它能结合文字指令理解图片,适合从截图、表单或图表中提取指定信息。图文请求将 text 与 image_url 放入同一内容数组,让问题和视觉材料保持对应。交付物可以是解释或结构化文本,但不会直接生成图片,也不会把答案合成为语音。
原生函数调用与思考能力让它可以承担信息核对、参数整理等聚焦任务。设计工作流时,应给出工具用途、必填参数和完成条件,把复杂目标拆成可检查步骤。函数调用表达的是操作意图,实际执行仍需要应用或已配置工具完成。
从具体任务出发,找到模型发挥作用的位置。
输入客服对话或工单文本,要求按既定标签判断问题类型,并提取产品、诉求与待补充信息,交付统一字段的记录。对缺少依据的标签允许返回待确认,再由人工复核疑难项,适合将高频、重复的整理工作嵌入业务流程。
输入文档文本、表单图片,或通过会话入口提供文件链接,指定需要的名称、日期、金额及对应原文,生成便于入库的结构化结果。先限定提取范围,再检查字段完整性与原文对应关系,避免让摘要内容替代精确的数据记录。
先提交材料并生成重点摘要,再围绕同一材料追问差异、条目或遗漏信息。使用会话入口可保存返回的 id 延续讨论;已有自建聊天系统则可通过 messages 携带历史。最终交付可包含摘要、问题清单和需要进一步确认的事项。
结合任务复杂度、输入材料与预期结果选择。
当任务是分类、简单提取、文档解析或范围明确的子代理工作,Flash-Lite 的低延迟、成本友好定位更合适。若需求转向复杂编码、长链条推理或持续自主执行,可将完整 Flash 或 Pro 纳入比较。用同一组样本评估字段正确率、任务完成率和返工量,而不是仅凭系列名称选型。
gemini-3.5-flash-lite 与 gemini-3.5-flash、gemini-3.1-flash-lite 是不同型号,不能将它们视作拼写别名。直接管理历史、输出格式和工具回填时,选择 Chat Completions;需要保存会话、提交文件链接和管理对话时,选择会话入口。迁移既有应用时,保留代表性样本检查结果。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 gemini-3.5-flash-lite 时的常见疑问。
不是。Flash-Lite 重点面向低延迟、成本敏感的文档解析、提取和轻量子代理任务,不能把 3.5 Flash 的配置直接沿用到 Lite。调用时使用 gemini-3.5-flash-lite,迁移后应重新检查输出质量与任务完成情况。
在提示中明确要求仅返回 JSON,并写清字段含义、必填项、枚举和缺失值规则,可附上预期输出示例。模型原生支持结构化输出;若使用 response_format 配置 JSON 对象或 JSON Schema,需以该入口对本型号实际支持的配置为准。收到结果后仍需解析并校验字段,尤其要区分格式正确与内容确实有材料依据。
文件会话可使用 /aichat2/conversations,在 message 中提供 file_url 和任务说明。Chat Completions 的图文内容使用 text 与 image_url,不应把 PDF 当作图片提交;也可先提取文本,再交给模型进行分类、摘要或字段整理。
它支持图像理解,可以根据图片回答问题或提取信息,但原生输出为文本,不支持图像生成或音频生成。图片可随文字指令一起提交;如果最终需要图片或语音作品,应将文本结果交给相应的生成服务处理。
使用 /gemini/chat/completions 时,通过 messages 提供需要保留的对话历史。使用 /aichat2/conversations 时,可开启 stateful,并在后续请求中带回会话 id。前者便于精细控制上下文,后者适合托管连续会话。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。
Input
$0.06per 1M tokens
Official $0.30
Output
$0.50per 1M tokens
Official $2.50
You pay$13,584for 142,800 credits · $0.0951 / credits46% OFF
You're billed in credits. Pick a top-up tier to see its per-credit rate — the larger the top-up, the cheaper each credit.
This is only a basic call example. See the full docs for more parameters and advanced usage.
View Docs