把关联材料放在一起推理
长输入容量适合同时纳入需求、关联代码、接口约定和历史讨论,围绕同一问题进行比较与归纳。实际组织材料时,按文件或章节分组,并明确要解决的问题,比单纯堆入全部内容更有用;输出可整理成修改清单、摘要或待确认事项。
在选型前明确容量、输入输出与调用方式。
原生容量与模态描述模型能力,本平台的图文对话和文件工具工作流分别由所选入口提供。
了解 gemini-3.7-flash 能为你的工作带来什么。
长输入容量适合同时纳入需求、关联代码、接口约定和历史讨论,围绕同一问题进行比较与归纳。实际组织材料时,按文件或章节分组,并明确要解决的问题,比单纯堆入全部内容更有用;输出可整理成修改清单、摘要或待确认事项。
可以将图表、页面截图与文字说明组合提交,让模型围绕指定问题解释画面、比较信息或整理观察结果。图文消息使用文本块与 image_url 块,图片可采用公开链接或 Base64 data URI;交付物是文字分析,不是重新生成图片。
函数调用用于描述模型希望执行的操作和参数,结构化输出则便于把结果接入业务程序。自行编排时应保存完整工具调用和结果;使用托管会话时,可结合文件读取及已授权工具完成多步任务,执行权限仍由应用和工具配置决定。
从具体任务出发,找到模型发挥作用的位置。
输入相关源码、错误日志、需求和测试条件,让模型先定位影响范围,再提出修改方案、代码片段与测试建议。适合需要跨文件理解的日常维护任务;交付时要求说明改动依据与未验证假设,实际编译和测试仍在开发环境中完成。
将报告文本、条款或会议记录按主题组织,要求输出摘要、差异表和问题清单。需要处理 PDF、CSV 或 TXT 链接时,可选托管会话的 file_url 工作流,让文件工具读取内容后分析,并在后续问题中沿用同一会话继续追问。
提交图表截图或产品页面,并注明分析目标,例如解释趋势、核对文字与图形是否一致,或整理界面改进项。输出可以是逐项说明,也可以是预先定义的 JSON 字段;涉及精确数值时,同时提供原始表格有助于交叉核对。
结合任务复杂度、输入材料与预期结果选择。
Gemini 3.7 Flash 是稳定型号,但不是最新 Flash;Gemini 3.8 Flash 已可用。已有经过验证的 3.7 提示词和工具流程,可以先保持现有配置,再用相同任务比较新版本。相对 3.6 是否值得切换,应看答案可用性、工具参数正确性和返工次数,而非假定每次任务都会更省。
需要关联多份材料、看图并输出结构化结果时,3.7 Flash 值得纳入候选;简单分类未必需要长上下文和较高思考等级,复杂推理则可与 Pro 系列比较。自行维护消息历史和工具循环,选 Chat Completions;希望按会话 ID 续聊并使用文件工具,选 AI Chat v2。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 gemini-3.7-flash 时的常见疑问。
使用 gemini-3.7-flash,保留数字之间的点。图文对话可调用 /gemini/chat/completions,托管会话可调用 /aichat2/conversations;前者提交 model 与 messages,后者可用 model 与 question 开始对话。
原生输入上限是 1,048,576 tokens,输出上限是 65,536 tokens,两者不是同一个预算。组织长任务时仍应筛选相关材料,并按交付物设置回答长度;这些原生数字不等于每次调用都应使用全部容量。
可选择 low、medium、high,原生不支持 minimal。简单归纳可以从 low 开始,多条件分析再尝试 medium 或 high。不要把极小回答预算当作关闭思考的办法;Gemini 3.x Flash 使用指南建议 max_tokens 设到 512 以上。
原生支持 PDF 理解,但不生成图片或语音。本平台的托管会话可通过 file_url 提交 PDF 链接,结合文件读取工具进行分析;普通图文消息采用 text 和 image_url 内容块,两种资料输入方式应分别处理。
自行编排函数调用时,保留调用 ID、函数参数及执行结果,再把工具结果交回模型。托管会话可使用返回的 id 续聊;若任务暂停等待补充信息,应通过 tool_results 回填,并保持 tool_use_id 与暂停事件中的工具 ID 一致。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。