多模态理解
可处理文本、图片、视频、音频和 PDF 输入
可处理文本、图片、视频、音频和 PDF 输入
支持大规模输入内容,适合长文档、资料包、代码库片段和多文件分析
可配合工具调用完成多步骤任务,让复杂流程不再停留在单轮问答
Gemini 3.5 Flash 提供多模态理解、长上下文处理、智能体执行等功能。适合开发者与技术团队、产品与设计团队、内容与运营团队围绕相关任务使用。
多模态理解:可处理文本、图片、视频、音频和 PDF 输入;长上下文处理:支持大规模输入内容,适合长文档、资料包、代码库片段和多文件分析;智能体执行:可配合工具调用完成多步骤任务,让复杂流程不再停留在单轮问答。