提问背景 Question:
models/gemini-2.5-flash-lite
models/gemini-2.5-flash
这些模型,支持文件上传吗?没有文件上传,太不方便了。
Gemini 2.5 Flash 文件上传指南
是的,Gemini 2.5 Flash 和 Gemini 2.5 Flash-lite 完全支持文件上传!它们是原生多模态大模型,不仅支持文本,还支持处理图片、音频、视频以及各种文档(如 PDF、Word、CSV、代码文件等)。
你可以通过以下两种主要方式来使用文件上传功能:
1. 在 Google AI Studio (网页端) 使用
如果你使用的是 Google 官方的开发者测试平台 Google AI Studio:
- 在底部的输入框左侧,有一个 “+” (Add) 按钮。
- 点击它,你可以选择 “Upload to Drive” 或者是 “Upload from computer” 导入本地文件。
- 上传后,你可以直接让模型对 PDF 进行翻译、总结,或者对长视频、音频进行内容提炼。
2. 通过 Gemini API (代码开发) 使用
如果你是通过 API 编写代码,Gemini 提供了专门的 Files API 来处理媒体文件和大型文档。对于大于 20MB 的文件,推荐先使用 File API 上传,再将返回的 URI 传给模型。
以下是 Python SDK 的使用示例:
import google.generativeai as genai
# 配置 API Key
genai.configure(api_key=\"YOUR_API_KEY\")
# 1. 上传文件(支持 PDF、视频、音频等,单个文件最大支持 2GB)
sample_file = genai.upload_file(path=\"report.pdf\", mime_type=\"application/pdf\")
print(f\"文件上传成功,URI: {sample_file.uri}\")
# 2. 传入模型进行分析
model = genai.GenerativeModel(\"gemini-2.5-flash\")
response = model.generate_content([
sample_file,
\"请帮我提炼这份报告的关键结论和数据点。\"
])
print(response.text)
核心限制与规格
- 文件大小限制:单个文件最大支持 2GB。
- 存储时间:通过 API 上传的文件会临时保存在 Google 的服务器中,48小时后会被自动删除(上传和存储不收取额外费用)。
- 上下文窗口:Gemini 2.5 Flash 拥有高达 100万 (1M) tokens 的超大上下文窗口,这使得它能够轻松一次性读入数千页的 PDF 或数小时的音视频文件。