Gemini 2.5 Flash Lite
厂商:谷歌
Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...
关键参数
- 上下文长度:1M
- 最大输出:65.5K
- Tokenizer:Gemini
- 发布时间:2025-07-22
Token 定价
- 输入价格:$0.100 / 100 万 tokens
- 输出价格:$0.400 / 100 万 tokens
- 缓存读取价格:$0.010 / 100 万 tokens
- 缓存写入价格:$0.083 / 100 万 tokens
- 综合单价:$0.175 / 100 万 tokens
- 图像生成价格:$0.0001 / 张
输入输出模态
文本、图像、文件、音频、视频
典型用例
- 深度推理与复杂分析:处理长篇法律文书、学术论文、财报,在超长上下文中进行多跳推理与证据链追踪。(≈ $0.0032/次)
- 图文理解与生成:识别图表中的数据趋势、OCR 扫描文档、分析照片内容并生成结构化报告。(≈ $0.0024/次)
- 语音交互:语音识别与转录,支持中英混合、方言识别,适合会议纪要、客服质检。
什么时候选这个模型
基于公开定价与能力字段派生的选型信号(非实测benchmark),最终选型请结合官方文档与你的评测。
- 输入与输出单价都较低,适合高频调用与大批量批处理。
- 综合单价低,舰队级(大规模)部署成本友好。
- 超长上下文(≥1M tokens),适合长文档问答、代码库分析、多轮 Agent。
- 最大输出 ≥30K tokens,适合深度报告 / 长文 / 文档起草。
- 支持图文多模态:图像描述、OCR、图表问答、视觉推理。
- 支持音频:语音转写、语音 Agent、会议纪要分析。
- 支持视频输入:视频理解、关键帧问答、内容审核。
- 支持文件/PDF:文档解析、合同审查、私域数据 RAG。
相关问题
- Gemini 2.5 Flash Lite 的 Token 定价是多少? 该模型的输入价为 $0.100 / 100 万 tokens,输出价为 $0.400 / 100 万 tokens,综合单价约 $0.175 / 100 万 tokens。具体价格以 谷歌 官方页面为准。
- Gemini 2.5 Flash Lite 支持多大的上下文窗口? 上下文窗口为 1M,最大输出约 65.5K,适合处理长文档、多轮对话与复杂推理任务。
- Gemini 2.5 Flash Lite 适合哪些使用场景? 基于其能力与定价,Gemini 2.5 Flash Lite 最适合:深度推理与复杂分析、图文理解与生成、语音交互。可在详情页「典型用例」区查看更详细的场景说明与成本估算。
- Gemini 2.5 Flash Lite 支持哪些输入输出模态? 支持 文本、图像、文件、音频、视频 模态。
- Gemini 2.5 Flash Lite 是免费模型吗? Gemini 2.5 Flash Lite 按 Token 计费,不属于免费模型。
- Gemini 2.5 Flash Lite 由哪家厂商提供? Gemini 2.5 Flash Lite 由 谷歌 提供。
同厂商其他模型
查看完整信息:Gemini 2.5 Flash Lite