ModelInfo
简体中文
全部模型

Gemini 3.5 Flash-Lite

低成本、低延迟的多模态模型,适用于子智能体任务和文档解析等高吞吐工作负载。

Googlegemini-3.5-flash-lite2026-07-21报告数据错误

规格

上下文
1.05M
最大输出
65.5K
输入价
$0.3/ 百万 Token
输出价
$2.5/ 百万 Token
发布日期
2026-07-21

上下文

上下文
1.05M
最大输入
1.05M
最大输出
65.5K

价格 · USD / 百万 Token

输入
$0.3
输出
$2.5
缓存读取
$0.03
缓存写入
—

输入输出

输入
文本图像视频音频文档
输出
文本

API

接口类型
generatebatch

思考

支持思考
支持
思考等级
—

源信息

状态
可用
发布日期
2026-07-21
知识截止
2026-03

能力

已确认
toolsstructured_outputstreamingcachingbatch
来源 · 官方文档核验 2026-10-11

调用方式

1 个 Provider

googlemodel = gemini-3.5-flash-litereasoning = generationConfig.thinkingConfig.thinkingLevel

generate
POSThttps://generativelanguage.googleapis.com/v1beta/models/{model}:generateContent
batch
POSThttps://generativelanguage.googleapis.com/v1beta/models/{model}:batchGenerateContent

JSON

标准格式
gemini-3.5-flash-lite.json
{
  "id": "gemini-3.5-flash-lite",
  "object": "model",
  "created": 1784592000,
  "owned_by": "google",
  "name": "Gemini 3.5 Flash-Lite",
  "api": {
    "types": [
      "generate",
      "batch"
    ]
  },
  "limits": {
    "context": 1048576,
    "input": 1048576,
    "output": 65536
  },
  "modalities": {
    "input": [
      "text",
      "image",
      "video",
      "audio",
      "document"
    ],
    "output": [
      "text"
    ]
  },
  "reasoning": {
    "supported": true,
    "efforts": []
  },
  "pricing": {
    "currency": "USD",
    "unit": "1M_tokens",
    "input": 0.3,
    "output": 2.5,
    "cache_read": 0.03,
    "cache_write": null
  },
  "features": [
    "tools",
    "structured_output",
    "streaming",
    "caching",
    "batch"
  ],
  "info": {
    "status": "active",
    "release_date": "2026-07-21",
    "knowledge_cutoff": "2026-03",
    "description": "Low-cost, low-latency multimodal model for high-throughput workloads such as subagent tasks and document parsing.",
    "docs": "https://ai.google.dev/gemini-api/docs/models/gemini-3.5-flash-lite",
    "verified_at": "2026-10-11"
  }
}

官方来源

7