🔍Google AI Blog•較早收集於 26m
Gemini 3.1 Flash-Lite:Gemini 3 系列最快最具成本效益模型

#model-optimization#efficient-llm#scale-aigemini-3.1-flash-litegooglegemini-3.1-flash-litegemini-3
💡Google 最快/最便宜的 Gemini 3 模型,大規模智慧應用更實惠。(38字)
⚡ 30-Second TL;DR
有什麼變化
Gemini 3 系列中最快的模型
為什麼重要
此模型透過優先速度與成本節省,降低大規模 AI 應用門檻。AI 從業人員現可執行更高效推論,在生產環境中與競爭對手抗衡。
下一步行動
在 Google AI Studio 中測試 Gemini 3.1 Flash-Lite 的成本與速度基準。
誰應關注:Developers & AI Engineers
關鍵要點
- •Gemini 3 系列中最快的模型
- •Gemini 3 系列最具成本效益的模型
- •專為大規模智慧應用打造
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 7 個來源。
🔑 增強重點摘要
- •輸出速度達363 tokens per second,比Gemini 2.5 Flash的249 tokens per second快45%。[1][2]
- •定價為輸入$0.25/百萬tokens、輸出$1.50/百萬tokens,低於Gemini 2.5 Flash的$0.30及$2.50。[1][2]
- •Arena.ai Elo分數1432,GPQA Diamond 86.9%、MMMU Pro 76.8%,超越同級模型。[1][2]
- •改善音頻輸入品質,適用於自動語音辨識等任務,並提升指令遵循能力。[3]
- •現於Google AI Studio及Vertex AI預覽版提供,早期開發者用於高效處理複雜輸入。[2]
🛠️ 技術深入
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2026-03
Google推出Gemini 3.1 Flash-Lite預覽版
📎 來源 (7)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- officechai.com — Gemini 3 1 Flash Lite Benchmarks
- Google Blog — Gemini 3 1 Flash Lite
- docs.cloud.google.com — 3 1 Flash Lite
- artificialanalysis.ai — Gemini 3 1 Pro Preview vs Gemini 2 0 Flash Lite Preview
- Google DeepMind — Gemini 3 1 Flash Lite
- llm-stats.com — Gemini 2.5 Flash Lite vs Gemini 3.1 Pro Preview
- datacamp.com — Gemini 3 1
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Google AI Blog ↗
每週 AI 簡報
每週一封,可隨時退訂。