來源較早收集於 28m

Google 發布 Gemini 3.5 與全新 AI Agent 產品

閱讀原文: Ifanr (爱范儿)
#google-ai#agentic-ai#multimodal

Google 最新的 Gemini 3.5 與 Agent 工具將重新定義其 AI 生態系統與開發者能力。

30 秒速覽

有什麼變化

發布新一代 Gemini 3.5 模型

為什麼重要

此次更新顯示 Google 正積極進軍 Agentic AI 領域,透過將這些模型直接整合至其生態系統中,向競爭對手發起挑戰。

下一步行動

註冊 Google AI Studio 等候名單或申請 API 存取權,將 Gemini 3.5 與您目前的 LLM 工作流程進行基準測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • 發布新一代 Gemini 3.5 模型
  • 推出用於增強自動化的全新 AI Agent 產品
  • 發布先進的影片生成模型

深度解析

背景與延伸:來自公開資料,非原文內容。引用 25 個來源。

增強重點摘要

  • Gemini 3.5 Flash是Gemini 3.5系列的首個模型,在代理任務基準測試(如MCP Atlas)中超越了OpenAI的GPT-5.5和Anthropic的Claude Opus 4.7,同時在輸出速度上比同類前沿模型快四倍,且成本通常不到一半。
  • Google推出了「Gemini Spark」個人AI代理,它基於Gemini 3.5 Flash運行,旨在成為一個全天候運作、學習用戶行為並主動在Google Workspace等應用程式中執行任務的自主系統。
  • 除了Gemini 3.5,Google還發布了「Gemini Omni」,這是一個新的多模態世界模型,其首個版本為「Gemini Omni Flash」,能夠生成具有更精確物理特性的影片,並支援多種輸入(文本、音訊、圖像、影片)以創建互動式世界或編輯現有影片內容。
  • Google的AI策略正從僅僅回答問題轉變為構建一個始終存在、在後台管理數位生活並透過代理工作流程主動執行任務的系統。
  • 更強大的Gemini 3.5 Pro模型目前正在內部測試中,預計將於下個月(2026年6月)公開發布。

競品分析

代理基準測試 (MCP Atlas)
Google Gemini 3.5 Flash
83.6%
OpenAI GPT-5.5
75.3%
Anthropic Claude Opus 4.7
79.1%
編碼基準測試 (Terminal-bench 2.1)
Google Gemini 3.5 Flash
76.2%
OpenAI GPT-5.5
78.2%
Anthropic Claude Opus 4.7
不適用/未提供
編碼基準測試 (SWE-Bench Pro)
Google Gemini 3.5 Flash
55.1%
OpenAI GPT-5.5
58.6%
Anthropic Claude Opus 4.7
不適用/未提供
輸出速度 (tokens/秒)
Google Gemini 3.5 Flash
比其他前沿模型快4倍
OpenAI GPT-5.5
較慢
Anthropic Claude Opus 4.7
較慢
輸入Token價格 (每1M)
Google Gemini 3.5 Flash
$1.50
OpenAI GPT-5.5
不適用/未提供
Anthropic Claude Opus 4.7
$5.00 (Opus)
輸出Token價格 (每1M)
Google Gemini 3.5 Flash
$9.00
OpenAI GPT-5.5
不適用/未提供
Anthropic Claude Opus 4.7
$25.00 (Opus)
上下文視窗 (輸入)
Google Gemini 3.5 Flash
100萬 tokens
OpenAI GPT-5.5
不適用/未提供
Anthropic Claude Opus 4.7
100萬 tokens (Claude Opus 4.6)
AI代理策略
Google Gemini 3.5 Flash
平台深度與數據存取,原生Workspace整合
OpenAI GPT-5.5
垂直整合,擁有模型、API和消費者平台
Anthropic Claude Opus 4.7
安全作為基礎設施

技術深入

  • Gemini 3.5 Flash基於Gemini 3 Flash的推理基礎,並引入了「思考層級」(thinking levels)來平衡品質、成本和延遲。
  • 該模型是原生多模態的,支援文本、圖像、音訊和影片作為輸入,並產生文本輸出。
  • 它支援高達100萬個輸入token的上下文視窗和64,000個輸出token。
  • 技術能力包括函數呼叫、結構化輸出、搜尋即工具(search-as-a-tool)和程式碼執行。
  • Gemini 3.5 Flash針對編碼能力和並行代理執行迴圈進行了高度優化,能夠獨立執行複雜的編碼流程或管理迭代研究專案。
  • Gemini Omni作為一個多模態世界模型,在輸入和輸出上都具備多模態特性,能夠生成具有更精確物理特性的影片。

前景展望基於引用來源的 AI 分析

Google將加速其AI產品的自主化與整合。
Gemini 3.5 Flash和新的AI Agent產品(如Spark)的發布,表明Google正將其AI策略從被動響應轉向主動執行任務,並深度整合至其生態系統中。
企業級AI自動化將迎來顯著增長。
Gemini Enterprise Agent Platform和Managed Agents的推出,為企業提供了構建和部署自主AI代理的統一平台,有望大幅提升業務流程效率。
AI模型之間的競爭將更加側重於「代理能力」和「執行速度」。
Gemini 3.5 Flash在代理基準測試中超越競爭對手,並強調其4倍的輸出速度和成本效益,預示著市場對AI模型實際執行複雜任務的能力和效率將有更高要求。

時間線

2023-12-06
Google發布Gemini模型家族,作為LaMDA和PaLM 2的繼任者,並強調其原生多模態能力。
2024-02-08
Bard應用程式正式更名為Gemini,並推出付費層級Gemini Advanced。
2024-05-14
Google在I/O大會上宣布推出Gemini 1.5 Flash模型。
2025-11-18
Google發布Gemini 3 Pro和Gemini 3 Deep Think模型。
2025-12-17
Google發布Gemini 3 Flash,取代Gemini 2.5 Flash。
2026-05-19
Google在I/O大會上正式發布Gemini 3.5 Flash模型、Gemini Spark個人AI代理、Gemini Omni世界模型,並推出Gemini Enterprise Agent Platform。

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ifanr (爱范儿)

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。