📱Ifanr (爱范儿)•較早收集於 27m
階躍星辰發布 Flash 模型,刷新效率與成本新標竿

💡成本大幅降至 Claude 3 Opus 的 1/9,對於追求成本效益的 AI 擴展應用至關重要。
⚡ 30-Second TL;DR
有什麼變化
任務成本降至 Claude 3 Opus 的 1/9
為什麼重要
推理成本的顯著降低,使得高效能 AI 在企業級應用與高頻任務中更具競爭力與普及性。
下一步行動
將您目前的推理成本與 Step-1 Flash 進行基準測試,評估是否能藉此優化您的 LLM 營運預算。
誰應關注:Developers & AI Engineers
關鍵要點
- •任務成本降至 Claude 3 Opus 的 1/9
- •專注於高效率的推理效能
- •將 Flash 模型重新定位為高效能主力工具
🧠 深度解析
Web-grounded analysis with 23 cited sources.
🔑 增強重點摘要
- •階躍星辰的Flash模型(特別是Step 3.7 Flash)採用Apache 2.0開源協議,並已在Hugging Face和ModelScope等主流平台開放,大幅降低了開發者接入和工作流編排成本。
- •Step 3.7 Flash模型專為生產級Agent場景設計,強調原生多模態理解與執行、強化聯網與視覺搜索能力,以及高可靠的工具調用與編排,使其能穩定處理複雜、多輪的任務流程。
- •階躍星辰積極推動「AI+終端」商業化戰略,其模型已深度整合至OPPO、榮耀、中興等手機品牌,以及吉利汽車的AgentOS智能座艙,模型裝機量已超過4200萬台。
- •該模型支援雲端與本地部署,並已完成對華為昇騰、沐曦股份、壁仞科技、燧原科技、天數智芯、阿里平頭哥等多家國產AI晶片,以及Mac Studio M4 Max、DGX Spark等本地設備的適配。
📊 競品分析▸ Show
| 特性/模型 | 階躍星辰 Step 3.7 Flash | Anthropic Claude 3 Opus (4.6/4.7) | Google Gemini 3 Flash (預覽版) | DeepSeek V4-Flash |
|---|---|---|---|---|
| 發布日期 | 2026年5月29日 | 2024年3月 (Claude 3系列) | 2025年12月17日 | 2026年4月 (V4系列) |
| 架構 | 稀疏MoE架構 | 專有 | Transformer解碼器模型架構 | 專有 |
| 總參數/激活參數 | 196B + 1.8B (ViT) / 11B (激活) | 專有 | 專有 | 284B (V4-Flash) |
| 最高生成速度 | 400 Tokens/s | 未明確公開 | 3倍快於Gemini 2.5 Pro | 未明確公開 |
| 上下文窗口 | 256K tokens | 200K tokens | 1M tokens (輸入) / 64K tokens (輸出) | 百萬Token上下文 |
| API定價 (每百萬Token) | 據稱是Claude 3 Opus的1/9 (約輸入$0.56 / 輸出$2.78,基於Opus $5/$25) | 輸入$5.00 / 輸出$25.00 (Opus 4.6/4.7) | 輸入$0.50 / 輸出$3.00 | 專有 |
| SWE-Bench Pro | 56.3% (全球第二) | 未明確公開 | 78.0% (優於Gemini 3 Pro) | 未明確公開 |
| 主要應用場景 | 生產級Agent、多模態、Coding、Search | 複雜任務、開放式提示、高階推理 | 網頁應用、聊天機器人、程式碼生成、測試生成 | 旗艦版V4-Pro與輕量版V4-Flash |
| 開源狀態 | 開源 (Apache 2.0) | 閉源 | 閉源 | 開源 (MIT協議) |
🛠️ 技術深入
- 模型架構: 採用稀疏混合專家(Sparse MoE)架構,旨在平衡性能與效率。
- 參數規模: 總參數量為1960億,並包含18億參數的視覺編碼器(ViT),每次推理僅激活約110億參數,實現「以小博大」的效果。
- 推理效能: Step 3.7 Flash最高生成速度可達每秒400個Token,支援256K的上下文長度。
- 多模態能力: 支援原生多模態理解,能夠直接處理UI界面、圖表、文檔、圖片等各類應用界面,並將複雜視覺信息轉化為結構化結果和可執行任務。
- 工具調用: 針對生產級Agent場景進行優化,可在長程多輪工作流中穩定調用API、瀏覽器、終端、Office工具等外部系統,顯著降低執行失敗風險。
- 推理層級: 提供低、中、高三檔推理級別,開發者可根據需求在響應速度、Token成本和能力之間進行平衡。
- 開源與部署: 採用Apache 2.0開源協議,已在Hugging Face和ModelScope平台開放權重和程式碼,支援雲端與本地部署,並兼容多種國產AI晶片及本地高性能設備。
- Agent生態兼容性: 對Claude Code、OpenClaw、KiloCode、RooCode、Hermes Agent等主流開發框架和工具調用協議進行了兼容優化。
🔮 前景展望AI analysis grounded in cited sources
AI Agent將加速在企業生產環境中的普及。
Step 3.7 Flash專注於生產級Agent場景,並優化了工具調用可靠性與多模態理解,將降低企業部署AI Agent的門檻和風險。
大模型市場的競爭將從單純追求「峰值智能」轉向「高效智能」。
Flash模型強調速度、成本與可靠執行,反映了市場對可規模化落地、兼顧效率與穩定性的AI解決方案的真實需求,而非僅僅是最高跑分。
「AI+終端」的商業模式將成為獨立大模型公司突圍的重要路徑。
階躍星辰與手機、汽車等終端廠商的深度合作,不僅能降低獲客成本,構建穩定現金流,還能實現AI技術從研發到消費終端的規模化落地,形成差異化競爭優勢。
⏳ 時間線
2023
階躍星辰(StepFun)於上海成立。
2023-05
階躍星辰獲得天使輪融資。
2024
階躍星辰完成A輪融資及數億美元B輪融資。
2026-01-26
階躍星辰完成超50億人民幣B+輪融資,印奇出任董事長。
2026-02-02
階躍星辰發布並開源Step 3.5 Flash模型。
2026-05-29
階躍星辰發布並開源Step 3.7 Flash模型。
📎 來源 (23)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ifanr (爱范儿) ↗


