🟩NVIDIA Developer Blog•較早收集於 31m
NVIDIA Blackwell 於 STAC-AI LLM 推論創金融紀錄

💡Blackwell 創金融 LLM 推論紀錄—提升交易 AI 效能(38字)
⚡ 30-Second TL;DR
有什麼變化
Blackwell 在 STAC-AI LLM 推論基準中創紀錄效能
為什麼重要
Blackwell 的紀錄突顯 NVIDIA 在金融 AI 推論硬體的主導地位,讓即時交易決策更快。可能促使對沖基金和銀行採用 LLM 以提升效率。
下一步行動
使用 DGX Cloud 在 NVIDIA Blackwell 上基準測試您的 LLM 金融工作負載。
誰應關注:Enterprise & Security Teams
關鍵要點
- •Blackwell 在 STAC-AI LLM 推論基準中創紀錄效能
- •處理金融新聞、社群媒體、財報等非結構化資料
- •預測股價走勢並自動化交易策略
- •展現金融特定 AI 工作負載的優越速度
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 7 個來源。
🔑 增強重點摘要
- •NVIDIA Blackwell B200 在 InferenceMAX v1 基準中達到每 GPU 60,000 tokens/秒吞吐量,並在 gpt-oss 模型上實現每用戶 1,000 tokens/秒互動性[1]。
- •Blackwell 透過軟體優化自推出以來效能已提升超過兩倍,使用 TensorRT-LLM、Dynamo 等框架支援推論[1]。
- •在 STAC-AI 相關金融基準外,Blackwell 在 SemiAnalysis InferenceX v2 中對比 Hopper 實現高達 100x FP4 效能提升[5]。
- •Blackwell Ultra GB300 NVL72 在低延遲代理 AI 工作負載上對比 Hopper 提供 50x 更高每兆瓦吞吐量與 35x 更低每百萬 tokens 成本[2]。
📊 競品分析▸ Show
| 基準 | NVIDIA B200 (Llama 3 70B tok/s batch 32) | AMD MI300X | Intel H100 |
|---|---|---|---|
| Inference Throughput | 2,800 | 1,620 | 1,850 |
| Training (Llama 3 70B tokens/sec) | - | 380 | 450 |
| Power Efficiency (perf/W) | - | 0.51 | 0.64 |
🛠️ 技術深入
- •第五代 Tensor Cores 支援 FP4 精度計算,比 FP8 快兩倍,Blackwell Ultra 更達三倍[3][6]。
- •第二代 Transformer Engine 使用 Blackwell Tensor Core 加速 LLM 和 Mixture-of-Experts 模型推論與訓練[6][7]。
- •支援推測解碼 (speculative decoding),如 gpt-oss-120b-Eagle3-v2 模型,將每用戶 100 TPS 吞吐量提升三倍[1]。
- •TensorRT-LLM 軟體堆疊優化,提供 10x 每兆瓦吞吐量與 15x 更低每百萬 tokens 成本,對比前代[1]。
- •GB300 NVL72 系統在 rack 規模下實現 55x 至 100x 效能優勢,使用 FP4 對比 Hopper FP8[5]。
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2024-03
NVIDIA 公布 Blackwell 架構,預告 AI 效能躍進
2025-03
GTC 2025 展示 Blackwell 原型與初步基準
2025-12
Blackwell 推出,開始 InferenceMAX 基準測試
2026-01
SemiAnalysis InferenceX v2 發布,Blackwell 展現對 Hopper 55x 優勢
2026-02
MLPerf Training v5.1 中 Blackwell 橫掃所有 LLM 訓練紀錄
2026-03
Blackwell 在 STAC-AI LLM 推論創金融新紀錄
📎 來源 (7)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- blogs.nvidia.com — Blackwell Inferencemax Benchmark Results
- blogs.nvidia.com — Data Blackwell Ultra Performance Lower Cost Agentic AI
- blogs.nvidia.com — Mlperf Training Benchmark Blackwell Ultra
- codercops.com — AI Chip Comparison Nvidia Amd Intel 2026
- newsletter.semianalysis.com — Inferencex V2 Nvidia Blackwell vs
- northflank.com — Best GPU for AI
- developer.nvidia.com — Delivering Massive Performance Leaps for Mixture of Experts Inference on Nvidia Blackwell
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: NVIDIA Developer Blog ↗
每週 AI 簡報
每週一封,可隨時退訂。
