💰钛媒体•較早收集於 6m
騰訊混元3D 2.0開源發布,挑戰閉源格局

💡開源3D模型基準超商業對手30% – 3D AI開發者必測。
⚡ 30-Second TL;DR
有什麼變化
騰訊開源混元3D 2.0
為什麼重要
加速開源3D AI創新,降低開發者進入門檻,加劇對專有模型競爭。
下一步行動
從騰訊GitHub複製混元3D 2.0儲存庫,並微調用於自訂3D資產生成。
誰應關注:Developers & AI Engineers
關鍵要點
- •騰訊開源混元3D 2.0
- •點雲F1-score達43.16
- •超越SEVA與Gen3C 30%以上
- •性能對標商業級模型
🧠 深度解析
本篇為 AI 生成分析,非原文內容。
🔑 增強重點摘要
- •混元3D 2.0 採用了基於多視角擴散模型(Multi-view Diffusion Model)與點雲生成相結合的混合架構,顯著提升了幾何結構的精確度。
- •該模型支援從單張圖像或文字描述生成高品質的 3D 資產,並針對遊戲開發與影視製作流程進行了優化,縮短了資產製作週期。
- •騰訊此次開源旨在透過降低 3D 生成技術門檻,加速構建以混元模型為核心的 3D 內容創作生態系統,以對抗 OpenAI 或 Midjourney 等閉源生態的壟斷。
📊 競品分析▸ Show
| 特性/模型 | 騰訊混元3D 2.0 | OpenAI Shap-E | Luma AI Genie |
|---|---|---|---|
| 開源狀態 | 完全開源 | 開源 | 閉源 |
| 核心技術 | 多視角擴散+點雲 | 隱式神經表示 | 擴散模型 |
| 基準測試(F1-score) | 43.16 | 較低 | 未公開 |
| 商業授權 | 寬鬆開源協議 | 研究用途 | 商業訂閱 |
🛠️ 技術深入
- 採用兩階段生成策略:首先生成多視角一致性圖像,隨後進行 3D 幾何重建。
- 引入了全新的「幾何感知」損失函數,有效解決了傳統模型在處理複雜拓撲結構時的空洞與噪點問題。
- 模型參數規模經過輕量化處理,支援在消費級 GPU(如 NVIDIA RTX 4090)上進行本地推理與微調。
- 支援標準 3D 格式導出(如 .obj, .glb),並內置了自動 UV 展開與貼圖烘焙功能。
🔮 前景展望AI analysis grounded in cited sources
開源 3D 生成模型將導致遊戲資產外包市場價格下降。
技術門檻的降低使得獨立開發者能以極低成本生成高品質 3D 模型,削弱了傳統外包公司的議價能力。
騰訊將在未來 12 個月內將混元 3D 能力整合進其遊戲引擎工具鏈。
騰訊擁有龐大的遊戲開發業務,將生成式 AI 直接嵌入開發管線是提升內部生產力的必然路徑。
⏳ 時間線
2023-09
騰訊正式發布混元大模型,標誌著其在生成式 AI 領域的全面布局。
2024-05
騰訊發布混元 3D 1.0 版本,初步具備從文字生成 3D 模型的能力。
2026-04
騰訊正式開源混元 3D 2.0,性能指標大幅提升並挑戰行業標準。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 钛媒体 ↗
每週 AI 簡報
每週一封,可隨時退訂。