
Moonshot AI 發布 K3 模型,具備 2.8 兆參數
Moonshot AI 發布了擁有 2.8 兆參數的巨型模型 K3,引發全球 AI 股票的重新評估。此舉加劇了模型開發商之間的競爭,並對 OpenAI 和 Anthropic 等主要業者的市場估值產生了影響。
Tag: #llm-scaling8 results

Moonshot AI 發布了擁有 2.8 兆參數的巨型模型 K3,引發全球 AI 股票的重新評估。此舉加劇了模型開發商之間的競爭,並對 OpenAI 和 Anthropic 等主要業者的市場估值產生了影響。

ByteDance 正式發布其旗艦級大型語言模型 Doubao-Seed-2.1 Pro。該模型已達到生產級標準,目前每日處理量高達 180 兆 tokens。

ByteDance 旗下的火山引擎已具備大規模量產媲美 Anthropic Opus 4.6 等級模型的能力。此進展大幅降低了部署頂尖 AI 功能的成本門檻。

Sina Weibo 的研究人員推出了 VibeThinker-3B,這是一款 30 億參數的模型,據稱其推理能力可媲美甚至超越大型旗艦模型。此發布在 AI 社群中引發了關於當前基準測試有效性的激烈爭論。

Berkeley Artificial Intelligence Research (BAIR) Lab 慶祝 2026 屆博士畢業生,展示了機器人技術、LLM 推理、電腦視覺與 AI 安全等領域的突破。這些研究人員正轉向學術界、工業實驗室及新創公司擔任關鍵職位。

DeepSeek 為應對高伺服器負載,已對「重新生成」與「修改」功能實施使用限制。官方表示這是等待新硬體部署期間的臨時措施。

SpaceX 的 IPO 文件顯示 xAI 在 2025 年虧損了 64 億美元。該公司正投入巨資以推動其 Grok AI 模型的擴張計畫。
本文認為像 Anthropic 和 OpenAI 這樣的頂尖 AI 實驗室並沒有所謂的「秘密配方」,其優勢主要來自於大規模的參數擴展。文中指出,近期出現的 5T 至 10T 參數模型已成為效能表現的新基準。