Search

Tag: #reasoning112 results

Grok 4.6 登陸 Vercel AI Gateway

Grok 4.6 登陸 Vercel AI Gateway

來自 xAI 的 Grok 4.6 現已透過 Vercel AI Gateway 提供,支援 500K token 上下文視窗,以及文字和圖片輸入。開發者可選擇 low、medium、high 或 xhigh 推理等級,預設為 high,也能透過 AI SDK 或 coding agents 使用該模型。

Vercel NewsMediaAug 12#model-routing#multimodal#reasoning
弱模型修復強模型的推理錯誤

弱模型修復強模型的推理錯誤

Woodpecker Distillation 顯示,強大語言模型的失敗往往源於中間推理步驟中的局部錯誤,而非整體能力不足。該方法利用弱模型的對比式介入與後續 token 分布,在數學推理基準上提升強模型的表現。

ArXiv AIResearchAug 7#reasoning#weak-to-strong
Qwen 預告全新 27B 模型

Qwen 預告全新 27B 模型

Qwen 開發團隊表示全新的 27B 模型即將發布,並稱其能力將大幅提升,而不只是重新訓練版本。他們也透露 Qwen3.8 的細節,包括 2.4T 總參數、95B 活躍參數、大量後訓練運算,以及用於處理超過 100 小時影片的階層式影片記憶方法。

Reddit r/LocalLLaMACommunityAug 5#27b-model#video-understanding#mixture-of-experts
Page 3 of 12