
GitHub Copilot接入Kimi K2.7開源模型
月之暗面的Kimi K2.7開源模型已正式接入GitHub Copilot,標誌著該國產AI模型在開發者生態中的重要拓展。
36氪 · 78 天前
新旗艦模型、上下文窗口、推理突破與跑分風波——每日追蹤這個時代的核心技術。
90 篇文章

月之暗面的Kimi K2.7開源模型已正式接入GitHub Copilot,標誌著該國產AI模型在開發者生態中的重要拓展。
36氪 · 78 天前
中信證券研報指出,美團已在五萬卡國產算力集群上完成萬億參數模型的全流程訓練,標誌著國產算力系統從推理升維至訓練。此外,DeepSeek V4將引入「峰谷定價」機制,反映出國產算力供給的持續緊張。
36氪 · 78 天前

包括 Alibaba、Tencent 和 ByteDance 在內的中國科技巨頭已推出 AI 程式碼代理,旨在與 Anthropic 的 Claude Code 競爭。這些工具透過提供在地化與優化的工作流程,試圖搶佔開發者市場。
Pandaily · 79 天前

月之暗面黃震昕表示,Kimi 將避免重交付的專案模式。公司主張將核心精力放在底層模型架構的創新,而非僅進行工程優化。
钛媒体 · 81 天前

Google 正推廣如 Gemma 4 31B 等小型模型用於 AI 輔助軟體工程,並強調其卓越的推論速度。這顯示業界正將重心轉向用於程式開發任務的高效、低延遲本地模型。
Reddit r/LocalLLaMA · 84 天前

北京的 Zhipu AI 發布了旗艦模型 GLM-5.2,因其卓越的編碼效能與高性價比而備受關注。業界觀察家將其影響力比作「DeepSeek 時刻」,並指出它是重要的開源權重競爭者。
SCMP Technology · 85 天前
DeepReinforce-AI 已發布 Ornith-1.0 模型系列,包含從 9B 到 397B 參數的多種規模。該發布聲稱在多項基準測試中達到業界領先水準。
Reddit r/LocalLLaMA · 86 天前

月之暗面開源了 Kimi K2.7 Code 模型,該模型在長上下文編程任務中具備更強的指令遵循能力與性能表現。新模型減少了 30% 的 token 消耗,並預告將於近期推出 6 倍速版本。
IT之家 · 99 天前
Anthropic 已正式委任 Morgan Stanley 和 Goldman Sachs 領軍其首次公開募股(IPO)。該公司正加速進入公開市場,以與 OpenAI 展開直接競爭。
Bloomberg Technology · 108 天前

AI 獨角獸 MiniMax Group(稀宇科技)已於 2026 年 5 月 29 日正式啟動 A 股 IPO 進程。中信證券已獲聘擔任其輔導機構。
cnBeta (Full RSS) · 112 天前
海光信息已成功在DTK異構計算平台上完成Step 3.7 Flash模型的適配與調優。此次整合使開發者能在海光硬體上高效運行多模態Agent與智慧程式碼助手,並降低部署成本。
36氪 · 112 天前

Vibe Modeling 代表了一種範式轉移,使用者透過自然語言而非手寫程式碼來生成功能性模型與視覺化成果。此方法基於「vibe coding」概念,將複雜的工作流程抽象化,使非技術人員也能進行複雜的數據分析。
虎嗅 · 120 天前

作者展示了 Google AI Studio 如何讓使用者僅透過自然語言描述,即可建立功能齊全的 Android 應用程式,跳過傳統的程式開發流程。
The Verge · 121 天前
DeepSeek擬募資最高500億元,這將成為中國人工智能公司史上最大一輪融資。消息來自財聯社。
36氪 · 134 天前
阿里巴巴宣布AI組織架構調整,將通義實驗室升級為事業部。李飛飛出任阿里雲CTO,負責AI雲基礎設施。
36氪 · 163 天前
BotzoneBench 提供可擴展框架,利用固定技能校準遊戲 AI 階層評估 LLM 在遊戲中的策略推理能力。它避免 LLM 對戰賽的二次方成本與不穩定性,提供絕對線性時間測量。
ArXiv AI · 214 天前
恆生指數與恆生科技指數雙雙高開。半導體及 AI 相關個股如兆易創新與智譜表現強勁。
36氪 · 66 天前
智譜 AI 獲得 43.3 億港元的南向資金淨買入,顯示投資者對這家中國 AI 模型領軍企業的強烈信心。
36氪 · 73 天前

NVIDIA Nemotron 正被用於建構能處理工業機械警報的 AI 代理。該系統自動化了提取歷史背景並為技術人員提供解決方案建議的過程。
NVIDIA Developer Blog · 74 天前

美團宣佈即將推出 LongCat-2.0 開源 AI 專案。目前官方僅釋出「即將推出」的預告訊息。
钛媒体 · 78 天前

MooreThreads 推出了專為程式編碼任務設計的大型語言模型 MusaCoder-27B。該發布包含可透過 Hugging Face 和 arXiv 取得的文件與研究論文。
Reddit r/LocalLLaMA · 101 天前

ByteDance 預計將於 6 月下旬為其 AI 助手 Doubao 推出付費訂閱服務。此次更新將伴隨新功能發布,並與抖音電商進行深度整合。
TechNode · 109 天前

Arcee 是一家 26 人美國新創公司,打造了高效能的大型開源大型語言模型。該模型在 OpenClaw 使用者中越來越受歡迎。
TechCrunch AI · 164 天前

阿里巴巴CEO確認Qwen模型系列將保持開源。這重申了公司在LLM競爭中對開源的承諾。
Reddit r/LocalLLaMA · 198 天前

DeepSeek 創辦人梁文鋒的身價已飆升至 360 億美元,使其成為 AI 模型領域最富有的創辦人。此估值反映了市場的快速成長以及投資人對 DeepSeek AI 技術的信心。
TechNode · 66 天前
網易雲音樂近日宣布全面接入DeepSeek-V4,提升聽歌找歌、社群互動、創作服務及個人化場景體驗。
36氪 · 130 天前

T3出行由頂級車廠與科技巨頭支持,在延遲5年後提交香港IPO申請。作為中國第三大智慧出行平台,它在2025年實現盈利,儘管競爭激烈。
虎嗅 · 136 天前

Nous Research,Hermes Agent 背後的開源實驗室,在 r/LocalLLaMA 宣布舉辦 AMA。活動定於 4 月 29 日週三太平洋時間上午 8-11 時,在專用討論串進行。
Reddit r/LocalLLaMA · 147 天前

林俊旸(1993年生)一年內升至阿里P10,憑Qwen 3.5開源模型成AI傳奇,獲馬斯克讚,突宣布離職。文章指阿里不許任何人成「神」,總能找到下一個周暢。
虎嗅 · 197 天前

Alibaba's Qwen 3.5 achieves superior results with a smaller model size. It emphasizes low inference costs over scale as key to AI application growth.
钛媒体 · 214 天前