
MooreThreads 發布 MusaCoder-27B 程式編碼模型
MooreThreads 推出了專為程式編碼任務設計的大型語言模型 MusaCoder-27B。該發布包含可透過 Hugging Face 和 arXiv 取得的文件與研究論文。
Tag: #llm90 results

MooreThreads 推出了專為程式編碼任務設計的大型語言模型 MusaCoder-27B。該發布包含可透過 Hugging Face 和 arXiv 取得的文件與研究論文。

ByteDance 預計將於 6 月下旬為其 AI 助手 Doubao 推出付費訂閱服務。此次更新將伴隨新功能發布,並與抖音電商進行深度整合。

Arcee 是一家 26 人美國新創公司,打造了高效能的大型開源大型語言模型。該模型在 OpenClaw 使用者中越來越受歡迎。本文為這支小團隊挑戰 AI 巨頭而喝采。

阿里巴巴CEO確認Qwen模型系列將保持開源。這重申了公司在LLM競爭中對開源的承諾。在r/LocalLLaMA Reddit分享。

DeepSeek 創辦人梁文鋒的身價已飆升至 360 億美元,使其成為 AI 模型領域最富有的創辦人。此估值反映了市場的快速成長以及投資人對 DeepSeek AI 技術的信心。
網易雲音樂近日宣布全面接入DeepSeek-V4,提升聽歌找歌、社群互動、創作服務及個人化場景體驗。

T3出行由頂級車廠與科技巨頭支持,在延遲5年後提交香港IPO申請。作為中國第三大智慧出行平台,它在2025年實現盈利,儘管競爭激烈。公司強調其垂直大模型「領行阡陌」與Robotaxi調度平台。

Nous Research,Hermes Agent 背後的開源實驗室,在 r/LocalLLaMA 宣布舉辦 AMA。活動定於 4 月 29 日週三太平洋時間上午 8-11 時,在專用討論串進行。社區成員請勿在公告貼文中提問。

林俊旸(1993年生)一年內升至阿里P10,憑Qwen 3.5開源模型成AI傳奇,獲馬斯克讚,突宣布離職。文章指阿里不許任何人成「神」,總能找到下一個周暢。凸顯大廠AI人才動態。

Alibaba's Qwen 3.5 achieves superior results with a smaller model size. It emphasizes low inference costs over scale as key to AI application growth. This reveals Alibaba's efficiency-focused strategy.