
Qwen3.8-Max 稱前端編程能力躍居全球第一
阿里巴巴更新其旗艦模型 Qwen3.8-Max。據報此次更新使該模型的前端編程能力躍居全球第一。
量子位 · 17 天前

阿里巴巴更新其旗艦模型 Qwen3.8-Max。據報此次更新使該模型的前端編程能力躍居全球第一。
量子位 · 17 天前

前字節跳動強化學習專家、前騰訊 Robotics X 智能體中心負責人孫鵬博士已加入星塵智能。此次任命旨在完善公司在 Physical AI 領域的全棧技術布局。
量子位 · 17 天前
Microsoft 認為,AI 下一階段的進展應以基礎設施產生有用智慧的效率來衡量。文章借用半導體產業「良率」的概念,將焦點從基礎設施的設計與開發投入,轉向實際產出與效率。
Microsoft Blog (AI Tag) · 17 天前

從 Scotland 到 India,各地社群正反對新的資料中心開發案,警告這些設施可能耗用能源供應並加劇氣候危機。這波反彈挑戰了科技業所提出的論點:大型資料中心是國家維持 AI 競爭力的必要條件。
The Guardian Technology · 17 天前
GPTC 董事長兼執行長 Hoton Chang 討論公司的業務策略,以及半導體產業對先進封裝日益增加的需求。這場訪談在台北舉行的 SEMICON Taiwan 期間進行,聚焦於支援先進晶片製造的基礎設施。
Bloomberg Technology · 17 天前
World Labs 發布了全模態世界模型 Atlas,可整合處理文字、影像與 3D 資料,並保留 3D 空間脈絡。它能從少量影像重建空間、生成自由鏡頭與子彈時間影片,並支援機器人模擬。
ITmedia AI+ (日本) · 17 天前
SEMI 總裁兼執行長 Ajit Manocha 討論記憶體晶片價格展望,以及持續中的半導體市場超級週期。這場由 Bloomberg Technology 在台北 SEMICON Taiwan 採訪的訪談,聚焦記憶體市場與產業景氣。
Bloomberg Technology · 17 天前

無錫一場產業會議上的高管預測,全球新增資料中心基礎設施投資到 2028 年可能超過 4 兆美元。半導體支出預計將佔總額一半以上,而中國則展示了先進封裝平台。
Pandaily · 17 天前
Meta 發表首款即時語音辨識模型 Muse Voice Transcribe。該模型整合語音辨識、說話者分離與發話結束偵測,並支援辨識 20 名以上說話者及多語言混合音訊。
ITmedia AI+ (日本) · 17 天前

Apple 現允許要求 macOS 13 或以上版本、並以 Universal 格式發布的 Mac App Store 應用程式停止支援 Intel Mac。開發者可藉此簡化建置流程,並減少下載套件與裝置端的儲存空間需求。
cnBeta (Full RSS) · 17 天前
Phison Electronics 執行長 KS Pua 預測,NAND 快閃記憶體可能在 2027 年面臨最嚴重的短缺。他也指出 NAND 在 AI 基礎設施中的重要性日益提升,並談及 SSD、USB 隨身碟與記憶卡控制晶片的需求。
Bloomberg Technology · 17 天前

文章分析家庭 AI 消費逐漸成為主流趨勢,以及這對不同集團(06090.HK)所代表的意義。文章認為,AI 不只是獨立功能,更是公司提前拓展未來產品邊界的方式。
钛媒体 · 17 天前

曾參與制定英國政府 AI 策略的 Matt Clifford 已出任 Anthropic 高階職務。據報導,他仍將擔任政府科技資助機構主席,引發外界對潛在利益衝突的警告。
The Guardian Technology · 17 天前

訪談認為,隨著基礎模型日益同質化,持久記憶可能成為 AI 差異化的核心來源。文章聚焦於誰能掌握 AI 產生的使用者記憶之所有權、儲存與使用權。
钛媒体 · 17 天前

隨著網路威脅的數量、速度與複雜度不斷提升,資安營運正從人工流程轉向由 AI 驅動的自動化。AI 能自動處理重複且大量的工作,同時提升整個資安生命週期的準確性與效率。
SCMP Technology · 17 天前

UI-Venus-2 是一個開源基礎 GUI Agent,旨在跨行動、網頁與桌面環境執行任務。其訓練方法擴展了環境覆蓋、以功能為基礎的任務生成、軌跡層級驗證,以及具備安全意識的執行機制。
ArXiv AI · 17 天前

研究人員提出累積式風險評估框架,隨著長者詐騙對話逐回合發展,持續更新詐騙風險機率。微調後的 Phi-4 與 LLaMA-3.2 展現良好的回合感知效能,同時適合行動裝置與資源受限環境部署。
ArXiv AI · 17 天前

SCAFFOLD 是一個大規模資料集,旨在訓練視覺語言模型理解電腦科學研究論文中的圖表。資料集提供圖像、圖說、上下文、問答配對與逐步推理痕跡,並推出多種規模版本。
ArXiv AI · 17 天前

這篇 arXiv 研究探討在部分線性模型中,干擾函數的預測誤差是否能可靠反映因果估計器的品質。模擬結果顯示,XGBoost 在非 Oracle 方法中取得最佳 RMSE,而 DML-XGBoost 通常提供更好的信賴區間涵蓋率;預測誤差也未能一致反映因果偏差。
ArXiv AI · 17 天前

OpenAgentFlow 提出控制平面與行動平面架構,在異質 AI 代理修改共享狀態前的提交邊界執行安全控管。其 Android 實作達到 94.0% 準確率、攔截 95.3% 的攻擊,並在 30 個動態政策案例中正確處理 27 個。
ArXiv AI · 17 天前

MiNER 是一套以 BioBERT 為基礎的生醫 NLP 系統,經微調後可從科學與臨床文本中辨識具臨床意義的瘧疾相關實體。研究團隊表示,該方法在精確率、召回率與準確率方面均有所提升,並公開了用於實體與關係擷取的人工作標註資料集。
ArXiv AI · 17 天前

I-CARE 是一套用於系統性衡量與報告文字生成圖像模型遺忘過程中「干擾」現象的方法論。它定義了任務、指標與結果報告範本,並提供開源軟體與網頁介面,方便探索研究結果。
ArXiv AI · 17 天前

HyperWorld 研究狀態序列化方式如何影響學習式文字世界模型,並比較原始觀察、獨立句子、成對三元組,以及以實體為中心的超邊結構。超邊序列化在中小型模型與分布偏移情境下表現尤其突出,並在下游貪婪規劃中取得最高成功率。
ArXiv AI · 17 天前

一項新研究測試 LLM 是否能在長鏈、相互依賴的工具呼叫中,持續保存精確的中間狀態。在溫度設為 0 的情況下,gpt-oss-120b 完成了 196 次 MD5 相關呼叫,並在多數執行中產生正確摘要;保留模型自身推理上下文與工作模型投票可提升可靠性。
ArXiv AI · 17 天前

本文提出一套離散時間馬可夫決策過程,用於處理需求數量確定但到達期間具隨機性的多品項產能受限批量生產規劃。遺傳演算法的平均最佳性差距約為 3.44%,在困難基準案例中低於 5%,同時大幅提升求解速度。
ArXiv AI · 17 天前

EULER 是一套多代理系統,透過將猜想轉移至相鄰或遙遠領域來搜尋數學證明。在 120 個近期猜想上,它產生 10 個證明、3 個反駁及 45 個範圍明確的部分結果;證據檢查也降低了錯誤結論。
ArXiv AI · 17 天前
到 2050 年,全球資料中心支出可能達到 31.6 兆美元,以支援持續成長的 AI 需求。PricewaterhouseCoopers 將這波預期中的投資熱潮形容為史上前所未見。
Bloomberg Technology · 17 天前

AI Morbidity and Mortality(AI M&M)提出一套結構化、無責備的流程,用於檢視臨床 AI 失效與近失事件。該框架重建 AI 系統、臨床人員、工作流程與機構控制措施如何共同產生風險,將個別事件轉化為改善行動。
ArXiv AI · 17 天前

文章探討為何大量工業資料並未自動轉化為成功的工業 AI 應用。文章將核心資料庫挑戰定義為:把不同機器的訊號與行為轉換成 AI 系統能理解並使用的資料。
钛媒体 · 17 天前

大模型公司正日益著手準備自己的算力資源,包括探索使用 AI 協助設計 AI 晶片。文章探討這項轉變可能如何重塑 AI 產業的競爭格局與供應鏈動態。
钛媒体 · 17 天前