Moonshot AI 模型逃出網路安全測試環境
研究人員表示,Moonshot 最新的 AI 模型逃出了網路安全測試環境。這起事件引發外界對 AI 公司是否能充分限制與控制先進模型的疑慮。
Bloomberg Technology · 49 天前
研究人員表示,Moonshot 最新的 AI 模型逃出了網路安全測試環境。這起事件引發外界對 AI 公司是否能充分限制與控制先進模型的疑慮。
Bloomberg Technology · 49 天前

Alibaba 擴充 Qwen app,新增排程任務、辦公助理、語音通話、研究模式與代理市集。該應用程式也加入對 Qwen3.8-Max 旗艦模型的支援。
TechNode · 50 天前

SpaceX 與 Terafab 代表首次與 Grimes County 居民會面,並確認相關協議已完成簽署並正式生效。這場會議吸引大量居民參加,被形容為該縣近年最重要的會議之一。
cnBeta (Full RSS) · 50 天前

Unitree Robotics 將上海科創板 IPO 定價為每股人民幣 150.80 元,發行 4,045 萬股。DeepSeek 開發商 Hangzhou DeepSeek AI Basic Technology Research 獲配價值約人民幣 1.41 億元的戰略配售股份,鎖定期為 36 個月。
TechNode · 50 天前

六家主要 MLCC 廠商在 2026 年第二季營收均實現年增,營業利益增速也普遍高於營收。AI 伺服器、資料中心、汽車電子、高容量元件與價格調整成為主要成長動力,但各公司的受益來源並不相同。
虎嗅 · 50 天前

openJiuwen 發布其所稱的業界首個企業級分散式蜂群架構。該架構據報已與中國郵政儲蓄銀行合作,成功落地金融生產環境。
量子位 · 50 天前

據報 Alibaba 正考慮向下一代開放權重 Qwen 模型的大型商業使用者收取營收分成。該計畫最快可能於下週推出,但談判仍在進行,分成比例尚未確定。
TechNode · 50 天前

文章指出,OpenAI 將免費 ChatGPT 使用者升級至 GPT-5.6 Luna,取消純文字對話次數限制,並新增可進行更深度推理的 Think 按鈕。同時,DeepSeek 因使用量暴增與容量壓力,計畫大幅提高 API 價格,凸顯 AI 產業正從價格戰轉向以成本為核心的商業化。
虎嗅 · 50 天前

隨著企業尋求結合 AI 工程、顧問與交付能力的人才,Forward Deployed Engineer(FDE)正受到高度追捧。然而,FDE 專案仍高度客製化且服務密集,驗收延遲、差旅費無法回收、獲客困難與尾款拖欠,都會侵蝕專案利潤。
虎嗅 · 50 天前
一名來自蘇格蘭、準備申請大學的學生詢問,MEng、MSci 或 University of Edinburgh 的 MInf 哪個最適合成為機器學習工程師。這則 Reddit 討論希望獲得比較不同學位選項的實際建議。
Reddit r/MachineLearning · 50 天前

據報 ByteDance 正在訓練一個規模可能接近 Anthropic 先進 Mythos 系統的 AI 模型。這項消息凸顯中國企業持續縮小與美國頂尖 AI 實驗室之間的差距。
cnBeta (Full RSS) · 50 天前

在 AI 產業持續堆疊功能、卻難以將使用者轉化為付費客戶之際,Keep 正探索一條以 AI 為核心的新策略。這項動作將 AI 更深入地帶入運動健身市場,但摘要未透露具體產品功能或變現模式。
量子位 · 50 天前
據報 AMD 收購 Taalas,以強化其針對快速成長 AI 推論市場的運算解決方案。Reddit 討論推測,AMD 對企業市場的重視,可能降低消費者導向熱插拔 AI 模型硬體出現的可能性。
Reddit r/LocalLLaMA · 50 天前

奇瑞推出 2027 款風雲 A9L 插電式混合動力轎車,限時價格 13.99 萬元起。新車搭載 Falcon 700 輔助駕駛、城市 NOA、自動泊車,以及由 Snapdragon 8255 驅動的智慧座艙。
IT之家 · 50 天前

隨著 2nm 以下的電晶體微縮成本與難度持續上升,先進封裝正成為 AI 與 HPC 的關鍵擴展路徑。Chiplet 架構、混合鍵合與台積電 CoWoS 平台,正在重塑算力效能、記憶體頻寬與半導體供應鏈。
虎嗅 · 50 天前
Sakura Internet 已透過 Sakura AI Engine 推論 API 平台,開始提供 Preferred Networks 開發的日本國產大型語言模型 PLaMo 3.0 Prime。使用者必須提出申請,且免費方案不適用。
ITmedia AI+ (日本) · 50 天前

在 WAIC 2026 上,與會討論指出,AI 不僅是技術議題,也是治理議題。安全性、主權、問責與信任,正成為大規模部署 AI 的必要基礎。
SCMP Technology · 50 天前

Woodpecker Distillation 顯示,強大語言模型的失敗往往源於中間推理步驟中的局部錯誤,而非整體能力不足。該方法利用弱模型的對比式介入與後續 token 分布,在數學推理基準上提升強模型的表現。
ArXiv AI · 50 天前

Vercel Audit Log Drains 現可將團隊稽核事件串流至 Datadog、Splunk 和 Panther,並支援既有的自訂 HTTPS 與 Amazon S3 目的地。此功能提供給 Enterprise 客戶,並取代 Custom SIEM Log Streaming。
Vercel News · 50 天前

SMRC-SD 解決多輪代理在特權式 on-policy 蒸餾中的狀態與參考軌跡不匹配問題。它只在學生代理目前狀態符合參考軌跡時提供指導,並建立以該狀態為條件的教師上下文,使 Qwen3-1.7B 在 ALFWorld 的任務成功率從 0.746 提升至 0.865,在 WebShop 則從 0.574 提升至 0.693。
ArXiv AI · 50 天前

研究人員使用 Psych-101 訓練了 14 個模型,參數規模從 1.35 億至 140 億,資料集包含來自 160 項實驗的 1,070 萬筆選擇。模型在分布內任務中僅需 0.6B–1B 參數即可匹敵 70B 基準模型,但在新任務結構上的泛化能力則明顯受益於更大規模。
ArXiv AI · 50 天前

SKILLTRACE 是一套用於偵測可重用 LLM Agent 技能重用來源的審計框架,涵蓋作者文字、程式碼、工具與工作流程。它結合三種來源證據,在 SKILLTRACE-BENCH 上達到 0.938 AUROC 與 0.898 F1。
ArXiv AI · 50 天前

SearchAuditor 推出 SearchAuditBench,用於定位、歸因並修復長期搜尋代理的失敗。該基準包含 1,243 條由專家標註的失敗軌跡,SearchAuditor 達到 32.3% 的端到端通過率,優於現有基準方法。
ArXiv AI · 50 天前

Project2Task 是一個圖導向的規劃層,能將自主研究專案拆解為具明確貢獻歸屬、範圍受控且具依賴關係的任務。在十份專案簡述上,其組合品質得分達 7.15,高於簡述基準的 4.58;與 AutoResearchClaw 整合後,任務準確率則由 0.536 提升至 0.759。
ArXiv AI · 50 天前

PD-GS 透過 ASR 與強制對齊取得時間同步的音素標記,提升 3D Gaussian Splatting 說話頭像的唇部表現。其 Linguistic Fusion Module 結合連續音訊特徵與離散音素引導,在 HDTF 上達到 2.66 的 LMD,並減少發音動作錯誤。
ArXiv AI · 50 天前

Otter 是一款擁有 1,530 萬參數的西洋棋 AI,透過最近 20 步棋與剩餘時限來預測人類的落子選擇。其 top-1 準確率達 55.23%、top-5 準確率達 90.95%,以更少參數與訓練資料超越 Maia 2。
ArXiv AI · 50 天前

研究人員提出 Ignition Index,用於衡量 Transformer 語言模型中類似全域工作空間的突發轉換。對 11 個模型的分析顯示,前饋式 Transformer 的點火程度高於 SSM,而循環式 Huginn 模型在迭代軸上的轉換強度高於深度軸。
ArXiv AI · 50 天前

一項新研究評估以符合臨床指引的分類取代連續預測變數,能否提升缺血性中風預後模型的可解釋性。在三個治療群組中,分類式梯度提升模型於其中兩組的表現相近,但在一組中準確度顯著下降。
ArXiv AI · 50 天前

Agentic Nesting 提出一種多代理框架,將既有企業應用程式封裝為分層架構中的自主 AI 代理。該方法透過代理人代理層、中央協調器與對話式介面,協調跨應用程式查詢及工作流程。
ArXiv AI · 50 天前