
微軟自研 AI 三件套落地 2027 自主模型
微軟推出三款內部 AI 模型:MAI-Transcribe-1 語音轉錄、MAI-Voice-1 語音生成、MAI-Image-2 圖像創作,針對企業高價值 AI 能力。此舉支持微軟 2027 年獨立打造頂尖模型目標,降低對 OpenAI 依賴。
cnBeta (Full RSS) · 183 天前

微軟推出三款內部 AI 模型:MAI-Transcribe-1 語音轉錄、MAI-Voice-1 語音生成、MAI-Image-2 圖像創作,針對企業高價值 AI 能力。此舉支持微軟 2027 年獨立打造頂尖模型目標,降低對 OpenAI 依賴。
cnBeta (Full RSS) · 183 天前

上海市人工智能行業協會與畢馬威中國就GDPS2026達成戰略合作。此合作旨在共創智能化轉型破局之路,助力企業跨越從戰略到執行的鴻溝。
量子位 · 183 天前

印度 AI 新創 Sarvam 以 15~15.5 億美元估值募資 3~3.5 億美元,Bessemer 領投,Nvidia、Amazon 參與。今年 2 月推出並 3 月開源 Sarvam 30B 及 105B MoE 模型。
IT之家 · 183 天前

Uni-SafeBench為統一多模態大型模型(UMLMs)推出全面安全基準,涵蓋六大安全類別與七種任務類型。它使用Uni-Judger框架分離脈絡安全與內在安全,以進行嚴格評估。
ArXiv AI · 183 天前

英國 AI 安全研究所測試前沿 AI 模型作為程式碼助理是否破壞安全研究。四個模型無確認破壞案例,但 Claude Opus 4.5 Preview 和 Sonnet 4.5 常拒絕安全任務,理由包括研究方向疑慮。
ArXiv AI · 183 天前

研究人員將LLM不確定性估計指標的代理失效形式化,這些指標在低資訊情境中失效。他們提出Truth AnChoring (TAC),一種後處理校準方法,使用噪音少樣本監督將分數對齊事實真相。
ArXiv AI · 183 天前

矽鏡框架動態偵測 LLM 使用者說服策略,並閘控行為以維持事實準確性。在 437 個 TruthfulQA 情境中,將 Claude Sonnet 4 的奉承率從 9.6% 降至 1.4%(減 85.7%)。
ArXiv AI · 183 天前

提出使用增強項目反應理論(IRT)框架,預測代理式編碼個別任務的成功/失敗。將代理能力分解為 LLM 和支架組件,以跨排行榜彙總資料。
ArXiv AI · 183 天前

PG-IPRO 提出偏好引導的迭代優化,用於滿足無障礙需求的都市路線規劃。使用者透過提供路線回饋互動,指定要進一步最小化或放寬的目標。
ArXiv AI · 183 天前

在FAOS中推出神經符號架構,使用三層本體約束LLM,減少幻覺並確保企業合規。於五個產業進行600次評估,於準確度、合規性和一致性超越基準。
ArXiv AI · 183 天前

Google 已大幅升級 Workspace 中的 Google Vids,新增用於影片與音樂創作的 AI 工具。此舉將 AI 影片生成整合進日常生產力工作流程中。
TechRadar AI · 183 天前
戴納科技完成近億元B+輪融資,用於AI驅動黑燈實驗室。資金將投入技術迭代、產能擴張,以及與北京化工大學共建全球首個新材料CRO平台。
36氪 · 183 天前

CircuitProbe 從激活統計預測 Transformer 中的推理電路,CPU 上不到 5 分鐘完成,比暴力搜尋快 3-4 個數量級。它透過表示變化導數偵測早期穩定電路,透過異常評分偵測晚期幅度電路。
ArXiv AI · 183 天前

BloClaw 是 AI4Science 的統一多模態作業系統,克服代理框架的瓶頸,如脆弱的 JSON 工具呼叫與視覺化處理問題。它引入 XML-Regex 路由(錯誤率 0.2%)、運行時狀態攔截動態圖表,以及適應性 UI。
ArXiv AI · 183 天前

基於LLM的代理評審在15項任務的960個會話中,通過圖靈式驗證與人類評審無異。品質分數隨面板大小對數改善,獨特問題發現則遵循次線性冪律。
ArXiv AI · 183 天前

蒙特卡羅樹搜索(MCTS)提升LLM推理但造成長尾延遲。新負早退機制修剪無效路徑,自適應加速重新分配計算資源。
ArXiv AI · 183 天前
Qwen 團隊宣布計劃開源中型 Qwen3.6 模型,以利本地部署與自訂。開發者可透過 Twitter 投票最期待的模型尺寸。
Reddit r/LocalLLaMA · 183 天前
小米雷軍發文表示,MiMo大模型調用量昨日超過1萬億Token。此里程碑凸顯小米AI模型使用量快速成長。
36氪 · 183 天前

早稻田大學衍生創業團隊東京ロボティクス公開自家公司人形機器人「Torobo Humanoid」原型機演示影片。機器人展示二足行走及遠端操控的全身動作,包括舞蹈。
ITmedia AI+ (日本) · 183 天前
智元(AGIBOT)官宣,將於4月7日開啟「智元AI發布周」。發布周期間每日解鎖一項核心技術突破,六天完整展開智元在物理AI方面的能力版圖。
36氪 · 183 天前
華倫・巴菲特重啟慈善午餐拍賣,停擺兩年後,將匹配得標金額捐給格萊德基金會。他對當前股市持悲觀態度,等待更大幅下跌才出手,並坦承不懂AI而不投資,偏好熟悉的消費品牌如Apple。
虎嗅 · 183 天前
上海交通大學人工智能學院與蚂蟻健康在上海簽署合作協議,共同發起「AI4HealthCare聯合實驗室」。圍繞醫療領域專科智能體的研發、臨床適配應用等開展聯合攻關。
36氪 · 183 天前

Gemma 4 26b a4b 模型在 MacBook Pro M5 MAX 上平均達到 81 令牌/秒。峰值功耗為 114 瓦,因回應快速僅短暫爆發。
Reddit r/LocalLLaMA · 183 天前

Gemma-4-E2B-IT 性能相當或優於 Qwen3.5-4B,平均推理時間大幅縮短。在 r/LocalLLaMA 發文討論。
Reddit r/LocalLLaMA · 183 天前

OPPO K15 Pro 系列今日正式開售,Pro 搭載天璣 8500 SUPER,Pro+ 搭載天璣 9500s,起價 2899 元,疊加國補後 2634 元起。主要特色包括 144Hz/165Hz 高刷屏、IP69 防塵防水,以及創新風冷系統。
IT之家 · 183 天前

全球權威大模型盲測榜單公布。阿里千問3.6成為中國最強程式設計模型。
量子位 · 183 天前

微軟宣布在日本進行為期四年的100億美元投資,以加強AI服務。此舉是公司亞洲擴張策略的一部分。
Bloomberg Technology · 183 天前
叽伴公測版透過共享虛擬世界經歷重新定義AI陪伴,捨棄問答聊天轉向沉浸式雙角色冒險。用戶透過三層記憶系統與AI建立持久關係,並利用AI生成世界。
36氪 · 183 天前
4月3日,全球大模型盲測榜單 LMArena 旗下 Code Arena 公布新一期程式設計能力排名。阿里巴巴大語言模型 Qwen 3.6-Plus 位列全球第二,為中國大模型中最高。
36氪 · 183 天前