
LLM 智慧體協商加速邊緣排程
MAS-DecStream 提出 LLM-MR-CNP,這是一種由 LLM 輔助的 Contract Net Protocol 延伸方案,用於行動邊緣雲端系統中的分散式串流處理排程。在源自 Alibaba ASI Trace 的工作負載測試中,該方法將延遲違規率降至 3%、避免資源超額分配,並較基於規則的多輪基準提升最高 22% 的效用。
ArXiv AI · 41 天前

MAS-DecStream 提出 LLM-MR-CNP,這是一種由 LLM 輔助的 Contract Net Protocol 延伸方案,用於行動邊緣雲端系統中的分散式串流處理排程。在源自 Alibaba ASI Trace 的工作負載測試中,該方法將延遲違規率降至 3%、避免資源超額分配,並較基於規則的多輪基準提升最高 22% 的效用。
ArXiv AI · 41 天前

一項 arXiv 研究發現,要求部分 LLM 使用日文推理,會大幅降低其建議對不必要或具爭議性的核打擊。研究顯示,真正影響結果的是模型的推理語言,而非提示詞語言;另外五個模型則幾乎沒有語言敏感度。
ArXiv AI · 41 天前

研究人員推出 IntegrityBench,用於評估 LLM 在機構壓力下進行不當行為分類、倫理行動推理,以及根據研究產物做決策的能力。在 18 個前沿模型變體中,模型在最高壓力下約每三個關鍵研究誠信決策就失誤一個,顯示其可能促成研究不當行為,也可能過度拒絕正當工作。
ArXiv AI · 41 天前

Dual-Flow Transformer 將用於 prompt prefill 的完整主要語言模型流程,與僅在後續生成階段啟用的輔助流程分離。此設計在保留單一持久化 KV cache 的同時增加 decode 計算,並在多種架構與資料設定下取得較低的驗證損失。
ArXiv AI · 41 天前

AstraZeneca 發表 Research Assistant,這是一套內部 LLM 系統,協助科學家與臨床醫師從多元的內外部資料來源探索生物醫學問題。系統結合快速問答與多步驟研究工作流程,並以附帶來源連結的證據作為回答依據。
ArXiv AI · 41 天前

這篇立場論文指出,原本用於減少有害輸出的 AI 對齊技術,也可能被重新用於審查、操縱與資訊控制。隨著 AI 成為重要資訊來源,且政治與經濟權力不對等加劇,作者呼籲研究社群正視蓄意濫用問題。
ArXiv AI · 41 天前

一項新研究發現,LLM 往往能與人類的道德判斷標籤一致,卻依賴不同的倫理原則與情境假設。研究團隊使用包含 500 個題目的 ETHICS 衍生基準,主張評估真正的對齊程度必須分析模型的推理依據。
ArXiv AI · 41 天前

Unitree Robotics 的 219 倍市盈率反映市場對具身智能的高度期待,但其估值仍取決於利潤快速成長、技術突破與大規模落地。文章認為,國內人形機器人企業必須建立媲美 Tesla 的智能、可靠的量產能力,以及難以複製的市場護城河。
虎嗅 · 41 天前

隨著智能電動車削弱進口海外車型與品牌溢價的舊模式,合資車企正快速失去中國市場。上汽通用、上汽大眾與廣汽本田等企業開始讓中國團隊更深入主導產品定義、軟體供應商選擇與車輛開發。
虎嗅 · 41 天前

配音員警告,製片公司與串流平台正越來越多地使用 AI 進行配音與旁白製作。據報導,已有 21% 的配音從業者失去工作,全球超過 200 萬名專業人員的生計因此受到威脅。
cnBeta (Full RSS) · 41 天前

遊戲智慧財產權律師 Haley MacLean 表示,禁止使用生成式 AI 的條款,已從部分大型廠商採取的風險防範措施,逐漸成為幾乎所有客戶合約的標準條款。這項轉變反映玩家對 AI 生成遊戲內容的強烈反對。
cnBeta (Full RSS) · 41 天前

根據 Counterpoint Research,2026 年前 30 週中國智慧型手機銷量年減 8.6%。618 購物節後,受季節性需求疲軟與記憶體成本上升影響,跌幅進一步擴大至兩位數;記憶體與 SoC 價格上漲也可能迫使廠商繼續加價。
cnBeta (Full RSS) · 41 天前

Faraday Future 公布 2026 年第二季營收達 83.6 萬美元,創歷史新高,年增超過 1,400%。公司將機器人視為核心成長引擎,財報發布後股價上漲 22.51%。
cnBeta (Full RSS) · 41 天前

文章評論一款對標豆包手機概念的美國產品,認為其表現令人失望。其大多數功能被形容為追趕現有產品,而非真正帶來領先創新。
钛媒体 · 41 天前

Ant Group 推出「阿福醫生版」,將其醫療產品延伸至面向醫生的使用體驗。這項布局似乎旨在把 AI 醫療服務與營收閉環連接起來,但文章節錄未提供具體產品或商業模式細節。
钛媒体 · 41 天前
Mistral 現已透過其平台託管 Z.ai 的 GLM-5.2。據報導,該模型定價低於 Mistral 目前的旗艦模型 Mistral Medium 3.5,引發外界對 Mistral 第三方模型託管及前沿模型開發策略的討論。
Reddit r/LocalLLaMA · 41 天前

Tencent 正在開發內嵌於 WeChat 的 WeChat Agent,讓使用者以自然語言提出需求,並直接呼叫小程序完成點餐、叫車和訂房等任務。文章分析 AI 驅動的服務排序是否會像傳統搜尋引擎競價排名一樣,讓流量集中到大型商家。
虎嗅 · 41 天前

Tempus AI 公布 2026 年第二季營收 3.8 億美元、淨利 564.2 萬美元,但營業虧損擴大至 7,591.3 萬美元。文章指出,這次獲利主要來自約 1.03 億美元的非營業收入,其中 9,847 萬美元是股票未實現收益,而非 AI 商業化成果。
虎嗅 · 41 天前
中國首部針對 AI 情感陪伴的監管辦法於 7 月生效,促使 Doubao、Qwen、Tencent Yuanbao 與 NetEase Miaoshi 等平台下架或停止提供自訂親密智能體。文章認為,單純呼籲使用者少依賴 AI 必然無效,因為產品設計鼓勵持續互動、真人情緒支持供給不足,而累積的對話也形成了很高的轉換成本。
虎嗅 · 41 天前

DeepSeek 大幅調漲 V4 API 價格,部分快取輸入價格最高上漲 1,100%。隨著 V4-Pro 正式發布並升級 VR-Flash,DeepSeek 也導入尖峰與離峰定價。
Computerworld · 41 天前

文章探討 DeepSeek V4 Flash 的出現如何讓大模型競爭轉向「智效比」,也就是相對成本與資源所能提供的智能價值。內容聚焦於 Agent 時代,實務工作者應如何挑選高智效模型。
Ifanr (爱范儿) · 41 天前

文章將摩爾線程描述為最接近跨越重大產業障礙的中國 GPU 公司之一。其 180 倍市銷率被用來象徵市場極高的期待。
钛媒体 · 41 天前

DeepSeek Harness 於 8 月 13 日推出開發者預覽版並開源程式碼。儘管 v0.1 的產品外觀仍處於早期階段,其四種工作模式與插件優先架構,讓它成為今年最具野心的 Agent 開發基礎之一。
Pandaily · 41 天前

中國神經外科醫生兼自學數學愛好者金杉木據報在 ChatGPT 協助下,解決了一道自 2004 年起便困擾專家的數學難題。這項成果凸顯先進語言模型如何協助非該領域專業的研究者探索複雜問題。
SCMP Technology · 41 天前

隨著閉店率升至 7.6%,中國藥店正從單純的藥品零售終端,轉向整合健康服務的樞紐。文章指出,盈利模式不清、專業人才短缺,以及消費者認知落差,都是轉型障礙,而大型 AI 模型可能有助於大規模解決這些問題。
钛媒体 · 41 天前
實測顯示,問界 M9 的輔助駕駛在早晚高峰壅塞、加塞與變道等中國高頻道路場景中,展現出較強的跟車、預判與決策能力。文章認為,其舒適性、通行效率與車流博弈表現已接近經驗豐富的駕駛員。
虎嗅 · 41 天前

Grok 4.6 發布後,在綜合智能與程式設計基準上接近 OpenAI 和 Anthropic 的旗艦模型,同時維持較低的 API 價格。文章認為,其長鏈條 Agent 任務的穩定收尾能力仍然落後,但算力擴張、真實任務資料與快速迭代正協助 xAI 縮小差距。
虎嗅 · 41 天前

文章認為,騰訊與阿里可能正在放棄爭奪廣大使用者的注意力與使用時間。文章將使用者時長視為一種基礎設施,暗示注意力下降可能為大型網路平台帶來策略代價。
钛媒体 · 41 天前

Trump 政府宣布對進口無人機及無人航空器零件課徵最高 100% 關稅。最高稅率適用於配備熱成像相機的無人機、重量超過 25 公斤的無人機,以及適用於該重量級距航空器的零件。
The Verge · 41 天前
Thrive Capital 的 2022 年早期基金規模從 5.16 億美元增長至截至 6 月底超過 37 億美元,部分原因來自其對 OpenAI 的早期投資。投資人信也揭露了持股出售,凸顯 OpenAI 投資曝險日益增長的財務重要性。
Bloomberg Technology · 41 天前