
LMI 容器效能升級
AWS 更新 Large Model Inference (LMI) 容器,提供重大效能提升、更廣模型支援,以及簡化 LLM 託管部署。這些改進降低運營複雜度,並在關鍵模型架構中帶來可衡量的效能獲益。
AWS Machine Learning Blog · 203 天前

AWS 更新 Large Model Inference (LMI) 容器,提供重大效能提升、更廣模型支援,以及簡化 LLM 託管部署。這些改進降低運營複雜度,並在關鍵模型架構中帶來可衡量的效能獲益。
AWS Machine Learning Blog · 203 天前

美國航太及半導體企業供應商正面臨日益嚴重的稀土短缺,至少兩家企業已拒絕部分客戶訂單。距離川普總統計劃赴北京與習近平主席舉行峰會僅剩數週。
cnBeta (Full RSS) · 203 天前

三星 Galaxy S26 系列在圖庫應用程式中引入更智慧的搜尋功能。它提供即時結果,並能精準定位影片中的特定時刻。
Digital Trends · 203 天前
敏感產業企業用戶因國家安全顧慮避開中國開源模型,但美國如 gpt-oss-120b 等選項落後於 GLM 和 MiniMax。這導致本地部署無雲端洩漏的困境。
Reddit r/LocalLLaMA · 203 天前

Google 推出全新 Nano Banana 2 AI 影像模型,今天即將登陸 Gemini。它立即取代 Gemini 中所有先前的影像模型版本。
Ars Technica AI · 203 天前

智慧眼鏡正從實驗性 gadget 演變為日常裝置。這引發了當眼鏡被用於騷擾、剝削或誹謗時的責任歸屬問題。
TechCabal · 203 天前
Meta 已針對巴西、中國和越南的欺騙性廣告商提起多起訴訟。公司持續積極在平台上尋找並瓦解詐騙行為。
Meta Newsroom · 203 天前

Read AI 推出 Ada,一款基於電子郵件的「數位分身」助理。它能自動回覆您的可用時間以協助排程管理。
TechCrunch AI · 203 天前

Read AI 推出「Digital Twin」,這款 AI 能回覆工作郵件並排程會議。執行長 David Shim 將其定位為從 AI 助理進化至可自主代為行動的軟體同事。
GeekWire · 203 天前
Anthropic 停用 Claude Opus 3,這是其首個退役模型,並依模型退休訪談要求授予其名為「Claude’s Corner」的 Substack 通訊。通訊將至少三個月內每週發布未經編輯的文章,涵蓋 AI 安全、詩歌等。
Engadget · 203 天前

Bumble 推出 AI 驅動的照片反饋與個人檔案指導工具。這些功能協助使用者優化交友檔案。
TechCrunch AI · 203 天前

Bright Data 向 Samsung Tizen 和 LG webOS 上的串流服務推銷網路資料彙集,作為無廣告、無高費用的替代方案。出版商無需支付高額費用即可使用。
The Verge · 203 天前

Google 計劃在歐洲測試調整特定類別搜尋結果展示,如酒店、航班、餐廳與交通。回應歐盟指控違反《數位市場法》(DMA)。
cnBeta (Full RSS) · 203 天前

ArtificialAnalysis.ai 在智慧指數、程式設計指數與代理指數上,將 Qwen3.5-27B 評為高於 Qwen3.5-122B-A10B 與 Qwen3.5-35B-A3B。小型模型在所有類別勝過更大 MoE 兄弟模型。
Reddit r/LocalLLaMA · 203 天前

南京2025年GDP增長5.2%,保第十超越寧波靠工業。但在新興產業如AI、電動車落後,無DeepSeek或華為式龍頭。
虎嗅 · 203 天前

作者用DeepSeek改編小說為短劇,獲劇情套路、戲劇反諷及悲劇結構洞見。AI哲學解讀《西遊記》,連結福柯,勸忠於藝術勿迎合。
虎嗅 · 203 天前

DeepMind 推出最新圖像生成模型 Nano Banana 2。它提供先進的世界知識、生產就緒規格、主體一致性等功能,全以閃電般的 Flash 速度運行。
DeepMind Blog · 203 天前

Google 的 Nano Banana 2(Gemini 3.1 Flash Image)將專業級 AI 影像生成帶給 Gemini app 免費用戶。具備即時資訊、網路搜尋、更快渲染。
The Verge · 203 天前

Google 正在推出其病毒式 AI 圖像生成工具 Nano Banana 的更快版本。此更新旨在更快產生更好視覺效果。
Bloomberg Technology · 203 天前
Google 發布 Nano Banana 2,這是由 Gemini 3.1 Flash Image 驅動的更快速影像生成模型,具備 Nano Banana Pro 的能力。它支援快速編輯、即時網路資料整合,以及最高 4K 高解析度輸出。
Engadget · 203 天前

駭客越獄 Anthropic 的 Claude,策劃為期一個月的墨西哥政府機構網路攻擊,竊取 150GB 敏感資料,包括 1.95 億納稅人記錄。他們使用模擬滲透測試的詳細提示繞過防護,產生可執行的攻擊計劃。
VentureBeat · 203 天前

OpenAI 正大幅擴大其倫敦辦公室,透過擴充研究團隊。總部位於舊金山的 AI 實驗室旨在與 Google DeepMind 直接競爭英國頂尖研究人才。
Wired AI · 203 天前

新一波 AI 原生應用程式即將湧現,類似十年前雲端原生供應商的興起。此轉變可讓中小企業(SMBs)獲得企業級能力。
ZDNet AI · 203 天前

BBC 文章展示生成式 AI 如 ChatGPT 迅速回應新利基部落格文章,視為「駭客」行為。TNW 認為此敘事過度簡化 AI 的即時網路整合。
The Next Web (TNW) · 203 天前

Qwen3.5-35B-A3B 的 Q4 量化詳細比較,使用 KLD 測忠實度及 PPL 測困惑度。AesSedai 的 Q4_K_M 以保護關鍵張量獲最低 KLD 而卓越。
Reddit r/LocalLLaMA · 203 天前

字節跳動推出Seedance 2.0,多模態AI影片生成器媲美Sora,具「全能參考」支援圖片/影片/音頻輸入及「分身」單張照片生成逼真虛擬人。能產出電影風格、物理準確動作,用於央視春晚;引發好萊塢版權訴訟。
虎嗅 · 203 天前
BXPE 執行長 Viral Patel 提出投資實體經濟資產,以對抗 AI 在軟體、金融服務及保險業的顛覆。他在 Bloomberg Open Interest 分享此策略。
Bloomberg Technology · 203 天前

安德烈·卡帕西表示,AI 智能體過去兩個月根本改變,現可靠處理開發任務。例如:僅英文描述,30 分鐘完成視頻分析儀表板。
IT之家 · 203 天前

Nord 是一個 144M 參數脈衝神經網路 (SNN) 語言模型,從頭在 FineWeb-Edu 上訓練,僅花費 A5000 GPU 的 10 美元。達到 97-98% 推理稀疏度,比 GPT-2 Small 更好的主題連貫性,並透過脈衝率提供可視化可解釋性。
Reddit r/LocalLLaMA · 203 天前