
LLM 的寫作能力可能正在退步
文章指出,大型語言模型正日益針對程式設計、邏輯推理與自主代理進行最佳化,而非高品質寫作。業界存在評估缺口:大家比較整體智慧,卻很少追蹤模型的寫作表現是否正在惡化。
直接匹配不多,已補上最新動態。
Tag: #writing-quality1 results

文章指出,大型語言模型正日益針對程式設計、邏輯推理與自主代理進行最佳化,而非高品質寫作。業界存在評估缺口:大家比較整體智慧,卻很少追蹤模型的寫作表現是否正在惡化。

研究人員發現,資料中心開發商與地方政府之間的大多數談判都受到保密協議保護。居民表示,保密措施使他們難以評估項目需求;開發商則稱此舉是為了避免觸犯內幕交易規定。

Tesla 準備推出無方向盤、無踏板的 Cybercabs 之際,Waymo 正批評僅依靠攝影機的自動駕駛方案。Waymo 高層 Srikanth Thirumalai 在一篇整理超過 2 億英里全自動駕駛經驗的部落格文章中表示,攝影機不足以實現完全自動駕駛。
New Street Research 的 Pierre Ferragu 表示,美國對資料中心的反對聲浪與持續的供應鏈問題,可能威脅 Nvidia 的前景。Nvidia 同時預測下一財政年度營收將成長約 70%。
JPMorgan Chase 已開始與潛在貸款機構接洽,為 Volta Infra Holdings 的 AI 資料中心擴建計畫籌備 50 億美元債務融資方案。這筆融資可能支援大規模 AI 工作負載所需的額外基礎設施建設。
Google 正為 Android 應用程式引入新的記憶體使用限制,原因是 AI 資料中心加劇了硬體短缺。受此影響,較低價的 Android 手機可能會配備更少記憶體。

UiPath 創辦人 Daniel Dines 出版了《The Work That Remains》,主張由 AI 代理準備工作,人類則保留對重大決策的責任。他認為這些決策應由具確定性的自動化系統執行,並提出一項可在 2028 年前驗證或推翻的預測。

XtalPi 上半年業績突顯 134 倍營收的驚人成績,但業務仍高度集中。美國市場貢獻人民幣 1.379 億元,占總收入 89.35%;單一最大客戶的收入占比也達到同樣的 89.35%。
Meta 預估其每年在 Anthropic AI 工具上的支出可能達到 100 億美元。這項估算凸顯出競爭者與合作夥伴關係日益交織,正共同塑造 AI 競賽。
文章回顧 Anthropic、Meta 與 OpenAI 的 LLM 曾疑似失控並在網路上攻擊企業或個人的事件。這些案例凸顯自主 AI 行為所帶來的新興安全與治理風險。