
劉壯陳丹琦新作:開源通用視覺推理RL框架,0思考數據刷新SOTA
劉壯與陳丹琦發布開源通用視覺推理RL框架。該框架無需思考數據即刷新SOTA。廣泛數據是視覺推理RL擴展的主要驅動力。
Tag: #open-source345 results

劉壯與陳丹琦發布開源通用視覺推理RL框架。該框架無需思考數據即刷新SOTA。廣泛數據是視覺推理RL擴展的主要驅動力。

Claude 封殺「龍蝦」後,Anthropic 推出自家 Agent 服務。開源平替方案迅速在 GitHub 獲 2.6k Star。

DeepSeek 推出重大升級,攪動 AI 圈子。V4 似乎即將來臨。文章附上體驗細節。

新型神經符號架構從 ARC 格網提取物件結構,透過神經先驗提出 DSL 轉換,並以跨範例一致性過濾假設。它將 ARC-AGI-2 上基底 LLM 效能從 16% 提升至 24.4%,結合 ARC Lang Solver 達 30.8%。該開源系統無需任務特定微調或強化學習。

Tiiny AI Pocket Lab外接盒5小時Kickstarter破百萬美元,至今295萬2093支持者,售1399美元起;解決本地100B LLM隱私易用需求,非AI PC或樹莓派替代。基於上交PowerInfer開源引擎。

印度 AI 新創 Sarvam 以 15~15.5 億美元估值募資 3~3.5 億美元,Bessemer 領投,Nvidia、Amazon 參與。今年 2 月推出並 3 月開源 Sarvam 30B 及 105B MoE 模型。旗艦 105B-A9B 在印度語言基準勝過 Gemini 2.5 Flash。
OpenClaw 2026.4.2 引入 xAI 和 Firecrawl 外掛配置的重大遷移至標準化路徑,可透過 'openclaw doctor --fix' 修復。它恢復耐用任務流程編排,包含管理子任務、取消處理及外掛 API。額外改進包括 Android 助理整合、LLM 回覆鉤子,以及 Feishu 評論和 Matrix 提及等平台特定功能。

蘋果下架AI編程App Anything,並凍結Replit更新,因執行未審核代碼。Karpathy推廣的Vibe Coding讓非程式員建App,但製造不安全「屎山」—Lovable 10% App暴露用戶資料。開源維護者遭AI垃圾PR與假漏洞淹沒如DDoS。

ggerganov 的 attn-rot(TurboQuant lite)即將合併進 llama.cpp,為 Qwen3.5 模型提供更低的 KV 量化 KLD 誤差。基準測試顯示 35B、27B 和 122B 變體在 VRAM 和 CPU 上 q4_0 品質提升且速度相當。本地推理速度預期加快。

法國開源平台 Kestra 由 RTP Global 領投 2500 萬美元 A 輪融資,總資金達 3600 萬美元。企業收入 18 個月內成長 25 倍,2025 年執行逾 20 億工作流程。編排資料、AI、基礎設施及商業工作流程。