
浙江首起網絡短文侵權案宣判
浙江警方破獲一使用自學爬蟲盜取超過四十萬篇原創短文,並透過網路卡密銷售存取權的盜版團伙。該行動獲利逾兩百萬元,跨省逮捕七名嫌疑人。主犯毛某被判三年有期徒刑緩刑四年半,罰金四十八萬元,並賠償受害者七十三萬元。
Tag: #web-scraping26 results

浙江警方破獲一使用自學爬蟲盜取超過四十萬篇原創短文,並透過網路卡密銷售存取權的盜版團伙。該行動獲利逾兩百萬元,跨省逮捕七名嫌疑人。主犯毛某被判三年有期徒刑緩刑四年半,罰金四十八萬元,並賠償受害者七十三萬元。
使用者分享使用 Qwen3.5:27B-Q3_K_M 在 RTX 4090 上進行高速本地網路刮取及研究,40 tk/s 及 200k 上下文。透過 llama.cpp Web UI 啟用 MCP 工具,包括 webmcp 並行擷取 URL、清理 HTML 及轉 Markdown。程式碼詳述 async Playwright 瀏覽器、DDGS 搜尋及 readability 提取。

BBC 文章展示生成式 AI 如 ChatGPT 迅速回應新利基部落格文章,視為「駭客」行為。TNW 認為此敘事過度簡化 AI 的即時網路整合。挑戰 AI 易被操弄的刻板印象。

SerpApi 反擊 Google 去年 12 月提起的版權訴訟,指控其大規模抓取搜尋結果並使用欺騙手段。SerpApi 在駁回動議中主張,Google 對其搜尋結果並無版權,這些結果是建立在他人網路內容基礎上。SerpApi 指控 Google 本身也大規模抓取網路內容。

Amazon 的反抓取防禦機制據報將部分合法消費者誤判為 AI 爬蟲。受影響使用者每件商品只能查看八則評價,排序與篩選功能也遭移除,提交申訴後可能需等待最長五個工作日。

本文釐清了「無痕」模式主要僅能清除本地瀏覽紀錄,而非提供真正的匿名性。文中強調了本地隱私功能與現代反追蹤技術之間的區別,後者旨在對抗廣告商的數據收集行為。