🔗Wired AI•最新收集於 30m
Cara 攜手合作,保護藝術家免受 AI 爬取

#ai-training-data#art-rights#web-scraping#creator-consentcaracara
💡Cara 遭遇的藝術作品爬取爭議,凸顯 AI 團隊需要更完善的創作者同意與資料集治理。
⚡ 30-Second TL;DR
有什麼變化
Cara 專為不希望作品被用於 AI 訓練的藝術家而設計。
為什麼重要
這項合作凸顯資料爬取、AI 訓練與創作者保護之間的複雜關係。對 AI 公司而言,這再次說明尊重創作者同意權的重要性,也應將反對未經授權收集資料的平台納入考量。
下一步行動
在匯入作品集平台資料前,稽核你的訓練資料管線,並加入有文件記錄的創作者同意、退出機制與來源排除檢查。
誰應關注:Creators & Designers
關鍵要點
- •Cara 專為不希望作品被用於 AI 訓練的藝術家而設計。
- •一名過去曾爬取藝術家作品的人,如今正合作開發保護藝術家的工具。
- •網路惡意人士曾透過爬取並發布平台資料來攻擊 Cara。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 8 個來源。
🔑 增強重點摘要
- •Cara 是一個由志願者營運的平台,目前擁有約 150 萬名用戶,且未接受風險投資,這使其在應對大規模爬取攻擊時面臨嚴峻的財務與營運壓力。
- •在 2026 年 8 月的十天內,Cara 遭受了三次針對性的 AI 資料爬取攻擊,導致其用戶的版權圖像與元數據被非法散佈至 Academic Torrents、Reddit 與 Hugging Face 等平台。
- •Cara 創辦人張晶娜(Jingna Zhang)正與開發者合作研發名為「Lantern」的工具,旨在協助藝術家追蹤其作品是否遭到爬取,並定位數據被託管的具體位置。
- •儘管 Cara 在所有用戶貼文中自動加入「NoAI」HTML 元數據標籤,但平台承認這僅是一種請求機制,無法從技術層面完全阻止專業爬蟲的繞過。
- •Cara 的崛起始於 2024 年年中,當時因 Meta 宣布將 Instagram 用戶內容用於 AI 訓練,導致大量藝術家轉向該平台尋求保護。
📊 競品分析▸ Show
| 特色 | Cara | ArtStation | |
|---|---|---|---|
| AI 訓練授權 | 預設禁止 (NoAI) | 預設允許 | 需手動設定 |
| 商業模式 | 志願者營運/社群支持 | 廣告/數據變現 | 廣告/招聘/市集 |
| 核心定位 | 藝術家權益保護 | 大眾社交媒體 | 專業作品集/招聘 |
🛠️ 技術深入
- NoAI 標籤:透過在 HTML 標頭中嵌入 metadata 標記,向爬蟲發出禁止抓取請求。
- Lantern 工具:專注於數據溯源與監控,透過比對技術識別已遭爬取的圖像分佈路徑。
- 數據防護限制:現有防護依賴於爬蟲對 robots.txt 或 HTML 標籤的遵守,缺乏針對圖像像素層級的加密或混淆技術。
🔮 前景展望AI analysis grounded in cited sources
「NoAI」標籤將在未來兩年內失去作為主要防禦手段的效力。
隨著爬蟲技術不斷演進以繞過前端標籤,藝術家將被迫轉向更複雜的數位浮水印或像素級干擾技術。
Cara 將面臨嚴重的法律訴訟成本壓力。
由於平台缺乏風險投資支持,持續的法律行動與伺服器維護成本將威脅其作為非營利項目的長期生存能力。
⏳ 時間線
2024-06
因 Meta 調整 AI 訓練政策,Cara 作為藝術家避風港迅速崛起。
2026-08
十天內遭受三次大規模 AI 資料爬取攻擊,引發社群與創辦人強烈反彈。
2026-08
Cara 用戶數據被發現於 Academic Torrents 等平台公開散佈。
📎 來源 (8)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Wired AI ↗
每週 AI 簡報
每週一封,可隨時退訂。