一篇文章可以被搜尋引擎收錄,也可以被助手臨時讀取,還可能進入資料集。這些行為在伺服器日誌里都可能表現為請求,卻對應不同的用途、使用者體驗與商業關係。內容平台如果只有“允許所有機器人”和“全部拒絕”兩個選項,就很難表達創作者真正的選擇。

近來的協議與產品探索,正在嘗試把這些選擇變成機器能夠讀取、系統能夠處理的規則。對開發者來說,重要的是先拆清楚每種機制負責什麼,再討論是否接入。

行業正在探索什麼

Cloudflare 在 2026 年 7 月的文章中討論了 AI 搜尋效率與內容使用補償。與此同時,截至本文核查時,其 Pay Per Crawl 文件仍標注為封閉測試。趨勢和產品探索值得關注,但不能據此推斷所有網站都已能開通穩定的收費渠道。Cloudflare 行業觀察 · 產品狀態文件

RSL 1.0 於 2025 年 12 月發佈,提供描述數位資產使用、許可和相關條件的機器可讀詞彙及機制。它為系統交換規則提供了一種共同表達方式;實際採用程度、交易效果和收益,需要分別驗證。RSL 1.0 規範

我們的判斷是,這些探索讓內容平台多了一組可以評估的工具,但接入協議本身尚不足以形成完整業務。平台仍要處理權利來源、調用方身分、訪問執行和交易爭議。

把四個問題分開設計

層次 需要回答的問題 常見的混淆
內容發現 哪些頁面希望被索引、引用或推薦? 把可被發現理解為允許任意使用
訪問控制 誰能獲取全文、附件或介面結果? 只發佈規則,卻沒有技術執行機制
用途與許可 獲取內容後允許做什麼? 把一次讀取授權擴展到所有後續用途
商業結算 什麼事件產生費用,如何核對? 把請求次數直接等同於有效使用和收入

RFC 9309 明確指出,robots.txt 規則不構成訪問授權。它適合表達爬蟲應遵循的訪問規則,但不能替代需要身分驗證的內容介面。RFC 9309

HTTP 狀態碼也需要放在具體協議中理解。例如,RFC 9110 將 402 保留供未來使用;某項服務使用 402 表達付費要求,並不意味著通用瀏覽器或任意 AI 客戶端已經實現統一付款流程。RFC 9110

從一張內容權利清單開始

假設平台上有作者原創文章、使用者上傳影片、外部引用和開放許可資料。它們可能展示在同一頁面,卻不能僅憑託管位置就被視為具有完全相同的授權條件。

我們建議先梳理平台能夠代表誰作出什麼決定:作者是否授權平台安排機器訪問,附件是否包含其他權利人的內容,現有許可如何影響可設置的條件。這些問題未澄清前,技術團隊不宜只給頁面加上價格字段就宣佈已經完成內容授權。

隨後,可以把內容標識、版本、規則生效時間和發佈者聲明對應起來。調用方看到的條款應能追溯到某個具體版本,平台也要能說明規則何時發生過變化。否則,同一個連結在不同時間代表不同條件,事後很難核對。

商業機制需要可解釋的計量

“按抓取收費”和“按使用收費”對系統提出的要求不同。前者需要定義有效請求、快取和重試的處理方式;後者還需要解釋什麼算使用,以及平台能夠直接觀察哪些事件。

作為設計建議,可以先做一個範圍很小的試點:選擇權利清楚的內容、明確的調用方和能夠核對的訪問方式。分別記錄訪問成功、許可匹配和結算結果,不把一次 HTTP 成功響應當成三項工作都已完成。

計量還應處理失敗情形。重復請求是否重復計費,未完整返回的內容如何處理,調用方預算耗盡時怎樣反饋,都應在介面和產品說明裡講清楚。儀錶盤中的請求量也不應被直接包裝成創作者收入預測。

開放性需要保留具體選擇

Creative Commons 對 pay-to-crawl 給出了有條件的討論:這類系統可能幫助部分網站維持運營,也可能造成新的控制集中或妨礙公共利益訪問;其建議強調區分使用者與用途,保留細緻選擇。Creative Commons 的觀點

對平台的啓示是,把正常閱讀、搜尋發現、研究訪問與商業內容服務放在同一條收費規則下,未必能實現預期目標。產品需要讓創作者理解規則,也需要給調用方留下明確的聯繫、糾錯與爭議處理入口。

還應減少計量所需之外的資料收集。為了核對一項授權而無限追蹤終端使用者,會引入新的複雜性。具體合同和法律適用應另行審查,技術協議不能代替這些判斷。

對於 AlphaBiz 這類關注內容分發與交易的項目,值得研究的是如何使內容標識、作者選擇和訪問行為相互對應。本文討論的是設計方向,不構成接入任何 AI 授權或付費協議的產品公告。

如果你正在為內容應用設計相關能力,歡迎在 AlphaBiz Discussions 描述你的內容類型、可觀察的計量事件和開放訪問需求。先把問題定義清楚,才有條件判斷某項協議是否真正適用。