Cloudflare/官方:AI Search 正式全面開放——原生圖像嵌入與掃描 PDF OCR;十一月起計費;免費額度涵蓋所有 Workers 方案

重點摘要

Cloudflare 宣布旗下託管檢索產品 AI Search 正式全面開放(generally available):在原有文字索引之上,新增原生圖像嵌入、掃描版 PDF 光學字元辨識(OCR),並把單檔上限由約四兆位元組提升至十兆位元組。官方指自家網誌與開發者文件亦已採用同一產品。

Cloudflare/官方:AI Search 正式全面開放——原生圖像嵌入與掃描 PDF OCR;十一月起計費;免費額度涵蓋所有 Workers 方案

Cloudflare 宣布旗下託管檢索產品 AI Search 正式全面開放(generally available):在原有文字索引之上,新增原生圖像嵌入、掃描版 PDF 光學字元辨識(OCR),並把單檔上限由約四兆位元組提升至十兆位元組。官方指自家網誌與開發者文件亦已採用同一產品。

計費將於二零二六年十一月一日起生效,所有 Workers 方案仍享有每月免費額度;攝取、儲存與查詢分開計價,嵌入與重排在特定 Workers AI 模型下可免額外包。對香港企業而言,這等於把內部知識庫、產品圖庫與掃描合約放進同一條可估價的 RAG 管道。

Cloudflare/官方:AI Search 正式全面開放——原生圖像嵌入與掃描 PDF OCR;十一月起計費;免費額度涵蓋所有 Workers 方案

引言

2026 年 10 月 1 日,Cloudflare 於官方網誌宣布 AI Search 進入正式開放階段。產品結合 Workers AI、Vectorize、R2 與 Browser Run,提供託管式索引與檢索流水線;自約一年前推出以來,已用於內部文件搜尋與網站搜尋等場景。本文依據 Cloudflare 官方公告整理功能與定價要點,來源真實性已驗證。

故事與稍早同日上線的託管版 Cloudflare OS、AI Gateway Auto Router 等屬同一產品波段,但標的不同:AI Search 聚焦「可計費、可估價的企業檢索/RAG」,而非代理工作區或模型路由。

一、核心事件:由預覽走到正式開放

技術細節

根據官方說明,全面開放當日起的主要更新包括:

  • 原生多模態嵌入:不再只靠「先做物件偵測與字幕、再對字幕做文字嵌入」的簡化路徑;系統會同時保留字幕(文字理解)與對圖像像素的直接嵌入(視覺檢索),並採用 Matryoshka Representation Learning(MRL)以在較小維度下保留可用資訊。
  • 查詢端行為:若實例所用嵌入模型支援圖像,查詢圖會直接嵌入同一向量空間;若模型僅支援文字,則先經 ToMarkdown 將查詢圖轉為字幕再搜尋,使文字模型仍有基本多模態能力。
  • 查詢管線:查詢可選擇改寫後嵌入;向量檢索與關鍵字檢索並行,結果融合後可選擇重排;最後回傳片段,或交由生成模型撰寫答案。
  • 更大檔案與 OCR:文字類檔案(Markdown、HTML、CSV、JSON 等)與 PDF 上限由約 4 MiB 提升至 10 MiB;對無文字層的掃描 PDF,可開啟 OCR,於分塊與嵌入前讀取頁面文字。OCR 向所有帳戶開放,並按新定價中的影像處理攝取代幣計費。
  • 計費時程:正式開放後,2026 年 11 月 1 日起開始對 AI Search 計費;計費前會再寄提醒電郵。所有 Workers 方案維持慷慨免費額度。

官方強調定價設計目標是「在索引任何檔案前即可估算帳單」:付費面向為攝取內容、儲存資料、執行查詢;中間的剖析、分塊、以 Workers AI 模型嵌入、關鍵字索引與重排等,在選定模型下納入方案,不另收實例時數、容量單位或月最低消費。

二、技術原理深度解析

傳統企業搜尋多依賴關鍵字與後設資料;生成式 AI 興起後,檢索增強生成(RAG)把「切塊 → 嵌入 → 向量召回 → 可選重排 → 語言模型作答」變成標準棧。難點往往不在 Demo,而在營運:多格式文件、掃描稿、產品圖片、成本可預測性,以及是否要把整條管線自建在向量資料庫與 GPU 叢集上。

AI Search 的產品化選擇是把上述管線收成託管服務,並與 Cloudflare 既有邊緣運算與物件儲存組件對齊:

  1. 雙通道理解圖像:字幕適合「說得出來的語意」;原生圖像嵌入保留紋理、構圖、色溫、圖表空間關係等難以用一句 caption 窮舉的訊號——對電商圖庫、介面截圖、掃描圖紙尤其有用。
  2. 混合檢索:向量(語意)與全文/關鍵字並行再融合,降低「只靠向量漏掉精確型號/條款編號」或「只靠關鍵字漏掉同義表述」的單邊風險。
  3. OCR 作為攝取前置:掃描 PDF 若無文字層,沒有 OCR 就幾乎無法進入文字 RAG;官方把 OCR 納入同一產品與同一套攝取代幣計量,減少另接第三方 OCR 的整合成本。
  4. 計價單位對齊營運語言:以代幣攝取、GB-月儲存、每千次語意/全文查詢計費,並公布免費額度(例如每月基礎攝取與影像處理各屬同一 5M tokens 池、儲存 10 GB、語意與全文查詢各 1,000 次等——以公告表為準),方便財務與架構師做容量規劃。

這並不取代企業對資料分類、權限邊界與提示注入防護的責任;它降低的是「從零組裝檢索棧」的工程與維運門檻。

四、日常應用場景

1. 開發者與技術團隊

可把產品說明、API 文件、執行手冊與設計截圖納入同一索引,用自然語言或「以圖找圖」輔助除錯與內部知識問答。對已在 Workers/R2 上的團隊,減少另架向量庫與排程爬蟲的樣板程式。

2. 企業與隱私敏感行業

法律、金融、醫療與製造業常同時握有掃描合約、圖紙與產品照片。OCR 加多模態檢索,有助把「紙本掃描+影像資產」納入可審計的內部搜尋,而不必先全部人工打字。權限、資料駐留與模型選擇仍須按合規要求另行設計——若資料不能出境,應評估私有部署或境內託管方案,而非假設公有雲檢索即等於合規完成。

3. 一般用戶

終端用戶感受多半是「網站/應用內搜尋更懂圖、也更能讀掃描稿」。計費與配額主要由建置方承擔;免費額度適合原型與小型專案。

4. 香港與亞洲市場視角

香港企業數碼轉型常見痛點是:中英夾雜文件、大量掃描 PDF、以及電商/零售圖庫與說明書分離。託管式多模態搜尋降低 POC 門檻;同時,對有 NDA、客戶資料不出境要求的機構,仍需把「檢索棧」與「模型託管位置」分開評估。YSK Limited 在香港提供企業私有 LLM 全託管與應用整合,可與公有雲檢索元件或完全私有 RAG 架構並用,視資料分級而定。

五、專業評價與潛在考量

優勢

  • 一級官方來源清楚:GA 時點、多模態與 OCR、10 MiB 上限、11 月 1 日起計費與免費額度結構均可核對。
  • 把「圖+掃描稿+文字」放進同一產品敘事,貼近真實企業語料,而非只示範純 Markdown 知識庫。
  • 定價表分開攝取/儲存/查詢,利於做成本模型;官方亦預告後續影音攝取與關鍵字引擎擴容。

需要留意的地方

  • 正式計費尚有約一個月緩衝,架構師應在十一月前用實際語料壓測查詢量與影像處理代幣。
  • 儲存與語意查詢並非免費無限;高流量面向顧客的搜尋需另做快取與配額策略。
  • 多模態與 OCR 提升召回,也放大錯誤字幕、掃描品質差、提示注入與越權讀取等風險,仍需權限分層與評測集。
  • 不應與同日其他 Cloudflare Birthday Week 產品(例如託管 Cloudflare OS、Workers KV Instant)混淆:AI Search 的賣點是檢索/RAG,不是代理作業系統或全球組態 KV。

結語

Cloudflare 把 AI Search 推上正式開放,並補上原生圖像嵌入、掃描 PDF OCR 與可預估的計費模型,標誌託管式企業檢索從「預覽玩具」進入可納入預算的基礎設施選項。對要做內部知識助理、多模態產品搜尋或文件問答的團隊,這縮短了組裝向量庫與 OCR 的時間;對資料敏感的香港機構,則應同步規劃模型與語料的駐留邊界。

若貴司需要在香港以私有資料建置企業檢索或 RAG,並要求微調與 API 託管、數據不出境,可參考 YSK Limited 的企業私有 LLM 全託管服務(https://ysk.hk/services/ai-automation),年費 HK$88,000 起,涵蓋資料集、QLoRA/LoRA 微調與 OpenAI 相容私有 API。


參考來源

  1. Cloudflare(官方網誌):AI Search is now generally available(2026-10-01)— https://blog.cloudflare.com/ai-search-ga/
  2. Cloudflare Blog RSS(發現來源)— https://blog.cloudflare.com/rss/

延伸閱讀 · 相關服務與產品