NLWeb(Natural Language Web)— Microsoft 開放標準讓網站與 AI Agent 直接對話
咩嘢係 NLWeb?點解香港企業需要關注?
NLWeb(Natural Language Web)係 Microsoft 喺 2025 年 Build 大會推出嘅開放原始碼項目,由曾創建 RSS、RDF 同 Schema.org 嘅互聯網先驅 R.V. Guha 開發。簡單講,NLWeb 嘅目標係「讓每個網站都可以用自然語言同人同 AI Agent 對話」。
根據 Moz 嘅 Whiteboard Friday 解說 同 Microsoft 嘅正式發布,NLWeb 嘅核心概念好簡單:將網站變成一個可以被自然語言查詢嘅 API。
想像吓,你嘅香港電子商務網站有成千件產品。用戶或 AI Agent 可以直接問:「我想揾一款適合香港夏天、透氣、預算 $500 左右嘅運動鞋」,NLWeb 會直接喺你嘅結構化數據中檢索相關產品,返回精準嘅答案——而唔係傳統站內搜尋嘅「Sorry,冇結果」。
NLWeb 點樣運作?
NLWeb 利用網站已經有嘅結構化數據(Schema.org JSON-LD、RSS Feed、其他 JSONL 格式),通過兩個端點提供自然語言查詢能力:
/ask——RESTful 端點,接受自然語言查詢,返回 Schema.org 格式嘅結構化答案。用戶可以直接喺網站上用自然語言提問/mcp——MCP(Model Context Protocol)伺服器端點,讓 AI Agent 可以自動發現並呼叫你嘅網站內容
整個流程係:自然語言查詢到達網站 → NLWeb 伺服器查詢向量數據庫(Vector DB)尋找相關內容 → LLM 對結果進行評分 → 返回 Schema.org JSON 格式嘅結構化答案。AI Agent 唔需要逐個 HTML 頁面爬取,而係直接通過 API 獲取精準資訊。
NLWeb 嘅生態發展:Cloudflare 整合令部署更簡單
截至 2026 年中,NLWeb 嘅生態已經有顯著發展:
- GitHub 6,200+ Stars——項目活躍維護,R.V. Guha 本人係直接貢獻者
- Cloudflare 整合——Cloudflare 嘅 AI Search 產品支援 NLWeb 部署,如果網站已經用緊 Cloudflare,唔需要額外嘅向量數據庫基礎設施
- 早期採用者——TripAdvisor、Shopify、Eventbrite、O'Reilly Media、Hearst(Delish)、Chicago Public Media、Common Sense Media 等已部署 NLWeb
- 模型兼容——支援 Deepseek、Gemini、Claude 等主流 LLM,同 Qdrant、Snowflake、Elasticsearch 等向量數據庫
NLWeb 同 WebMCP 有咩分別?
我哋之前介紹過 WebMCP(Web Model Context Protocol),咁 NLWeb 同 WebMCP 係競爭定互補?
根據 DAC Group 嘅分析,佢哋係互補嘅:
- WebMCP——瀏覽器層級嘅 Agent 協定,讓 AI Agent 喺用戶瀏覽網站時可以透過瀏覽器呼叫工具
- NLWeb——伺服器層級嘅查詢 API,讓 AI Agent 可以直接查詢網站嘅結構化內容
- 共同點——兩個都最終提供 MCP 端點,但治理同實施路徑唔同
對香港企業嚟講,好消息係兩個唔係二擇其一——你可以同時部署兩個,佢哋各自解決唔同嘅問題。
NLWeb 對 SEO 有影響嗎?
呢個係最常見嘅問題。根據 Google 官方嘅 AI 優化指南:
- NLWeb 唔係 Google 排名因素——Google 目前冇使用 NLWeb 作為 ranking signal
- AI Agent 可見度——NLWeb 嘅主要價值係直接嘅 Agent 存取,而唔係改善搜尋排名
- 結構化數據嘅重要性——無論 NLWeb 定 Google Search,高質量嘅 Schema.org 都係基礎
不過,隨著 AI Agent 瀏覽網站嘅方式改變,NLWeb 嘅採用可能會影響你嘅網站喺 Agentic Web 入面嘅「可見度」——尤其係當 TripAdvisor 同 Shopify 呢啲平台開始用 NLWeb 之後,用戶對自然語言網站互動嘅期望會愈來愈高。
NLWeb 同 llms.txt 嘅分別
llms.txt(我哋之前喺 llms.txt 同技術 GEO 指南 介紹過)係一個發現層嘅索引文件。而 NLWeb 係一個操作層嘅查詢 API。一個話 AI Agent 知你網站有咩,另一個讓 AI Agent 直接喺你網站上執行查詢。兩者可以共存,唔衝突。
香港企業 NLWeb 實施指南
第一步:做好結構化數據基礎
NLWeb 嘅質量完全取決於你網站嘅結構化數據質量。建議先做 Schema.org 審計:
- 產品頁面嘅 Product Schema 係咪完整?
- 文章頁面嘅 Article Schema 有冇 author、datePublished、dateModified?
- FAQ 頁面嘅 FAQPage Schema 有冇正確標記?
- LocalBusiness Schema 嘅 NAP 資料係咪一致?
第二步:評估部署路徑
如果你嘅網站喺 Cloudflare 上面,部署 NLWeb 最簡單——Cloudflare AI Search 嘅 NLWeb 模板可以直接啟用,唔需要自建向量數據庫。如果你用其他主機,就需要自行部署 NLWeb 伺服器同向量數據庫。
第三步:選擇性部署,唔需要全面覆蓋
唔係所有內容都需要 NLWeb。優先考慮:產品目錄、FAQ、文章知識庫、地點資訊——呢啲內容最適合自然語言查詢。
香港企業行動清單
- ✅ 進行結構化數據審計——檢查網站嘅 Schema.org 實施質量,確保 JSON-LD 正確無誤,避免用 JavaScript 注入 Schema
- ✅ 了解 Cloudflare NLWeb 部署——如果你嘅網站用緊 Cloudflare,研究 Cloudflare AI Search + NLWeb 文檔
- ✅ 唔需要急住部署——NLWeb 目前唔係排名因素,亦唔影響 Google 搜尋。但可以開始規劃,尤其係如果你嘅網站有大規模產品目錄或 FAQ 內容
- ✅ 追蹤 NLWeb 生態——監察 NLWeb GitHub 項目同 Cloudflare 整合嘅成熟度
- ✅ 同時準備 WebMCP——兩個標準互補,一齊準備可以令你嘅網站全面 ready for AI Agent
- ✅ 培訓技術團隊——確保你嘅開發團隊了解 NLWeb、WebMCP、llms.txt 嘅分別同各自嘅應用場景
- ✅ 建立結構化數據維護流程——NLWeb 嘅質量取決於數據質量,建立定期嘅 Schema.org 審計流程
總結:Agentic Web 嘅「HTML 時刻」
Microsoft 將 NLWeb 形容為「Agentic Web 嘅 HTML 時刻」——正如 HTML 讓任何人都可以建立網站,NLWeb 嘅目標係讓任何網站都可以變成 AI 應用。而家 NLWeb 已經有 Cloudflare 整合、知名早期採用者,同活躍嘅開發者社群。
對於香港企業嚟講,而家唔需要急住部署 NLWeb,但需要開始做好準備。結構化數據嘅質量——呢個本來就係技術 SEO 嘅基本功——將會變得更加重要。做好呢件基本功,無論係 Google Search、AI Overviews、定未嚟嘅 AI Agent,你嘅網站都處於更有利嘅位置。
需要幫助評估你嘅網站 AI 準備度?聯絡我哋嘅技術 SEO 團隊,我哋可以幫你進行完整嘅結構化數據審計同 AI Agent 準備度評估。