Skip to content
所有標籤

#web-search

24 篇文章

Keenable 該放進台灣 Agent 團隊的搜尋備選嗎?

Keenable.ai 把自己定位成給 AI agents 用的搜尋基礎設施:100B+ 文件索引、Search/Fetch API、 MCP/CLI 入口、100K 免費月額度與 keyless public endpoint。對台灣/繁中 agent 團隊來說, 現階段最合理的位置是 provider matrix 裡的實測候選;Brave、Exa、Tavily 或 Serper 仍要留著對照。

tech deep-dive

Groundlane 實戰系列(篇 1):為什麼 AI 代理需要一個受控的網路存取層

Groundlane 是一個開源 TypeScript 遠端 MCP 伺服器(v0.1.0),以單一穩定合約為 AI 代理提供 web_search、web_fetch、web_extract 三種能力,並把身份驗證、提供者替換與資源限制留在操作者邊界內。

tech deep-dive

Groundlane 實戰系列(篇 2):三個 MCP 工具的參數、回傳與錯誤處理

以實際呼叫範例說明 web_search(十適配器、RRF 合併、雙提供者預設)、web_fetch(format/render 策略、finalUrl 來源證據)、web_extract(CSS selector 結構、無 LLM 隱式步驟),並整理回傳結構與錯誤邊界。

tech deep-dive

Groundlane 實戰系列(篇 3):與傳統方案的對比 — WebFetch、stealth_fetch、puppeteer 與 requests

從確定性、可替換性、身份邊界、維運成本四維度比較 Groundlane 三工具與傳統本機方案(WebFetch、stealth_fetch、puppeteer、requests),指出各方案適合與不適合的場景。

tech deep-dive

Groundlane 實戰系列(篇 4):在 quidproquo 站內的應用 — 以現有 MCP 工具與流程為事實

以站內 .claude/skills/groundlane 的 usage-modes 流程為事實,說明如何把 web_fetch 與 web_extract 整合進文章參考驗證與每日 digest 資料收集,而不假設未實作功能。

tech deep-dive

Groundlane 實戰系列(篇 5):踩坑與最佳實踐 — timeout、selector、render 模式與安全邊界

整理實戰中最常見的操作陷阱:timeout 與位元組上限導致的 truncated、selector 設計錯誤、render 模式切換的成本與確定性風險、版本變動(v0.1.0 早期預覽)的可重現驗證方式,以及預設安全邊界不可繞過的原因。

Agent 搜尋 Query 怎麼寫:關鍵字、語意描述、拆解與改寫

Agent 不該把使用者原句直接丟給每一種搜尋服務:先辨認 exact lookup、keyword、semantic 或 fielded search,再把來源、時間、語言與欄位限制放進 provider 原生參數,最後依零結果、結果過廣與來源不對症狀改寫。

ai guide

Brave Search API 完整指南:用獨立搜尋索引替 Agent 取得網路結果

Brave Search API 以 Brave 自有的網頁索引與排名模型提供 Web、News、Images、Videos 與 LLM Context 五類端點;核心搜尋不只是 Google SERP 的 API 包裝。

ai deep-dive

Parallel Web Systems:Agent 的搜尋、擷取與深度研究層

Parallel Web Systems 把 Search、Extract 與 Task API 分成三個成本與延遲不同的網路存取層,並以 Basis 把引用、摘錄與信心標到輸出欄位。

從搜尋結果到可靠引用:URL 去重、來源分級與 Claim-Source Mapping

可靠引用不是在答案後面塞 URL:先把 URL、內容副本與來源獨立性拆開,再用 atomic claim、quote span、snapshot 與可重跑檢查建立 claim-source matrix。

ai guide

SerpAPI 完整指南:多搜尋引擎、結構化 SERP 與非同步查詢

SerpAPI 的核心是代管搜尋結果頁的抓取與解析:用 engine 指定來源,取得結構化 SERP,再自行處理地區、分頁、非同步輪詢與結果驗證。

ai guide

Serper Search API 完整指南:把 Google 搜尋結果變成 Agent 可用 JSON

Serper 是第三方 Google SERP API:用一個 POST 請求取得 organic、knowledgeGraph、peopleAlsoAsk 等結構化 JSON;真正上線前仍要驗證選填欄位、URL、重試與引用證據。

Exa:為 agent 而不是為人設計的神經搜尋 API

Exa 把整個網頁索引轉成 embedding 再檢索,而不是比對關鍵字。2026-08 官方定價:/search $7 / 1k 次(含前 10 筆結果)、/contents $1 / 1k 頁、deep 系列 $12–15 / 1k 次,新帳號 $20 免費額度。這個 blog 的 CLAUDE.md 把 Exa 列在雲端抓取工具的第一順位,38 支 skill 裡有 16 支寫到它,站上既有文章只有 4 篇順帶提過——但一篇專文都沒有。這篇補上。

ai deep-dive

免費搜尋、爬取與瀏覽器 API 怎麼選:週期額度、限速、試用與自架成本

免費方案有每日或每月額度、餘額補回、持續限速與一次性試用;有些 API 沒有免費額度,必須預付或按量計費。

ai guide 搜尋與爬取實戰

Linkup Search API 完整指南:從 standard、deep 到結構化輸出

Linkup 把搜尋深度與輸出格式分開控制:多數 agent 查詢先用 standard + searchResults,需要循線讀多頁才升到 deep;每月補回 20 美元是餘額恢復,不是固定再送 20 美元。

ai guide

SearXNG 完整介紹:引擎調校、JSON API 與自架維運

SearXNG 是元搜尋引擎,不是 crawler,也沒有自己的全網索引。這篇以官方 2026.8.20 文件為準,從 Compose 安裝、settings.yml、引擎選擇與 JSON API,一路做到空結果診斷。

ai guide 搜尋與爬取實戰

自己架一套搜尋後端:SearXNG + Crawl4AI,從零到接進 Claude Code

三個元件、各做一件事:SearXNG 負責找、Crawl4AI 負責讀、一層薄薄的程式把兩者黏起來。有三個預設值不改就不會動——`formats` 預設只吐 HTML、`secret_key` 預設是 `ultrasecretkey`、limiter 開了會擋你自己的程式。另外官方安裝方式在 2026 年 3 月換過,網路上多數教學指的 searxng-docker 已經封存了。

Tavily 和 Exa 不能自己架:要怎麼自己組一套

Tavily 和 Exa 都是純雲端 API,不能自己架。能自己組的是 SearXNG(269 個上游引擎、82 個預設開啟)+ Crawl4AI(78.8k stars、Apache-2.0),現成的 Tavily 相容 wrapper 都還是幾十顆星的個人專案,不建議直接用。但 SearXNG 沒有自己的索引,而且從機房 IP 跑會被搜尋引擎打成空結果——這兩件事決定了自架划不划算。

ai guide

Tavily Search API 完整指南:搜尋、抽取、Map 與 Crawl

Tavily 把 Search、Extract、Map、Crawl 做成同一組 agent 網路 API;免費方案每月有 1,000 credits,Search 的 basic、fast、ultra-fast 各用 1 credit,advanced 用 2 credits。

Agent 搜尋品質怎麼驗收:Web Retrieval Benchmark 實作

Web retrieval 要測的是完整 task,不是 HTTP 200:固定 30 題、五種失敗層、三條 live channel,同時量答案、引用、freshness、延遲、成本與不必要升級。本文交付可執行 harness 與 gate,但因目前沒有三條 live channel 設定,不提供虛構排名。

AI Agent 上網查資料的完整路由:Search、Fetch、Crawler、Browser 怎麼切換

Agent 上網不該一律開瀏覽器:先依任務分流 Search 或 Fetch,再按狀態碼、內容品質、JS shell、登入與 challenge 訊號逐級升級;每一步都受 retry、budget、快取、去重與來源紀錄約束。

ai guide 搜尋與爬取實戰

AI Agent 接搜尋 MCP 工具:當 WebFetch / WebSearch 被擋的時候

用 Claude Code、Cursor 等 AI agent 時,內建 WebFetch / WebSearch 常被 Cloudflare、地理限制或 rate limit 擋住。接一個 search MCP server 是最直接的解法,這篇比較 2026 年實際能用的選項。

你的 JSON-LD 和 schema 對 AI 搜尋引擎是隱形的嗎?各家管線拆解與 AEO/GEO 策略

不同 AI 引擎讀網頁的方式差異很大。有的只看 body、有的靠預建索引。JSON-LD 和 schema 不是萬能的,正文品質和結構才是跨平台有效的基礎。

ai guide OpenClaw 文件導讀

OpenClaw 工具篇(一):一個專屬瀏覽器、三種附著方式,與被標成「不可信」的搜尋結果

OpenClaw 的瀏覽器是一個獨立的 agent 專用 profile,跟你的個人瀏覽器完全隔離。而 web_search 的回傳結構裡有一個 externalContent.untrusted 標記——搜尋結果在型別層就被標成不可信的外部內容。