网页

概览

开放网页上的通用 agentic 检索,专门对付那些不会出现在论文里的东西:时事、产品、价格、文档。Google 加缓存页面正文——从不实时抓取。请求形态、NDJSON 协议和 agentic 配额都与 Papers 相同。

问网页registered key+ /stream

POST/web/agent/search

请求体同"问 arXiv",用 Google 结果加缓存页面正文作答。回答带真实 URL 的 markdown 链接;每个来源带 read: true|false。共用 agentic 配额。

CLIdeepxiv ask --web "…"

参数

参数类型说明
query string 必填 1–2000 字符。问得具体;要数字就直接问数字。
effort default | high | xhigh = default 检索轮数上限:1–2 / 3 / 4–5。
verbose bool = false 返回工具调用轨迹(流式时多 tool_call / tool_result / thinking 事件)。
search_type search | scholar | news | images = search Google 垂直类型。
gl string = us Google 国家码。中文 query 自动切到 cn
hl string = en 搜索语言。中文 query 自动切到 zh-cn
stream_answer bool = true 仅流式端点。false 时只发一个 answer 事件而非增量。
max_rounds integer 可选 0–8。覆盖 effort 预设。0 直接用预取结果作答——首 token ≈1.3s。
force_answer_after number 可选 0.5–30 秒。强制切入作答阶段。
max_answer_tokens integer = 4096 256–16384。触顶时置 answer_truncated
language string 可选 回答语言。默认跟随 query 的语言。
网页证据有两种强度。只读缓存的页面正文——从不实时抓取——未缓存的页面只贡献摘要。把 read 暴露出去,让 agent 对弱证据加限定。中文站点和新闻页缓存较少。
web 比 arXiv 慢:上游缓存未命中要 1.7–4.3s。首 token 目标是 10s 而非 5s。

原始网页搜索

POST/websearch

上游搜索 API 的 organic 结果,不读、不作答。每次扣 50 次通用请求。除非你就要结果列表,否则优先用问网页

参数

参数类型说明
query string 必填 搜索词。
search_type scholar | web = scholar scholarweb
page integer = 1 结果页码。
use_cache bool = true 有缓存时用缓存。

每次 50 次通用请求