网页
概览
开放网页上的通用 agentic 检索,专门对付那些不会出现在论文里的东西:时事、产品、价格、文档。Google 加缓存页面正文——从不实时抓取。请求形态、NDJSON 协议和 agentic 配额都与 Papers 相同。
问网页registered key+ /stream
POST
/web/agent/search请求体同"问 arXiv",用 Google 结果加缓存页面正文作答。回答带真实 URL 的 markdown 链接;每个来源带 read: true|false。共用 agentic 配额。
CLI
deepxiv ask --web "…"参数
| 参数 | 类型 | 说明 | |
|---|---|---|---|
| query | string | 必填 | 1–2000 字符。问得具体;要数字就直接问数字。 |
| effort | default | high | xhigh | = default | 检索轮数上限:1–2 / 3 / 4–5。 |
| verbose | bool | = false | 返回工具调用轨迹(流式时多 tool_call / tool_result / thinking 事件)。 |
| search_type | search | scholar | news | images | = search | Google 垂直类型。 |
| gl | string | = us | Google 国家码。中文 query 自动切到 cn。 |
| hl | string | = en | 搜索语言。中文 query 自动切到 zh-cn。 |
| stream_answer | bool | = true | 仅流式端点。false 时只发一个 answer 事件而非增量。 |
| max_rounds | integer | 可选 | 0–8。覆盖 effort 预设。0 直接用预取结果作答——首 token ≈1.3s。 |
| force_answer_after | number | 可选 | 0.5–30 秒。强制切入作答阶段。 |
| max_answer_tokens | integer | = 4096 | 256–16384。触顶时置 answer_truncated。 |
| language | string | 可选 | 回答语言。默认跟随 query 的语言。 |
网页证据有两种强度。只读缓存的页面正文——从不实时抓取——未缓存的页面只贡献摘要。把
read 暴露出去,让 agent 对弱证据加限定。中文站点和新闻页缓存较少。web 比 arXiv 慢:上游缓存未命中要 1.7–4.3s。首 token 目标是 10s 而非 5s。
原始网页搜索
POST
/websearch上游搜索 API 的 organic 结果,不读、不作答。每次扣 50 次通用请求。除非你就要结果列表,否则优先用问网页。
参数
| 参数 | 类型 | 说明 | |
|---|---|---|---|
| query | string | 必填 | 搜索词。 |
| search_type | scholar | web | = scholar | scholar 或 web。 |
| page | integer | = 1 | 结果页码。 |
| use_cache | bool | = true | 有缓存时用缓存。 |
每次 50 次通用请求