authority(来源权威性等级)字段,方便开发者对结果做下一步评估、过滤。
相比把整页网页交给模型,使用联网搜索 Pro 接口有四个好处:
- 更准的回答:减少导航、广告等无关信息干扰,让关键信息更集中。
- 更低的 Token 成本:只将高相关片段送入上下文,减少无效 Token 消耗,响应更快。
- 更少的工程投入:正文切块和相关性排序由服务端完成,结果可直接交给模型使用。
- 来源始终可溯:每个片段保留标题、链接和站点信息,方便引用和核查。
选择合适的接口
三个接口按次计费,价格见 联网搜索价格。
常见任务和推荐的接口:
联网搜索 Pro 在 联网搜索 Basic 找到网页之后多做了一步:读懂正文,把与问题最相关的内容片段挑出来,按相关性排好序。
结果不经过模型、直接展示给用户时(搜索结果页、来源卡片),或者想自己加工正文(切块、筛选)时,联网搜索 Pro 的加工反而是多余的,建议选用 联网搜索 Basic。
控制成本
除了单次调用拿回的内容量,调用次数也影响成本。建议把同一信息需求的追问改写成一条更完整的查询词,合并成一次调用。近似查询词搜到的页面高度重叠,拆开调用就要为同一批页面重复付费;合并之后,同样的花费能覆盖更多不同的来源。
例如,想调研 2025 年诺贝尔物理学奖的获奖情况:
- ✗ 拆成三次调用:
2025 年诺贝尔物理学奖、2025 年诺贝尔物理学奖 获奖成果、2025 年诺贝尔物理学奖 实验验证 - ✓ 合并成一次调用:
2025 年诺贝尔物理学奖 获奖成果 实验验证
写有效查询词
接口按提交的查询词(text_query)原样搜索,不会自动改写、补全或扩展。查询词决定搜到什么。模糊的查询词把调用浪费在无关页面上,具体的查询词让每个结果都有用。
把查询词写具体有三个维度:
三个维度组合起来,一次调用就能拿到可以直接使用的材料:
- ✗
诺贝尔奖 - ✓
2025 年诺贝尔物理学奖 获奖成果 实验验证
- 一次调用只表达一个信息需求。把互不相关的问题堆进一条查询词,得到的只是一条又长又散的查询,结果质量反而下降。
- 不要用同义改写重发。两次近似查询的结果高度重叠,等于为同一份结果付了两次费。第一次结果不好时,应该补实体、时间、限定词,或者换一个角度(换维度、换语言)。
按站点和时间过滤结果
联网搜索 Pro 提供两个约束参数,可以直接限定搜索范围:sites:限定来源站点,最多 5 个,多个站点按 OR 处理。例如["gov.cn", "miit.gov.cn"]让结果只来自指定站点。time_window:限定发布时间的起止范围,日期支持YYYY、YYYY-MM、YYYY-MM-DD三种格式。查询词里的时间词影响搜索和排序,time_window直接按时间过滤结果,两者可以叠加。
设置结果数量和超时时间
联网搜索 Basic 和 联网搜索 Pro 还支持limit 和 timeout_seconds,建议显式设置:
limit:返回结果的数量上限,默认 5,范围 1 到 20。先取少量结果判断方向,再决定是否深入。timeout_seconds:超时时间,范围 1 到 60 秒。返回正文(include_content=true)或使用 联网搜索 Pro 时耗时更长,建议给足超时时间。
处理边界情况
- 网页能否取到正文,受网站可访问性、登录限制、反爬策略、页面结构和网络状况影响。搜索接口取不到正文时,仍会返回网页的标题、链接和摘要,可以先按摘要判断相关性,再决定是否换来源。
- 网页抓取 返回的 Markdown 是网页正文的提取结果,不包含图片、视频等多媒体资源。
完整示例
以下示例用 联网搜索 Pro 搜索 2025 年诺贝尔物理学奖:查询词包含时间和实体,sites 限定官方站点,time_window 限定发布时间范围:
chunks[].score 是片段与查询词的相关性分数,只在同一次查询内有相对意义,不要跨查询比较绝对值。