海艺思创

首页/ AI写作教程/ OpenAI Responses API 写作怎么用网页搜索核对最新资料

AI写作教程

OpenAI Responses API 写作怎么用网页搜索核对最新资料

OpenAI Responses API 写作怎么用网页搜索核对最新资料

准备

先准备好 OpenAI API 密钥、已安装的 Python SDK,以及文章主题、截止时间和目标读者。网页搜索只是资料获取环节,不能替代人工判断;涉及版本、价格、政策和发布时间的内容,仍要回到来源页面核对。

Responses API 的 create 请求支持通过 tools 声明内置工具,也支持用 include 请求额外返回网页搜索来源。资料整理和输出规则建议分开写:稳定规则放进 instructions,本次主题放进 input。输入组织方式可参考Responses API 写作输入怎么组织

分步操作

  1. 明确核查范围。把主题、资料时间范围、允许使用的来源类型和必须核对的字段写清楚。例如要求模型只使用指定日期之后的公开网页,并为每个数字、日期和产品状态保留来源。
  2. 声明网页搜索工具。tools 中放入当前 SDK 和接口文档支持的网页搜索工具描述。研究资料确认 Responses API 支持通过内置工具调用网页搜索,但具体工具名称和参数应以你当前安装版本的官方文档为准,不要照抄旧版本示例。
  3. 要求先查资料再写作。instructions 中规定:先搜索,再提取事实,区分已确认信息与无法确认的信息;正文中的关键结论不得超出来源内容。
  4. 请求搜索来源。需要保存检索依据时,在 include 中加入 web_search_call.action.sources,这样应用可以进一步读取网页搜索工具调用的来源信息。
  5. 保存响应和来源。至少记录主题、请求参数、响应 ID、生成时间、正文和来源列表。不要只保存最终文章,否则后续很难解释某个结论来自哪里。
  6. 逐条复核再发布。把文章拆成事实句,检查每句是否能对应来源。来源只支持背景描述时,不要把它扩写成价格、资格、性能或承诺。

可复制请求模板

下面示例保留了 Responses API 的核心请求结构。网页搜索工具的具体 descriptor 请替换为当前 SDK 文档中可用的写法:

from openai import OpenAI

client = OpenAI()

web_search_tool = {
    "type": "<当前 SDK 支持的网页搜索工具类型>"
}

response = client.responses.create(
    model="<当前项目可用的模型>",
    instructions=(
        "你是事实核查型写作者。先使用网页搜索查找最新资料,"
        "再写作。为日期、数字、版本状态和产品能力保留来源依据。"
        "无法确认的内容标记为待核实,不要自行补全。"
    ),
    input=(
        "主题:<文章主题>\n"
        "资料截止时间:<日期或时间范围>\n"
        "输出:先给出事实表,再给出文章提纲。\n"
        "每条事实包含:结论、来源、来源日期、核查备注。"
    ),
    tools=[web_search_tool],
    include=["web_search_call.action.sources"]
)

print(response.output_text)

如果只需要生成提纲,可以把输出要求改成“只输出标题层级、每节要点和对应来源”。如果要生成完整文章,则应要求模型把来源依据保留在结构化结果或单独的事实表中,避免正文完成后丢失核查线索。

搜索结果怎么核对

  • 先看来源页面是否真的讨论目标对象,而不是只看搜索摘要。
  • 检查页面日期、版本号和上下文,防止把旧资料当成最新状态。
  • 对同一事实尽量寻找多个独立来源;无法交叉确认时,降低语气强度。
  • 把“官方已公布”“媒体报道”“模型推断”分成不同状态。
  • 数字、价格、地区限制、开放资格和发布时间必须逐项核对。

翻车怎么改

常见故障:返回了文章,但没有可用的搜索来源,或者正文写出了来源没有提到的确定结论。

原因:请求没有正确声明网页搜索工具,未请求额外来源字段,或者提示词只要求“写最新文章”,没有规定事实边界。另一个常见原因是把旧版工具名称直接复制到当前 SDK,导致工具没有按预期执行。

修正动作:先检查 tools 是否使用当前接口支持的网页搜索 descriptor,再确认 include 是否包含 web_search_call.action.sources。随后把提示词改为“先搜索、后列事实、再写作”,并要求没有来源的内容标记为待核实。调试阶段先输出响应中的工具调用和来源字段,确认搜索确实发生后再生成正式正文。

如果问题是正文格式不稳定,可以在应用侧把响应转换成统一字段,再检查标题、事实表、来源和正文是否齐全,相关思路可参考Responses API 写作结果怎么做结构化检查

完成前检查

  • 文章标题和正文是否围绕原始主题,没有混入未核实的扩展结论。
  • 每个关键日期、数字、版本状态和产品能力是否能对应来源。
  • 来源页面是否仍可访问,页面时间是否符合文章的资料截止范围。
  • 没有来源支持的内容是否已删除,或明确标记为待核实。
  • 是否保存了响应 ID、请求参数、生成时间和来源列表,便于后续复查。
  • 最终发布内容是否经过人工阅读,而不是直接把模型输出当成事实结论。

下一步

把这篇的方法练一遍

提示词和步骤可以带到创作里直接试做一版。

去创作 看同栏目更多