Skip to content

用同一任务比较多个 AI 工具

目标

完成一次公平的工具对比,并记录选择依据。

前置条件

选择两个或三个可访问的工具,准备一项不会包含敏感数据的真实任务。

步骤

  1. 把任务写成固定输入,明确长度、格式和截止条件。
  2. 关闭不必要的联网、记忆或连接器,使测试条件尽量一致。
  3. 将同一输入分别交给每个工具,不追加针对某个工具的提示。
  4. 按正确性、可编辑性、耗时和隐私要求评分。
  5. 对最高分结果做一次人工事实核验,并记录最终选择和不适用场景。

预期结果

得到一份包含原始输出、评分与选择理由的对比记录。

排错

  • 工具能力不等价:把联网或文件能力作为独立测试。
  • 输出格式不同:评分前先核对是否遵循了相同约束。
  • 无法复现:记录日期、方案和启用功能。

基于 OpenAI 兼容协议 · 多模态算力网关