API 教程

RobustDX API

获取生成的对抗提示词,并通过 advResponse 提交每个待测模型响应。

RobustDX 采用与 BenchDX 相同的追踪式流程,但端点路径和响应字段不同。 获取提示词列表前,请等待对抗提示词生成完成。

1. 获取对抗提示词

GET/api/evaluation/all-adv-prompts

返回为所选 RobustDX 评估生成的全部提示词。

位置名称类型必填
查询参数evaluationIdnumber
请求头AuthorizationBearer PAT
获取对抗提示词cURL
curl -X GET \
  "https://trial.aidx.pro/api/evaluation/all-adv-prompts?evaluationId={evaluation_id}" \
  -H "Authorization: Bearer {personal_access_token}"
响应示例JSON
{
  "code": "req_01J...",
  "message": "Operation Succeed",
  "data": [
    {
      "traceId": "trace_id_1",
      "content": "adversarial_prompt_1"
    },
    {
      "traceId": "trace_id_2",
      "content": "adversarial_prompt_2"
    }
  ],
  "success": true
}

2. 运行待测模型

将每个对抗性 content值发送给待测模型,并将原始 traceId与该提示词产生的答案保持对应。

3. 提交对抗响应

POST/api/evaluation/adv-response

为一条 RobustDX 追踪记录保存一个待测模型答案。

位置名称类型必填
表单evaluationIdnumber
表单traceIdstring
表单advResponsestring
请求头AuthorizationBearer PAT

API 接受 multipart/form-data application/x-www-form-urlencoded 参数。

提交对抗响应cURL
curl -X POST \
  "https://trial.aidx.pro/api/evaluation/adv-response" \
  -H "Authorization: Bearer {personal_access_token}" \
  -F "evaluationId={evaluation_id}" \
  -F "traceId={trace_id}" \
  -F "advResponse={model_response}"
响应示例JSON
{
  "code": "req_01J...",
  "message": "Operation Succeed",
  "data": "Operation success",
  "success": true
}

4. 验证进度

使用 Process Details确认每条追踪记录均已完成评估。只有所有必要测试用例均已完成评估或被明确处理后,评估才能进入 Completed 状态。