开始使用
平台导览
了解登录、工作区、评估区域、执行工具和个人访问令牌(PAT)如何在当前 AIDX 平台中协同工作。
当前工作区是 AIDX 的操作边界,决定你可以使用的评估、点数、成员和已启用模块。在该边界内,BenchDX 和 RobustDX 分别提供自己的创建、执行、进度与结果视图。
登录并创建第一个工作区
AIDX 使用无密码邮件验证;如果已配置相关身份提供方,也可能提供 Google 或 Microsoft 登录。

接受 Terms of Service
使用邮箱、Google 或 Microsoft 登录前,先接受服务条款。
验证身份
使用邮箱登录时,输入邮箱地址,选择 Login,然后输入发送到收件箱的六位验证码。倒计时结束后可使用 Resend code;需要更换邮箱时使用 Use a different email。
完成首次设置
新用户输入 Account name 和 Workspace name,然后选择 Create workspace。新工作区会成为当前工作区, AIDX 随后打开 Home 页面。
如果通过邀请开始注册,请先完成首个工作区设置。之后 AIDX 会返回待处理邀请,让你接受受邀工作区。
了解工作区上下文
已有用户登录后需选择工作区。使用应用顶部栏中的工作区选择器切换当前工作区。在创建评估或使用点数前,请始终确认当前工作区。

| 工作区控件 | 影响范围 |
|---|---|
| 成员 | 哪些用户可以进入工作区,以及他们获得何种成员级访问权限。 |
| 已启用模块 | 可用的评估菜单和功能。 |
| 点数 | 创建评估时使用的余额。 |
| 评估数据 | 当前上下文中可见的评估、进度和结果。 |
查找支持的评估区域
| 菜单 | 用途 | 方法特定输入 |
|---|---|---|
| LLM → BenchDX | 根据所选分类或标准开展基准安全评估 | 模型名称、模型版本,以及基准分类或标准 |
| LLM → Adversarial Test | 使用生成的攻击提示词开展 RobustDX 对抗测试 | 上传的 CSV 或 TXT 种子提示词,以及所选攻击方法 |
了解评估工具
打开评估,即可访问创建后的工具:
- Request Tutorial
- 创建后显示的指南,会引导你选择该评估可用的请求工作流。
- API Guide
- 用于获取提示词,并针对每个 traceId 提交一个模型响应的集成路径。
- Evaluation Trigger
- 无需自定义集成脚本,即可将 AIDX 提示词映射到待测目标 API、提取响应并发送待处理请求的路径。
- Process Details
- 显示 Awaiting Trigger、Sent、Responded、Evaluated 和 Error 状态的用例级视图。
- Completed 仪表板
- 包含评估摘要、结论、图表、详细评分和评分定义的结果视图。
API Guide 和 Evaluation Trigger 是两种可选执行路径。每批请求应明确选择一种路径,并通过 Process Details 监控进度。


创建和管理个人访问令牌(PAT)
个人访问令牌(PAT)是脚本和外部自动化访问 LLM 评估 API 时支持的凭据。使用 Evaluation Trigger 无需创建 PAT。

打开 Personal Access Token
打开右上角用户菜单,选择 Personal Access Token。
创建令牌
选择 Create PAT,输入名称,然后选择到期日期或 30、60、90 天快捷选项,最后确认创建。
立即复制
创建结果出现时,立即安全保存原始令牌。令牌值只显示一次;之后的列表只显示名称、状态和到期时间。
在评估指南中使用
在每个支持的外部请求中发送
Authorization: Bearer <YOUR_PAT>。打开评估的 Request Tutorial 获取评估 ID。文档使用的 API 基础 URL 为https://trial.aidx.pro。使用 API Guide 获取提示词,并针对每个traceId提交一个响应。不再需要时撤销
在个人访问令牌页面删除令牌,即可在到期前撤销。已到期的令牌无法使用。