---
title: "實驗（A/B 測試）"
description: "在真實通話中並行運行兩個智能體設定，讓成功率選出勝出者。"
---

A/B 測試以數據而非直覺回答「新提示實際上是否更好？」：系統會將來電分配至不同智能體**變體**，每通來電均按平常方式評分，並比較各變體的成功率。

設有兩個介面：

- **每個智能體**——測試於各智能體的建構器內設定及調整，位於其 **A/B** 分頁（`/dashboard/agents/<id>?tab=variants`）。你可在此建立變體及啟用測試。
- **跨智能體總覽**——**Experiments** 頁面（`/dashboard/experiments`，位於 Quality & Testing 下）會將每個智能體的測試彙整至同一個表格。

## 設定測試

在 Experiments 頁面按一下 **設定 A/B 測試**，然後選擇智能體——你會前往該智能體的 A/B 分頁，於此建立變體設定（其中一個標記為**對照組**）並啟用分流測試。建構器詳情請參閱[建立智能體](/yue/guides/build-an-agent)。

## 查看總覽

Experiments 表格會為每個設有測試的智能體顯示：

- **狀態**——啟用中（已開啟分流測試）或已暫停。
- **變體**——以標籤顯示每個變體，並標示對照組。
- **領先中**——目前成功率最高的變體及其百分比。在變體累積已評分的來電前，會顯示*資料尚不足*——不要只憑少量來電便判定勝出者。
- **通話**——測試中所有變體的通話總數。

未設測試的智能體會列於下方，讓你一鍵開始測試。按一下任何一列即可前往該智能體的 A/B 分頁，以調整或結束測試。

<Tip>
  處理某通來電的變體會記錄於該通話本身，因此你可在[通話記錄](/yue/guides/review-calls)篩選及抽查各方的逐字稿。
</Tip>

<Note>
  建議使用此內建功能，而非在[動態設定 webhook](/yue/guides/dynamic-call-config)中自行建立 A/B 分配流程——你可直接獲得分配、各變體統計數據及評分功能。
</Note>

## 下一步

<CardGroup cols={2}>
  <Card title="建立智能體" icon="robot" href="/yue/guides/build-an-agent">
    在智能體的 A/B 分頁建立變體。
  </Card>
  <Card title="模擬測試" icon="flask" href="/yue/guides/test-agents">
    在實際流量作出評價前，先以 AI 來電者進行部署前測試。
  </Card>
</CardGroup>
