Skip to content

目前,现有实验的评估仅在 Python SDK 中支持。

如果您已经运行了一个实验,并希望添加额外的评估指标,可以像之前一样,使用 evaluate() / aevaluate() 方法将任何评估器应用到该实验。只需传入实验名称/ID,而不是目标函数:

python
from langsmith import evaluate

def always_half(inputs: dict, outputs: dict) -> float:
    return 0.5

experiment_name = "my-experiment:abc"  # 替换为实际的实验名称或 ID

evaluate(experiment_name, evaluators=[always_half])

LangChain 中文文档