回覆評估與監測結果
概述
版本更新說明
Deepeval 3.7.0 新功能
1. 可配置的評估 LLM
# 在評估設定中指定使用的 LLM
evaluation_config = {
"evaluation_model": "gpt-4", # 或其他支援的模型
"temperature": 0.0,
"max_tokens": 1000
}2. 彈性處理空白 Ground Truth
3. 平行處理提升評估效能
測試案例數
舊版本耗時
新版本耗時
效能提升
升級建議
查看回覆評估結果
即時監控
自動化測試
評分指標
指標
描述
影響原因
問題
回覆
檢索上下文
正確答案

誠實性評分(Faithfulness)與幻覺檢測(Hallucination)的差異
面向
Faithfulness
Hallucination
功能支援對照
指標
即時監控
自動化測試
分數意義
分數偏低的原因釐清與解決方法
最佳實踐
使用彈性 Ground Truth
善用平行處理
技術資源
Last updated
Was this helpful?
