回答評価とモニタリング結果
概要
バージョン更新のお知らせ
Deepeval 3.7.0 の新機能
1. 設定可能な評価用 LLM
# 評価設定で使用する LLM を指定
evaluation_config = {
"evaluation_model": "gpt-4", # またはその他の対応モデル
"temperature": 0.0,
"max_tokens": 1000
}2. 空白の Ground Truth に対する柔軟な処理
3. 並列処理による評価パフォーマンスの向上
テストケース数
旧バージョン所要時間
新バージョン所要時間
向上率
アップグレードのご提案
回答評価結果の確認
リアルタイムモニタリング
自動化テスト
評価指標
指標
説明
影響要因
質問
回答
検索コンテキスト
正解

誠実性スコア(Faithfulness)とハルシネーション検出(Hallucination)の違い
観点
Faithfulness
Hallucination
機能サポート対応表
指標
リアルタイムモニタリング
自動化テスト
スコアの意味
スコアが低い原因の切り分けと解決方法
ベストプラクティス
柔軟な Ground Truth の活用
並列処理の有効活用
技術リソース
Last updated
Was this helpful?
