如何使用 Confident AI
安裝DeepEval: 運行'pip install -U deepeval'以安裝DeepEval庫
導入所需模塊: 從deepeval導入assert_test、metrics和LLMTestCase
創建測試案例: 使用input和actual_output創建一個LLMTestCase對象
定義評估指標: 創建一個指標對象,例如HallucinationMetric,帶有所需參數
運行斷言: 使用assert_test()來評估測試案例對於該指標
執行測試: 運行'deepeval test run test_file.py'來執行測試
查看結果: 在控制台輸出中檢查測試結果
記錄到Confident AI平台: 使用@deepeval.log_hyperparameters裝飾器將結果記錄到Confident AI
分析結果: 登錄Confident AI平台查看詳細的分析和見解
Confident AI 常見問題
Confident AI 是一家提供大型語言模型(LLMs)開源評估基礎設施的公司。他們提供 DeepEval 工具,允許開發人員在不到 10 行代碼的情況下對 LLMs 進行單元測試。
Confident AI 每月流量趨勢
Confident AI 的訪問量增長了 43.1%,達到 104,660 次訪問。這顯著的增長很可能是由於人們對人工智能,特別是主動式 AI 和即時互動功能的興趣日益增長所推動。Sam Altman 關於在 2025 年建立通用人工智能(AGI)和 AI 代理加入勞動力市場的自信言論,可能也促進了流量的增加。
查看歷史流量
查看更多