永續 AI 資料庫 / AI 應用模型評測Model Evaluation模型評測是以明確任務、資料及評分準則檢查模型或 AI 應用表現的過程,可包含答案正確性、檢索品質及安全行為等面向。企業如何使用這個概念?建立代表實務問題的測試題,持續比較不同模型與提示版本。容易混淆之處模型評測聚焦可量測表現,不等於僅憑幾次展示就完成業務驗收。定義依據LangChain:Evaluation conceptsNIST AI measurement and evaluation來源查核日期:2026-09-09繁體中文為編輯工作譯名;本次未取得統一官方繁中譯名的證據,英文名稱保留概念辨識,不冒充標準條文譯本相關服務AI 應用服務 →返回查找結果