Evaluierungen und Tests, mit denen die Qualität und Zuverlässigkeit von KI-Modell-Outputs systematisch gemessen wird.
Zurück zum Glossar