
LLM evaluation in .NET: testare la qualità delle risposte con Microsoft.Extensions.AI.Evaluation
Come si fa **LLM evaluation** in .NET: i test unitari verificano il codice, ma ==la risposta di un modello non è deterministica== e va *giudicata*, non confrontata. Con *Microsoft.Extensions.AI.Evaluation* costruisco una ==suite xunit== che dà un punteggio a *relevance*, *coherence* e *groundedness* delle risposte di un assistente, con un **giudice locale via Ollama**, cache su disco e ==report HTML== da allegare alla CI.







