Skip to content
Preptima

Evaluation & Guardrails interview questions

Building an offline eval set, LLM-as-judge and its failure modes, regression suites for prompts, and measuring hallucination honestly.

3 questions in Generative AI & Large Language Models.

hard3