Why single-turn evaluation is insufficient
Why is evaluating only single-turn interactions a mistake for agent testing?
Acest exercițiu face parte din cursul
Building AI Agent Harnesses with Strands Agents
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul