figure.2

Agent Evaluation

Agent Evaluation 한줄 정의 LLM 에이전트의 성능과 품질을 측정하는 방법론. 정량적 메트릭과 정성적 평가를 결합하여 에이전트의 개선 방향을 도출한다. 핵심 이해 LLM-as-Judge는 강력한 LLM을 평가자로 활용하는 기법이다. 사람의 판단 기준을 프롬프트로 정의하고, 에이전트 출력을 LLM이 채점한다. 비용 효율적이고 확...

Evaluation & AgentOps

Evaluation & AgentOps 핵심 개념 요약 에이전트 시스템의 품질을 측정하고 평가하는 방법론과, 에이전트를 프로덕션 환경에서 운영·관리하는 AgentOps 전략을 학습한다. LLM 기반 시스템의 평가 지표 설계, 자동 평가 파이프라인, 그리고 모니터링·로깅·추적을 통한 에이전트 운영 방법을 다룬다. 주요 내용 1. L...

05. LangGraph StateGraph로 Agent 실행 흐름을 분리한 이유

Lumi_agent에서 LangGraph를 쓴 이유는 “Agent를 만들 수 있어서”가 아니라 “실행 흐름을 보이게 만들 수 있어서”다. 외부 도구를 호출하는 Agent는 단순히 답변을 생성하는 챗봇보다 실패 지점이 많다. 도구를 호출할지, 어떤 도구가 안전한지, 실행 후 다시 생각할지, 마지막에 기억을 저장할지 결정해야 한다. wrapper 방식...