Agent Lab Agent LabAgent Lab
  • Agent Lab Agent LabAgent Lab
  • 배우기
  • AX 실행
  • 인사이트
    • github
    • linkedin
  • github
  • linkedin
KO / EN
Tags / #METRICS

#METRICS

2개의 콘텐츠

playbook evaluation

LLM 품질 평가 기준 설계

일반 벤치마크 대신 실제 업무의 성공 기준과 사람 검토를 연결하는 평가 프레임워크

note evaluation

AI 서비스 운영 지표(KPI) 설계

실제 사용 흐름을 기준으로 품질, 안전, 비용, 신뢰성을 함께 관리하는 AI 서비스 운영 지표 설계법입니다.

Agent Lab Agent LabAgent Lab

AI PO building services with LLM agents.

  • github
  • linkedin

Content

  • 배우기
  • AX 실행
  • 인사이트

Legal

  • About
  • Terms
  • Privacy Policy

Connect

  • github
  • linkedin

© 2025 SeokMo Gu. All rights reserved.