AI KNOWLEDGE · AI 개발 통합
AI 테스트 자동화
LLM 앱의 비결정성 때문에 기존 단위 테스트로는 불충분. ①골든 셋 테스트: 정답 데이터셋으로 회귀 테스트 ②LLM as Judge: AI가 AI 응답을 평가 ③퍼즈 테스트: 변형된 입력으로 강건성 테스트 ④속성 기반 테스트. LangSmith, Braintrust 활용.
AI 개발 통합
핵심 설명
LLM 앱의 비결정성 때문에 기존 단위 테스트로는 불충분. ①골든 셋 테스트: 정답 데이터셋으로 회귀 테스트 ②LLM as Judge: AI가 AI 응답을 평가 ③퍼즈 테스트: 변형된 입력으로 강건성 테스트 ④속성 기반 테스트. LangSmith, Braintrust 활용.
Continue Learning
AI Knowledge 학습을 이어가세요
총 100개의 독립 HTML 학습 문서 중 하나입니다. 각 문서는 고유 URL과 canonical 메타데이터를 가집니다.