PHpullh
학습 라이브러리/AI Knowledge/AI 테스트 자동화

AI KNOWLEDGE · AI 개발 통합

AI 테스트 자동화

LLM 앱의 비결정성 때문에 기존 단위 테스트로는 불충분. ①골든 셋 테스트: 정답 데이터셋으로 회귀 테스트 ②LLM as Judge: AI가 AI 응답을 평가 ③퍼즈 테스트: 변형된 입력으로 강건성 테스트 ④속성 기반 테스트. LangSmith, Braintrust 활용.

AI 개발 통합

핵심 설명

LLM 앱의 비결정성 때문에 기존 단위 테스트로는 불충분. ①골든 셋 테스트: 정답 데이터셋으로 회귀 테스트 ②LLM as Judge: AI가 AI 응답을 평가 ③퍼즈 테스트: 변형된 입력으로 강건성 테스트 ④속성 기반 테스트. LangSmith, Braintrust 활용.