Ep.27 | 사람의 승인을 어디에 둘 것인가
AI가 실제 쿠폰·환불을 실행할 때 승인 버튼 하나면 충분할까요? 야간 상담 사례를 따라가며 사람이 개입해야 할 순간과 승인 이후의 안전장치를 살펴봅니다.
Ep.26 | 컨텍스트가 모델보다 중요한 순간
AI가 오래된 정책을 답했을 때 더 좋은 모델이 해결책일까요? 검색 결과가 만들어지는 경로를 따라가며 원본·최신성·권한을 설계하는 법을 살펴봅니다.
Ep.25 | AI 품질을 테스트한다는 것
매번 표현이 달라지는 AI를 어떻게 배포할 수 있을까요? 실제 실패를 평가 기준으로 바꾸고, 좋아 보이는 답과 안전한 답을 구분하는 법을 살펴봅니다.
Ep.24 | AI 데모를 제품으로 바꾸는 계약
회의실에서는 잘되던 AI가 실제 사용자 앞에서 흔들리는 이유는 무엇일까요? 데모를 운영 가능한 제품으로 바꾸는 기준을 한 사례로 살펴봅니다.