LLM 활용
멀티벤더 AI 검증에서 모델 ID를 표시명으로 믿으면 안 되는 이유
검증 결과 파일에 적힌 모델 이름과 실제로 호출된 모델이 다를 수 있다. 잘못된 슬러그가 조용히 다른 모델로 대체된 사례로 표시명 대신 실행 로그를 확인하는 법을 정리했다.
태그
검증 결과 파일에 적힌 모델 이름과 실제로 호출된 모델이 다를 수 있다. 잘못된 슬러그가 조용히 다른 모델로 대체된 사례로 표시명 대신 실행 로그를 확인하는 법을 정리했다.
AI 코딩 에이전트가 긴 대화를 압축할 때 낡은 결정, 미완료 작업, 출처, 민감 정보, 불확실성이 사라지는 5가지 유형과 대응 체크리스트를 정리했다.
AI가 쓴 코드를 같은 모델로 검토하면 자기 실수를 놓친다. 작성자와 다른 벤더가 계획·테스트·구현을 단계마다 교차 검증하고, 근거가 비면 통과 대신 실패로 처리한다.