-
AI 코드 검토가 타당한 반론이 될 수 없는 이유
AI 코드 검토가 타당한 반론이 될 수 없는 이유 | GeekNews
<ul> <li>LLM 코딩 도구의 잦은 오류를 사람이 모두 검토하면 된다는 해법은 <strong>코드 리뷰의 처리 한계</strong> 때문에 품질과 생산성을 함께 보장하기 어려움</li> <li>경험적 연구에 따르면 효과적인 리뷰는 한 번에 <strong>1시간·400 LOC</strong> 정도가 상한이며, 이를 넘…
-
코딩 평가에서 신호와 잡음 분리하기
코딩 평가에서 신호와 잡음 분리하기 | GeekNews
<ul> <li>AI 모델의 코딩 능력 평가는 배포와 안전성 판단에 직접 연결되지만, OpenAI의 감사에서 SWE-Bench Pro 작업 중 약 <strong>30%가 깨진 상태</strong>로 추정됨</li> <li>SWE-Bench Pro는 더 긴 작업 범위와 현실적인 과제를 목표로 했으나, <strong>731개…