현재 Host 에 설치한 LLM Models 목록 중 용도에 따른 평가결과내용은 다음과 같다. 주요목적은 코드의 디버깅문서의 번역 작업을 주요한 평가목표로 삼고 있다.

후보 크기 코딩 번역 가성비 점수
qwen3-coder:8b 5.2G ⭐⭐⭐⭐⭐ ⭐⭐ ⭐⭐⭐⭐⭐
qwen3.5:9b 6.6GB ⭐⭐⭐⭐ ⭐⭐⭐⭐ ⭐⭐⭐⭐ (백업)
mistral-nemo 7.1GB ⭐⭐⭐ ⭐⭐⭐⭐⭐ ⭐⭐⭐⭐⭐ (번역)
phi-4 8.4GB ⭐⭐⭐⭐ ⭐⭐ ⭐⭐⭐
Qwen3-14B-Claude-Sonnet-Distill 9.0GB ⭐⭐⭐⭐⭐ ⭐⭐⭐ ⭐⭐⭐ (느림)
qwen3.6:27b 17GB ⭐⭐⭐⭐⭐ ⭐⭐⭐⭐⭐ ⭐⭐ (VRAM 초과)

이번에 정의할 주요한 목적은 코드 디버깅을 위한 Prompt 를 자동으로 생성하는 LLM Agent 및 Skills 를 적용하는 방법에 대해서 작업을 진행하고 그 내용용들을 정리해 보겠습니다.


Code Review

LLM Models 를 활용하여 작 직금 현재 가장 오래걸리는 작업은, 신규 기능 및 Layout 구현이 아니라