현재 Host 에 설치한 LLM Models 목록 중 용도에 따른 평가결과내용은 다음과 같다. 주요목적은 코드의 디버깅 및 문서의 번역 작업을 주요한 평가목표로 삼고 있다.
| 후보 | 크기 | 코딩 | 번역 | 가성비 점수 |
|---|---|---|---|---|
| qwen3-coder:8b | 5.2G | ⭐⭐⭐⭐⭐ | ⭐⭐ | ⭐⭐⭐⭐⭐ |
| qwen3.5:9b | 6.6GB | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ (백업) |
| mistral-nemo | 7.1GB | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ (번역) |
| phi-4 | 8.4GB | ⭐⭐⭐⭐ | ⭐⭐ | ⭐⭐⭐ |
| Qwen3-14B-Claude-Sonnet-Distill | 9.0GB | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐ (느림) |
| qwen3.6:27b | 17GB | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐ (VRAM 초과) |
이번에 정의할 주요한 목적은 코드 디버깅을 위한 Prompt 를 자동으로 생성하는 LLM Agent 및 Skills 를 적용하는 방법에 대해서 작업을 진행하고 그 내용용들을 정리해 보겠습니다.
Code Review
LLM Models 를 활용하여 작 직금 현재 가장 오래걸리는 작업은, 신규 기능 및 Layout 구현이 아니라