
에이전트 스킬은 스스로 진화할 수 있을까 — SkillProx 논문의 실측 검증
2026-08-07 공개된 arXiv 논문 SkillProx(2608.07449) — 에이전트 스킬 자기진화를 실측 검증. 사람이 만든 스킬이 오히려 성능을 떨어뜨리는 역설(45.3→36.7), 검증 없는 진화는 폭락(→13.0), 닫힌 루프 검증의 가치(→54.5).
Tag
이 주제로 기록된 글 3개를 모았습니다.

2026-08-07 공개된 arXiv 논문 SkillProx(2608.07449) — 에이전트 스킬 자기진화를 실측 검증. 사람이 만든 스킬이 오히려 성능을 떨어뜨리는 역설(45.3→36.7), 검증 없는 진화는 폭락(→13.0), 닫힌 루프 검증의 가치(→54.5).

Tree-sitter로 코드베이스를 AST 파싱해 Memgraph 지식 그래프로 만들고 자연어로 쿼리하는 Code-Graph-RAG(★2,968)의 설치·사용법, 그리고 codegraph(★65,579)와의 차이를 자세히 비교합니다.

arXiv:2608.06312 실측 검증: 488개 GB/T 문서·7,306건 오류로 평가한 결과 최강 LLM(0.3280)도 전문가(0.6640)의 절반 수준이었고, GB/T-Reviewer 구조가 GPT-5.5의 CMCS를 0.3185→0.5094로 끌어올렸습니다.