
Vercel eve Software Factory — AI 에이전트 4명이 코드를 만드는 "소프트웨어 공장"
Vercel Labs가 공개한 eve Software Factory(Foreman). 이슈를 받아 4개 스테이션(Classifier→Analyst→Implementer→Reviewer)을 거쳐 리뷰된 초안 PR을 만든다. 실측: 공개 3일 만에 668★. "판단은 사람, 실행은 에이전트" 패러다임과 한계·도입 체크리스트.
Tag
이 주제로 기록된 글 7개를 모았습니다.

Vercel Labs가 공개한 eve Software Factory(Foreman). 이슈를 받아 4개 스테이션(Classifier→Analyst→Implementer→Reviewer)을 거쳐 리뷰된 초안 PR을 만든다. 실측: 공개 3일 만에 668★. "판단은 사람, 실행은 에이전트" 패러다임과 한계·도입 체크리스트.

2026년 8월 npm 공급망 공격. keyv 유지보수자 계정 탈취로 시작해 400+ 패키지 감염. 설치 시 preinstall로 자동 실행, Claude Code/VS Code/Codex 하이재킹. 영향 20억+ 월간 설치. pnpm v11·npm v12·--ignore-scripts 같은 실질적 대안 포함.

이미지-투-비디오 생성의 불안정성을 프롬프트·시드 이중 최적화로 잡은 논문의 구조와 근거를 분리해 읽는다

SkillProx 논문이 입증한 "스킬 구조화 = 품질 향상" 원리가 어떻게 프로덕션 도구로 구현됐는지 실측 분석합니다. 24종 스킬, 8개 슬래시 커맨드, 85K★.

Tree-sitter로 코드베이스를 AST 파싱해 Memgraph 지식 그래프로 만들고 자연어로 쿼리하는 Code-Graph-RAG(★2,968)의 설치·사용법, 그리고 codegraph(★65,579)와의 차이를 자세히 비교합니다.

arXiv:2608.06312 실측 검증: 488개 GB/T 문서·7,306건 오류로 평가한 결과 최강 LLM(0.3280)도 전문가(0.6640)의 절반 수준이었고, GB/T-Reviewer 구조가 GPT-5.5의 CMCS를 0.3185→0.5094로 끌어올렸습니다.

DeepSeek 전용 코딩 에이전트 Reasonix를 하루 종일 서브에이전트로 써본 실측: 캐시 히트 99.82%와 $3 미만 비용은 진짜였지만, 코딩 품질은 기대 이하였습니다.