Tag
#에이전트 글 목록 2페이지
32개 글 중 16번째부터 표시합니다.

에이전트가 기억하는 것은 거짓말을 영구적으로 당한다는 뜻 — 메모리 중독 공격의 실측
코퍼스의 1.2% 거짓 주입만으로 에이전트 메모리 가치 2/3가 사라진다(정확도 0.850→0.300). 내용 필터는 거짓 기억 360개 중 0개를 거부했다(arXiv 2608.21230).

Hermes Agent로 자율 공격 보안 에이전트를 만들다 — Cybermes가 해결한 보안 스캐너의 노이즈 문제
Cybermes는 Hermes Agent로 구동되는 자율 보안 에이전트다. Zero-False-Positive 게이트, 토큰 70~85% 절약, 자율 추론 루프로 전통 스캐너의 노이즈 문제를 해결한다.

하네스 하나로 단시간 자가개선은 일어나지 않는다 — Phantom Gains가 밝힌 유령 이득
자가개선은 실재하지만, 대조군 없이 측정하면 7가지 경로로 유령 이득(phantom gains)이 생긴다(arXiv 2608.20290). 하네스 하나로 단시간 자가개선은 측정 artifact다.

Grok Bot 열풍의 실체 — computer-use의 포장, OpenBot의 인기, Manus의 침묵
Grok Bot(8/11) 열풍의 실체를 파헤친다. "컴퓨터 한 대"는 Linux VM+browser-use의 상용 포장. OpenClaw(386K★)·Hermes(232K★)가 이미 하던 일. OpenBot 인기는 CopilotKit 브랜드+AG-UI 창시자 덕. Manus는 Meta 인수→중국 차단→독립 재개. 기술 스택 비교(폐쇄형은 비공개 표기).

GitHub이 무너진 날, 머스크의 Cursor가 Origin을 출시했다 — 에이전트 시대의 코드 호스팅 경쟁
8/17 GitHub critical 장애 그날, 머스크의 Cursor가 자체 코드 호스팅 Origin 출시. 에이전트 떼가 초당 22.6커밋 찍는 시대의 코드 호스팅 경쟁. 전 GitHub CEO Entire($60M), AI 학습 반대 Monohub, Google Git 태그→Drive까지 — 게이트키퍼 교체의 실체.

nanobot vs Hermes Agent — 소유와 성장, 어떤 에이전트 프레임워크를 골라야 하나
HKUDS nanobot(47,160★) vs Nous Research Hermes Agent(232,673★) 비교. 초경량·소유·투명 vs 자기개선·성장. 왜 지향점이 다른가 (대학 vs AI 연구소 배경), 어떤 경우 무엇을 써야 하는지 선택 기준.

Cumora — AI 에이전트가 팀원이 되는 크로스플랫폼 팀 채팅
Cumora(하루 2,179★) 소개. AI 에이전트가 사람과 같은 대화방에서 1급 팀원으로 활동하는 팀 채팅. 페르소나·메모리·작업 청구·조정. Cumora Cloud 또는 BYOA(Claude Code/Codex). freshness gate·원자적 청구·트라이지 게이트 조정 메커니즘.

Mind Viruses — 에이전트가 생각을 전염시키는 다중 에이전트 위험
Mind Viruses(arXiv 2608.10218) 리뷰. 다중 에이전트에서 생각이 대화로 자기 증식하는 현상. 실측: 6명 코딩 팀에서 감염자가 콜루전, SOUL.md 수정으로 영구 감염, 시스템 프롬프트 한 줄 경고로 거의 완전 면역. 프론티어 모델 저항, 취약 모델 공개.

그래프 엔지니어링(Graph Engineering) — 유튜브가 갑자기 말하기 시작한 단어의 탄생
2026년 7월 갑자기 유튜브를 점령한 "그래프 엔지니어링". 최초 언급자(Josh Simmons, Peter Steinberger, Carlos Perez)부터 prompt→context→loop→graph 용어 러닝머신, typed edge, 멀티홉, 왜 하필 지금인가까지 실측으로 추적하는 칼럼.

Vercel eve Software Factory — AI 에이전트 4명이 코드를 만드는 "소프트웨어 공장"
Vercel Labs가 공개한 eve Software Factory(Foreman). 이슈를 받아 4개 스테이션(Classifier→Analyst→Implementer→Reviewer)을 거쳐 리뷰된 초안 PR을 만든다. 실측: 공개 3일 만에 668★. "판단은 사람, 실행은 에이전트" 패러다임과 한계·도입 체크리스트.

DeepSeek Harness — 하루 만에 2.6만 별, "모든 것이 플러그인"인 에이전트 하네스
DeepSeek AI가 공개한 오픈소스 에이전트 하네스 dsh. 공개 당일 26,746★. "Everything is a Plugin" 아키텍처와 Cordis 기반 시공간 합성성. npx 한 줄 실행. 단 developer preview라 프로덕션은 보류.

CLAUDE.md는 왜 끝없이 커지는가 — 치명적 기억 과잉(Catastrophic Remembering)
에이전트 코딩에서 프롬프트 파일이 무한정 커지는 문제를 1,867개 레포의 24.7만 인스트럭션 수명으로 실측. +226% 성장, 커밋당 +4.9개, 나이든 규칙은 삭제 불가 — 해결책은 "이유를 남기는 주석".

스킬을 압축해야 하는 이유 — SkillZip의 구조적 압축 실측 31.2%
자가진화 에이전트의 스킬 비대화 문제를 해결하는 SkillZip. 평가 없이 구조적으로 압축해 압축률 31.2%, 성능은 오히려 상승, 3.5배 빠르고 rollout 0회. 자가진화 시리즈 후속작.

LinkedIn이 운영 중인 자가진화 에이전트 — 2주 A/B 실측 +9.0pp
LinkedIn의 자가진화 고객지원 에이전트 실측 분석. 진화적 검색으로 프롬프트만 최적화(모델 재훈련 없이), 2주 프로덕션 A/B에서 QA 자가해결 +9.0pp, 라우팅 정확도 +30.6pp.

자가진화의 두 방식 — 스킬을 진화시키는 SkillProx, 에이전트를 진화시키는 Ouroboros
AI 에이전트 자가진화는 두 가지 방식으로 연구된다. 지식을 진화시키는 SkillProx와 에이전트 자신을 진화시키는 Ouroboros를 실측 수치로 비교합니다.