AGENTS.md는 정말 효과가 있을까? 첫 실증 논문이 밝힌 의외의 결과
GitHub 6만 개 이상 리포지토리가 쓰는 AGENTS.md, 정말 효과가 있을까. ETH Zürich의 첫 실증 논문은 LLM 생성 파일이 성공률을 3% 낮추고 개발자 작성 파일도 4% 오르는 데 그쳤으며 추론 비용은 20% 늘었다고 밝혔다. 결과와 원인을 분석한다.
태그
4개 글
GitHub 6만 개 이상 리포지토리가 쓰는 AGENTS.md, 정말 효과가 있을까. ETH Zürich의 첫 실증 논문은 LLM 생성 파일이 성공률을 3% 낮추고 개발자 작성 파일도 4% 오르는 데 그쳤으며 추론 비용은 20% 늘었다고 밝혔다. 결과와 원인을 분석한다.
정렬 후 발생하는 모드 붕괴 문제를 해결하는 Verbalized Sampling 기법. 재훈련 없이 LLM 출력 다양성을 1.6〜2.1배 향상시키는 프롬프팅 전략 완벽 가이드
LLM 기반 Semantic Similarity Rating으로 225개 평가를 수행한 실험 결과와 통계 분석. ICC 0.83의 높은 신뢰도 검증 및 시각화 포함.
AI 에이전트에 성별이나 페르소나를 부여하면 실제로 업무 성능이 달라질까요? 120개 이상의 심리학·NLP 연구가 밝힌 전문가 페르소나, 감정 표현, 역할 부여의 효과를 정리하고, 코딩·창작·요약 등 업무 유형별 최적 에이전트 설계 전략을 분석합니다.