멀티 에이전트 병렬 실행이 SWE-bench에서 단일 모델을 능가하다 — Verdent AI 76.1%
Verdent AI가 SWE-bench Verified에서 76.1%를 달성. 단일 대형 모델이 아닌 멀티 에이전트 병렬 실행 아키텍처로 소프트웨어 엔지니어링 자동화의 새로운 패러다임을 제시합니다.
태그
3개 글
Verdent AI가 SWE-bench Verified에서 76.1%를 달성. 단일 대형 모델이 아닌 멀티 에이전트 병렬 실행 아키텍처로 소프트웨어 엔지니어링 자동화의 새로운 패러다임을 제시합니다.
인간이 코드를 작성하지도, 리뷰하지도 않는 팩토리 모델이 현실화되고 있습니다. 시나리오 기반 확률적 테스트, 하루 1000달러 컴퓨팅 비용, EM 역할의 근본적 변화를 분석합니다.
오케스트레이션 에이전트 중심의 반복적 리뷰 사이클을 통해 복잡한 개발 작업의 에러율을 40-90% 감소시키는 체계적 방법론을 소개합니다.