Hermes Agent — 작업할수록 스스로 진화하는 오픈소스 AI 에이전트
NousResearch의 Hermes Agent v0.7.0을 설치해봤다. 작업을 마칠 때마다 스킬 문서를 자동 생성하고, 다음 실행에서 그걸 참조하는 자기 진화 루프가 실제로 동작하는지 확인한 기록.
태그
17개 글
NousResearch의 Hermes Agent v0.7.0을 설치해봤다. 작업을 마칠 때마다 스킬 문서를 자동 생성하고, 다음 실행에서 그걸 참조하는 자기 진화 루프가 실제로 동작하는지 확인한 기록.
Google이 Apache 2.0으로 공개한 Gemma 4를 Ollama로 직접 설치해 한국어, 구조화 출력, 함수 호출까지 테스트했다. 9.6GB짜리 로컬 모델이 에이전트 파이프라인의 빌딩 블록이 될 수 있을까?
AI 에이전트 여러 개를 회사처럼 관리하는 오픈소스 플랫폼 Paperclip을 직접 설치해봤다. Linear 스타일 대시보드, Org Chart, 비용 추적, 다양한 에이전트 어댑터까지 — Claude Code 에이전트를 조직화하는 실전 경험과 솔직한 평가를 공유합니다.
Mistral이 공개한 4B 파라미터 오픈 웨이트 TTS 모델 Voxtral을 분석한다. ElevenLabs를 인간 평가에서 이겼고 3초 보이스 클로닝을 지원하지만, 일본어·한국어 미지원이라는 치명적 빈자리가 아시아 시장 활용을 막는다. 라이선스 함정과 실무 대안도 함께 짚는다.
Zhipu AI의 GLM-5는 744B MoE 구조로 NVIDIA 없이 화웨이 Ascend 칩만으로 훈련된 MIT 오픈소스 최전선 모델입니다. EM/CTO 관점에서 엔터프라이즈 AI 전략을 재검토합니다.
AI2의 Olmo Hybrid는 Transformer와 DeltaNet(Linear RNN)을 3:1로 결합해 동일 정확도를 49% 적은 토큰으로 달성합니다. 어텐션과 Linear RNN 하이브리드가 학습 효율을 높이는 원리와 LLM 개발자를 위한 실무 시사점을 분석합니다.
ggml.ai 팀이 Hugging Face에 합류하여 llama.cpp의 장기적 지속가능성을 확보합니다. 로컬 AI 추론 생태계의 구조적 변화와 기술적 의미를 분석합니다.
Mistral Devstral Small 2 24B와 Qwen3 Coder 30B가 동시에 등장했습니다. Raspberry Pi에서도 작동하는 소형 코딩 모델의 비교 분석과 로컬 AI 코딩의 미래를 살펴봅니다.
14M 파라미터·25MB 미만으로 클라우드 TTS 품질을 구현한 Kitten TTS V0.8을 철저히 분석합니다. 엣지 디바이스 배포 가능성과 로컬 음성 AI 최신 트렌드를 살펴봅니다.
CUDA 코드를 AMD GPU에서 직접 실행하는 오픈소스 컴파일러 BarraCUDA를 심층 분석합니다. LLVM 의존성 없이 15,000줄 C99로 구현된 컴파일러 아키텍처, 지원 CUDA 기능 목록, GPU 벤더 종속에서 벗어나는 전략을 실제 코드 예시와 함께 설명합니다.
DeepSeek V4 출시가 임박한 가운데 Qwen3.5, GLM-5 등 중국 AI 기업들의 모델 러시가 이어지고 있습니다. DeepSeek-R1 대비 추론·코딩 벤치마크 개선점을 비교하고, 오픈소스 LLM의 GPT-4급 근접에 따른 글로벌 AI 경쟁 구도 재편을 분석합니다.
4억 파라미터 경량 TTS 모델 KaniTTS2가 오픈소스로 공개되었습니다. 3GB VRAM으로 제로샷 보이스 클로닝이 가능하며 사전학습 코드까지 완전 공개되었습니다. MOS 스코어와 음성 품질을 분석하고, 로컬 AI 환경에서의 실용적 활용 가능성을 상세히 살펴봅니다.
OpenRouter 주간 이용 랭킹 TOP5 중 4개가 오픈소스 모델(Qwen3-Coder, DeepSeek R2, MiniMax M2.5 등)을 차지했습니다. 프로프라 모델 우위의 종언과 오픈소스가 실사용에서 선택받는 이유를 분석합니다.
Heretic 1.2가 출시되었습니다. 4bit 양자화로 VRAM 사용량을 최대 70% 줄이고, MPOA로 고품질 어블리테레이션을 구현합니다. 로컬 LLM 운용 비용 절감의 최신 기법을 소개합니다.
GPT-OSS 120B Uncensored 모델의 기술적 특징과 무검열 오픈소스 LLM이 촉발한 세이프티 가드레일 논쟁을 기술·윤리 양면에서 분석합니다.
MiniMax M2.5가 SWE-Bench Verified 80.2%를 달성하며 Claude Opus 4.6을 넘어섰습니다. 오픈 웨이트 모델과 프로프라이어터리 모델의 성능 격차가 급속히 좁혀지고 있는 현황을 벤치마크 데이터와 함께 분석합니다.
오픈소스 AI 비서 플랫폼 OpenClaw 완전 소개 가이드. Telegram·Discord·Slack 멀티채널 지원, Claude·GPT·Gemini 멀티모델 동적 전환, 노드 기반 자동화 워크플로우의 핵심 아키텍처와 즉시 따라할 수 있는 설치 가이드를 한번에 정리합니다.