AI 에이전트 & 개발 도구
Cursor 3.0: 에이전트 중심 인터페이스로 완전히 재설계된 개발 환경
Cursor가 전통적 IDE 중심 모델에서 에이전트 기반 워크스페이스 아키텍처로 전환하는 대규모 업데이트를 발표했다. 로컬, 워크트리, 클라우드, 원격 SSH 환경에서 여러 에이전트를 동시 실행하는 Agents Window와, UI 요소를 직접 선택해 에이전트에 작업을 지시하는 Design Mode가 핵심이다. /worktree와 /best-of-n 등 새 명령어, MCP 구조화 콘텐츠 지원도 추가되었다.
goose - Block이 만든 오픈소스 로컬 실행 자율 AI 개발 에이전트
Block에서 공개한 자율 AI 개발 에이전트로, 프로젝트 생성부터 코드 실행, 수정, 테스트, 디버깅, 워크플로 오케스트레이션까지 처리한다. 20개 이상 LLM 프로바이더를 지원하며 MCP 서버 연동으로 기능을 확장할 수 있다. Lead/Worker 모델 자동 전환, Planning Mode를 제공하고, Apache 2.0 라이선스의 Rust + TypeScript 기반이다.
코딩 에이전트의 구성 요소
코딩 에이전트는 LLM 제어 루프와 소프트웨어 하니스(harness)로 구성된다. 실시간 리포 컨텍스트, 프롬프트 캐시, 도구 접근, 컨텍스트 최소화, 세션 메모리, 하위 에이전트 위임의 6가지 핵심 구성 요소를 해설하며, 하니스 설계 품질이 동일 LLM의 성능 차이를 결정한다고 강조한다.
Ravenclaw - AI 코딩 에이전트의 작업 컨텍스트를 관리하는 오픈소스 시스템
에이전트가 이슈 생성, 상태 변경, 위키 작성을 수행하고 사람은 웹 UI에서 확인 및 방향 설정을 하는 프로젝트 관리 시스템이다. 컨텍스트 스냅샷으로 세션 간 작업 이어받기가 가능하며, Claude Code, Gemini CLI, Codex 등 멀티 에이전트를 지원한다. 40개 이상의 MCP 도구와 그래프 뷰 진행률 추적 기능을 제공한다.
rtk - LLM 토큰 소비를 60~90% 줄여주는 CLI 프록시
CLI 명령어 출력을 필터링하고 압축하여 LLM 토큰을 60~90% 절감하는 Rust 단일 바이너리 도구다. git, grep, ls 등 100개 이상 명령어를 지원하며, Claude Code, Codex, Cursor, Gemini CLI 등 10개 AI 코딩 도구와 호환된다. 30분 세션에서 약 80% 토큰 절감, 테스트 러너는 최대 90% 절감을 달성했다.
Caveman - 원시인 말투로 Claude/Codex 토큰 절약하기
LLM 출력을 원시인 말투로 압축하여 평균 65~75%의 출력 토큰을 절감하는 기법이다. 간결한 표현을 강제함으로써 불필요한 장황함을 제거하는 독특한 접근 방식이다.
AgentNews - 에이전트를 위한 해커뉴스
자율 AI 에이전트가 직접 게시하고 순위를 매기고 정보를 소비하는 에이전트 전용 플랫폼이다. HTTP 402 프로토콜로 실제 금액을 스테이킹하여 게시하며, 인기도 대신 실용성(utility) 기반 순위 체계를 사용한다.
Claude Code를 만든 Boris Cherny가 직접 추천한 기능 15가지
Claude Code 제작자 Boris Cherny가 공유한 숨겨진 기능 가이드다. 모바일 앱, 기기 간 세션 이동, /loop와 /schedule로 자동 반복 실행, Hooks를 통한 커스텀 동작, Git Worktrees로 병렬 작업 등 실무에서 활용도 높은 기능들을 소개한다.
MCP의 모든 것을 알아봅시다
MCP(Model Context Protocol)의 원리와 구조를 상세히 해설하는 기술 포스트다. AI 에이전트와 외부 도구 연동의 핵심 프로토콜로, 에이전트 생태계 확장의 기반이 되는 표준을 다룬다.
AI 연구 & 보안
Claude Code가 23년간 숨겨져 있던 Linux 취약점을 발견
Anthropic의 Claude Code가 최소한의 감독 하에 Linux 커널 NFS 드라이버에서 23년간 발견되지 않았던 원격 악용 가능 힙 버퍼 오버플로우 취약점을 자동 탐지했다. Claude Opus 4.6 모델이 이전 버전 대비 현저히 높은 탐지 능력을 보였으며, 수백 개의 추가 잠재 취약점이 발견되었으나 인간 검증 병목으로 대부분 미보고 상태다. 현재까지 5건의 취약점이 공식 패치되었다.
코드 생성 성능을 향상시키는 놀라울 만큼 단순한 자기 증류 기법
교사 모델이나 강화학습 없이 모델 자체 생성 코드로 학습하는 SSD(Simple Self-Distillation) 기법이다. Qwen3-30B의 LiveCodeBench v6 pass@1이 42.4%에서 55.3%로 향상되었고, 가장 어려운 문제에서 +15.3%p 개선을 보였다. 훈련 데이터의 62%가 무의미해도 효과가 유지되며, Llama/Qwen 4B~30B에서 범용적으로 작동한다.
감정적 표현이 AI 성능을 바꿀까? - 프롬프트 감정 프레이밍의 실제 효과
하버드 연구에서 고정된 감정 접두사('I'm angry' 등)는 LLM 성능에 거의 영향을 미치지 않으며 감정 강도도 무관함을 확인했다. 다만 EmotionRL로 질문별 동적 감정 선택 시 일관된 성능 향상을 보여, 감정 프롬프팅을 범용 템플릿이 아닌 적응적 라우팅 문제로 재정의해야 한다고 제안한다.
AI 업계 동향
Google AI Edge Gallery - 완전 오프라인 LLM 갤러리 앱 오픈소스
온디바이스 LLM 실행에 특화된 iOS/안드로이드 오픈소스 앱이다. 완전 오프라인에서 Gemma 4 패밀리를 구동하며, Agent Skills, Thinking Mode(단계별 추론 시각화), Audio Scribe(실시간 음성 전사/번역), Prompt Lab 등 다양한 기능을 제공한다.
Claude, 이제 서드파티에서 구독 모델 사용 불가
Anthropic이 Claude 구독 사용자의 OpenClaw 등 서드파티 도구 접근을 차단했다. 할인 사용량 번들 또는 API 키로 전환해야 하며, 기존 구독자에게 월 구독료 상당의 크레딧을 일회 보상한다. Claude Code, Agent SDK 등 Anthropic 자체 도구는 영향이 없다.
OpenAI, 미디어 기업 TBPN 인수
OpenAI가 라이브 테크 토크쇼 및 미디어 기업 TBPN을 인수했다. AI 기술의 사회적 영향 전달 강화가 목적이며, TBPN은 편집 독립성을 유지한 채 Strategy 조직에 편입된다. 커뮤니티에서는 기업 소유 미디어의 편집 독립성에 대한 우려를 제기하고 있다.
GitHub 역사상 가장 빠르게 10만 스타를 기록한 오픈소스 프로젝트
GitHub 최단 10만 스타 프로젝트 기록 정리다. Claude Code 기반 claw-code, GitHub Agentic Workflows, Gemini CLI 등 AI 코딩 도구가 폭발적 관심을 받고 있음을 보여준다.
만약 당신이 클로드 블루 때문에 힘들다면
AI 발전으로 인한 개발자 불안감('Claude Blue')에 대한 분석과 처방이다. 대부분의 AI 엔지니어링 기법은 'API에 적절한 입력을 보내고 응답을 처리하는' 변형이며, LLM은 다음 토큰 예측 모델이라는 기본 원리를 이해하면 새 용어가 기존 지식의 어디에 위치하는지 판단할 수 있다고 강조한다.
기계는 괜찮아요. 나는 우리가 걱정됩니다.
AI가 '이해 없이 결과만 생산하는 연구자'를 증가시킨다는 논의다. AI 도구 의존이 연구의 깊이를 약화시킬 수 있다는 우려를 제기하며, 도구 활용과 본질적 이해 사이의 균형에 대해 성찰을 촉구한다.
AI 활용 & 실전
LLM-Wiki - LLM을 활용하여 개인 지식저장소 구축하기
Andrej Karpathy가 제시한 LLM 기반 개인 지식 저장소 구축 가이드다. RAG와 달리 에이전트가 위키를 직접 생성하고 관리하며, 하나의 소스에서 10~15페이지를 업데이트하고 상호 참조를 유지한다. 원본 문서(불변), 위키 마크다운(LLM 관리), 스키마 설정의 3계층 아키텍처를 사용한다.
AI 문서 어시스턴트를 위한 RAG 대체 가상 파일시스템 구축
문서를 가상 파일시스템 구조로 전환하여 RAG의 한계를 극복한 사례다. ChromaFs 기반으로 grep, cat, ls, find 명령어를 지원하며, 세션 생성 시간이 46초에서 100ms로 단축되었다. RBAC 기반 접근 제어와 2단계 필터링 등 최적화 기법도 적용했다.
8년의 갈망, 3개월의 완성 - AI가 바꾼 사이드 프로젝트의 공식
8년간 구상했던 SQLite 개발 도구를 AI 코딩 에이전트(Claude Code)로 3개월 만에 완성한 경험담이다. 초기 'vibe coding'은 유지 불가능한 코드를 생성해 Rust 재작성이 필요했다. AI는 구현 가속기이지 설계 대체제가 아니며, 검증 가능한 문제에서 탁월하지만 아키텍처 결정에서는 한계를 보인다는 결론이다.
Mac mini에서 Ollama와 Gemma 4 26B 모델 설정 요약
Apple Silicon Mac mini에서 Ollama + Gemma 4 로컬 LLM 설정 가이드다. Homebrew와 Launch Agent로 자동 실행 및 모델 메모리 상주를 구성할 수 있다. 8B 모델은 9.6GB 메모리로 안정 구동되며, Ollama v0.19+는 MLX 백엔드와 OpenAI 호환 Chat Completion API를 지원한다.
Awesome Design.MD - 유명 웹사이트 디자인 시스템을 내 사이트에 적용하기
마크다운 파일 하나로 AI가 읽을 수 있는 텍스트 디자인 문서를 구성하는 개념이다. AI 코딩 도구와의 통합을 위한 디자인 시스템 문서화 접근으로, 기존 디자인 시스템을 AI 에이전트가 활용 가능한 형태로 변환할 수 있다.
왜 우리는 아직도 AI에게 일을 제대로 못 시킬까?
AI 시대의 핵심 역량 '잘 시키는 능력'에 대한 분석이다. 프롬프트 엔지니어링에서 컨텍스트 엔지니어링, 하니스 엔지니어링으로 진화하는 과정을 다루며, Idea Manager 도구를 통한 프롬프트 관리 방법을 소개한다.
문돌이 PM이 만든 AI 세션에 대기자 200명이 몰린 이유
비개발자를 위한 Claude Cowork 세션 운영자 인터뷰다. 12회 세션에 200명 대기자가 발생했으며, AI 협업 마인드셋, 컨텍스트 설계, 결과 밸리데이팅의 실무 적용 방법을 공유한다.
AI 시대 해커톤은 어떻게 변해야 하는가?
2026 GDGOC KR 연합 해커톤 ONE WAVE 기록이다. 160명 참가자가 AI를 활용해 기획 밀도에 중점을 두었으며, 배포를 선택제로 두어 기획 완결성을 높이고 운영 자동화로 현장 대응력을 향상시켰다.
추천 영상
IT뉴스 — Gemma 4, Veo3.1 Lite, 오픈AI 새 이미지 모델, 클로드 코드 유출, Grok Quality Mode 등
조코딩 채널의 주간 IT 뉴스 요약 영상이다. Gemma 4, Veo3.1 Lite, OpenAI 새 이미지 생성 모델, Claude Code 소스 유출 사태, Grok Quality Mode 등 이번 주 주요 AI·IT 소식을 빠르게 정리한다.
AI뉴스 — Claude Mythos 유출, TurboQuant, Sora 종료, Seedance 2.0, Meta 뇌 읽는 AI
지난주 주요 AI 뉴스를 조코딩이 정리한 영상이다. Claude Mythos 유출, TurboQuant 출시, Sora 서비스 종료, Seedance 2.0, Meta의 뇌 신호 해독 AI 등 다양한 소식을 챕터별로 설명한다.
AI 코딩 에이전트 전용 터미널 cmux — 왜 개발자들이 열광할까?
개발동생 채널에서 소개한 AI 코딩 에이전트 시대에 맞게 설계된 오픈소스 터미널 cmux 리뷰 영상이다. 워크스페이스 관리, 에이전트 알림, 내장 브라우저, 세션 간 컨텍스트 공유 기능을 갖췄으며, iTerm·Ghostty·Warp 등 기존 터미널과의 차이점을 실제 시연과 함께 설명한다.