AI 에이전트 & 연구

AI 에이전트 벤치마크를 무너뜨린 방법과 그 다음 단계

UC 버클리 연구팀이 SWE-bench, WebArena, OSWorld 등 주요 AI 에이전트 벤치마크 8종에서 실제 문제 해결 없이도 최고 점수를 얻을 수 있는 구조적 취약점을 발견했다. 자동화 스캐닝 에이전트를 통해 점수 계산 로직을 악용하거나, 보상 해킹, 정답 노출, 평가 코드 조작 등으로 100%에 가까운 점수를 획득할 수 있었다. 연구팀은 벤치마크 보안 점검 도구 BenchJack을 오픈소스로 공개하며 적대적 평가 견고성 검증의 표준화를 제안했다.

원문 보기GeekNews | 출처: GeekNews / Hacker News

Meta의 HyperAgents - 에이전트가 스스로 자신의 하네스를 설계할 때

Meta와 UBC가 공동 발표한 HyperAgents는 작업 수행 코드뿐 아니라 개선 메커니즘 자체까지 스스로 수정하는 자기참조적 AI 에이전트 프레임워크다. 코딩, 논문 리뷰, 로보틱스, 수학 채점 등 다양한 도메인에서 에이전트가 영속 메모리, 성능 추적, 다단계 검증 파이프라인 등을 독립적으로 발명해냈다. 에이전트가 인프라의 소비자에서 생산자로 전환 중이며, 개발자의 역할은 하네스 직접 구축에서 에이전트가 효과적 하네스를 진화시킬 초기 조건 설계로 변화하고 있다.

원문 보기GeekNews | 출처: GeekNews

Managed Agents 확장하기: 두뇌와 손을 분리하기

장기 실행 에이전트를 위한 Managed Agents 아키텍처가 하네스(두뇌)와 샌드박스(손)를 분리하는 접근을 채택했다. OS가 하드웨어를 가상화하듯 에이전트 구성 요소(세션, 하네스, 샌드박스)를 가상화해 독립적으로 교체 가능하게 만들었으며, 이를 통해 p50 TTFT 60% 감소, p95는 90% 이상 감소를 달성했다.

원문 보기GeekNews | 출처: GeekNews

가짜 질병을 만들었더니 AI가 사실이라고 말했다

Nature에 게재된 연구에서 과학자들이 의도적으로 가짜 질병을 만들어 AI에 질문했더니, AI가 이를 실제 질병이라고 응답한 것으로 나타났다. AI 환각(hallucination) 문제가 의료 분야에서 심각한 위험을 초래할 수 있음을 보여주는 실험 결과로, 의료 정보에 대한 AI 의존도가 높아지는 상황에서 검증 체계의 필요성을 재확인시켰다.

원문 보기 | 출처: Hacker News

AI 보안 & 사이버 위협

AI 사이버보안의 새로운 경계: Mythos 이후의 현실

Anthropic의 Claude Mythos가 대규모 제로데이 취약점을 자동 탐지한 이후, 3.6B~5.1B급 소형 오픈 모델들도 동일 취약점 탐지에 성공하면서 AI 보안 능력의 지형이 바뀌고 있다. 모델 크기와 성능이 비선형적이며, 특정 과제에서는 소형 모델이 대형 모델보다 정확한 결과를 보여줬다. 진정한 경쟁력은 모델 자체가 아닌 시스템 설계와 검증 파이프라인에 있으며, 전문가 지식이 내장된 오케스트레이션 구조가 핵심이라는 분석이다.

원문 보기GeekNews | 출처: GeekNews

미국, Anthropic AI 모델의 사이버 위험에 대해 은행 수장들 소환

미국 정부가 Anthropic 최신 AI 모델이 제기하는 사이버 보안 위험에 대해 주요 은행 수장들을 소환해 논의했다. AI 모델의 취약점 발견 능력이 방어뿐 아니라 공격에도 활용될 수 있다는 우려가 금융권 차원의 대응 논의로 이어진 것이다.

원문 보기 | 출처: Hacker News

OpenAI, Axios 공급망 공격 대응 보안 강화

OpenAI가 Axios 개발자 도구 공급망 공격에 대응해 macOS 코드 서명 인증서를 교체하고 애플리케이션 보안을 전면 강화했다. 사용자 데이터는 손상되지 않았음을 확인했으며, 공급망 보안 위협이 AI 도구 생태계에도 현실적 위험임을 보여주는 사례다.

원문 보기 | 출처: OpenAI Blog

Gemini SynthID 워터마크를 역공학으로 탐지 및 제거하는 오픈소스

Google의 SynthID 인코더/디코더 접근 없이 순수 신호 처리와 스펙트럼 분석만으로 Gemini 이미지의 비가시 워터마크 구조를 복원하는 데 성공했다. 동일 모델 생성 이미지 간 위상 템플릿 일관성이 99.5% 이상으로 사실상 고정 패턴이었으며, 다중 해상도 스펙트럼 코드북 감산 방식으로 PSNR 43dB 이상을 유지하면서 91% 위상 일관성 감소를 달성했다. 연구/교육 목적으로 GitHub에 전체 코드가 공개되었다.

원문 보기GeekNews | 출처: GeekNews

AI 업계 동향 & 요금제

ChatGPT Pro 요금제, 월 $100부터 시작하는 6단계 체계로 개편

OpenAI가 기존 요금 구조를 대폭 개편했다. Free/Plus($20) 사이에 광고 포함 가능한 Go($8) 플랜을 신설하고, Pro는 $100(5x)과 $200(20x) 두 단계로 분리해 총 6단계 체계로 확장했다. Pro 플랜부터 GPT-5.4 Pro 모델 사용이 가능하며 컨텍스트 윈도우 128K, 추론 컨텍스트 400K까지 지원한다. 미국 K-12 교사는 2027년 6월까지 무료, 비영리 단체는 최대 75% 할인을 받을 수 있다.

원문 보기GeekNews | 출처: GeekNews

Anthropic, Google/Broadcom과 차세대 대규모 컴퓨팅 파트너십 확대

Anthropic이 Google, Broadcom과 수 기가와트 규모의 차세대 컴퓨팅 파트너십 확대를 발표했다. AI 인프라 투자가 전례 없는 규모로 확장되고 있으며, 대규모 모델 학습과 서비스에 필요한 컴퓨팅 자원 확보 경쟁이 본격화되고 있음을 보여준다.

원문 보기 | 출처: Anthropic Blog

Anthropic 캐시 TTL 5분 단축과 Claude Code 할당량 논란

Anthropic이 Claude Code의 캐시 TTL을 1시간에서 5분으로 단축하면서 캐시 재생성 비용이 20~32% 증가했다. Pro Max 5x 요금제에서도 적당한 사용량에 1.5시간 만에 할당량이 소진되는 문제가 보고되고 있으며, cache_read 토큰이 전체 비율로 계산되는 오류가 지목되고 있다. 커뮤니티는 비용 상승과 사전 공지 부재를 비판하며 TTL 설정의 사용자 선택권을 요구하고 있다.

원문 보기GeekNews | 출처: GeekNews

Cirrus Labs, OpenAI에 합류

9년간 외부 자본 없이 CI/CD, 빌드 도구, 가상화 분야에서 혁신을 이어온 Cirrus Labs가 OpenAI의 Agent Infrastructure 팀에 합류한다. Apple Silicon 가상화 도구 Tart의 라이선스 비용이 제로로 전환되며, Cirrus CI는 2026년 6월 1일 서비스를 종료한다.

원문 보기GeekNews | 출처: GeekNews

딥시크, 내몽골 데이터센터에 엔지니어 모집

딥시크가 내몽골 지역 데이터센터 인력 채용에 나서며 자체 컴퓨팅 인프라 확장에 속도를 내고 있다. 차세대 AI 모델 출시를 앞두고 대규모 컴퓨팅 자원 자체 확보에 나선 것으로, 글로벌 AI 인프라 경쟁이 한층 심화되고 있음을 시사한다.

원문 보기 | 출처: AI타임스

OpenAI, 엔터프라이즈 AI의 다음 단계 발표

OpenAI가 Frontier, ChatGPT Enterprise, Codex, 전사 AI 에이전트로 구성된 엔터프라이즈 AI의 다음 단계를 공개했다. 기업 AI 도입이 가속화되는 가운데 산업 전반으로의 에이전트 확산을 예고하는 행보다.

원문 보기 | 출처: OpenAI Blog

AI 정책 & 규제

리눅스 커널 기여 시 AI 보조 도구 사용 지침 공식화

Linus Torvalds의 Linux 커널에 AI 코딩 도구 사용 지침이 공식 문서로 추가되었다. AI는 Signed-off-by 태그를 추가할 수 없으며, 법적으로 인간만 인증 가능하고 인간 개발자가 AI 생성 코드의 전체 책임을 부담해야 한다. AI 기여 코드에는 Assisted-by 형식으로 모델명:버전 및 분석 도구를 명시해야 하며, 모든 기여는 GPL-2.0-only 호환이어야 한다.

원문 보기GeekNews | 출처: GeekNews / Hacker News

OpenAI, AI 기업 모델 피해 소송 면책 법안 지지

OpenAI가 일리노이 주에서 AI 기업의 모델 피해 소송 책임을 제한하는 법안을 지지하고 나섰다. AI 기업 면책 범위와 규제에 대한 글로벌 논쟁을 촉발하고 있으며, 기술 발전 속도와 법적 책임 체계 간의 격차가 핵심 쟁점으로 부상하고 있다.

원문 보기 | 출처: Hacker News

테슬라 FSD, 유럽 최초로 네덜란드 승인

테슬라의 FSD(Full Self-Driving) 감독형이 유럽 최초로 네덜란드에서 규제 승인을 획득했다. EU 전역 확산의 발판이 될 수 있는 규제 이정표로, 자율주행 기술의 글로벌 규제 승인 흐름에 주목할 필요가 있다.

원문 보기 | 출처: AI타임스

Mistral AI의 유럽 AI 전략 플레이북

Mistral AI가 유럽 AI 주권과 경쟁력 확보를 위한 전략 플레이북을 제안했다. 미국과 중국 주도의 AI 경쟁 속에서 유럽이 독자적 AI 생태계를 구축하기 위한 정책적 방향을 제시하고 있다.

원문 보기 | 출처: Hacker News

AI 사회적 영향

Sam Altman 자택 화염병 공격과 AI에 대한 폭력적 반발

Sam Altman CEO의 자택에 화염병이 투척되는 사건이 발생한 가운데, AI에 대한 폭력적 반발의 역사적 맥락을 분석하는 논의가 확산되고 있다. 산업혁명기 러다이트 운동에서 시작된 기술 폭력이 오늘날 AI와 데이터센터를 향한 공격으로 되살아나고 있으며, 기술이 물리적으로 파괴 불가능할수록 분노는 기술을 만든 인간에게 향하는 경향이 강화된다는 분석이다. Altman은 AI를 인류의 잠재력을 확장하는 도구로 규정하며 대화와 민주적 절차를 통한 해결을 촉구했다.

원문 보기GeekNews | 출처: GeekNews / Hacker News

OpenAI Safety Fellowship 발표

OpenAI가 독립적 안전성 및 정렬 연구를 지원하고 차세대 인재를 양성하기 위한 파일럿 프로그램 Safety Fellowship을 발표했다. AI 안전 연구 생태계의 확장을 목표로 하며, 외부 연구자들의 참여를 통해 안전 연구의 다양성을 높이려는 시도다.

원문 보기 | 출처: OpenAI Blog

AI 도구 & 플랫폼

Anthropic, 'Claude for Word' 출시 - MS 오피스에서 코파일럿과 경쟁

Anthropic이 마이크로소프트 워드에서 Claude와 협업할 수 있는 새로운 도구를 출시했다. MS 주요 오피스 제품군에 직접 Claude를 통합하며, Microsoft Copilot과의 본격적인 경쟁이 시작되었다.

원문 보기 | 출처: AI타임스

Instant 1.0 - AI로 작성한 앱을 위한 백엔드 플랫폼

바이브 코딩으로 만든 앱에 실시간 동기화, 오프라인 모드, 인증, 파일 저장소를 한 번에 붙여주는 오픈소스 백엔드다. 백엔드 생성이 DB 행 추가 수준으로 수 밀리초 만에 완료되며, AI 에이전트가 API/CLI로 직접 앱 생성, 스키마 변경, 권한 설정까지 수행할 수 있다. 4년간 개발된 Postgres 기반 멀티테넌트 구조로 GitHub에 전체 코드가 공개되어 있다.

원문 보기GeekNews | 출처: GeekNews / Hacker News

Safetensors, PyTorch Foundation에 합류

Hugging Face의 Safetensors가 PyTorch Foundation에 공식 합류했다. AI 모델 직렬화 형식의 업계 표준화가 한 단계 진전된 것으로, 안전하고 효율적인 모델 저장 및 로딩 방식이 PyTorch 생태계에 공식 통합된다.

원문 보기 | 출처: Hugging Face Blog

추천 영상

IT뉴스 - Claude Mythos와 glasswing, Codex Scratchpad, 메타 뮤즈 스파크 등

조코딩 채널의 주간 IT 뉴스 요약 영상이다. Claude Mythos, glasswing, Codex Scratchpad, 메타 뮤즈 스파크, 영상 생성 모델 HappyHorse, GLM-5.1 등 이번 주 주요 AI 소식을 빠르게 정리한다.

영상 보기YouTube

사람 대신 일하는 AI, 실제 현업에선 이렇게 씁니다

조코딩 채널에서 인핸스 이승현 대표와 함께 AI를 실제 업무에 도입한 현장 사례를 다루는 인터뷰 영상이다. AI 자동화가 현업에서 어떻게 적용되고 있는지 실무 관점에서 들어볼 수 있다.

영상 보기YouTube

내 컴퓨터를 통째로 자동화해주는 Manus My Computer

코드팩토리 채널에서 소개한 Manus My Computer 리뷰 영상이다. 컴퓨터 전체를 AI로 자동화하는 도구의 기능과 활용법을 시연과 함께 설명한다.

영상 보기YouTube

하네스 엔지니어링, 9달러 vs 200달러의 비밀 (클로드 코드)

짐코딩 채널에서 Claude Code의 하네스 엔지니어링을 다루는 영상이다. 동일한 작업에서 비용 차이를 만드는 하네스 설계 전략과 실전 팁을 공유한다.

영상 보기YouTube