편집자 노트: 2026년 4월 27일 주간 AI 뉴스 — OpenAI GPT-5.5/Pro 출시와 Google의 Anthropic 400억 달러 투자 결정이 동시에 발표되며 거대 모델 경쟁과 자본 집중이 한층 가속됐습니다.
Gemini Enterprise Agent Platform과 Stash·mini-swe-agent·LLM 위키 같은 에이전트 인프라·메모리·경량 코딩 에이전트도 줄지어 등장했습니다.
AI 모델 & 출시
OpenAI, API에 GPT-5.5와 GPT-5.5 Pro 출시
GeekNews
- GPT-5.5와 GPT-5.5 Pro를 Chat Completions API와 Responses API에 정식 출시 — Pro 모델은 어려운 문제 해결을 위해 더 많은 추론 연산을 사용
- 100만 토큰 컨텍스트 윈도우, 이미지 입력, 구조화 출력, 함수 호출, Skills, MCP, 웹 검색까지 풀 스택 기능 지원
- 기본 reasoning effort는 medium, 캐싱은 extended prompt caching에서만 동작하고 in-memory caching은 미지원
- GPT Image 2도 함께 출시 — 유연한 이미지 크기, 고충실도 이미지 입력, 토큰 기반 과금, Batch API 50% 할인 적용
"그리는 것이 곧 이해하는 것"…구글, 생성 AI로 비전 AI 역할까지 하는 '비전 바나나' 공개
AI타임스
- 구글 딥마인드가 이미지 생성 능력을 유지하면서 의미론적 분할·객체 분할·단안 깊이 추정·표면 법선 추정 등 시각 이해까지 함께 수행하는 통합 모델 'Vision Banana'를 공개
- 이미지 생성 학습이 LLM 사전 학습과 동일한 효과를 낼 수 있다는 연구 결과 — 비전 AI와 생성 AI 통합 신호로 해석
- 단순 이미지 생성 모델을 넘어 시각 정보 이해까지 가능한 범용 시각 모델로의 진화 가능성을 시사
딥시크-V4, 세계 10위에 그쳐..."기대 이하 성능에 미국은 안도"
AI타임스
- 딥시크의 플래그십 모델 V4가 Artificial Analysis 지능지수 순위에서 52점, 전체 10위에 그침
- 같은 날 공개된 1위 GPT-5.5(60점) 와 8점 차이로 격차가 큼
- 중국 모델 중에서도 4위 — 5위 키미 K2.6(54점)·샤오미 미모 등에 밀린 결과
- 기대에 미치지 못한 성능에 워싱턴·실리콘밸리가 안도의 한숨을 내쉬었다는 평가가 이어짐
GPT 5.5 on AI Gateway
Vercel
- Vercel AI Gateway에서 GPT-5.5를 사용 가능 — 별도 API 키 없이 Vercel 인프라를 통해 호출
- AI Gateway의 라우팅·재시도·로깅 기능을 GPT-5.5에도 동일하게 적용
- DeepSeek V4, GPT Image 2, Kimi K2.6까지 함께 추가되어 모델 선택 폭이 한층 넓어짐
투자 & 산업 동향
Google, Anthropic에 최대 400억 달러 (약 59조원) 투자
GeekNews
- Google이 Anthropic에 즉시 100억 달러 현금을 투자하고, 성과 목표 달성 시 추가 300억 달러를 집행 — 기업가치는 3,500억 달러로 책정
- Google Cloud는 향후 5년간 5GW 규모 컴퓨팅 용량을 제공하고 Broadcom 협약을 확장
- Anthropic은 Claude Code의 폭발적 성공으로 자금 조달이 가속되며, 빠르면 10월 IPO까지 검토 중
- AI 코딩 시장 주도권을 두고 파트너이자 경쟁자 관계가 심화 — Amazon으로부터도 50억 달러 추가 투자 유치
AI 산업은 대중이 자신들을 혐오한다는 사실을 발견하고 있음
GeekNews
- AI 기업 CEO 자택 화염병 공격, 데이터센터 지지 시의원 자택 총격 등 정치적 동기의 폭력까지 등장
- 일자리·경제에 대한 AI 장기 효과를 긍정적으로 보는 비율이 전문가와 일반 대중 사이에서 크게 벌어짐
- 극단적 미래상과 대규모 투자 요구가 불안정한 고용·생활비·전기요금 부담 우려와 충돌
- 생산성 약속이 아직 입증되지 않은 상황 — 다수 기업이 AI 도입 후 생산성 향상을 체감하지 못하고 파일럿도 수익에 미달
- 신뢰 회복에는 백서·홍보보다 검증 가능한 행동, 성능 투명성, 규제·책임 수용, 데이터센터 지역 참여가 더 중요
- OpenAI Sam Altman 자택 화염병 공격 사례 — 용의자가 AI 실존 위협 경고 선언문을 남김
AI 알약을 먹은 복리 성장 스타트업
GeekNews
- 샌프란시스코 AI 네이티브 기업 5곳을 방문해 관찰한 결과 PM 역할 소멸과 조직 전반의 실험 속도 가속이 두드러짐
- 전담 PM은 5개 기업 중 단 1명, 엔지니어가 고객과 직접 대화하고 제품 결정을 전담하는 구조로 전환
- 하루 만에 무엇이든 구현 가능해지면서 모든 요청을 구현하려는 '기능 공장(feature factory)' 유혹이 가장 큰 전략 리스크
- 기술 스택은 Slack, Claude Code, GitHub, Codex, Linear 로 수렴 — Slack이 에이전트 오케스트레이션의 핵심 허브
- 실험 비용 붕괴로 3~5배 빠른 반복 실행 달성 — AI 내재화 기업과 전략 논의만 하는 기업 간 격차가 매주 벌어짐
에이전트 플랫폼 & 인프라
Gemini Enterprise Agent Platform — 구글 클라우드의 차세대 AI 에이전트 통합 플랫폼
GeekNews
- Agent Studio + ADK로 로우코드부터 코드 중심까지 다양한 숙련도에 맞는 에이전트 개발 경로 제공
- Agent Runtime은 서브 세컨드 콜드 스타트와 며칠 단위 장기 워크플로 지원 — 영업 리드 관리 같은 복합 작업에 적합
- Memory Bank로 대화 장기 기억을 자동 생성·관리 — 일회성 세션을 넘어 개인화된 상호작용 구현
- Agent Identity·Registry·Gateway 3종 도구로 암호화 ID, 도구·에이전트 중앙 관리, 프롬프트 주입 방어를 일괄 적용
- Model Garden으로 200개 이상 모델 접근 — Gemini 3.1 Pro/Flash Image, Lyria 3, Gemma 4뿐 아니라 Anthropic Claude 시리즈 등 서드파티까지 지원
Google Cloud가 제시하는 멀티 에이전트 시스템의 5가지 통합 패턴: A2A와 MCP
GeekNews
- Agent Card — A2A 지원 에이전트가 자신의 기능·인증·호출 제한을 JSON으로 공개 (OpenAPI의 에이전트 버전)
- Agent Registry — 조직 내 에이전트를 중앙 등록소에 등록해 URL 없이도 검색·접근 가능 (서비스 메시 유사)
- 다언어·다팀 협업: Go·Java·TypeScript 등 서로 다른 스택 팀이 A2A 프로토콜만 구현하면 연동 가능
- 독립 배포·진화 — 마이크로서비스처럼 각 에이전트가 독립적으로 업데이트되며 조정 에이전트 변경 불필요
- MCP는 단일 프로토콜로 REST·DB·레거시를 표준 인터페이스로 통합, Apigee API Hub로 기존 거버넌스 재활용
Stash - AI 에이전트를 위한 지속형 메모리 계층
GeekNews
- 세션이 바뀌어도 대화·작업 맥락을 잇는 지속형 메모리 계층 — 원시 관찰을 episodes로 저장한 뒤 구조화된 지식으로 누적
- 모델 비종속적 구조로 Claude·GPT·로컬 LLM·커스텀 에이전트가 같은 메모리 계층에 연결, PostgreSQL + pgvector 기반
- RAG와 다른 역할: 문서 검색을 넘어 대화에서 사실·관계·목표·실패·가설까지 축적 (RAG와 병행 가능)
- namespace + 계층형 경로로 사용자·프로젝트·에이전트 자기지식을 분리, consolidation 파이프라인이 facts·causal links·contradictions를 합성
- MCP 네이티브 통합과
/self자기 모델, 반복 연구 루프까지 포함 — 세션형 에이전트를 장기 연속성을 가진 작업 주체로 변환
Karpathy 스타일 LLM 위키를 에이전트들이 직접 유지하는 시스템 - Markdown과 Git 기반
GeekNews
- AI 에이전트가 세션을 넘어 컨텍스트를 누적하도록 설계된 LLM 네이티브 지식 베이스 레이어
- Postgres·pgvector·Neo4j·Kafka 같은 무거운 인프라 대신 markdown + git만으로 구성 —
~/.wuphf/wiki/에 로컬 저장 - 벡터 DB 없이 BM25 + SQLite로 지식 관리 — bleve로 검색, SQLite로 facts·entities·edges·redirects 메타데이터 보관
- 벡터 DB 미사용 상태에서 500개 아티팩트·50개 쿼리 벤치마크 기준 recall@20 85% 달성
- 각 에이전트의 개인 노트북(
agents/{slug}/notebook/)과 공유 위키(team/)를 분리 — 에이전트·사람 리뷰 후 위키로 승격
앤트로픽이 증명한 '에이전트 거래'의 실체..."반려견 산책까지 성사"
AI타임스
- Anthropic이 'Project Deal' 파일럿 실험으로 AI 간 상거래 환경 시뮬레이션을 발표
- 샌프란시스코 사무실 직원 69명에게 100달러 예산을 지급하고 각자의 AI 에이전트가 슬랙 기반 시장에서 중고 물품·서비스를 자율 거래
- 에이전트들이 반려견 산책 같은 서비스 거래까지 자율 협상으로 성사 — 에이전트 경제의 가능성과 위험을 동시에 확인
개발 도구 & 코딩 에이전트
mini-swe-agent - 100줄짜리 AI 에이전트로 GitHub 이슈 해결 및 커맨드라인 지원
GeekNews
- SWE-bench·SWE-agent를 만든 Princeton·Stanford 팀의 최소주의 AI 코딩 에이전트
- 약 100줄의 Python 코드로 동작 — 거대한 설정 파일이나 모노레포 없이 초경량 구조
- bash만 도구로 사용하고 LLM tool-calling 인터페이스 없이도 어떤 모델과든 호환
- SWE-bench verified 벤치마크 74% 이상 달성 (Gemini 3 Pro 기준)
subprocess.run으로 액션을 독립 실행 — 상태 유지 쉘 세션 불필요, Docker 전환은docker exec로 교체만 하면 됨- 완전 선형 히스토리 구조로 트래젝토리와 LLM 메시지가 동일 — 디버깅·파인튜닝에 최적
Codex, Browser use로 웹사이트 구현 및 검증 지원
GeekNews
- Browser Use 플러그인으로 Codex 앱 내부에서 브라우저를 실행해 사용자가 실제로 클릭하듯 앱을 테스트
- Codex가 프론트엔드 코드를 빌드한 후 vision으로 화면을 직접 보고 웹앱과 상호작용
- 네트워크·콘솔 로그를 함께 체크하며 검증
- 로컬 개발에서 구현(Build)과 검증(Verify)을 하나로 묶어 자동화된 개발 흐름 지원
Claude Code 루틴이 내 재정을 지켜볼 수 있을까?
GeekNews
- Driggsby + Plaid로 금융 계좌를 MCP에 연결해 잔액·거래내역·투자·대출 정보를 도구로 노출
- 기존 Codex CLI cron-job 방식은 웹 로그인·렌더링 문제·2FA·passkey 제한으로 자주 깨졌음
- 재구성한 일일 이메일 자동화는 아침 스케줄 + custom connector +
email_me()도구 조합으로 모든 계좌·순자산 정리 발송 - 거래 감시 자동화는 이상 거래·큰 유출을 최근 패턴과 비교, 조건 충족 시에만 메일 발송으로 알림 피로 감소
- 비개발자도 실시간 데이터 기반 재무 점검을 직접 운영할 수 있는 개인 맞춤형 운영 자동화 사례
Claude를 해지한 이유: 토큰 문제, 품질 저하, 부실한 지원
GeekNews
- 초기 몇 주는 빠른 속도와 공정한 토큰 허용량, 좋은 결과 품질로 만족했지만 약 3주 전부터 체감이 크게 변함
- 10시간 휴식 후 Claude Haiku에 짧은 질문 두 개만 보내도 사용량이 100%까지 치솟음
- 지원 채널은 자동화된 답변 뒤 사실상 닫힌 상태 — 문의 핵심을 다루지 못함
- 단일 프로젝트도 두 시간 만에 토큰 한도 소진, 리팩터링은 우회책 보정에만 5시간 창의 절반을 소비
- 대화 캐시가 일정 시간 후 사라져 코드베이스를 다시 읽는 비용이 반복, 주간/월간 한도 체계가 일관되지 않음
- 생산성·잠재력은 인정했지만 지원 부실·품질 저하·한도 혼란이 누적되어 결국 계정 해지
안전 & 연구
GPT-5.5 바이오 버그 바운티
GeekNews
- OpenAI가 GPT-5.5의 생물학 안전장치 점검을 위한 범용 jailbreak 탐색 프로그램을 가동
- 범위는 Codex Desktop 전용 GPT-5.5로 제한 — 새 채팅에서 moderation 유도 없이 단일 프롬프트로 5개 바이오 안전 질문에 모두 답하게 만들어야 함
- 5문항 전부 통과하는 첫 진짜 범용 jailbreak에 25,000달러 — 부분 성공도 재량으로 소액 보상
- 신청은 2026년 4월 23일~6월 22일, 테스트는 4월 28일~7월 27일에 진행 — 초대·신청 심사 병행
- 참가자는 ChatGPT 계정과 NDA 서명 필요 — 모든 프롬프트·completion·발견 사항에 NDA 적용
ChatGPT를 활용한 아마추어가 Erdős 문제를 풀다
GeekNews
- 수학 비전공 아마추어가 ChatGPT를 활용해 Erdős 문제 중 하나를 풀어 화제
- AI를 사고 보조 도구로 사용한 협업적 수학 연구 사례로 주목
- 고도화된 추론 모델이 전문가 영역의 문제 해결에 어떻게 기여하는지 보여주는 단면
YouTube
IT뉴스 - GPT-5.5, Images 2.0, 딥시크 V4, Claude quality 리포트, 8세대 TPU, 딥리서치 API, Kimi K2.6 등
GPT-5.5와 GPT Image 2 출시, 딥시크 V4 성능, Claude 품질 리포트, 8세대 TPU, 딥리서치 API, Kimi K2.6 등 이번 주 주요 IT 뉴스 정리.
Codex 완벽 가이드 2026: 지금은 코덱스가 최강인 것 같네요.
2026년 시점에서 Codex가 다른 코딩 에이전트 대비 어떤 강점을 갖는지 정리한 완벽 가이드.
OpenAI Duct Tape vs Google Nano Banana 한국어 완성도
OpenAI의 'Duct Tape' 이미지 모델과 Google의 Nano Banana를 한국어 환경에서 직접 비교한 결과 공유.
GPT 5.5 vs Opus 4.7 DNA 모델링
GPT-5.5와 Claude Opus 4.7을 DNA 모델링이라는 도메인 과제로 직접 비교해 보는 실전 테스트.
99%가 모르는 하네스 엔지니어링 — AI 에이전트 생산성을 10배 올리는 세팅법 (바이브마피아 최수민님)
바이브마피아 최수민 님이 공유하는 하네스 엔지니어링 노하우 — 환경·도구·규칙 설계를 통해 AI 에이전트 생산성을 10배 끌어올리는 세팅법.
GPT 5.5 vs 클로드 4.7! 같은 프롬프트로 싸움 붙이기! 앙
같은 프롬프트로 GPT-5.5와 Claude Opus 4.7을 동시에 비교해 보는 실전 매치업.
클로드 라이브 아티펙트로 실시간 워크플로우 만들기!
Claude의 Live Artifact 기능을 활용해 실시간 워크플로우를 직접 구성하는 방법 소개.
OpenAI x 코드팩토리 Codex로 모노레포 멀티 플랫폼 서비스 만들기
OpenAI Codex와 코드팩토리가 함께한 모노레포 기반 멀티 플랫폼 서비스 구축 실전 영상.
클로드 코드로 카드뉴스 만드는 3가지 이유 | HTML CSS 자동화
Claude Code로 HTML·CSS 카드뉴스 제작을 자동화하는 세 가지 이유와 실전 워크플로.
마누스 AI한테 내 컴퓨터를 통째로 맡겼더니 생긴 일
Manus AI에게 데스크톱 환경 전반을 맡겨 본 사용기 — 가능성과 한계를 함께 정리.
클로드 코드 스킬로 인스타 카드뉴스 자동 생성
Claude Code 스킬을 활용해 인스타그램용 카드뉴스를 자동 생성하는 워크플로.