편집자 노트: 2026년 4월 27일 주간 AI 뉴스 — OpenAI GPT-5.5/Pro 출시와 Google의 Anthropic 400억 달러 투자 결정이 동시에 발표되며 거대 모델 경쟁과 자본 집중이 한층 가속됐습니다.
Gemini Enterprise Agent Platform과 Stash·mini-swe-agent·LLM 위키 같은 에이전트 인프라·메모리·경량 코딩 에이전트도 줄지어 등장했습니다.

AI 모델 & 출시

OpenAI, API에 GPT-5.5와 GPT-5.5 Pro 출시

GeekNews

  • GPT-5.5GPT-5.5 Pro를 Chat Completions API와 Responses API에 정식 출시 — Pro 모델은 어려운 문제 해결을 위해 더 많은 추론 연산을 사용
  • 100만 토큰 컨텍스트 윈도우, 이미지 입력, 구조화 출력, 함수 호출, Skills, MCP, 웹 검색까지 풀 스택 기능 지원
  • 기본 reasoning effort는 medium, 캐싱은 extended prompt caching에서만 동작하고 in-memory caching은 미지원
  • GPT Image 2도 함께 출시 — 유연한 이미지 크기, 고충실도 이미지 입력, 토큰 기반 과금, Batch API 50% 할인 적용

"그리는 것이 곧 이해하는 것"…구글, 생성 AI로 비전 AI 역할까지 하는 '비전 바나나' 공개

AI타임스

  • 구글 딥마인드가 이미지 생성 능력을 유지하면서 의미론적 분할·객체 분할·단안 깊이 추정·표면 법선 추정 등 시각 이해까지 함께 수행하는 통합 모델 'Vision Banana'를 공개
  • 이미지 생성 학습이 LLM 사전 학습과 동일한 효과를 낼 수 있다는 연구 결과 — 비전 AI와 생성 AI 통합 신호로 해석
  • 단순 이미지 생성 모델을 넘어 시각 정보 이해까지 가능한 범용 시각 모델로의 진화 가능성을 시사

딥시크-V4, 세계 10위에 그쳐..."기대 이하 성능에 미국은 안도"

AI타임스

  • 딥시크의 플래그십 모델 V4가 Artificial Analysis 지능지수 순위에서 52점, 전체 10위에 그침
  • 같은 날 공개된 1위 GPT-5.5(60점) 와 8점 차이로 격차가 큼
  • 중국 모델 중에서도 4위 — 5위 키미 K2.6(54점)·샤오미 미모 등에 밀린 결과
  • 기대에 미치지 못한 성능에 워싱턴·실리콘밸리가 안도의 한숨을 내쉬었다는 평가가 이어짐

GPT 5.5 on AI Gateway

Vercel

  • Vercel AI Gateway에서 GPT-5.5를 사용 가능 — 별도 API 키 없이 Vercel 인프라를 통해 호출
  • AI Gateway의 라우팅·재시도·로깅 기능을 GPT-5.5에도 동일하게 적용
  • DeepSeek V4, GPT Image 2, Kimi K2.6까지 함께 추가되어 모델 선택 폭이 한층 넓어짐

투자 & 산업 동향

Google, Anthropic에 최대 400억 달러 (약 59조원) 투자

GeekNews

  • Google이 Anthropic에 즉시 100억 달러 현금을 투자하고, 성과 목표 달성 시 추가 300억 달러를 집행 — 기업가치는 3,500억 달러로 책정
  • Google Cloud는 향후 5년간 5GW 규모 컴퓨팅 용량을 제공하고 Broadcom 협약을 확장
  • Anthropic은 Claude Code의 폭발적 성공으로 자금 조달이 가속되며, 빠르면 10월 IPO까지 검토 중
  • AI 코딩 시장 주도권을 두고 파트너이자 경쟁자 관계가 심화 — Amazon으로부터도 50억 달러 추가 투자 유치

AI 산업은 대중이 자신들을 혐오한다는 사실을 발견하고 있음

GeekNews

  • AI 기업 CEO 자택 화염병 공격, 데이터센터 지지 시의원 자택 총격 등 정치적 동기의 폭력까지 등장
  • 일자리·경제에 대한 AI 장기 효과를 긍정적으로 보는 비율이 전문가와 일반 대중 사이에서 크게 벌어짐
  • 극단적 미래상과 대규모 투자 요구가 불안정한 고용·생활비·전기요금 부담 우려와 충돌
  • 생산성 약속이 아직 입증되지 않은 상황 — 다수 기업이 AI 도입 후 생산성 향상을 체감하지 못하고 파일럿도 수익에 미달
  • 신뢰 회복에는 백서·홍보보다 검증 가능한 행동, 성능 투명성, 규제·책임 수용, 데이터센터 지역 참여가 더 중요
  • OpenAI Sam Altman 자택 화염병 공격 사례 — 용의자가 AI 실존 위협 경고 선언문을 남김

AI 알약을 먹은 복리 성장 스타트업

GeekNews

  • 샌프란시스코 AI 네이티브 기업 5곳을 방문해 관찰한 결과 PM 역할 소멸과 조직 전반의 실험 속도 가속이 두드러짐
  • 전담 PM은 5개 기업 중 단 1명, 엔지니어가 고객과 직접 대화하고 제품 결정을 전담하는 구조로 전환
  • 하루 만에 무엇이든 구현 가능해지면서 모든 요청을 구현하려는 '기능 공장(feature factory)' 유혹이 가장 큰 전략 리스크
  • 기술 스택은 Slack, Claude Code, GitHub, Codex, Linear 로 수렴 — Slack이 에이전트 오케스트레이션의 핵심 허브
  • 실험 비용 붕괴로 3~5배 빠른 반복 실행 달성 — AI 내재화 기업과 전략 논의만 하는 기업 간 격차가 매주 벌어짐

에이전트 플랫폼 & 인프라

Gemini Enterprise Agent Platform — 구글 클라우드의 차세대 AI 에이전트 통합 플랫폼

GeekNews

  • Agent Studio + ADK로 로우코드부터 코드 중심까지 다양한 숙련도에 맞는 에이전트 개발 경로 제공
  • Agent Runtime은 서브 세컨드 콜드 스타트와 며칠 단위 장기 워크플로 지원 — 영업 리드 관리 같은 복합 작업에 적합
  • Memory Bank로 대화 장기 기억을 자동 생성·관리 — 일회성 세션을 넘어 개인화된 상호작용 구현
  • Agent Identity·Registry·Gateway 3종 도구로 암호화 ID, 도구·에이전트 중앙 관리, 프롬프트 주입 방어를 일괄 적용
  • Model Garden으로 200개 이상 모델 접근 — Gemini 3.1 Pro/Flash Image, Lyria 3, Gemma 4뿐 아니라 Anthropic Claude 시리즈 등 서드파티까지 지원

Google Cloud가 제시하는 멀티 에이전트 시스템의 5가지 통합 패턴: A2A와 MCP

GeekNews

  • Agent Card — A2A 지원 에이전트가 자신의 기능·인증·호출 제한을 JSON으로 공개 (OpenAPI의 에이전트 버전)
  • Agent Registry — 조직 내 에이전트를 중앙 등록소에 등록해 URL 없이도 검색·접근 가능 (서비스 메시 유사)
  • 다언어·다팀 협업: Go·Java·TypeScript 등 서로 다른 스택 팀이 A2A 프로토콜만 구현하면 연동 가능
  • 독립 배포·진화 — 마이크로서비스처럼 각 에이전트가 독립적으로 업데이트되며 조정 에이전트 변경 불필요
  • MCP는 단일 프로토콜로 REST·DB·레거시를 표준 인터페이스로 통합, Apigee API Hub로 기존 거버넌스 재활용

Stash - AI 에이전트를 위한 지속형 메모리 계층

GeekNews

  • 세션이 바뀌어도 대화·작업 맥락을 잇는 지속형 메모리 계층 — 원시 관찰을 episodes로 저장한 뒤 구조화된 지식으로 누적
  • 모델 비종속적 구조로 Claude·GPT·로컬 LLM·커스텀 에이전트가 같은 메모리 계층에 연결, PostgreSQL + pgvector 기반
  • RAG와 다른 역할: 문서 검색을 넘어 대화에서 사실·관계·목표·실패·가설까지 축적 (RAG와 병행 가능)
  • namespace + 계층형 경로로 사용자·프로젝트·에이전트 자기지식을 분리, consolidation 파이프라인이 facts·causal links·contradictions를 합성
  • MCP 네이티브 통합/self 자기 모델, 반복 연구 루프까지 포함 — 세션형 에이전트를 장기 연속성을 가진 작업 주체로 변환

Karpathy 스타일 LLM 위키를 에이전트들이 직접 유지하는 시스템 - Markdown과 Git 기반

GeekNews

  • AI 에이전트가 세션을 넘어 컨텍스트를 누적하도록 설계된 LLM 네이티브 지식 베이스 레이어
  • Postgres·pgvector·Neo4j·Kafka 같은 무거운 인프라 대신 markdown + git만으로 구성~/.wuphf/wiki/ 에 로컬 저장
  • 벡터 DB 없이 BM25 + SQLite로 지식 관리 — bleve로 검색, SQLite로 facts·entities·edges·redirects 메타데이터 보관
  • 벡터 DB 미사용 상태에서 500개 아티팩트·50개 쿼리 벤치마크 기준 recall@20 85% 달성
  • 각 에이전트의 개인 노트북(agents/{slug}/notebook/)과 공유 위키(team/)를 분리 — 에이전트·사람 리뷰 후 위키로 승격

앤트로픽이 증명한 '에이전트 거래'의 실체..."반려견 산책까지 성사"

AI타임스

  • Anthropic이 'Project Deal' 파일럿 실험으로 AI 간 상거래 환경 시뮬레이션을 발표
  • 샌프란시스코 사무실 직원 69명에게 100달러 예산을 지급하고 각자의 AI 에이전트가 슬랙 기반 시장에서 중고 물품·서비스를 자율 거래
  • 에이전트들이 반려견 산책 같은 서비스 거래까지 자율 협상으로 성사 — 에이전트 경제의 가능성과 위험을 동시에 확인

개발 도구 & 코딩 에이전트

mini-swe-agent - 100줄짜리 AI 에이전트로 GitHub 이슈 해결 및 커맨드라인 지원

GeekNews

  • SWE-bench·SWE-agent를 만든 Princeton·Stanford 팀의 최소주의 AI 코딩 에이전트
  • 100줄의 Python 코드로 동작 — 거대한 설정 파일이나 모노레포 없이 초경량 구조
  • bash만 도구로 사용하고 LLM tool-calling 인터페이스 없이도 어떤 모델과든 호환
  • SWE-bench verified 벤치마크 74% 이상 달성 (Gemini 3 Pro 기준)
  • subprocess.run 으로 액션을 독립 실행 — 상태 유지 쉘 세션 불필요, Docker 전환은 docker exec 로 교체만 하면 됨
  • 완전 선형 히스토리 구조로 트래젝토리와 LLM 메시지가 동일 — 디버깅·파인튜닝에 최적

Codex, Browser use로 웹사이트 구현 및 검증 지원

GeekNews

  • Browser Use 플러그인으로 Codex 앱 내부에서 브라우저를 실행해 사용자가 실제로 클릭하듯 앱을 테스트
  • Codex가 프론트엔드 코드를 빌드한 후 vision으로 화면을 직접 보고 웹앱과 상호작용
  • 네트워크·콘솔 로그를 함께 체크하며 검증
  • 로컬 개발에서 구현(Build)과 검증(Verify)을 하나로 묶어 자동화된 개발 흐름 지원

Claude Code 루틴이 내 재정을 지켜볼 수 있을까?

GeekNews

  • Driggsby + Plaid로 금융 계좌를 MCP에 연결해 잔액·거래내역·투자·대출 정보를 도구로 노출
  • 기존 Codex CLI cron-job 방식은 웹 로그인·렌더링 문제·2FA·passkey 제한으로 자주 깨졌음
  • 재구성한 일일 이메일 자동화는 아침 스케줄 + custom connector + email_me() 도구 조합으로 모든 계좌·순자산 정리 발송
  • 거래 감시 자동화는 이상 거래·큰 유출을 최근 패턴과 비교, 조건 충족 시에만 메일 발송으로 알림 피로 감소
  • 비개발자도 실시간 데이터 기반 재무 점검을 직접 운영할 수 있는 개인 맞춤형 운영 자동화 사례

Claude를 해지한 이유: 토큰 문제, 품질 저하, 부실한 지원

GeekNews

  • 초기 몇 주는 빠른 속도와 공정한 토큰 허용량, 좋은 결과 품질로 만족했지만 약 3주 전부터 체감이 크게 변함
  • 10시간 휴식 후 Claude Haiku에 짧은 질문 두 개만 보내도 사용량이 100%까지 치솟음
  • 지원 채널은 자동화된 답변 뒤 사실상 닫힌 상태 — 문의 핵심을 다루지 못함
  • 단일 프로젝트도 두 시간 만에 토큰 한도 소진, 리팩터링은 우회책 보정에만 5시간 창의 절반을 소비
  • 대화 캐시가 일정 시간 후 사라져 코드베이스를 다시 읽는 비용이 반복, 주간/월간 한도 체계가 일관되지 않음
  • 생산성·잠재력은 인정했지만 지원 부실·품질 저하·한도 혼란이 누적되어 결국 계정 해지

안전 & 연구

GPT-5.5 바이오 버그 바운티

GeekNews

  • OpenAI가 GPT-5.5의 생물학 안전장치 점검을 위한 범용 jailbreak 탐색 프로그램을 가동
  • 범위는 Codex Desktop 전용 GPT-5.5로 제한 — 새 채팅에서 moderation 유도 없이 단일 프롬프트로 5개 바이오 안전 질문에 모두 답하게 만들어야 함
  • 5문항 전부 통과하는 첫 진짜 범용 jailbreak에 25,000달러 — 부분 성공도 재량으로 소액 보상
  • 신청은 2026년 4월 23일~6월 22일, 테스트는 4월 28일~7월 27일에 진행 — 초대·신청 심사 병행
  • 참가자는 ChatGPT 계정과 NDA 서명 필요 — 모든 프롬프트·completion·발견 사항에 NDA 적용

ChatGPT를 활용한 아마추어가 Erdős 문제를 풀다

GeekNews

  • 수학 비전공 아마추어가 ChatGPT를 활용해 Erdős 문제 중 하나를 풀어 화제
  • AI를 사고 보조 도구로 사용한 협업적 수학 연구 사례로 주목
  • 고도화된 추론 모델이 전문가 영역의 문제 해결에 어떻게 기여하는지 보여주는 단면

YouTube