편집자 노트: 2026년 7월 20일 주간 AI 뉴스 — 지난주 OpenAI가 주도했던 흐름은 이번 주 프런티어 모델 경쟁으로 옮겨왔습니다.
Anthropic이 Claude Fable 5를 Max·Team Premium 요금제에 정식 포함한 같은 시점에, 알리바바가 2.4조 매개변수 규모의 '큐원 3.8'을 공개하며 오픈 웨이트 진영의 추격을 예고했고, 오픈소스 AI가 폐쇄형과 3.3%까지 좁힌 현황 리포트가 이를 뒷받침했습니다.
코딩 에이전트 쪽에서는 Claude Code가 변경 로그 없이 도입했다 이틀 만에 되돌린 '자동 진행' 기능 분석과, LLM 코드를 사람이 다 검토하면 된다는 해법의 한계를 짚은 글이 화제가 됐습니다.
정책·사회 영역에서는 뉴욕시의 임대 광고 AI 이미지 공개 의무화 추진, 미국 42개 주에서 열린 AI 데이터센터 반대 동시 시위가 이어졌고, 산업에서는 Apple과 OpenAI의 영업비밀 분쟁이 격화되는 한편 애플이 엔비디아를 제치고 시총 1위를 되찾으며 AI 가치 무게중심이 인프라에서 서비스·플랫폼으로 이동하는 신호가 함께 나타났습니다.
모델 & 주요 발표
Claude Fable 5, 7월 20일부터 Max·Team Premium 요금제에 기본 포함
GeekNews
Anthropic이 7월 20일부터 Claude Fable 5를 Max·Team Premium 사용자의 요금제 사용 한도 50%까지 기본 제공한다고 발표했다. Pro·Team Standard는 구독 기본 한도 대신 Usage 크레딧으로 계속 이용하며 일회성 100달러 크레딧이 지급되고, Fable 사용량이 구독 기본 한도에 직접 포함되지는 않는다. Anthropic은 예상보다 큰 수요와 제한된 처리 용량 탓에 단계적으로 적용을 넓혀 왔으며 그 과정에서 사용자가 이용 가능 여부를 확신하기 어려웠다는 점을 인정하고, Fable 사용량이 많은 요금제는 50% 제공을 표준화하겠다고 밝혔다.
알리바바, 2.4조 매개변수 '큐원 3.8' 공개…"페이블 5 이어 세계 2위"
AITimes
알리바바가 2조 4,000억 개의 매개변수를 갖춘 초대형 멀티모달 모델 '큐원 3.8'을 공개하고, 곧 오픈소스로 전환해 모델 가중치를 개방하겠다고 발표했다. 알리바바는 X를 통해 큐원 3.8이 현재 전 세계에서 사용 가능한 가장 강력한 인프라 중 하나이며, 글로벌 최첨단 프런티어 모델들과 어깨를 나란히 한다고 밝혔다. 현존 최고 성능으로 평가받는 Anthropic의 페이블 5에 이은 2위 수준이라는 주장으로, 오픈 웨이트 진영의 프런티어 추격을 상징하는 발표다.
2026년 7월 오픈소스 AI 현황
GeekNews
오픈 웨이트 모델이 코딩·지시 이행·일반 지식에서 폐쇄형과 비슷한 수준에 도달하고 추론 비용도 36개월간 50배 하락하면서, 경쟁의 중심이 모델 자체에서 에이전트 하네스로 이동했다는 진단이다. 2026년 중반 OpenRouter에서는 오픈 웨이트가 토큰 처리량의 과반을 차지하고 상위 5개 모델도 모두 오픈이지만, 추론·긴 문맥 검색·에이전트 작업에서는 폐쇄형과 평균 3.3%의 역량 격차가 남아 있다. 개발자의 79%가 오픈 모델을 쓰면서도 프로덕션 도달률은 51%로 폐쇄형(63%)보다 낮아, 다음 경쟁은 하네스·메모리·쓰기 권한·거버넌스를 누가 소유하느냐로 옮겨간다고 짚는다.
Thinking Machines의 새 모델 'Inkling' 공개
Hugging Face
Thinking Machines가 공개한 새 모델 'Inkling'을 Hugging Face가 블로그로 소개했다. 수집 시점에 피드 본문이 제공되지 않아 세부 사양은 확인되지 않았으며, 자세한 내용은 원문에서 확인하는 것이 좋다.
코딩 에이전트
Claude Code의 잘못 설계된 자동 진행 기능 해부
GeekNews
Claude Code 2.1.198이 AskUserQuestion에 60초간 답이 없으면 모델이 자체 판단으로 작업을 계속하는 '자동 진행' 기능을 기본 활성화했지만, 출시 당시 변경 로그와 문서에는 기록하지 않았다는 분석이다. 권한 요청을 자동 승인하지는 않았으나 이미 허용된 도구나 --dangerously-skip-permissions 환경에서는 'staging 또는 production' 같은 의사결정 게이트를 대신 통과할 수 있었다. 문제 제기 약 이틀 뒤 나온 2.1.200은 기능을 삭제하지 않고 기본값만 끈 옵트인 방식으로 전환했으며, 필자는 기본 자동 업데이트와 불완전한 변경 기록이 결합하면 사용자 개입 없이 안전 가정이 달라질 수 있다고 경고한다.
AI 코드 검토가 타당한 반론이 될 수 없는 이유
GeekNews
LLM 코딩 도구의 잦은 오류를 "사람이 다 검토하면 된다"는 해법이 코드 리뷰의 처리 한계 때문에 품질과 생산성을 함께 보장하기 어렵다는 주장이다. 경험적 연구에 따르면 효과적인 리뷰는 한 번에 1시간·400 LOC 정도가 상한이며, 이 기준을 적용하면 LLM이 만든 400 LOC마다 숙련 개발자의 집중 검토 1시간이 필요해 현실적 일일 처리량은 1,000 LOC 미만일 수 있다. 게다가 인간은 LLM 생성 코드에서 결함을 덜 찾으면서도 더 강한 확신을 보인다는 초기 증거가 있어, 검토만으로 오류를 충분히 걸러낼 수 있다고 보기 어렵다고 짚는다.
Mindwalk - 코딩 에이전트 세션을 코드베이스 3D 지도 위에서 재생하는 시각화 도구
GeekNews
Mindwalk는 코딩 에이전트가 무엇을 했는지뿐 아니라 저장소를 '어떻게 이해했는지'를 3D 지도로 보여주는 시각화 도구다. 저장소를 야간 지도로 그려 에이전트가 검색·읽기·수정한 위치는 빛나고 나머지는 어둡게 유지하며, 파일별 터치 상태를 seen(녹색)·read(파랑)·edited(호박색)·unvisited(어두움)로 구분한다. Claude Code와 Codex 세션 로그를 읽는 단일 Go 바이너리로 완전히 로컬에서 동작하며, HUD가 오류율·churn된 파일·마지막 verify 이후 수정 같은 마찰 신호를 묶어서 표시한다.
AI 안전 & 연구
GPT-Red: 견고성을 위한 자기개선
OpenAI
OpenAI가 자기대국(self-play)으로 AI 안전성·정렬·프롬프트 인젝션 견고성을 개선하는 자동 레드팀 시스템 'GPT-Red'를 공개했다. 사람이 수작업으로 공격 시나리오를 짜는 대신 모델이 스스로 취약점을 탐색·강화하도록 설계한 접근으로, 안전 평가를 자동화·확장하려는 시도다.
DeepMind·Isomorphic Labs의 바이오리질리언스 접근
Google DeepMind
Google DeepMind와 Isomorphic Labs가 '바이오리질리언스(bioresilience)'와 AI 모델에 대한 공동 접근 방식을 공유했다. 생명과학 분야의 회복력을 AI로 강화하려는 두 조직의 협업 방향을 제시하는 내용이다.
정책 & 사회
Mamdani 뉴욕시장, 임대 광고에 AI 이미지를 몰래 사용할 수 없다고 밝혀
GeekNews
뉴욕시가 부동산을 실제보다 매력적으로 보이게 만든 AI 생성·편집 이미지를 임대 광고에 사용할 경우 그 사실을 공개하도록 요구하는 방안을 추진한다. 시 행정부의 Rental Ripoff Report는 이미지뿐 아니라 AI·디지털 도구로 변경한 임대 매물 정보 전반을 공개 대상으로 권고했으며, 현장을 확인하지 못한 채 계약하는 원격 이주 세입자에게 특히 피해가 크다고 지적한다. 보고서에는 AI 사용 공개와 함께 세입자 조합 인정, 협상권 확대, 법규 집행 현대화 등 세입자 보호 조치가 담겼다.
미국 전역서 AI 데이터센터 반대 시위…42개 주서 초당적 동시 집회
AITimes
미국 42개 주에서 AI 데이터센터 건설에 반대하는 첫 전국 규모 동시 시위가 열려 총 142건의 집회가 진행됐다. 급증하는 AI 인프라가 지역 사회의 물·전력·환경을 위협하고 주민 의견을 충분히 반영하지 않는다는 불만이 보수와 진보를 넘어 확산되며, 데이터센터 문제가 미국 정치권의 쟁점으로 떠올랐다. 이번 시위는 보수 성향 시민단체 '휴먼스 퍼스트(Humans First)'가 주도했으며, 텍사스에서 18건으로 가장 많은 집회가 열렸다.
산업 & 비즈니스
Apple, OpenAI 직원 수십 명에게 법적 서한 발송
GeekNews
Apple이 자사 출신으로 OpenAI에 이직한 직원 약 40명에게 문서·통신 기록을 보존하고 Apple 변호사와 면담하라는 개별 법적 서한을 발송했다. OpenAI가 Apple의 기밀 하드웨어 설계를 도용했다는 소송을 뒷받침할 증거 확보 조치로, 이직한 전 Apple 직원 약 400명 중 10%가 대상이 됐다. Apple은 제출한 증거가 의심 행위의 '빙산의 일각'이라고 주장한 반면 OpenAI는 소송에 근거가 없다고 반박했으며, Apple이 OpenAI 하드웨어 사업 전체가 오염됐다고 주장하면서 화면 없는 손바닥 크기 가정용 기기 출시와 준비 중인 IPO에 법적 불확실성이 커졌다.
애플, AI 전망 재평가에 엔비디아 제치고 시총 1위 재탈환
Bloter
애플이 약 4조 8,800억 달러의 시가총액으로 약 4조 8,600억 달러의 엔비디아를 제치고 세계 시총 1위를 되찾았다. 애플이 1위에 오른 것은 지난해 4월 이후 처음으로, AI 전망이 재평가받으며 투자자 관심이 인프라 관련 기업에서 서비스·플랫폼으로 이동한 영향이라는 분석이다. 애플 주가는 6월 저점 대비 21%, 연초 대비 23% 올라 매그니피센트7 종목 가운데 가장 높은 수익률을 기록 중이다.
100만 개 키워드가 보여준, AI가 검색에 미치는 영향
GeekNews
월간 검색량 1만 회 이상인 101만 개 키워드를 분석한 결과, 전체 검색 수요의 29%가 감소했지만 증가한 수요가 이를 거의 상쇄해 총검색량은 사실상 유지됐다. 감소 폭은 정보 탐색 비중이 큰 FinTech(-37.7%)처럼 AI가 완결된 답을 주기 쉬운 분야에서 컸고, 구매·비교·사이트 방문이 필요한 SaaS·Lifestyle에서는 오히려 증가했다. 미국 소비자 70%가 AI 사용을 늘렸지만 검색을 줄였다는 응답은 17%에 그쳐, 검색 최적화는 감소하는 일반 키워드 방어를 넘어 브랜드 권위와 AI 답변 내 노출을 함께 확보하는 방향으로 확장해야 한다고 정리한다.
YouTube
IT뉴스 - Kimi K3 열풍, Fable 5 구독제 계속, 오픈AI 하드웨어, grok-build 오픈소스, Gemini Spark, Lucy 2.5 등
Kimi K3 열풍, Claude Fable 5 구독제, OpenAI 하드웨어, grok-build 오픈소스 등 이번 주 주요 AI 소식을 한 번에 정리한 영상.
헤르메스 에이전트 5개로 뉴스 큐레이션부터 주식 매매까지 자동화한 방법 (AI 엔지니어 샘 호트만)
AI 엔지니어 샘 호트만이 5개의 에이전트를 엮어 뉴스 큐레이션부터 주식 매매까지 자동화한 구성을 공개하는 영상.
AI뉴스 - GPT-5.6, GPT‑Live, Work, Grok 4.5, Muse Spark 1.1, Lingbot-World-2, Google 커스텀 URL 등
GPT-5.6, GPT-Live, ChatGPT Work, Grok 4.5, Muse Spark 1.1 등 최근 발표를 종합 정리한 뉴스 영상.
AI 네이티브 회사에서 실제로 벌어지고 있는 일들 (리트머스 김응진 대표)
리트머스 김응진 대표가 AI 네이티브 회사의 실제 업무 방식과 조직 변화를 이야기하는 대담 영상.
내돈내산 GPT 5.6 Sol vs Claude Fable 5 리뷰
직접 결제해 써본 GPT-5.6 Sol과 Claude Fable 5를 실사용 관점에서 비교하는 리뷰 영상.
[LIVE] OpenAI 내부자가 직접 알려주는 신규 업데이트 및 Codex 사용법
OpenAI 내부자가 신규 업데이트와 Codex 활용법을 직접 소개하는 라이브 영상.
이번 주 도구 트렌드
GitHub 주간 트렌딩
- Blueturboguy07/cue ⭐615 — 화면 위에 떠서 회의를 보고 들으면서도 화면 공유에는 잡히지 않는 오픈소스 macOS AI 코파일럿. Cluely 대안이며 본인 API 키를 연결해 쓰는 방식이다.
- v-modal/vmodal_sdk_flutter ⭐587 — 어디서든 무엇이든 검색할 수 있게 해주는 V-Modal AI의 Flutter SDK.
- MIgHTy-alIeN/Trading-Bot ⭐351 — 외부 자동화 스크립트와 연결된 스마트 컨트랙트로 동작하는 차익거래 봇.
- erickong/penecho ⭐335 — 채팅창을 넘어 손글씨·수식·다이어그램·공간적 사고를 함께 다루는 AI 공유 캔버스.
- QuantumByteOSS/quantumbyte ⭐331 — 의도를 곧바로 작동하는 앱으로 바꿔주는 오픈소스 앱 빌더 엔진.
Claude Code Hot
- v2.1.215: Claude가
/verify·/code-review스킬을 임의로 실행하지 않도록 바뀌었다. 이제 필요할 때 사용자가 직접/verify,/code-review로 호출해야 한다. - v2.1.214: 중첩 디렉터리를 무단 자동 승인하던
Edit(src/**)류 규칙 오류와 Windows PowerShell 5.1 권한 검사 우회 등 다수의 권한 관련 버그를 수정하고, 남용·탈옥 시도 세션을 종료할 수 있는 EndConversation 도구를 추가했다. - thedotmack/claude-mem ⭐87877 — 세션 간 컨텍스트를 유지시키는 플러그인. 에이전트 작업을 캡처·압축해 다음 세션에 관련 맥락을 다시 주입한다.
- DietrichGebert/ponytail ⭐86114 — AI 에이전트를 "가장 게으른 시니어 개발자"처럼 사고하게 만들어, 굳이 짤 필요 없는 코드는 짜지 않게 유도한다.
- zarazhangrui/frontend-slides ⭐25941 — 코딩 에이전트의 프런트엔드 능력을 활용해 웹에서 슬라이드를 제작하는 도구.
Hugging Face
- 모델: thinkingmachines/Inkling ♥1152 · prism-ml/Ternary-Bonsai-27B-gguf ♥793 · prism-ml/Bonsai-27B-gguf ♥498
- 논문: LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget · VideoChat3: Fully Open Video MLLM for Efficient and Generalist Video Understanding
이번 주의 팁
v2.1.215부터 Claude Code는 /verify와 /code-review 스킬을 스스로 돌리지 않는다. 이전에는 모델이 판단해 자동 실행할 수 있어 언제 검증이 도는지 예측하기 어려웠지만, 이제는 사용자가 원하는 시점에 /verify, /code-review를 직접 입력해야 실행된다. 구현이 끝난 뒤 이 두 명령을 명시적인 검토 게이트로 워크플로에 끼워 넣으면, 검증 실행 시점을 스스로 통제하면서 리뷰 누락도 줄일 수 있다.
이번 주 용어: LLM · Token · Agent · Multimodal · Long Context · AI 코딩 에이전트 · Alignment · Prompt Injection · Red Teaming