No. 141

무게는 공개되고 권력은 심판받습니다 — GLM-5.3 오픈 웨이트⁠·앤트로픽 판결⁠·AI DMCA

GLM-5.3 오픈 웨이트 공개, 미 법원의 앤트로픽 블랙리스트 위법 판결, AI 발 DMCA로 루안티가 삭제된 하루입니다.

오늘의 핵심

오늘의 축은 두 개입니다. 하나는 능력의 무게가 공개물이 된 것이고, 다른 하나는 권력의 남용이 법원에서 걸러진 것입니다. Z.ai가 약속했던 대로 GLM-5.3의 가중치를 열었고, 샌프란시스코 연방법원은 국방부의 앤트로픽 블랙리스트를 “위법하고 근거 없다”고 잘라 말했습니다. 그 사이에서 자동화의 양면도 같은 날 드러났습니다. AI 저작권 감지 봇의 통지는 검증 없이 오픈소스 게임 엔진을 스토어에서 지웠고, 구글의 에이전트 팀은 며칠짜리 프로젝트에 검증 절차를 얹었습니다.


GLM-5.3, 약속대로 오픈 웨이트 공개 — 총 파라미터 약 7,533억 개

Z.ai가 지난 14일 공개한 GLM-5.3의 가중치가 28일(현지 시간) 허깅페이스에 올라왔습니다. 세이프텐서 141개 샤드, 총 파라미터 약 7,533억 개(753B) 규모로, 발표문의 “안전성 평가와 강화를 마친 뒤 2주 안에 연다”는 약속이 지켜진 셈입니다.

  • 오픈 진영 최고 코딩 성능: 같은 기반 모델에서 포스트트레이닝만 확장해 Z.ai 코드 벤치 50 % 향상, Terminal Bench 3.0 28.3점으로 오픈 웨이트 최고 성능을 기록했습니다.
  • 의도하지 않은 사이버 능력: 포스트트레이닝을 늘리며 CyberGym 취약점 탐지에서 스테이트 오브 더 아트에 올랐고, 익스플로잇 체인 상류에서는 GLM-5.2 대비 2배 이상 올랐습니다.
  • 변형도 잇따라: 전날에는 경량 버전 GLM-5.3-Flash도 공개됐습니다.
Terminal Bench 3.0점수
GLM-5.328.3
Kimi K317.4
Claude Opus 4.821.1
GPT-5.6 Sol34.6
📢 오픈 웨이트와 폐쇄 프론티어의 격차가 코딩 벤치마크에서 사실상 닫히는 순간입니다. 다만 공개되는 것이 코딩 실력만이 아니라 침해 연쇄의 상류까지 강해진 사이버 능력이라는 점은, 열어주는 쪽도 계산하지 못한 무게입니다.

출처: GLM-5.3: Frontier Coding with Emergent Cyber Capabilities⁠—⁠Z.ai Blog, GLM-5.3 모델 저장소⁠—⁠Hugging Face


미 연방법원, 국방부의 앤트로픽 블랙리스트는 “위법하고 근거 없다”

28일(현지 시간) 샌프란시스코 연방지방법원 리타 린 판사는 59쪽 명령문에서 미 국방부의 앤트로픽 블랙리스트 지정을 막았습니다. 국가안보 공급망 위험 지정이 “위법하고 근거 없다”고 판단하고, 국가안보를 정부 비판자 처벌에 쓸 수 없다고 밝혔습니다.

  • 갈등의 시작: 앤트로픽은 클로드의 미국 내 감시·자율무기 사용을 허용하지 않았고, 국방부는 이를 이유로 일부 군사 계약에서 회사를 배제했습니다. 미국 기업이 이 법에 따라 공개적으로 공급망 위험으로 지정된 첫 사례입니다.
  • 헌법 논거: 앤트로픽은 보복성 지정이 수정헌법 제1조의 표현의 자유와 제5조의 적법절차를 침해한다고 주장했고, 계약 손실과 평판 훼손 규모를 수십억 달러로 추산했습니다.
  • 끝나지 않은 싸움: 민간 정부 계약까지 배제할 수 있는 별도 지정을 다투는 소송이 워싱턴 D.C.에서 진행 중입니다.
시점사안
2월 27일트럼프, 연방기관의 앤트로픽 기술 사용 중단 지시
3월 9일앤트로픽, 블랙리스트 차단 소송 제기
8월 28일연방법원, 지정은 “위법·근거 없음” 판결
📢 AI 정책 갈등이 처음으로 조달법과 헌법의 틀에서 심판을 받았습니다. 안보를 명분으로 기업의 침묵을 강요할 수 없다는 선이 그어졌고, 이 판결은 다른 기업의 동일한 지정에도 그대로 참조될 겁니다.

출처: US judge blocks Pentagon’s Anthropic blacklisting⁠—⁠Reuters, Anthropic sues to block Pentagon blacklisting over AI use restrictions⁠—⁠Reuters


미국, 이탈리아 A/I 콜렉티브를 ‘테러 지원’으로 제재

26일(현지 시간) 미 국무부와 재무부는 20년 넘게 운영된 이탈리아 자율 서버 플랫폼 A/I 콜렉티브(아우티스티치/인벤타티)를 테러 관련 제재 명단에 올렸습니다. 하마스·안티파·팔레스타인 액션 등에 서비스를 제공했다는 것이 지정 사유입니다.

  • 당사자의 반박: 콜렉티브는 같은 날 성명에서 “모든 혐의를 돌려보낸다”며, 익명 이메일과 디지털 자기방어 도구를 활동가와 개인에게 제공하는 것이 본업이라고 밝혔습니다.
  • 파장: 미국의 시민자유 진영은 익명 통신 인프라 전체가 테러 금융 틀로 재단의 대상이 되었다고 비판합니다. 인터셉트는 28일 “진짜 표적은 미국 내 표현의 자유”라는 분석을 냈습니다.
📢 플랫폼 중립성이 국경 밖에서 어떻게 무너지는지 보여주는 사례입니다. '누가 쓰는지'만으로 인프라 제공자를 지정하는 논리가 관철되면, 다음 지정의 잣대는 어디에나 닿을 수 있습니다.

출처: A/I 콜렉티브 성명 전문⁠—⁠cavallette, Trump Goes After Anonymous Email Provider in Italy. The Real Target Is Free Speech in the U.S.⁠—⁠The Intercept


루안티, AI 생성 DMCA 통지로 구글 플레이에서 삭제

오픈소스 복셀 게임 엔진 루안티의 안드로이드 앱이 Tracer.AI가 마이크로소프트를 대신해 제출한 DMCA 통지로 구글 플레이에서 내려왔습니다. 통지에는 마인크래프트 저작권을 침해한 구체적 자산이나 증거가 없습니다.

  • 반복되는 남용: Tracer.AI는 2023년에도 같은 통지를 냈고 당시 복구까지 46일이 걸렸습니다. 올해는 Allumeria도 같은 경로로 스팀에서 일시 삭제됐습니다.
  • 루안티의 대응: 반론 통지를 제출했고, 마이크로소프트·Tracer.AI에는 사람의 검증과 구체적 증거를, 구글에는 통지 검증 개선을 요구했습니다. 앱은 F-Droid와 공식 웹사이트에서 계속 배포됩니다.
📢 저작권 감시를 자동화하면 첫 타격은 늘 검증받지 못한 쪽이 입습니다. 봇의 오탐 비용을 치르는 것은 통지를 낸 회사가 아니라 지워진 커뮤니티입니다.

출처: Luanti removed from Google Play by baseless AI copyright notice⁠—⁠Luanti Blog, Lumen Database 통지 원문⁠—⁠Lumen Database


오픈AI 파이썬 SDK, HTTPX에서 HTTPX2로 전환

오픈AI 파이썬 SDK가 동기·비동기 HTTP 클라이언트를 파이단틱의 HTTPX2로 옮겼습니다. 이제 openai를 설치해도 예전처럼 httpx가 함께 깔리지 않습니다.

  • 조용한 파괴적 변경: TLS 검증 기본값이 certifi 번들이 아니라 운영체제 신뢰 저장소로 바뀝니다. 최소 컨테이너 이미지나 기업 TLS 프록시 환경에서는 인증서 검증이 깨질 수 있습니다.
  • 대응: 시스템 CA를 설치하거나 SSL_CERT_FILE·SSL_CERT_DIR로 번들을 지정하면 됩니다. SDK 기본 클라이언트를 쓰던 대부분의 API 호출은 코드 수정 없이 동작합니다.
📢 "그냥 되던" 의존성이 사라지는 날이 실무에서 가장 위험한 날입니다. 파이썬 서비스를 굴린다면 CI 이미지에 시스템 CA 인증서가 있는지 오늘 확인할 목록입니다.

출처: Migrating to HTTPX2⁠—⁠OpenAI Python SDK, pydantic/httpx2⁠—⁠Pydantic


GitHub PR 설명의 ‘클로드 문체’, 0.7 %에서 39 %로

load-bearing 프로젝트가 GitHub 풀 리퀘스트 설명을 주제가 아니라 쓰인 어휘로 군집화한 결과, 열 개 문체 중 하나가 2025년 초 전체의 0.7 %에서 2026년 중반 39 %로 늘었습니다. 그 문체의 축을 이루는 어휘는 클로드가 쓰는 표현들입니다.

  • 측정 방식: 매일 GitHub 검색 API로 PR 설명을 모으고, 어휘 분포로 문체를 분류합니다. 코드가 아니라 ‘말’로 남는 AI의 흔적을 정량화한 셈입니다.
  • 함의: 커밋 메시지와 PR 본문이 이미 에이전트의 문체로 덮이는 속도를 보여줍니다. 오픈소스의 문서 신뢰성 논의가 코드 저작권에서 작성 문체로 옮겨가는 근거가 됩니다.
📢 AI가 코드가 아니라 글로 흔적을 남기기 시작하면, 감지와 검증의 단위도 토큰에서 문체로 내려옵니다. 다음 해 협업 도구의 평가 항목에 '사람이 썼는가'가 오를 수 있습니다.

출처: The load-bearing vocabulary of Claude⁠—⁠load-bearing, louisabraham/load-bearing⁠—⁠GitHub


구글 안티그래비티 ‘팀워크’: 며칠짜리 일을 에이전트 팀에 맡기는 법

구글의 에이전트 개발환경 안티그래비티에 팀워크 미리보기가 공개됐습니다. /teamwork-preview 명령 하나로 여러 전문 에이전트가 팀을 이뤄 대규모 리팩터링, 시스템 시뮬레이션, 수학 증명 같은 장기 과제를 나눠 처리합니다.

  • 역할 분리: 코디네이터인 Sentinel을 비롯해 오케스트레이션·구현·검증 역할이 나뉘고, 마일스톤마다 독립 검증이 돌아갑니다.
  • 컨텍스트 대신 산물: 각 에이전트는 격리된 프로젝트 디렉터리에서 작업하고, 대화창을 늘리는 대신 깨끗한 산물 인계로 다음 단계에 넘깁니다.
📢 단일 세션의 컨텍스트 한계를 팀 조직도로 푸는 설계입니다. 검증 역할이 별도 편성으로 존재한다는 점이, 에이전트 팀의 신뢰를 어디서 만들지를 보여줍니다.

출처: Teamwork agent teams⁠—⁠Google Antigravity


트릴리언 랩스: 블랙박스 LLM의 크기를 기억력으로 잰다

트릴리언 랩스가 28일 공개한 분석은 크기가 비공개인 프론티어 모델의 파라미터 수를 ‘희귀 사실을 얼마나 기억하는가’로 역산합니다. 난이도별 희귀 지식 질문(이넨컴프레서블 날리지 프로브) 점수를 크기가 공개된 모델과 비교하는 방식입니다.

  • 결과: 이 기법은 클로드 소넷을 약 766B급으로 추정합니다. 소문으로 돌던 1조와 가까운 숫자이고, 일부 최신 프론티어 모델은 수조 개 파라미터에 해당하는 지식 용량을 가진 것으로 추정됩니다.
  • 기준선의 이동: 오픈 진영은 Kimi K3의 총 2.8조 개로 3T 문턱을 넘었습니다. GLM-5.3에 이어 오픈 웨이트의 체급이 곧 참조 좌표가 되는 흐름입니다.
📢 크기를 비밀로 하는 시대에 '기억력'이 자로 등장했습니다. 체급 추정은 호기심 채우기가 아니라, 그 규모에서 지금 성능이 가능하다는 가능성의 증명이라는 것이 이 글의 요지입니다.

출처: 블랙박스 LLM의 크기를 재는 법⁠—⁠Trillion Labs, Incompressible Knowledge Probes⁠—⁠arXiv


Gemini Omni 1.1 Flash: 생성 비디오에 편집의 문법이 들어오다

구글이 27일(현지 시간) 공개한 Gemini Omni 1.1 Flash는 생성 비디오를 API로 다루는 개발자용 제어군입니다. 장면 연장, 첫·끝 프레임 지정, 4K 업스케일이 포함됐습니다.

  • 장면 연장: 이전 영상을 최대 10초까지 참조해 이어 생성하고, 10초 단위로 최대 40초까지 늘릴 수 있습니다. 이전 세대가 마지막 1초만 봤던 것과 대비됩니다.
  • 프레임 지정: 시작과 끝 프레임을 주면 그 사이를 채워 카메라 오빗·줌·루프 클립을 만들 수 있습니다.
📢 생성 비디오의 경쟁이 '잘 돌린다'에서 '붙이고 잇는다'로 옮겨갑니다. 편집 도구의 문법이 모델 안으로 들어오면, 짧은 클립의 세계가 시퀀스의 세계로 바뀝니다.

출처: Gemini Omni 1.1 Flash lets you build with more control⁠—⁠Google Blog


Gemini Notebook, 계산량 기반 유연 사용 한도 도입

구글이 Gemini Notebook에 모델의 계산량을 반영한 유연한 사용 한도를 도입한다고 28일(현지 시간) 발표했습니다. 어떤 모델을 쓰는지에 따라 소모되는 양이 다르다는 전제를 사용자 경험에 명시적인 정책으로 담은 것입니다.

  • 흐름 읽기: 무료 AI 노트 도구들이 ‘무제한’ 마케팅에서 벗어나 자원 소모를 설명하는 단계로 넘어가고 있습니다. 사용량 정책 자체가 제품 신뢰의 일부가 되는 신호입니다.
📢 프론티어 모델의 호출 비용 편차가 커지면서, '몇 번 썼는가'보다 '얼마나 무거운 걸 썼는가'가 한도의 단위가 됩니다. 다른 무료 도구들도 같은 문법을 따를 겁니다.

출처: We’re introducing flexible usage limits for Gemini Notebook.⁠—⁠Google Blog


오늘의 도구 추천

Mycelium — Claude Code·Codex·Kiro·OpenCode 세션을 한곳에 모아 정리하고, 폴더 안에서 반복되는 내용을 지식으로 남겨 다음 세션에 물려주는 로컬 우선 TUI입니다. 오늘 팀워크가 보여주듯 에이전트의 단위가 세션에서 팀으로 커지는 시점에, 세션 사이의 기억을 관리하는 도구가 곧 개인의 기반이 됩니다. 자신의 CLI와 로컬 데이터를 쓰므로 외부 전송 없이 돌아갑니다.


에디터 노트

오늘 뉴스를 다시 나열하면 이렇습니다. 7,533억 개의 파라미터가 공개되었고, 59쪽의 판결문이 국가의 편의를 걸렀고, 증거 없는 통지 하나가 커뮤니티의 배급망을 지웠습니다. 무게의 단위는 제각각이지만 방향은 같았습니다. 능력을 여는 일, 권력을 심판하는 일, 자동화를 검증하는 일이 이제 같은 하루 안에서 벌어집니다.

그래서 오늘의 도구들이 더 의미 있게 읽힙니다. 트릴리언 랩스는 보이지 않는 것을 재는 자를 만들었고, load-bearing은 스며든 문체를 세는 자를 만들었고, 팀워크는 검증자를 에이전트 팀 안에 앉혔습니다. GLM-5.3의 사이버 능력이 보여주듯 열리는 것에는 늘 남용의 그림자가 따라오고, 그 그림자를 걷어내는 건 결국 측정과 절차입니다. 내일도 그 둘 사이의 뉴스를 가져오겠습니다.

다음에 또 찾아옵니다. — 에이브랜치