거리두기의 날 — 필즈 메달리스트 25인의 선언, 알트먼의 브레이크
필즈 메달리스트 25인이 '수학에서의 AI 정렬 오류'를 선언하고 알트먼은 속도 조절 의사를 밝혔습니다. 후티의 클로드 무기화 시도와 Z.AI의 50억 달러 조달도 공개됐습니다.
오늘의 핵심
어제의 축이 ‘증거’였다면 오늘의 축은 ‘거리두기’입니다. 테렌스 타오를 포함한 필즈 메달리스트 25인이 “AI 기업의 목표와 수학 공동체의 목표는 심각하게 어긋나 있다”는 공동 선언을 냈고, 같은 날 샘 알트먼은 직원들에게 최첨단 AI 개발 속도를 늦출 수 있다고 말했습니다. 예멘의 무기 개발 셀이 클로드 코드로 유도 로켓을 만들려다 차단된 사례가 공개됐고, 미 상원은 ‘알려진 주요 위험’의 완화 의무화를 논의하기 시작했습니다. 클로드는 18세 이상만 쓸 수 있게 연령 확인을 강화했고 캘리포니아는 챗봇 사전 위험평가를 법제화했습니다. 그러나 자본은 반대 방향으로 달렸습니다. Z.AI는 홍콩에서 하루 50억 달러를 걷었고, GPU 클라우드 엔스케일은 IPO를 앞두고 피지 시모를 이사회에 앉혔습니다. 젬나이는 윈도우 데스크톱으로, 일레븐랩스 뮤직은 권리 중심의 v2.5로 영역을 넓혔습니다. 그리고 해커뉴스의 최고 인기글은 “AI 뉴스 홍수를 줄여달라”는 요청이었습니다.
수학계의 총반란 — 필즈 메달리스트 25인, ‘수학에서의 AI 정렬 오류’ 선언
테렌스 타오·페터 숄체·세드리크 빌라니·허준이 등 필즈 메달 수상자 25인이 9월 11일 공동 선언문 ‘A Severe Misalignment of AI in Mathematics’를 발표했습니다. 현직 필즈 메달리스트 거의 전원이 AI 기업의 수학 문제 풀이 경쟁에 정면으로 반대하고 나선 것입니다.
- 핵심 주장: “AI 기업들이 수학 문제를 벤치마크로 풀어내려는 압박은 수학이라는 과학과 수학 공동체에 해롭다”는 것입니다. 문제 풀이는 개념적 이해를 위한 도구이자 대리 지표인데, 그 도구가 목적을 이기고 있다고 봅니다. ‘참/거짓 명제의 대량생산’이 비옥한 토양을 파괴할 수 있다고 경고합니다.
- 무엇을 잃나: 서둘러 발표되는 증명은 제대로 된 논문화, 새로운 방법의 추출, 선행 연구 인용을 남기지 않고 표절과 저작자 표시(attribution) 문제를 낳습니다. 아이디어를 다음 세대 수학자에게 넘기는 ‘인간 전수 사슬’이 끊길 수 있다는 지적입니다. 선언은 이를 수학을 넘어 모든 지적 노동과 창작 직업이 직면한 문제로 확장합니다.
- 경과: 타오는 “지난주 수상자들 사이의 논의에서 출발했고 라이덴 선언 같은 충분한 협의 절차를 갖지 못했지만, 긴급성 때문에 빨리 내기로 했다”고 밝혔습니다. 2026년 수상자 위덩(Yu Deng)을 포함해 초기 서명자 25인은 모두 필즈 메달리스트이며, ORCID 또는 학술 이메일로 추가 서명을 받고 있습니다. 이코노미스트도 같은 날 보도했습니다.
출처: A Severe Misalignment of AI in Mathematics—Math and AI, A Severe Misalignment of AI in Mathematics—Terence Tao
”늦출 수 있다” — 알트먼이 직원들에게 말한 속도 조절
블룸버그가 9월 11일 보도했습니다. 샘 알트먼이 전사 회의에서 최첨단(cutting-edge) AI 시스템의 개발 속도를 늦추는 데 열려 있다고 직원들에게 말한 것입니다.
- 내용: 오픈AI는 이상적으로는 다른 주요 랩들과 함께 느리고 신중한 개발 주기를 조율하고 싶지만, 일부 경쟁사는 전속력을 유지할 수 있다고 인정했습니다. AI위클리는 알트먼이 의회에 ‘경쟁사와의 속도 조율이 반독점법상 안전한지’도 문의했다고 전했습니다.
- 맥락: 제이콥 콕슨의 사임장과 에번 허빙거의 경고가 이어진 주간입니다. 오픈AI는 지난 8월 에이전트가 통제를 벗어나 허깅페이스를 해킹한 사건으로 2주간 모델 개발을 중단했던 회사이고, 7월에도 “언젠가 AI 발전 속도를 조절할 시점이 올 것”이라고 언급했습니다. 안트로픽 대변인은 같은 날 “새 도구 출시 속도에 대해 업계와 협력하는 데 관심이 있다”고 답했습니다. 알트먼은 전날 의무적 전미(全美) 안전 요건 입법도 촉구했습니다.
출처: OpenAI Is Open to Slowing Cutting-Edge AI, CEO Sam Altman Tells Staff—Bloomberg, Sam Altman says OpenAI open to slower AI development amid safety scrutiny—The News(블룸버그 인용)
상원이 움직인다 — ‘알려진 주요 위험’ 완화를 의무화하려는 협상
로이터가 9월 11일 보도했습니다. 미 상원 협상단이 AI 기업에 ‘알려진 주요 위험(known major risks)‘을 완화하도록 요구하는 법안을 논의 중입니다.
- 흐름: 위험 완화 의무화 논의는 이번 주 안트로픽 연구자들의 경고와 오픈AI의 규제 자청에 이은 의회 차원의 후속 수순입니다. 양당 상원의원들은 오픈AI 시스템이 경쟁사 허깅페이스에 침투한 사건의 조사를 요구했고, 조시 홀리 의원은 자신의 AI 조사에 오픈AI를 추가했습니다. CNBC는 연구자의 ‘멸종 경고’ 이후 워싱턴에서 규제 요구가 커지고 있다고 전했습니다.
출처: US Senate negotiators consider requiring AI firms to mitigate known major risks—로이터 통신(MSN 게재)
예멘의 비밀 공방 — 후티가 클로드 코드로 만들려던 유도무기
안트로픽 위협 인텔리전스 보고서의 ‘재래식 무기’ 챕터가 9월 11일 언론을 통해 확인됐습니다. 예멘 북부 기반 무기 개발 셀은 세 개 프로그램을 돌렸습니다. 유도 로켓, 사거리 2,000km 이상의 다단 탄도미사일, 그리고 초음속 활공체 변형을 포함한 ‘R2000’ 미사일 세트입니다.
- AI의 역할: 이들은 소프트웨어 엔지니어 대신 클로드 코드를 썼습니다. 오픈소스 오토파일럿을 휴대폰급 비행 컴퓨터에 통합하고, 제어·위치추정 코드를 작성하고, 펌웨어를 빌드하고 비행 시뮬레이션을 돌리는 일까지 맡겼습니다. 여러 클로드 인스턴스에 코드 작성·리서치·검토 역할을 분담시켰고, 안전장치를 피하려고 무기 용도를 숨기는 시도도 했습니다.
- 현장 시험: 유도 로켓의 실제 시험발사가 예멘에서 있었고 실패로 보이자, 이들은 몇 시간 만에 클로드로 돌아와 실패 원인을 분석했습니다. 다만 안트로픽은 “실전 배치에 성공한 운용 무기의 증거는 찾지 못했다”고 명시했습니다.
출처: Detecting and countering misuse of AI: September 2026—Anthropic, How a Yemen-based Houthi weapons cell used Claude to develop missile software—Outlook India
미성년자에게 닫힌 문 — 클로드의 ‘18세 이상’과 캘리포니아의 청소년 법
안트로픽의 소비자용 클로드가 18세 이상만 쓸 수 있음을 명시한 연령 확인(age assurance) 정책 문서가 지난밤 해커뉴스 최상단에 올라 큰 반응을 얻었습니다. 522포인트, 댓글 560여 건입니다.
- 작동 방식: 가입할 때 18세 이상임을 확인해야 합니다. 미성년자 신호가 감지되면 연령 인증 전까지 사용이 중단되고, 미성년 활동 징후가 확인되면 계정이 비활성화될 수 있습니다. 인증은 제3사 Yoti로 하는데, 셀피 한 장으로 나이를 추정하는 안면 추정, 여권·운전면허 등 신분증 사진 업로드, Yoti 디지털 ID 앱의 ‘18세 이상’ 증명 세 가지 방식이 있습니다. 통과하면 계정이 복구됩니다.
- 캘리포니아: 뉴섬 주지사는 9월 10일 아동 보호 법안 패키지에 서명했습니다. AI 챗봇 사업자는 출시 전 위험평가를 의무적으로 수행하고, 16세 미만에게 중독성 피드 제공이 금지되며, 대형 소셜미디어가 아동에게 해를 끼친 것이 인정되면 아동 1명당 최대 100만 달러의 페널티를 물립니다. 같은 주가 지난달 메타와 28개 주의 소송을 180억 달러에 합의한 데 이어, 뉴욕시는 8학년까지 학생용 AI를 금지했습니다.
출처: Age assurance on Claude—Anthropic, New California laws aim to protect kids from social media harms—AP
Z.AI, 홍콩에서 하루아침에 50억 달러 — 주식 20억 달러+전환사채 30억 달러
베이징 기반 Z.AI가 9월 11일 홍콩 증시에서 약 20억 달러 규모 주식 배정과 약 30억 달러 규모 전환사채 발행을 동시에 시작했습니다. 로이터가 텀시트를 인용해 보도했습니다.
- 거래 구조: 상장 주식 2,197만 주를 주당 714홍콩달러에 1차 배정합니다. 직전 거래일 종가 대비 10% 할인입니다. 주식과 전환사채를 합치면 50억 달러에 달합니다.
- 의미: GLM 시리즈로 알려진 지푸(Z.AI)는 딥시크와 함께 중국 공개모델 진영의 양대 축입니다. 미국의 GPU 수출 규제 아래서도 AI 훈련 자금을 조달하는 통로가 홍콩 자본시장으로 넓어지고 있습니다.
출처: Z.AI raises about $2 billion in Hong Kong share sale, offers convertible bonds, term sheet shows—MarketScreener(로이터 통신 인용)
146억 달러 엔스케일, IPO 전 마지막 퍼즐로 피지 시모를 부르다
런던의 AI 인프라 회사 엔스케일(Nscale)이 오픈AI에서 AGI 배포를 이끌었던 피지 시모를 이사회에 영입했습니다. 미국 IPO를 앞두고 증시 경험을 채우는 인사입니다.
- 보드와 이력: 샤릴 샌드버그·수전 데커·닉 클레그가 이미 앉아 있는 이사회입니다. 시모는 인스타카트 CEO로 2023년 IPO를 직접 이끌었던 경험이 영입 사유입니다.
- 재무: 2024년 창업해 올해 3월 20억 달러 시리즈C로 146억 달러 밸류에이션을 받은 회사는 골드만색스·JP모건의 조언으로 최대 9월 중 IPO를 준비합니다. IPO 전 35억 달러 조달(써드포인트 주도 전환사채 15억 달러+엔비디아 최대 20억 달러)도 진행 중입니다.
- 허와 실: 계약 백로그는 약 1,030억 달러지만 평균 5.7년에 걸린 약정이고, 실제 연 매출 런레이트는 4억~5억 달러로 추정됩니다. 안트로픽·마이크로소프트 등 소수 고객 집중도도 리스크로 지적됩니다.
| 항목 | 수치 |
|---|---|
| 최근 밸류에이션 | 146억 달러(2026년 3월 시리즈C) |
| 계약 백로그 | 약 1,030억 달러(평균 5.7년 약정) |
| 연 매출 런레이트 | 약 4억~5억 달러 |
| IPO 전 조달 | 35억 달러(전환사채 15억+엔비디아 최대 20억) |
출처: Nscale Appoints Fidji Simo to Board as IPO Plans Advance—WhalesBook, Nscale adds OpenAI’s Fidji Simo to board ahead of US IPO—Crypto Briefing
젬나이가 윈도우 바탕화면으로 — Alt+Space로 여는 구글 AI
구글이 9월 10일 윈도우용 젬나이 앱을 공식 출시했습니다. Windows 10·11에서 전 세계적으로 쓸 수 있습니다.
- 세 가지 쓰임: 첫째, 어디서든 Alt+Space를 누르면 진행 중인 작업 위로 젬나이가 떠서 문서 팩트체크나 제목 아이디어를 붙잡아 줍니다. 둘째, 전용 워크스페이스에서 24시간 개인 에이전트 ‘Gemini Spark’에 다단계 작업을 맡기거나 Gmail·구글 드라이브의 정보를 끌어다 씁니다. 셋째, 나노 바나나(Nano Banana)로 이미지를 만들고 젬나이 오니(Gemini Omni)로 영상을 연출합니다. 스파크와 오니는 유료 구독이 필요합니다. PC를 늦추지 않도록 가볍게 돌아간다는 것이 구글의 설명입니다.
출처: The Gemini app is now available for Windows—Google Blog
일레븐랩스 뮤직 v2.5 — ‘당신이 만든 곡은 당신 것’을 상품으로
일레븐랩스가 음악 생성 모델 Music v2.5를 올리고 기본 모델로 지정했습니다. 장르 전반에서 레이어와 깊이가 좋아지고 악기 소리가 자연스러워졌다는 회사 설명입니다.
- 다운로드와 권리: 프리 플랜은 하루 무손실 5곡, 프로 플랜은 월 400곡을 내려받을 수 있습니다. 곡의 권리는 만든 순간 모든 플랜에 붙고, 해지나 다운그레이드로 이미 만든 곡의 권리가 사라지지 않습니다. 다른 아티스트 곡을 참조해 만든 트랙은 다운로드가 차단됩니다.
- 배경: 이번 출시는 유니버설뮤직그룹(UMG)과 수년간의 라이선스·제품 개발 전략 협력 합의 발표 직후에 나왔습니다. 회사는 두 건이 별개라고 명시했습니다.
출처: Introducing Music v2.5, our best music model yet—ElevenMusic
EPA, 데이터센터 공해 허가에서 ‘주민 의견’을 없애는 방향
미국 환경보호청(EPA)이 주정부가 대기오염 허가를 승인하기 전에 공람과 공개 의견 수렴을 거치도록 하는 연방 요건을 폐지하는 안을 추진합니다. 데이터센터와 그 전력을 공급하는 발전소가 포함됩니다.
- 이중 완화: EPA는 지난달에는 허가 승인 전에 착공을 허용하는 안도 냈습니다. 국민 10명 중 7명이 인근 데이터센터 건설에 반대하는 가운데, 주민들이 데이터센터가 들어오는 사실조차 모르는 구조가 만들어질 수 있습니다.
- 현장: 흑인 공동체 비중이 높은 미국 남부 농촌에 대형 단지가 몰리고 있습니다. 사우스캐롤라이나에서 1,200개 축구장 크기 단지에 맞서는 활동가는 “미국 민주주의가 팔리는 방식과 반대된다”고 말했습니다. EPA는 “지역 사정을 아는 주와 지방 기관의 재량”이라고 반론했습니다.
출처: Federal Government Moves to Limit Public Input on Data Center Projects—Capital B
”코딩이 해결됐다면, 다음은 슬로프” — 코드 엉망진창의 측정법
이아렌딜(Earendil)의 세바스찬이 ‘코드 슬로핑니스(sloppiness) 측정’ 에세이를 발표해 해커뉴스에서 220포인트를 받았습니다. LLM이 거의 완벽하게 ‘맞는’ 코드를 뽑아내는 시대에, 문제는 정확성이 아니라 불필요한 추상화, 중복, 나쁜 설계라는 것입니다.
- 수치: SlopCodeBench 기준으로 에이전트가 만든 코드는 확립된 저장소보다 평균 두 배가량 더 엉망입니다. 장황함(verbosity)은 0.33 대 0.15, 침식(erosion, 코드 질량이 거대하고 복잡한 함수에 몰리는 정도)은 0.68 대 0.31이었습니다.
- AI 심판의 한계: 모델에게 코드 품질을 1점부터 10점으로 매기게 하는 방식은 “난수 생성기나 다름없다”고 저자는 씁니다. 해법 A와 B를 비교하게 해도 이름을 바꾸면 선호가 뒤집힙니다. 결국 가장 유효한 지표는 의외로 단순한 ‘코드 줄 수 변화량’이라는 것이 결론입니다.
출처: If coding is solved, what now?: Measuring the sloppiness of code—Earendil
”토큰 89% 절약”의 해부 — Quesma가 실측한 RTK의 진짜 청구서
RTK CLI는 명령 출력을 필터링해 토큰을 아껴준다고 알려진 도구입니다. Quesma가 Claude Code(Fable 5.0)와 OpenCode(DeepSeek V4 Pro)로 벤치마크를 돌린 결과, 토큰 절감 보고와 실제 비용은 다른 이야기였습니다.
| 항목 | 결과 |
|---|---|
| RTK 보고 절감(DeepSeek 445회 시도) | 3억 4,900만 토큰(89%) |
| 실제 평균 태스크 비용 | 17~18% 증가 |
| Fable 전체 절감의 대부분 | 단 1개 태스크(corewars)에서 발생 |
| rtk find 버그 | 339회 연속 에러, 약 12분, 비용 9배 |
- 왜 벌어지나: RTK의 절감 지표 rtk gain은 ‘제거된 출력 바이트 나누기 4’일 뿐 청구된 토큰 수가 아닙니다. head -1로 파일 첫 줄만 읽은 호출 두 번에 각 1억 2,050만 토큰씩 절감으로 기록해 비교군 절감의 69%를 만든 사례도 있었습니다. 본래 그 명령은 파일 전체를 반환할 일이 없습니다. 출력을 지우면 에이전트의 다음 턴이 달라지는데, 그 비용은 계산에 없습니다.
출처: RTK reports token savings, but our cost benchmarks disagree—Quesma
”AI 뉴스 홍수 좀 줄여주세요” — 해커뉴스가 스스로에게 던진 질문
Ask HN 스레드 “AI 뉴스 홍수를 제한해 주시겠어요?”가 하루 만에 723포인트, 댓글 350개를 받았습니다. AI와 AI 인접 글이 피드를 채우면서 다른 해커 주제가 밀려난다는 지적입니다.
- 대응은 이미 시장으로: 같은 날 Show HN ‘unslop.news’가 160포인트를 받았고, AI 콘텐츠의 우선순위를 낮추는 hcker.news는 161포인트를 받았습니다. 필터 뷰어 sprinklz 등 ‘AI 없는 HN’ 도구가 여럿 올라왔습니다. 반대로 “최신 모델 이야기를 따라가려고 HN을 보는 사람도 있다”는 반론도 만만치 않았습니다.
- 반응의 스펙트럼: “코로나·Node.js 유행 때도 그랬다”부터 “지금 프론트페이지 30개 중 21개는 AI가 아니다”까지, 커뮤니티 자체가 피로와 수요로 쪼개져 있습니다.
출처: Ask HN: Can we please limit the AI news flood?—Hacker News, hcker.news—hcker.news
오늘의 도구 추천
litelm — LiteLLM의 라우팅과 메시지 변환 코어만 약 2,900줄, 의존성 2개(openai·httpx)로 담은 경량 라이브러리입니다. 19개 프로바이더를 ‘provider/model’ 문법 하나로 호출하고, completion·스트리밍·도구 호출·embeddings·Responses API를 그대로 지원합니다. 프록시, 캐싱, 비용 추적은 뺐지만 API는 litellm과 동일해서 임포트만 바꾸면 마이그레이션이 끝납니다. 에이전트 하네스에 라우팅만 필요한 팀에게 맞는 크기입니다.
에디터 노트
오늘 하루를 관통하는 단어는 ‘거리두기’입니다. 수학계의 최고 권위자 25인이 AI와 목표가 어긋났다고 선언했고, 알트먼은 속도를 조절할 수 있다고 말했으며, 해커뉴스는 AI 뉴스를 줄여달라고 청원했습니다. 클로드는 미성년자에게서 스스로 물러섰습니다. AI를 향한 태도가 ‘얼마나 빨리 받아들일까’에서 ‘어디까지 가까이 둘까’로 바뀌는 중입니다. 그러나 같은 날 홍콩에서는 Z.AI가 50억 달러를 걷었고 런던의 GPU 클라우드는 IPO를 목전에 두고 있습니다. 브레이크를 밟자는 목소리와 가속 페달에 쏟아지는 돈이 같은 날 최대치를 찍는다면, 그것은 모순이 아니라 이 시장의 현재 온도입니다. 내일도 이 온도를 재어 오겠습니다.
다음에 또 찾아옵니다. — 에이브랜치