No. 173

여는 순서의 경쟁 — 제미나이 4 아르곤, FTC 조사, 모두의 AI

구글은 방어자에게만 먼저 연 제미나이 4 아르곤을 공개했고, FTC는 AI 기업 조사에 착수했으며, 한국은 10월 전 국민 무료 '모두의 AI'를 앞둔 날입니다.

오늘의 핵심

어제 하루 20개 발표로 속도를 과시한 오픈AI에 대해, 구글은 ‘순서’로 응답했습니다. 신규 최강 모델 제미나이 4 아르곤을 일반에 곧바로 풀지 않고 신뢰된 사이버 방어자에게 먼저 문을 연 것입니다. 같은 날 미 연방거래위원회는 오픈AI와 앤스로픽 등의 제품 위험 조사에 착수했고, 오픈AI 최고경영진은 ‘불량 AI 에이전트’ 상원 청문회 참석을 거절했습니다. 그 사이 한국은 10월 중 전 국민이 무료로 쓰는 ‘모두의 AI’ 베타를 앞두고 있습니다. 누구에게, 어떤 조건으로, 얼마나 먼저 여느냐가 새로운 경쟁의 문법이 된 날입니다.


제미나이 4 아르곤 — 구글이 ‘순서’로 답한 신모델

구글이 새 프론티어 모델 제미나이 4 아르곤을 공개했습니다. 핵심은 성능만이 아니라 출시 방식입니다. 구글은 일반 공개에 앞서 신뢰된 사이버 방어자들에게만 먼저 접근을 허용하는 페어윈드 프로그램을 통해 단계적으로 모델을 풀고 있습니다.

  • 성능: 실제 코드베이스 장기 과제 벤치마크 DeepSWE v1.1에서 77.9%로 새 최고 기록을 세웠고, 재피어의 업무 자동화 벤치마크 AutomationBench에서 51.3%로 1위, 긴 영상 이해 LVBench에서 91.7%로 최고 성능을 냈습니다. 출력 토큰 한계를 기존 64K에서 100만 개로 확대해 한 번의 추론으로 깊게 생각할 공간을 만들었습니다. 아트리피셜 애널리시스는 지능지수 53으로 223개 모델 중 8위로 평가했습니다.

  • 가격: 도입 기준 입력 100만 토큰당 2달러, 출력 10달러이며 캐시 입력은 95% 할인됩니다. 어제 나온 GPT-6.1 솔과 같은 가격대입니다. 다만 도입 기간이 끝나면 입력 4달러, 출력 20달러로 올라갑니다.

  • 내부 성과: 구글은 이미 아르곤을 내부에 투입했습니다. 양자 알고리즘 최적화에서 기존 기록을 40% 개선했고, 에이전트 팀이 데이터센터 전체 프로파일링을 분석해 300티비바이트 넘는 메모리를 회수했으며, 후시아 지르콘 커널 등 80만 줄 이상의 C/C++ 코드를 러스트로 이식하는 작업을 진행 중입니다.

  • 사이버 방어: 신뢰된 방어자에게는 사이버 가드레일을 제거한 버전을 제공합니다. 초기 실증에서 전 세계 병원이 쓰는 의료 소프트웨어의 중요 취약점을 찾아냈는데, 이전 프론티어 모델들이 놓친 것이었습니다. Wiz가 공공 인프라를 무료로 보호하는 ‘스캔 포 굿’에서 이미 활용 중입니다.

  • 안전 장치: 미국 정부의 자발적 사전 접근 절차에 참여하고 있고, 프롬프트 삽입 강건성 벤치마크(그레이 스완 IPI)에서 앞서며, 모델의 사고 과정과 행동을 모니터링해 의도를 벗어나면 정지시키는 시스템을 붙였습니다. 일반 개발자와 기업, 소비자에게는 유료 API와 구글 AI 울트라 구독자부터 순차적으로 확대합니다.

📢 가장 강한 모델을 가드레일 없이 가장 먼저 받는 상대가 일반 사용자가 아니라 방어자라는 설계는, 어제의 백악관 협정과 무단 접근 사태에 대한 구글식 응답입니다. 성능 경쟁이 출시 순서와 조건의 경쟁으로 바뀌었습니다.

출처: Gemini 4 Argon: our next era of frontier intelligence — Google, Gemini 4 Argon (High) — Artificial Analysis


FTC, 오픈AI·앤스로픽 제품 위험 조사 착수

미국 연방거래위원회(FTC)가 오픈AI와 앤스로픽 등 주요 AI 기업을 상대로 제품 위험 조사를 시작했습니다.

  • 내용: 통제를 벗어난 ‘불량 AI 에이전트’ 공격 사례가 잇따르자, FTC가 기업들의 제품 안전성과 위험 관리 실태를 들여다보는 것으로 알려졌습니다. 백악관의 자율 규제 협정이 발표된 지 하루 만에 연방 규제기관의 조사가 병행된 셈입니다.

  • 흐름: 소비자 보호 관점에서 AI 제품의 실패가 사용자와 제3자에게 끼치는 피해가 조사 대상이 됩니다. 업계 자율 약속과 연방 기관의 검증이 동시에 움직이는 이중 구도가 당분간 기본 환경이 됩니다.

📢 '스스로 지키겠다'는 약속과 '실제로 지켜지는지 확인하겠다'는 조사가 같은 주에 출발했습니다. 협정 문구의 무게는 결국 조사 서류로 측정됩니다.

출처: FTC is investigating OpenAI, Anthropic and other AI companies over product risks — CNBC, FTC opens probe into OpenAI, Anthropic over AI safety risks — Yahoo News


올트먼, ‘불량 AI 에이전트’ 상원 청문회 불참

오픈AI 경영진이 불량 AI 모델과 국토안보 영향을 다루는 미 상원 청문회에 참석하지 않기로 했습니다.

  • 사안: 조쉬 홀리 상원의원(공화당)이 이끄는 소위원회가 수요일 열린 청문회에 올트먼과 오픈AI 관계자를 불렀으나, 회사 측이 서면 답변으로 갈음하겠다고 통보했다고 NBC 뉴스가 보도했습니다.

  • 반응: 홀리 의원은 불참이 유감이라고 밝히면서, AI 기업은 자사 에이전트가 입힌 피해에 대해 책임을 져야 한다고 주장했습니다. 서면 답변이 서면 이행으로 이어질지가 다음 쟁점입니다.

📢 청문회 불참은 법적 의무가 아니어서 비용이 낮지만, 대중 신뢰의 관점에서는 값이 비쌉니다. 닷츠로 상시 에이전트를 파는 회사가 '누가 책임지나'라는 질문만은 피해갈 수 없습니다.

출처: OpenAI CEO Sam Altman to skip congressional hearing on rogue AI agents — NBC News


GPT-시놉시스 — AI가 칩을 설계하는 전용 모델

오픈AI와 반도체 설계 자동화(EDA) 기업 시놉시스가 칩 설계 전용 AI 모델 ‘GPT-시놉시스’를 만들기 위한 다년간 전략적 파트너십을 맺었다고 더 디코더가 보도했습니다.

  • 구조: 오픈AI가 시놉시스의 EDA 도구를 라이선스해 모델 학습과 추론에 활용하고, 완성된 모델은 설계 목표를 받아 직접 시놉시스 도구를 조작하도록 설계됩니다. 엔지니어는 목표를 위임하고 결과를 검수·승인하는 역할으로 이동합니다.

  • 운영: 모델은 오픈AI 인프라에서 돌아가며, 고객 데이터는 학습에 쓰이지 않고 암호화 저장된다고 두 회사는 밝혔습니다. 반도체 고객 대상 초기 테스트가 이미 진행 중이고, 두 회사가 함께 판매하고 수익을 배분합니다.

  • 맥락: 오픈AI는 브로드컴과 함께 자체 추론용 칩 ‘할라피뇨’를 개발 중입니다. AI가 AI를 위한 칩을 설계하는 재귀 구조가 본격화했습니다.

📢 프론티어 모델의 다음 토지는 일반 지식이 아니라 전문 도구입니다. 설계 검토라는 인간 관문은 남았지만, 칩 엔지니어링의 단위 업무가 에이전트 과제로 바뀌는 첫 삽입니다.

출처: OpenAI and Synopsys team up to build an AI model that designs chips like a seasoned engineer — The Decoder


America.gov 챗봇, 출시 행사 중 대답이 바뀌었다

트럼프 행정부의 공식 AI 포털 아메리카(America.gov) 챗봇이 출시 직후 바이든의 2020년 승리와 수정 헌법 제22조를 인용한 3선 불가 입장을 밝혔다가, 행사가 진행되는 동안 대답을 바꾼 것으로 확인됐습니다.

  • 경과: 포춘 등에 따르면 챗봇은 출시 직후 2020년 대선에서 바이든이 이겼다고 답하고, 트럼프 대통령의 3선은 수정 헌법 제22조가 막는다고(2016년과 2024년 두 번 당선됐다는 근거) 설명했으며, 최근 지구 온난화가 인간의 온실가스 배출에서 비롯됐다고 답했습니다. 그러나 트럼프 대통령의 출시 기조연설이 진행되는 사이 선거·탄핵·유죄 판결 관련 질문은 ‘정치적 질문’이라며 거부하기 시작했습니다.

  • 실체: 약 2만 9천 개 정부 웹사이트를 검색하는 이 챗봇은 구글 제미나이와 xAI 그록으로 구동됩니다. 그러나 챗봇 스스로는 “어떤 언어모델이 아메리카를 구동하는지 공개하지 않는다”고 답했습니다. 건설을 맡은 국립 디자인 스튜디오는 30명 남짓 인력에 기계학습 엔지니어가 없는 것으로 알려졌습니다.

  • 다음 단계: 같은 날 대통령 명령으로 연방 기관의 대국민 서비스와 포털 통합이 지시됐고, 2027년 여권·메디케어·학자금 신청까지 같은 구조로 연결될 예정입니다.

📢 출시 행사 한가운데에서 답변이 실시간으로 다시 써지는 모습은, 정부 챗봇의 신뢰가 모델 성능이 아니라 운영 규칙의 투명성에 달려 있음을 보여줍니다.

출처: America.gov chatbot altered mid-launch after Biden 2020 reply — AI Weekly, Ask Trump’s AI chatbot who won in 2020. You might not get an answer. — Yahoo News


빌 게이츠 “AI 자율 규제는 미친 짓”

빌 게이츠가 뉴욕타임스 에즈라 클라인 쇼와의 인터뷰에서 AI 업계 자율 규제론을 강하게 비판했습니다.

  • 핵심 발언: 게이츠는 “이 문제에서 업계의 자율 규제를 신뢰할 수 없다”며 “그건 정말 미친 짓”이라고 말했습니다. 소송 위험이 곧 안전장치라는 주장에 대해서는 “누군가 생물학 무기를 만들어 1억 명을 죽인 뒤에 소송을 제기하겠다는 것이냐”고 반문했습니다.

  • 비유: 그는 현재의 AI 규제 논의를 “식품의약국도 없고, 항공안전위원회도 없으며, 자동차에 안전벨트 설치 의무도 없는 상태”에 비유했습니다. 재앙 이전에 안전장치와 감시 체계를 의무화해야 한다고 강조했습니다.

  • 노동 제안: 일자리 대응으로는 로봇·AI에 고용주가 내는 사회보장세와 같은 세금을 매겨 대체 속도를 늦추고 재교육 재원으로 쓰자고 제안했습니다. 보육, 노인 요양, 의료, 교육처럼 공감이 필요한 영역은 인간 고용을 보장하는 ‘인간 보호 일자리’로 지정하자는 의견도 냈습니다.

📢 백악관이 '자율 규제' 문서에 서명한 주에, 업계 원로는 같은 단어를 '미친 짓'으로 규정했습니다. 약속의 속도와 제도의 속도가 벌어진 만큼, 이 격차가 정치적으로 어떻게 메워질지가 4분기의 본선입니다.

출처: 빌 게이츠 “AI 자율규제는 미친짓…약물규제·안전벨트 없는 셈” — 연합뉴스


’모두의 AI’ 10월 베타 — 전 국민 무료 서비스가 문을 연다

SK텔레콤·카카오·KT 컨소시엄이 이달 중 전 국민이 무료로 쓰는 국산 AI 서비스 ‘모두의 AI’ 베타를 공개합니다. 12월 정식 출시를 앞두고 이용자 확보전이 시작됩니다.

  • 목표: 생성형 AI 이용자가 약 2,300만 명인 한국에서, 남은 3분의 1까지 AI를 쓰게 하는 것이 목적입니다. 연말까지 이용자 1,500만 명, 내년부터는 행정·생활 서비스를 대신 수행하는 ‘1인 1 AI 에이전트’로 발전시킨다는 구상입니다. 컨소시엄별로 엔비디아 B200 512장을 지원받는 대신 전체 활용량의 50% 이상을 국산 모델로 써야 하는 의무도 있습니다.

  • 3사 차별화: SK텔레콤은 전화와 문자로 접근하는 ‘앱리스’ 실행형 AI, 카카오는 카카오톡에서 예약부터 결제까지 끝내는 통합 에이전트, KT는 다음 검색과 직방 매물, 무신사 쇼핑을 한 앱에 모은 ‘이음 인사이드’로 나뉩니다. 고령층과 디지털 취약계층 접근성이 SKT 카드의 무기입니다.

  • 관전 포인트: 업계는 기능이 얼마나 유기적으로 이어지고 어디까지 자동 실행되는지, 그리고 일상 침투 속도와 사용 빈도가 승부처라고 봅니다.

📢 미국이 문을 여는 조건을 두고 다투는 사이, 한국은 무료라는 조건으로 전 국민에게 문을 여는 실험을 시작합니다. 외산 의존을 낮춘 국산 기반의 대규모 채택 테스트라는 점에서 결과가 정책에 그대로 반영됩니다.

출처: SKT·카카오·KT, 10월 중 ‘모두의 AI’ 첫선…전국민 무료 — 연합뉴스, 전화·문자 vs 생활·검색 vs 카톡…목적 같아도 색깔은 다른 ‘모두의 AI’ — 매일경제


영란은행 “AI 관련 부채 4,500억 달러, 급락 위험 커진다”

잉글랜드은행이 금융정책위원회 보고서를 통해 AI 투자 붐이 만든 부채 축적이 금융시장 급락 위험을 키운다고 경고했습니다.

  • 수치: 로이터가 인용한 모건스탠리 추산으로, 글로벌 AI 관련 채권 발행은 2026년 9월 초까지 약 4,500억 달러로 1년 만에 두 배가 됐습니다.

  • 위험 구조: 7월 기술주 매도세에서 레버리지를 얹은 AI 투자의 취약성이 확인된 바 있습니다. 영란은행은 지정학 긴장과 에너지 가격, 정부 차입 비용 상승이 겹치는 상황에서 여러 위험이 동시에 터질 가능성이 커졌다고 짚었고, 은행과 금융기관이 강력해진 AI가 만드는 새로운 사이버 위협에도 노출됐다고 덧붙였습니다.

📢 시장의 관심이 모델 성능에서 자금 조달 구조로 옮겨가고 있습니다. 인프라 약정이 늘수록 금리와 신용시장이 AI 산업의 실질적인 감속장치가 됩니다.

출처: Bank of England sees growing risk that dangers from AI and debt will materialise — Financial Times, Bank of England Warns $450 Billion AI Debt Surge Could Trigger Financial Market Crisis — The420.in


메타, 2022년 이후 최고 월간 상승으로 9월 마감

메타 주가가 AI 모멘텀을 업고 2022년 이후 가장 큰 월간 상승폭으로 9월 거래를 마쳤다고 CNBC가 보도했습니다.

  • 의미: 뮤즈 출시와 엔터프라이즈 플랫폼 전환, 그리고 구독 경제 공략이라는 메타의 에이전트 스토리가 주가에 반영된 결과입니다. 같은 날 구글의 제미나이 4 아르곤 공개 소식에 알파벳 주가도 상승 마감했습니다.

  • 대비: 한편 영란은행은 같은 날 AI 부채 급증 경고를 내놨습니다. 같은 산업에 대한 두 가지 판단이 하루 안에 나란히 호가창에 붙었습니다.

📢 9월의 마감 잔고는 명확합니다. 시장은 에이전트 전략에 배팅했고, 그 배팅의 부채 기록은 중앙은행 장부에 쌓이고 있습니다.

출처: Meta stock enjoys best month since 2022 on AI momentum — CNBC


MI5 “영국 대학의 AI 연구가 표적” — 100명 넘는 학자 연루 경고

영국 국내안보국 MI5가 중국 국가안전부와 깊이 연계된 조직이 영국 대학의 AI 연구를 지원·표적화하고 있다고 경고했습니다.

  • 내용: MI5는 중국기술일반연구원(CGTRI)이 중국 국가안전부와 ‘매우 강한 유대’를 갖고 있으며, 이 경로로 자금을 받은 연구에 영국 관련 학자 100명 이상이 참여했다고 밝혔습니다. 경고 대상 분야는 AI, 사이버 보안, 은폐 통신, 정보 은닉 기술(스테가노그래피)입니다.

  • 대응: 영국 정부는 대학에 해당 조직과의 기존·예정 협력을 즉시 재점검하라고 권고했고, 보안 담당 장관은 총장들에게 관계 단절을 촉구하는 서한을 보냈습니다. 연결 관계가 의도적으로 감춰져 선의로 참여한 학자도 있을 수 있다는 점도 함께 인정됐습니다.

📢 AI 연구 보안의 최전선이 데이터센터가 아니라 연구비 계약서입니다. 국가 간 연구 자금의 투명성 요구가 갈수록 구체적인 실무 장벽이 됩니다.

출처: UK Security Service Warns Universities, Academics Could Face Criminal Charges Over Research Funded By China-Linked ‘Spy’ Company — Sahara Reporters, British universities aiding Chinese espionage, warns MI5 — Yahoo News


수학계, AI 생성 증명의 ‘책임 있는 공개’ 원칙 발표

수학자 연합체 에이지에이아이(AGMAI)가 ‘AI 생성 수학의 책임 있는 공개’ 성명을 발표하고, AI 기업에 고급 수학 문제를 폐쇄형 모델로 테스트하는 관행 중단을 요구했습니다.

  • 배경: 최근 언어모델이 확률론의 난제인 침투 이론 추측의 증명을 생성해 냈습니다. 필즈 메달리스트 뒤미닐코팽이 “유명 추측도 (AI라는) 불도저에 넘어갈 때가 온다”고 쓴 지 며칠 뒤였습니다. 과학 매체들은 이를 두고 “사람이 풀었다면 필즈 메달감”이라는 수학자 반응을 전했습니다.

  • 원칙: 600건이 넘는 수학계 응답을 모아 만든 권고는 세 가지입니다. 중요한 결과는 가능한 한 빨리 공개할 것, 인간의 이해 없이 공개했다면 그 이해가 따라오도록 자금을 포함한 지원을 할 것, 그리고 그 이해의 발전은 연구소가 아니라 커뮤니티가 주도할 것.

  • 핵심 문장: “저자는 논문의 수학적 논증을 이해하고 스스로 검증하며 내용에 전적으로 책임진다”는 수학계 오랜 규범이 AI 앞에서 어떻게 살아남을지가 성명의 본질적 질문입니다.

📢 증명의 생산이 아니라 이해의 소유권이 새로운 희소 자원이 됐습니다. 기업은 결과를, 커뮤니티는 이해를 책임진다는 이 분업이 실제로 작동할지 주목할 시점입니다.

출처: Responsible Release of AI-Generated Mathematics — AGMAI, AI solves a ‘holy grail’ problem from probability theory — Scientific American


”유 세드 노 MCP” — 백 번 거절하고 번복한 도구 철학

에이전트 피(Pi)를 만드는 에아렌딜(Earendil)이 ‘당신들은 MCP를 쓰지 말라 했잖아’라는 제목의 에세이를 발표해 해커뉴스에서 큰 반향을 일으켰습니다.

  • 번복: 피는 공식 사이트에 ‘MCP를 지원하지 않는다’고 선언하고 팟캐스트에서도 MCP를 공개적으로 낮춰 왔습니다. 그러나 최신 버전에서 MCP를 코어 기능으로 넣었습니다. “세상은 정적이지 않다”는 것이 첫 번째 이유였습니다.

  • 비판은 유효: 다만 여전히 남는 문제를 저자는 정직하게 짚습니다. MCP는 여전히 조합하기 어렵고, 많은 MCP 서버는 도구를 컨텍스트에 쏟아붓는 하니스에 맞춰 텍스트를 반환하도록 만들어져 있다는 것입니다. 저자의 대안은 ‘지능적 도구 발견이 있는 오픈API’에 가까운 MCP, 즉 정형 데이터를 돌려주고 문서로 발견되는 도구입니다.

  • 기술적 핵심: 피의 MCP는 자바스크립트 샌드박스에서 도구를 실행하는 코데모드 위에 얹혔습니다. 도구가 지연 로딩되는 모델 시대에 도구 메타데이터를 하니스가 이해하도록 맞추는 작업이 코어 통합의 실제 이유였습니다.

📢 생태계 표준과의 싸움에서 이기는 방법은 밖에서 비판하는 것이 아니라 안에서 모양을 바꾸는 것이라는 선언입니다. 도구 생태계의 설계 철학이 하니스 경쟁만큼 중요해지는 시점입니다.

출처: “You Said No MCP!” — Earendil


오늘의 도구 추천

Magnitude — 하드웨어에 맞춰 스스로 최적화하는 오픈소스 에이전트 추론 엔진입니다. 커널을 사용자 기기에서 컴파일하고 튜닝해 llama.cpp보다 최대 2배 빠르게 오픈 모델을 구동하며, 메탈 기반 디코딩은 92% 더 빠릅니다. 에이전트당 메모리를 27% 아끼고 세션 간 접두사 캐시를 공유합니다. 피, 오픈코드, 헤르메스, 코덱스, 클로드 코드 등 쓰던 에이전트와 한 번에 연결되고 아파치 2.0 라이선스입니다. 상시 에이전트를 로컬에서 굴리려는 흐름이 커지는 지금, 토큰 비용 없이 속도를 올리는 선택지입니다.


에디터 노트

오늘 뉴스를 하나의 문장으로 압축하면 ‘개방의 조건’입니다. 구글은 가장 강한 모델을 방어자에게 먼저, 그리고 가드레일 없이 주는 역설을 선택했습니다. 오픈AI는 협정에 서명하면서도 책임을 묻는 자리에는 없었습니다. 영란은행은 문을 여는 돈의 출처를 물었고, 수학계는 증명은 열되 이해는 커뮤니티의 것이라고 못 박았습니다. 그 사이 한국은 조건 없는 무료라는 가장 단순한 조건으로 전 국민을 대상으로 실험을 시작합니다. 속도만이 능력이던 시기는 끝나가고, 무엇을 누구에게 어떤 조건으로 먼저 여는지가 기술의 진짜 설계도 되어 가고 있습니다.

다음에 또 찾아옵니다. — 에이브랜치