No. 89

AI 모델은 더 강해졌고, 운영 규칙은 더 촘촘해집니다 — Anthropic⁠·GitHub⁠·Google⁠·AWS⁠·Cloudflare

Anthropic 모델 복구와 GitHub·Google·AWS·Cloudflare 업데이트가 에이전트 운영 통제 경쟁을 보여줍니다.

오늘의 핵심

오늘의 흐름은 AI 에이전트가 더 강해지는 만큼, 모델 출시와 운영을 둘러싼 통제 장치도 함께 제품화되고 있다는 점입니다. Anthropic의 Fable 5·Mythos 5 복구는 프런티어 모델 출시가 더 이상 연구소 단독 결정이 아니라는 사실을 보여줬고, GitHub·AWS·Cloudflare·Exabeam의 업데이트는 비용, 로그, 검색, 보안, 크롤러 제어까지 에이전트 운영 표면이 빠르게 넓어지고 있음을 말해줍니다.


Anthropic 모델 복구 과정, 프런티어 AI 출시가 정부 검증 이슈로 바뀌었습니다

Axios는 Anthropic의 Fable 5·Mythos 5가 20일 가까이 중단됐다가 복구된 과정을 보도했습니다. Amazon이 제기한 jailbreak 우려가 미국 행정부의 수출통제와 다기관 기술 검토로 이어졌고, 이후 Anthropic은 정부와 추가 안전장치를 조율해 모델을 다시 열었습니다.

  • 다기관 검토: 상무부, NSA, 백악관, 재무부 등 여러 기관이 Anthropic 모델 안전성 논의에 참여했습니다.
  • 출시 불확실성: Axios는 Anthropic 이후 OpenAI와 Google의 최신 모델 출시 방식에도 같은 질문이 적용될 수 있다고 짚었습니다.
📢 프런티어 모델 출시는 이제 제품 출시가 아니라, 국가 안보·수출통제·취약점 공개 체계가 함께 걸린 운영 이벤트가 됐습니다.

출처: How the world’s top AI models were revived — Axios


Anthropic, Fable 5·Mythos 5를 재배포하며 jailbreak 위험 점수화를 제안했습니다

Anthropic은 Fable 5와 Mythos 5 접근이 복구됐다고 밝히며, Amazon·Microsoft·Google 등 Glasswing 파트너와 함께 jailbreak 심각도를 평가하는 공동 프레임워크를 만들겠다고 했습니다. Fable 5는 Claude Platform, Claude.ai, Claude Code, Claude Cowork에서 다시 제공되고, Mythos 5는 미국 내 일부 조직부터 접근이 재개됩니다.

  • 99 % 차단 목표: Anthropic은 Amazon 보고서에 나온 특정 우회 기법을 새 classifier가 99 % 이상 차단한다고 설명했습니다.
  • 오탐 비용: 강화된 classifier는 정당한 코딩·디버깅 요청도 더 자주 막을 수 있어, 보안과 사용성 사이의 비용이 전면에 드러났습니다.
📢 앞으로 모델 안전성 논쟁은 "막을 것인가"보다 "어떤 위험을 어느 등급으로 보고 누가 검증할 것인가"로 이동할 가능성이 큽니다.

출처: Redeploying Fable 5 — Anthropic


GitHub Copilot, 에이전트 세션 스트리밍을 공개 프리뷰로 열었습니다

GitHub는 Copilot agent session streaming을 공개 프리뷰로 내놨습니다. 엔터프라이즈 소유자는 스트리밍 엔드포인트로 Copilot 에이전트 세션 이벤트를 받을 수 있고, REST API로 최근 48시간 사용 기록도 조회할 수 있습니다.

  • 관측성 강화: 에이전트가 무엇을 호출하고 어떤 세션에서 비용을 쓰는지 실시간에 가깝게 추적할 수 있습니다.
  • 엔터프라이즈 운영형 기능: 세션 로그와 사용량 기록은 감사, 비용 배분, 이상 행동 탐지의 기본 데이터가 됩니다.
📢 코딩 에이전트가 조직 표준 도구가 되려면 결과물보다 먼저 세션 기록과 비용 기록을 설명할 수 있어야 합니다.

출처: Copilot agent session streaming is now in public preview — GitHub Changelog


GitHub Copilot CLI·SDK, 에이전트 세션별 AI credit 한도를 지원합니다

GitHub는 Copilot CLI와 Copilot SDK에 세션별 AI credit 한도를 추가했습니다. 사용자는 /limits로 대화형 세션 한도를 설정하거나, 비대화형 실행에서 --max-ai-credits 옵션으로 한 번의 자동화가 쓸 수 있는 비용을 제한할 수 있습니다.

  • 자동화 비용 상한: 사람이 보고 있지 않은 agent run이 끝없이 비용을 쓰는 상황을 줄이는 장치입니다.
  • 세션 단위 통제: 전체 예산과 별개로 개별 작업의 spend를 제한해 CI, 스크립트, 백그라운드 작업에 적용하기 쉽습니다.
📢 에이전트 운영의 기본 단위가 "사용자 구독"에서 "작업 세션 예산"으로 내려오고 있습니다.

출처: Set AI credit session limits in Copilot CLI and SDK — GitHub Changelog


GitHub Copilot Vision, 이미지와 PDF를 모든 Copilot 플랜에 열었습니다

GitHub는 Copilot Vision을 정식 출시했습니다. VS Code, github.com Copilot Chat, Copilot CLI에서 이미지와 PDF를 프롬프트에 첨부할 수 있고, Free·Pro·Pro+·Business·Enterprise 플랜 전체에서 기본 제공됩니다.

  • 코드 밖 맥락 입력: 스크린샷, 설계 문서, 오류 화면, PDF 명세를 코드와 함께 해석할 수 있습니다.
  • agent mode 적용: VS Code에서는 ask, plan, agent mode 모두에서 시각 자료를 붙일 수 있습니다.
📢 개발자 에이전트의 입력은 더 이상 저장소 텍스트에 머물지 않고, 화면과 문서 상태까지 포함하는 작업 맥락으로 확장되고 있습니다.

출처: Copilot vision is generally available — GitHub Changelog


Google Cloud, AI Threat Defense와 Gemini 3.5·Spark를 묶어 기업 AI 운영 표면을 넓혔습니다

Google Cloud는 최근 AI 발표를 정리하며 Google AI Threat Defense, Gemini 3.5, Gemini Omni, Antigravity, Gemini Spark, Workspace AI 업데이트를 함께 소개했습니다. 핵심은 모델 성능뿐 아니라 보안, 업무 자동화, 에이전트 개발 환경을 한 패키지로 묶는 방향입니다.

  • 보안 제품화: Google AI Threat Defense는 AI 기반 사이버보안 솔루션으로 소개됐습니다.
  • 업무 에이전트화: Gemini Spark는 Enterprise와 Workspace 고객을 위한 24시간 개인 AI 에이전트로 설명됩니다.
📢 Google의 AI 전략은 모델 라인업보다, 보안·업무·개발자 도구를 같은 엔터프라이즈 운영층에 배치하는 데 초점이 맞춰지고 있습니다.

출처: What Google Cloud announced in AI this month — Google Cloud Blog


AWS Bedrock AgentCore, 기업 경계 안에서 쓰는 Web Search를 추가했습니다

AWS는 Amazon Bedrock AgentCore에 Web Search를 추가했습니다. 개발자가 AI 에이전트에 최신 웹 정보를 제공하면서도 고객의 AWS 보안·컴플라이언스 경계 안에서 질의를 처리하도록 설계한 기능입니다.

  • agentic retrieval: 웹 검색 결과를 에이전트가 쓰기 좋은 발췌와 맥락으로 반환하도록 최적화했습니다.
  • 보안 경계 유지: 별도 검색 벤더 온보딩, 인증, 청구 흐름을 붙이지 않아도 된다는 점을 강조했습니다.
📢 실시간 정보 접근은 에이전트의 필수 능력이지만, 기업 고객에게는 "어디에서 검색했는가"보다 "어떤 보안 경계 안에서 검색했는가"가 더 중요해지고 있습니다.

출처: New in Amazon Bedrock AgentCore: Build agents with broader knowledge and continuous learning — AWS Machine Learning Blog


Cloudflare, AI 크롤러를 Search·Agent·Training으로 나눠 제어하게 했습니다

Cloudflare는 모든 고객이 AI crawler를 행동 유형별로 관리할 수 있다고 알렸습니다. AI traffic을 Search, Agent, Training 세 범주로 나눠 검색 유입을 주는 트래픽은 허용하고, 콘텐츠를 학습 목적으로 가져가는 트래픽은 차단하는 식의 선택지를 제공합니다.

  • 콘텐츠 소유권 통제: 웹사이트 운영자가 AI traffic을 일괄 차단하지 않고 목적별로 다룰 수 있습니다.
  • 에이전트 트래픽 분리: Agent 범주가 별도로 생기면서 자동화된 웹 행동을 기존 검색 크롤러와 구분하기 쉬워집니다.
📢 AI 시대의 robots 정책은 "허용/차단"을 넘어, 검색·에이전트·학습이라는 사용 목적별 계약으로 세분화되고 있습니다.

출처: Application security changelog — Cloudflare Docs


Exabeam, AI 에이전트 행동 분석과 Claude 지원을 보안 플랫폼에 추가했습니다

Exabeam은 autonomous AI agent 위험을 탐지하기 위해 Agent Behavior Analytics, Threat Center, Exabeam Nova 등 보안 기능을 확장했습니다. AI-focused behavioral detection을 90개로 늘리고, ChatGPT·Gemini·Microsoft Copilot·GitHub Copilot에 더해 Anthropic Claude 지원도 추가했습니다.

  • agent behavior monitoring: AI 에이전트가 시스템, 사용자, 민감 데이터와 어떻게 상호작용하는지 추적하는 데 초점을 둡니다.
  • 오픈소스 telemetry: Observra라는 AI agent telemetry 라이브러리도 공개해 보안 운영 도구로 데이터를 보내기 쉽게 했습니다.
📢 기업 보안팀의 다음 관측 대상은 사람 계정만이 아니라, 합법적 권한으로 도구를 호출하는 AI 에이전트입니다.

출처: Exabeam Expands Security Platform to Tackle Risks from Autonomous AI Agents — IT News Africa


Hugging Face와 Cerebras, 오픈 speech-to-speech 에이전트 파이프라인을 공개했습니다

Hugging Face의 speech-to-speech 저장소는 VAD, STT, LLM, TTS를 모듈형으로 연결한 저지연 voice-agent pipeline입니다. Cerebras는 Gemma 4 31B를 자사 inference cloud에서 초당 1,800개 이상 토큰으로 실행한다고 설명하며, 음성·시각·에이전트 루프를 더 빠르게 만들 수 있다고 강조했습니다.

  • 모듈형 음성 에이전트: Parakeet TDT, OpenAI-compatible LLM, Qwen3-TTS 등 구성 요소를 교체할 수 있습니다.
  • 운영 사례: GitHub 저장소는 이 파이프라인이 수천 대의 Reachy Mini 로봇 대화 백엔드로 쓰인다고 설명합니다.
📢 음성 에이전트 경쟁의 병목은 모델 품질만이 아니라 tail latency와 공급자 종속성입니다.

출처: speech-to-speech — GitHub / Hugging Face, Gemma 4 on Cerebras — Cerebras


Cognition, Devin 중심의 자율 코딩 에이전트 가치평가를 다시 끌어올렸습니다

Tech Insider는 Cognition이 260억 달러 post-money valuation으로 10억 달러 이상을 조달했고, 회사 내부 코드의 89 %를 Devin이 작성한다는 주장을 전했습니다. 자율 코딩 에이전트가 보조 도구를 넘어, 실제 제품 개발 조직의 운영 모델로 평가받고 있다는 신호입니다.

  • 자본 집중: 투자자들은 단순 autocomplete가 아니라 일을 위임받아 PR까지 여는 agentic workflow에 높은 가치를 매기고 있습니다.
  • dogfooding 지표: Cognition의 89 % 코드 작성 주장은 검증이 필요한 수치지만, 시장이 보는 방향성은 분명합니다.
📢 코딩 에이전트 시장의 경쟁축은 "얼마나 똑똑한가"에서 "조직이 얼마나 많은 일을 실제로 맡길 수 있는가"로 이동하고 있습니다.

출처: Cognition Hits $26B; Devin Writes 89% of Its Code — Tech Insider


오늘의 도구 추천

speech-to-speech — Hugging Face가 공개한 모듈형 voice-agent pipeline입니다. OpenAI Realtime-compatible WebSocket API를 제공하고, VAD·STT·LLM·TTS 각 단계를 교체할 수 있어 음성 에이전트의 지연시간과 공급자 종속성을 직접 실험하기 좋습니다.


에디터 노트

오늘 눈에 띄는 것은 “에이전트가 가능해졌다”가 아니라 “에이전트를 운영하려면 어떤 계량 장치가 필요한가”입니다. Anthropic의 모델 복구는 안전성 점수와 정부 검증을, GitHub는 세션 로그와 credit 한도를, Cloudflare는 AI traffic 목적 분류를, Exabeam은 agent behavior telemetry를 이야기합니다. 모두 같은 방향입니다. 강한 모델 자체보다, 강한 모델이 조직 안에서 남기는 흔적과 경계를 어떻게 관리할지가 제품 경쟁력이 되고 있습니다.

다음에 또 찾아옵니다. — 에이브랜치