AI 모델은 더 강해졌고, 운영 규칙은 더 촘촘해집니다 — Anthropic·GitHub·Google·AWS·Cloudflare
Anthropic 모델 복구와 GitHub·Google·AWS·Cloudflare 업데이트가 에이전트 운영 통제 경쟁을 보여줍니다.
오늘의 핵심
오늘의 흐름은 AI 에이전트가 더 강해지는 만큼, 모델 출시와 운영을 둘러싼 통제 장치도 함께 제품화되고 있다는 점입니다. Anthropic의 Fable 5·Mythos 5 복구는 프런티어 모델 출시가 더 이상 연구소 단독 결정이 아니라는 사실을 보여줬고, GitHub·AWS·Cloudflare·Exabeam의 업데이트는 비용, 로그, 검색, 보안, 크롤러 제어까지 에이전트 운영 표면이 빠르게 넓어지고 있음을 말해줍니다.
Anthropic 모델 복구 과정, 프런티어 AI 출시가 정부 검증 이슈로 바뀌었습니다
Axios는 Anthropic의 Fable 5·Mythos 5가 20일 가까이 중단됐다가 복구된 과정을 보도했습니다. Amazon이 제기한 jailbreak 우려가 미국 행정부의 수출통제와 다기관 기술 검토로 이어졌고, 이후 Anthropic은 정부와 추가 안전장치를 조율해 모델을 다시 열었습니다.
- 다기관 검토: 상무부, NSA, 백악관, 재무부 등 여러 기관이 Anthropic 모델 안전성 논의에 참여했습니다.
- 출시 불확실성: Axios는 Anthropic 이후 OpenAI와 Google의 최신 모델 출시 방식에도 같은 질문이 적용될 수 있다고 짚었습니다.
출처: How the world’s top AI models were revived — Axios
Anthropic, Fable 5·Mythos 5를 재배포하며 jailbreak 위험 점수화를 제안했습니다
Anthropic은 Fable 5와 Mythos 5 접근이 복구됐다고 밝히며, Amazon·Microsoft·Google 등 Glasswing 파트너와 함께 jailbreak 심각도를 평가하는 공동 프레임워크를 만들겠다고 했습니다. Fable 5는 Claude Platform, Claude.ai, Claude Code, Claude Cowork에서 다시 제공되고, Mythos 5는 미국 내 일부 조직부터 접근이 재개됩니다.
- 99 % 차단 목표: Anthropic은 Amazon 보고서에 나온 특정 우회 기법을 새 classifier가 99 % 이상 차단한다고 설명했습니다.
- 오탐 비용: 강화된 classifier는 정당한 코딩·디버깅 요청도 더 자주 막을 수 있어, 보안과 사용성 사이의 비용이 전면에 드러났습니다.
출처: Redeploying Fable 5 — Anthropic
GitHub Copilot, 에이전트 세션 스트리밍을 공개 프리뷰로 열었습니다
GitHub는 Copilot agent session streaming을 공개 프리뷰로 내놨습니다. 엔터프라이즈 소유자는 스트리밍 엔드포인트로 Copilot 에이전트 세션 이벤트를 받을 수 있고, REST API로 최근 48시간 사용 기록도 조회할 수 있습니다.
- 관측성 강화: 에이전트가 무엇을 호출하고 어떤 세션에서 비용을 쓰는지 실시간에 가깝게 추적할 수 있습니다.
- 엔터프라이즈 운영형 기능: 세션 로그와 사용량 기록은 감사, 비용 배분, 이상 행동 탐지의 기본 데이터가 됩니다.
출처: Copilot agent session streaming is now in public preview — GitHub Changelog
GitHub Copilot CLI·SDK, 에이전트 세션별 AI credit 한도를 지원합니다
GitHub는 Copilot CLI와 Copilot SDK에 세션별 AI credit 한도를 추가했습니다. 사용자는 /limits로 대화형 세션 한도를 설정하거나, 비대화형 실행에서 --max-ai-credits 옵션으로 한 번의 자동화가 쓸 수 있는 비용을 제한할 수 있습니다.
- 자동화 비용 상한: 사람이 보고 있지 않은 agent run이 끝없이 비용을 쓰는 상황을 줄이는 장치입니다.
- 세션 단위 통제: 전체 예산과 별개로 개별 작업의 spend를 제한해 CI, 스크립트, 백그라운드 작업에 적용하기 쉽습니다.
출처: Set AI credit session limits in Copilot CLI and SDK — GitHub Changelog
GitHub Copilot Vision, 이미지와 PDF를 모든 Copilot 플랜에 열었습니다
GitHub는 Copilot Vision을 정식 출시했습니다. VS Code, github.com Copilot Chat, Copilot CLI에서 이미지와 PDF를 프롬프트에 첨부할 수 있고, Free·Pro·Pro+·Business·Enterprise 플랜 전체에서 기본 제공됩니다.
- 코드 밖 맥락 입력: 스크린샷, 설계 문서, 오류 화면, PDF 명세를 코드와 함께 해석할 수 있습니다.
- agent mode 적용: VS Code에서는 ask, plan, agent mode 모두에서 시각 자료를 붙일 수 있습니다.
출처: Copilot vision is generally available — GitHub Changelog
Google Cloud, AI Threat Defense와 Gemini 3.5·Spark를 묶어 기업 AI 운영 표면을 넓혔습니다
Google Cloud는 최근 AI 발표를 정리하며 Google AI Threat Defense, Gemini 3.5, Gemini Omni, Antigravity, Gemini Spark, Workspace AI 업데이트를 함께 소개했습니다. 핵심은 모델 성능뿐 아니라 보안, 업무 자동화, 에이전트 개발 환경을 한 패키지로 묶는 방향입니다.
- 보안 제품화: Google AI Threat Defense는 AI 기반 사이버보안 솔루션으로 소개됐습니다.
- 업무 에이전트화: Gemini Spark는 Enterprise와 Workspace 고객을 위한 24시간 개인 AI 에이전트로 설명됩니다.
출처: What Google Cloud announced in AI this month — Google Cloud Blog
AWS Bedrock AgentCore, 기업 경계 안에서 쓰는 Web Search를 추가했습니다
AWS는 Amazon Bedrock AgentCore에 Web Search를 추가했습니다. 개발자가 AI 에이전트에 최신 웹 정보를 제공하면서도 고객의 AWS 보안·컴플라이언스 경계 안에서 질의를 처리하도록 설계한 기능입니다.
- agentic retrieval: 웹 검색 결과를 에이전트가 쓰기 좋은 발췌와 맥락으로 반환하도록 최적화했습니다.
- 보안 경계 유지: 별도 검색 벤더 온보딩, 인증, 청구 흐름을 붙이지 않아도 된다는 점을 강조했습니다.
출처: New in Amazon Bedrock AgentCore: Build agents with broader knowledge and continuous learning — AWS Machine Learning Blog
Cloudflare, AI 크롤러를 Search·Agent·Training으로 나눠 제어하게 했습니다
Cloudflare는 모든 고객이 AI crawler를 행동 유형별로 관리할 수 있다고 알렸습니다. AI traffic을 Search, Agent, Training 세 범주로 나눠 검색 유입을 주는 트래픽은 허용하고, 콘텐츠를 학습 목적으로 가져가는 트래픽은 차단하는 식의 선택지를 제공합니다.
- 콘텐츠 소유권 통제: 웹사이트 운영자가 AI traffic을 일괄 차단하지 않고 목적별로 다룰 수 있습니다.
- 에이전트 트래픽 분리: Agent 범주가 별도로 생기면서 자동화된 웹 행동을 기존 검색 크롤러와 구분하기 쉬워집니다.
출처: Application security changelog — Cloudflare Docs
Exabeam, AI 에이전트 행동 분석과 Claude 지원을 보안 플랫폼에 추가했습니다
Exabeam은 autonomous AI agent 위험을 탐지하기 위해 Agent Behavior Analytics, Threat Center, Exabeam Nova 등 보안 기능을 확장했습니다. AI-focused behavioral detection을 90개로 늘리고, ChatGPT·Gemini·Microsoft Copilot·GitHub Copilot에 더해 Anthropic Claude 지원도 추가했습니다.
- agent behavior monitoring: AI 에이전트가 시스템, 사용자, 민감 데이터와 어떻게 상호작용하는지 추적하는 데 초점을 둡니다.
- 오픈소스 telemetry: Observra라는 AI agent telemetry 라이브러리도 공개해 보안 운영 도구로 데이터를 보내기 쉽게 했습니다.
출처: Exabeam Expands Security Platform to Tackle Risks from Autonomous AI Agents — IT News Africa
Hugging Face와 Cerebras, 오픈 speech-to-speech 에이전트 파이프라인을 공개했습니다
Hugging Face의 speech-to-speech 저장소는 VAD, STT, LLM, TTS를 모듈형으로 연결한 저지연 voice-agent pipeline입니다. Cerebras는 Gemma 4 31B를 자사 inference cloud에서 초당 1,800개 이상 토큰으로 실행한다고 설명하며, 음성·시각·에이전트 루프를 더 빠르게 만들 수 있다고 강조했습니다.
- 모듈형 음성 에이전트: Parakeet TDT, OpenAI-compatible LLM, Qwen3-TTS 등 구성 요소를 교체할 수 있습니다.
- 운영 사례: GitHub 저장소는 이 파이프라인이 수천 대의 Reachy Mini 로봇 대화 백엔드로 쓰인다고 설명합니다.
출처: speech-to-speech — GitHub / Hugging Face, Gemma 4 on Cerebras — Cerebras
Cognition, Devin 중심의 자율 코딩 에이전트 가치평가를 다시 끌어올렸습니다
Tech Insider는 Cognition이 260억 달러 post-money valuation으로 10억 달러 이상을 조달했고, 회사 내부 코드의 89 %를 Devin이 작성한다는 주장을 전했습니다. 자율 코딩 에이전트가 보조 도구를 넘어, 실제 제품 개발 조직의 운영 모델로 평가받고 있다는 신호입니다.
- 자본 집중: 투자자들은 단순 autocomplete가 아니라 일을 위임받아 PR까지 여는 agentic workflow에 높은 가치를 매기고 있습니다.
- dogfooding 지표: Cognition의 89 % 코드 작성 주장은 검증이 필요한 수치지만, 시장이 보는 방향성은 분명합니다.
출처: Cognition Hits $26B; Devin Writes 89% of Its Code — Tech Insider
오늘의 도구 추천
speech-to-speech — Hugging Face가 공개한 모듈형 voice-agent pipeline입니다. OpenAI Realtime-compatible WebSocket API를 제공하고, VAD·STT·LLM·TTS 각 단계를 교체할 수 있어 음성 에이전트의 지연시간과 공급자 종속성을 직접 실험하기 좋습니다.
에디터 노트
오늘 눈에 띄는 것은 “에이전트가 가능해졌다”가 아니라 “에이전트를 운영하려면 어떤 계량 장치가 필요한가”입니다. Anthropic의 모델 복구는 안전성 점수와 정부 검증을, GitHub는 세션 로그와 credit 한도를, Cloudflare는 AI traffic 목적 분류를, Exabeam은 agent behavior telemetry를 이야기합니다. 모두 같은 방향입니다. 강한 모델 자체보다, 강한 모델이 조직 안에서 남기는 흔적과 경계를 어떻게 관리할지가 제품 경쟁력이 되고 있습니다.
다음에 또 찾아옵니다. — 에이브랜치