문이 커진 주, 표가 다시 쓰인 주
에이전트를 프로덕션에서 돌리는 팀이라면 이번 주 뉴스를 모델 뉴스가 아니라 표로 봐야 합니다. 실행 비용을 바꾸는 변수가 토큰 단가에서 접근의 조건으로 이동했습니다. 여기서 표는 요금표입니다. 어떤 모델에, 어떤 경로로, 얼마나, 어떤 가격으로 쓸 수 있는지. 에이전트가 모델을 쓸 수 있는 조건 전체가 그 표 위에 올라 있습니다. 이번 주 다이제스트는 두 개의 목록으로 갈립니다. 하나는 커진 것의 목록입니다. 다른 하나는 줄어든 것의 목록입니다. 커진 쪽에는 Grok 4.6의 일반 출시, Astra의 파트너 접근 개방, 에이전트 벤치마크에서 상위까지 오른 오픈소스 모델, 5초에 1대씩 찍힌 로봇 주문이 들어 있습니다. 줄어든 쪽에는 17% 줄어든 코딩 어시스턴트 주간 한도와 11월 12일 종료되는 모델 접근이 놓여 있습니다. 문이 커졌고 표가 다시 쓰였습니다. 둘 다 같은 문장을 가리킵니다. 조건이 움직이면 에이전트 워크로드에 미치는 타격은 균등하지 않습니다.
글의 핵심 개념을 형상화했습니다.
표를 줄이는 두 가지 방식
첫 번째 표 축소는 양의 변경입니다. 앤트로픽은 9월 14일부터 Claude Code 유료 사용자의 사용 한도를 변경합니다. 50%의 일시 증액이 25%의 영구 증액으로 대체됩니다. 두 수치를 더하면 증액이 삭감보다 커 보입니다. 그런데 헤드라인은 이를 주간 한도 기준 17% 축소로 정리합니다. 임시 조치가 끝나자 영구 조치가 더 낮은 수준에 안착했습니다. 17%는 한 번 들으면 작은 숫자입니다. 그런데 에이전트는 사람처럼 중간에 멈추지 않습니다. 한도가 줄면 사람이 체감하는 것은 하루의 끝자락입니다. 에이전트가 체감하는 것은 그 하루 전체입니다. 매일 반복되는 워크플로에 붙은 한도 변경은 단가 변경보다 계산이 단순합니다. 그래서 더 빠르게 예산을 바꿉니다.
두 번째 표 축소는 존재의 변경입니다. 오픈AI는 11월 12일에 코딩 도구 Cursor의 GPT 시리즈 직접 접근을 종료한다고 알렸습니다. 종료 범위에는 Astra 같은 예정된 출시 모델도 포함됩니다. 로드맵에 있는 모델까지 함께 거둬가는 구조입니다. 계획 지평이 바뀝니다. 앞으로 올 모델을 전제로 세운 실행 계획은, 그 전제가 11월 12일에 사라집니다. 오픈AI는 그간의 계약 위반 이력을 이유로 들었고 헤드라인은 이번 조치가 스페이스X 인수와 연관 있다고 전합니다. 하나는 표의 양이 줄어든 사건입니다. 다른 하나는 표 자체를 거둬가는 사건입니다. 두 변경은 같은 주에 일어났고 둘 다 모델 제공사가 일방적으로 결정했습니다. 공통점은 두 사건이 모두 코딩 에이전트를 향한다는 것입니다. 코딩 어시스턴트는 토큰을 가장 많이 쓰는 부류입니다. 한도와 채널은 그 부류에 먼저 작용하는 변수입니다.
벤치가 바꾼 바닥 가격
표가 줄어든 사이, 대안은 자랐습니다. 독립 성능 테스트 Terminal-Bench 4.0에서 오픈소스 GLM-5.3 Max가 GPT-5.6 Max와 Sol을 누르고 3위를 확보했습니다. 헤드라인은 GLM-5.3이 오픈AI의 최고 모델도 앞섰다고 전했고 다이제스트는 이를 프로프라이어티 모델과 로컬 모델 간 경쟁 구도의 이동으로 평가합니다. 3위라는 숫자보다 어떤 과목에서 3위를 했는지가 중요합니다. Terminal-Bench 같은 테스트는 에이전트가 터미널에 직접 손을 대서 일을 끝내는 과목을 재는 시험입니다. 이 시험의 과목은 실행 능력입니다. 프로프라이어티와 로컬이 같은 시험지를 푸는 구도 자체가 이번 주에 새로 그려진 것입니다. 자체로 서빙 가능한 모델이 이 시험에서 상위를 밟았다는 것은 에이전트 모델 후보 풀의 경계가 움직였다는 뜻입니다. 오픈소스 모델이 에이전트 과업에서 성능을 검증받기 시작하면 API 접근의 조건은 더 이상 유일한 선택지가 아닙니다. 대안이 검증받는 순간 표는 협상 대상이 되고 바닥 가격이 바뀝니다.
같은 주에 프로프라이어티 쪽에서도 옵션 세트가 넓어졌습니다. 스페이스XAI는 Grok 4.6을 첫 일반 릴리스로 배포했고 웹, iOS, 안드로이드에서 Fast, Expert, Heavy, Build 네 가지 모드 모두에 적용했습니다. 한 벤더가 같은 모델 안에서 네 개의 등급을 파는 구조입니다. 모드는 표의 칸입니다. 칸이 많을수록 같은 작업이라도 어느 칸에 앉히느냐의 차이가 납니다. 다이제스트는 이번 릴리스가 제한적이었던 코딩 중심의 초점을 더 넓은 용도로 돌렸다고 전합니다. 오픈AI는 9월 3일 출시를 앞두고 Astra의 파트너 접근을 개방했습니다. 내부 독식(dogfood) 단계는 종료됐습니다. 코드네임은 ultima-alpha입니다. 소수 파트너에게 먼저 제공되며 얼리액세스 프로그램은 확대될 계획입니다. 모델이 더 많이 도착하고 각각의 모델은 자기 표를 달고 옵니다. 이때 생기는 질문은 어떤 워크플로에 어떤 모델을 붙일지가 됩니다. 그 질문은 한 번에 끝나지 않습니다. 표가 바뀔 때마다 다시 뜨는 질문입니다.
공급은 랙 단위로 움직인다
하드웨어 쪽도 조건을 다시 쓰고 있습니다. TrendForce 전망에 따르면 엔비디아 차세대 랙 시스템의 합산 출하액은 2027년 710억 달러를 넘습니다. 헤드라인은 이를 7110억 달러, 2025년 대비 8배 증가로 정리했고 연간 증가율은 214%로 전합니다. 인퍼런스 용량의 공급은 랙 단위로, 어떤 계약보다 빠르게 팽창합니다. 기업이 지불하는 API 단가는 이 곡선 위에 올라탄 숫자입니다. 곡선 자체가 8배 움직이면 표는 협상 가능한 값이 됩니다. 여기 비대칭이 하나 있습니다. 소프트웨어 쪽의 조건은 이번 주에 줄었고 하드웨어 쪽의 공급은 여덟 배입니다. 병목이 칩에서 조건으로 이동하는 지형입니다.
실행 표면은 아래로도 넓어졌습니다. 허깅페이스와 Pollen Robotics는 399달러의 오픈소스 로봇 Microduck를 공개했습니다. Thom Wolf에 따르면 공개 직후 수요는 5초에 1대 수준이었고 첫 24시간 동안 260만 달러 규모의 주문이 접수됐습니다. 399달러의 가격표는 물리적으로 실행되는 에이전트에게 주어진 낮은 진입점입니다. 실행 표면은 설계까지 여는 방향으로 넓어집니다. 하드웨어의 진입점은 399달러인데 소프트웨어의 조건은 이번 주에 17%와 11월 12일이라는 칸으로 다시 쓰였습니다. 표면은 넓어지고 조건은 다른 스케일로 바뀝니다. 그 사이는 실행 레이어가 설 자리가 됩니다. 에이전트가 실행되는 장소가 클라우드 API 하나뿐이던 시기는 지났습니다. 표면이 넓어질수록 주문은 조건보다 먼저 도착합니다. 수요가 조건을 앞지르는 시장은 실행 레이어가 미리 서 있어야 하는 시장입니다.
두 종류의 팀
이번 주 뉴스는 두 종류의 팀에 다르게 떨어집니다. 하나는 API 접근을 사서 모델을 쓰는 팀입니다. 그 팀에게 온 것은 한도와 채널입니다. 17%의 주간 한도 축소는 예산 변경 통지였고 Cursor의 접근 종료는 계획 폐기 통지였습니다. 다른 하나는 모델을 스스로 서빙하는 팀입니다. 그 팀에게 온 것은 벤치와 랙입니다. 오픈소스 모델은 이제 에이전트 과업에서 검증됐습니다. 옵션 풀이 두꺼워진 것입니다. 랙 전망은 단가 아래에 있는 비용 곡선이 내려가는 신호입니다. 같은 주의 가격표에서 다른 칸을 체감했습니다. 체감한 칸은 다르지만 확인할 목록은 하나입니다. 내일 바뀌는 조건이 무엇인지, 그것이 바뀌면 어떤 워크플로가 먼저 흔들리는지를 보는 일입니다. 그런데 결론의 방향은 같습니다. 조건이 움직일 때 한쪽에만 서 있는 것이 유일한 리스크입니다. API만 쓰는 팀은 양과 존재에 노출되고 서빙만 하는 팀은 검증과 운영에 노출됩니다. 두 노출을 함께 가리는 것은 모델의 성능이 아니라, 조건을 자기 층에서 다루는 구조입니다. 남은 구조는 두쪽을 동시에 살 수 있는 쪽입니다.
표는 단가가 아니다
실행 비용이 오른다는 말에 대한 통념의 대응은 단가를 협상하는 것입니다. 토큰 단가, 할인율, 사전 구매, 이것이 사람들이 가격표에서 보는 칸입니다. 하지만 이번 주에 움직인 네 가지는 모두 단가 칸 밖에서 일어났습니다. 한 주 안에, 같은 가격표의 다른 칸을 네 번이나 건드렸습니다. 한도의 양, 채널의 존재, 벤치의 대안, 랙의 공급. 단가는 느리게 움직이고 조건은 빠르게 움직입니다. 조건은 협상 테이블을 거치지 않고 일방 발표로 움직입니다. 조건이 움직였을 때 에이전트 워크로드에 타격이 균등하지 않은 이유는 여기에 있습니다. 모델과 한도가 고정된 워크플로는 먼저 부러집니다. 어떤 작업에 어떤 모델을 붙일지를 정책이 정하는 워크플로에서는 움직임이 결정이 됩니다. 그래서 이번 주 뉴스는 표 이야기입니다.
문은 커졌고 표는 다시 쓰였습니다. 기업이 실행해야 할 작업 목록은 바뀌지 않았습니다. 바뀐 것은 그 작업이 실행될지를 정하는 변수의 위치입니다.
조건이 움직였을 때, 누가 정하는가
그 질문에 답하려면 오늘의 네 움직임이 실행 레이어의 어떤 리소스에 닿는지 살펴볼 필요가 있습니다.
Paxis는 ThakiCloud의 Agent-Native Cloud, 정식 제품 v1.1 GA입니다. Skills, Tools, Policies, Audit Logs를 일급 리소스로 다룹니다. 자율도 L0에서 L3까지를 정책 게이트와 감사 로그로 거버넌스합니다. 격리 샌드박스에서 실행을 돌립니다. MCP 커넥터와 스킬 마켓으로 기업 시스템에 연결하고 소버린과 온프레미스 K8s 배포를 제공합니다. CostRouter로 작업마다 모델을 고릅니다.
이번 주 네 움직임은 각각 다른 리소스를 향했습니다. 17% 한도 축소와 Cursor 접근 종료는 Policies가 응답해야 하는 이벤트입니다. 특정 모델의 조건이 바뀌었을 때 어떤 워크플로가 어떤 모델로 남는지는 정책 결정이지 사고가 아닙니다. CostRouter의 작업별 모델 선택은 넓어진 옵션 세트를 실행 비용의 변수로 바꿉니다. 벤치에서 검증된 모델은 비용이 중요한 과업으로 가고 프런티어 모델은 능력이 중요한 과업으로 갑니다. 소버린과 온프레미스 K8s 배포는 채널 리스크에 대한 답입니다. 오픈소스 후보 풀이 자라면 자체 서빙하는 구조가 단일 접근점의 조건에 의존하지 않게 됩니다. Audit Logs는 어떤 스킬이 어떤 모델로, 어떤 정책 아래에서 실행됐는지 기록합니다. 표가 바뀐 날 처음 확인하는 것은 그 기록이고 대응하는 것도 그 기록입니다. 격리 샌드박스는 새 모델을 시험할 수 있는 범위를 정하고 스킬 마켓은 정책 아래 검증된 스킬이 내부로 분배되는 길입니다.
문은 다음 주에도 커질 것이고 표는 다시 쓰일 것입니다. 작업 목록은 바뀌지 않습니다. 남은 질문은 작업을 정하는 조건이 어디에 있는지입니다. 남이 찍은 가격표 위에 있으면 표는 통지이고 자기 정책 층 안에 있으면 표는 변수입니다.
참고 자료
이 글은 아래 뉴스를 종합해 작성했습니다.
- HuggingNews, OpenAI Cuts Cursor Model Access Nov 12 Following SpaceX Acquisition
- HuggingNews, Hugging Face’s $399 Microduck Draws $2.6M Orders in First 24 Hours
- HuggingNews, Anthropic Cuts Claude Code Weekly Limits 17% Despite Permanent 25% Raise
- HuggingNews, OpenAI Opens Astra Partner Access for Sept 3 Launch, Ending Internal Dogfood Stage
- HuggingNews, Open-Source GLM-5.3 Beats GPT-5.6 for 3rd Place on Terminal-Bench 4.0, Outperforming OpenAI Best
- HuggingNews, Nvidia NVL72 Rack Market Projected at $711 Billion by 2027, 8x Jump From 2025
- HuggingNews, SpaceXAI Deploys Grok 4.6 to All Modes in First General Release