직원급 접근 권한, 외부인에게 내어주다
지난 며칠간 상위 뉴스에서 가장 자주 나온 단어를 하나만 고르라면, ‘접근’입니다. OpenAI는 외부 안전 검토자에게 직원과 같은 수준의 접근을 약속했습니다. 같은 날 Anthropic은 METR에 직원급 영구 접근 권한을 부여했습니다. 그리고 같은 주, 이 회사는 과학자의 Claude 계정을 생물무기 위험 이유로 차단했습니다. 접근 권한을 내어주고 또 거둬들였습니다. 이 한 단어가 조용히 업계의 신뢰 단위로 이동하고 있는 셈입니다. 약속, 상시 합의, 이니셔티브, 차단. 형태가 다른 네 사건이 하나의 단어를 중심으로 일어났습니다.
글의 핵심 개념을 형상화했습니다.
직원급 접근
OpenAI의 이번 약속은 직선적입니다. 이 회사는 독립 안전 평가자와 외부 검토자에게 직원과 비교할 만한 수준의 접근을 제공하기로 했습니다. 이 약속은 Sam Altman이 Anthropic CEO Dario Amodei의 주장을 지지하는 흐름 속에서 나왔습니다. OpenAI는 Anthropic을 따릅니다. Anthropic이 먼저 상시적 합의로 만든 것을, OpenAI는 회사 차원의 약속으로 옮긴 것입니다. 한 회사의 관행으로 선례가 서면, 다른 회사의 약속은 그것을 인정하는 행위입니다.
‘직원급’이라는 말 자체가 멈춤을 요구합니다. 접근의 수준을 자기 직원으로 재단한다는 표현입니다. 얼마나 열 수 있는지를 외부의 기준이 아니라 내부 인력이 보는 범위로 정합니다. 밖을 안쪽과 같은 자리에 놓는다는 전제가 담긴 기준입니다.
Amodei의 주장은 명확했습니다. AI 연구소가 안전 프로토콜이 성능 향상의 속도를 따라갈 수 있도록 모델 개발 속도를 낮추라는 것이었습니다. Elon Musk도 개발 속도 조절과 외부 평가자 도입이라는 같은 주장을 지지했습니다. 두 주장이 바라보는 문제는 같습니다. 하나는 속도를 보고 다른 하나는 감시를 봅니다. 둘 다 능력에 따라가지 못하는 안전을 걱정합니다. 두 주장이 가리키는 답은 같습니다. 내부에서 일어나는 것을 외부에서 보게 하라는 것입니다.
Anthropic의 합의에는 또 다른 디테일이 있습니다. ‘영구’라는 말입니다. 이 회사는 METR(Model Evaluation and Threat Research)와 얼라인먼트·미스얼라인먼트 사건의 독립적 조사를 위한 합의를 체결했고 METR에 직원 수준의 영구 접근 권한을 부여했습니다. 얼라인먼트 사건은 모델이 의도대로 움직이지 않은 사건이고 미스얼라인먼트는 방향 자체가 어긋난 사건입니다. 그런 사건의 독립 조사는 사건이 일어난 현장에 들어가지 않으면 불가능합니다. 이 조치는 METR에게 회사 안에 상시로 두는 자리를 줍니다. 한 번 주어지면 계속 유효한 접근입니다. 일회성 감사에는 영구라는 말을 쓰지 않습니다.
Hugging Face의 외부 안전 연구자들도 9월 12일, 프런티어 랩의 모델 개발 방식을 겨냥한 투명성 이니셔티브 Open Alignment Initiative를 시작합니다. 이 이니셔티브는 Anthropic의 안전 프로그램에 합류합니다. 모델을 호스팅하는 플랫폼 스스로가 투명성의 질문을 꺼낸 것이 세 번째 형태입니다. 공개 생태계에는 나뉘어 있던 두 원이 연결되는 신호입니다. 오픈 플랫폼의 투명성 이니셔티브와 프런티어 랩의 안전 프로그램이 이제 한 틀을 공유합니다.
세 회사, 세 가지 형태입니다. OpenAI의 약속, Anthropic과 METR의 합의, Hugging Face의 이니셔티브. 방향은 같습니다. 셋을 함께 읽으면 성숙의 순서가 보입니다. 먼저 상시 합의가 선례를 세우고 회사 차원의 약속이 그것을 인정하며 제3자의 이니셔티브가 흐름에 합류합니다. 안전은 오랫동안 랩들이 스스로 들려준 이야기였습니다. 이제 외부인이 확인할 수 있는 것으로 바뀌고 있습니다. 직원급 접근은 직원이 보는 것을 외부인도 보라는 뜻입니다. 신뢰가 자기 선언에서 검증 가능한 접근으로 이동하고 있습니다.
NotebookLM이 소스를 종합해 생성한 인포그래픽입니다.
양쪽으로 도는 다이얼
차단은 별개의 사안이 아닙니다. Anthropic은 목요일, 과학자들의 Claude 계정을 차단했다고 밝혔습니다. 해당 연구자들은 Claude의 안전장치를 우회하는 동안, 무기와 연계될 수 있는 생물학 연구를 진행하고 있었습니다. 안전장치는 첫 번째 선이고 계정은 두 번째 선입니다. 첫 번째 선이 우회되었고 대응은 두 번째 선을 끊는 일이었습니다. 그리고 같은 주, 이 회사는 METR에 접근 권한을 내어주었습니다. 기준은 누가 요청하느냐가 아니라, 문의 다른 쪽에 어떤 위험이 놓여 있는가입니다.
접근 권한은 다이얼입니다. 위험에 따라 실시간으로 올리고 내립니다. 문제는 돌리는 순간입니다. 누가, 무엇을, 언제, 어떤 이유로 접근했는지가 로그에 남아야 합니다. 로그가 없으면 접근 차단 행위는 믿어봐야 할 진술에 그칩니다. 이력이 있는 순간, 같은 행위는 검증 가능한 것이 됩니다. 약속과 차단과 합의, 오늘 뉴스의 사건들은 전부 접근 결정입니다. 부여와 차단을 함께 보면, 접근은 이제 부여되고 거두어지고 감사될 수 있는 거버넌스 구조라는 것을 보여줍니다. 모델 계층에서 접근 결정이 실시간으로 이루어지는 지금, 그 로그 자체가 제품이 됩니다. 이번 주의 부여와 이번 주의 차단, 둘 다 같은 요구를 받습니다. 왜 그랬는지를 설명하고, 그 근거를 남겨야 합니다.
기록적인 돈이 움직이는 사이
뉴스 상단에는 접근이 가득한데, 하단에는 돈이 있습니다.
Anthropic은 2조 달러 밸류에이션으로 1000억 달러 IPO를 추진하고 있습니다. 역사상 최대 규모의 발행입니다. 유출된 S-1 표지는 11월 중간선거 이전 공개 시장 데뷔 완료를 겨냥한 준비를 드러냈습니다. 1000억 달러라는 조달은 행처가 있습니다. 앞으로 모델이 소비할 컴퓨트입니다. Nvidia는 이번 발행의 앵커 투자자로 참여를 논의 중이며 최대 100억 달러 출자를 검토 중입니다. AI에 컴퓨트를 공급하는 GPU 제조사가 그것을 소비하는 회사의 앵커가 될 논의입니다.
OpenAI는 반대편에 서 있습니다. CEO Sam Altman은 Fortune에 2026년 IPO가 없다고 말했습니다. 회사의 가치는 1.6조 달러 수준이고 Altman은 현 시기를 IPO에 부적절하다고 평가했습니다. 비공개 체제에 머무는 1.6조 달러 회사의 자금 조달은 여전히 사모시장의 몫입니다.
두 프런티어 랩, 하나는 공개 시장으로 달려가고 다른 하나는 물러서 있습니다. 하나는 역사상 최대 IPO를 겨냥하고 다른 하나는 2026년을 명시적으로 건너뜁니다. GPU 제조사는 공개 시장으로 달려가는 쪽의 앵커 투자자로 논의되고 있습니다. 같은 업계에서 공개 시장으로 가는 속도를 다르게 정하고 있습니다. 하나는 이제라고 하고 다른 하나는 아직이라고 합니다. 컴퓨트 경쟁을 어떻게 자금으로 버틸 것인가에 대한 두 회사의 답은 아직 하나로 수렴하지 않았습니다.
칩에도 비슷한 크기의 격차가 있습니다. SemiAnalysis는 DeepSeek V4.1 Flash를 분석해, Nvidia의 달러당 성능이 AMD 대비 최대 42배까지 나온다고 밝혔습니다. AMD는 Nvidia의 CUDA 버전 vLLM이 해당 모델을 지원한 지 이틀 뒤, 이 모델 실행용 소프트웨어 이미지를 공개했습니다. 이틀이라는 격차는 날짜로는 작고 원가로는 큽니다. 달러당 성능을 가르는 격차는 대부분 실리콘 위에 깔린 소프트웨어 스택에 쓰여 있습니다. 정확한 측정 조건을 따져볼 여지가 있지만, 범위가 그만큼 넓다는 사실 자체는 중요합니다. 이 격차가 운영자에게 무엇을 뜻할까요. 같은 모델, 같은 워크로드. 하드웨어와 스택 선택에 따라 비용이 최대 42배까지 벌어질 수 있습니다. 하드웨어와 모델의 선택은 예산 문제가 됩니다. 범위가 최대 42배라면, 그 선택은 한 달 치 마진의 문제가 아니라 연간 예산의 문제인 셈입니다.
같은 시간, 프런티어 서비스 자체도 되돌려야 했습니다. OpenAI는 품질 저하 이후 Codex와 ChatGPT Work에 ‘Astra 리셋’을 발령했습니다. 이 회사는 4,000~5,000명 사용자에게 영향을 준 컨텍스트 관리 실험을 비활성화했고 잘못 구성된 엔진도 제거했습니다. 컨텍스트 관리 실험은 서비스의 심장을 만지는 구성입니다. 잘못 구성된 엔진은 서빙 경로에 섞여 있던 문제인 셈입니다. 프런티어 서비스조차 둘을 동시에 되돌려야 했습니다. 4,000~5,000명이라는 실험 규모는, 저하가 제한된 범위 안에서 되돌려졌음을 보여주는 숫자입니다.
며칠 사이, 두 방향입니다. 접근 뉴스는 전부 문을 여는 방법에 대한 것이고 돈 뉴스는 얼마나 멀리 갈 수 있는가에 대한 것입니다.
실행 플랫폼이 이미 답하고 있는 질문
모델 랩들이 지금 마주한 질문은, 실행 계층에서는 이미 오래된 답입니다. 누가 어떤 접근을 어떤 조건에서 갖고 그것을 나중에 어떻게 증명하느냐. 에이전트 실행 플랫폼은 이것을 일상으로 처리해 왔습니다. 답이 오래된 이유는 간단합니다. 에이전트는 누군가의 인프라 위에서, 누군가의 자격증명을 가지고 움직입니다. 실행 플랫폼은 다른 모든 것 전에 접근을 정해 왔습니다. 차이는 빈도입니다. 업계의 접근 논쟁은 주에 한 번 옵니다. 실행 계층의 접근 결정은 에이전트가 작업을 돌릴 때마다 옵니다.
Paxis는 ThakiCloud의 Agent-Native Cloud로, v1.1 GA 이후 정식 제품입니다. 여기서 접근 권한은 리소스로 다뤄집니다. Skills, Tools, Policies, Audit Logs, 넷 모두 일급 리소스입니다. 어떤 스킬이 어떤 도구와 어떤 정책 하에서 실행되는지는 미리 선언되고, 나중에 기록됩니다. 외부인에게 직원과 같은 접근을 주라는 약속은, 실행 계층에서 보면 자신의 에이전트와 시스템에 누가 어떤 접근을 갖을지를 정하는 일상적 행위입니다.
앞 섹션의 메커니즘은 Paxis의 L0~L3 자율도 거버넌스 안에서 움직입니다. 신뢰하는 워크로드의 자율도는 올리고 민감한 워크로드는 낮춥니다. 자율도가 오를 때와 내릴 때, 그 모든 순간은 정책 게이트를 지나고 각 결정은 감사 로그에 기록됩니다. 감사 로그는 앞의 나중에 어떻게 증명하느냐는 질문에 대한 직접적인 답입니다. 업계가 지금 손으로 돌리는 메커니즘이, 여기서는 스스로 돌며 이력을 남기는 시스템입니다.
앞의 생물무기 이야기는 실행 계층에서 격리가 답이었습니다. 격리 샌드박스 실행이 고위험 작업을 담고 감시하는 구조입니다. 42배 성능-원가 격차도 여기 자리를 찾습니다. 작업별 모델 선택 CostRouter가 각 작업마다 어떤 모델이 돌리느냐를 정합니다. 모든 작업에 하나의 모델을 붙이는 대신, 작업마다 다른 모델을 씁니다. 원가 격차가 42배라면, 그 결정은 예산 문제입니다. 소버린/온프렘 K8s(ai-platform)은 같은 거버넌스를 내 경계 안에서 돌립니다. 접근 관리는 자기 데이터센터 안에서 끝내는 일입니다. 모델 랩의 반응보다 먼저, 자기 시스템의 답부터 정할 수 있습니다. MCP 커넥터와 스킬 마켓은 외부 시스템의 접속 지점을 제공합니다.
열쇠가 외부인에게 넘어가고 있습니다. 모델 계층에서는 그것이 아직 마케팅 수입니다. 실행 계층에서는 오래전부터 아키텍처였습니다.
NotebookLM이 소스를 종합해 생성한 인포그래픽입니다.
참고 자료
이 글은 아래 뉴스를 종합해 작성했습니다.
- HuggingNews, OpenAI Pledges Outside AI Safety Reviewers the Same Access as Employees
- HuggingNews, Elon Musk Backs Anthropic CEO Call for AI Slowdown and External Evaluators
- HuggingNews, Nvidia Delivers Up to 42 Times AMD’s DeepSeek Performance per Dollar, SemiAnalysis Says
- HuggingNews, Anthropic Blocks Scientists’ Claude Access Over Bioweapons Risks
- HuggingNews, Sam Altman Rules Out 2026 OpenAI IPO for $1.6 Trillion Firm
- HuggingNews, Hugging Face Launches Open Alignment Initiative to Join Anthropic Safety Program
- HuggingNews, Anthropic Targets $100 Billion IPO at $2 Trillion Valuation for Largest Offering in History
- HuggingNews, Anthropic Targets $100 Billion Raise in Largest IPO With $10 Billion Nvidia Investment
- HuggingNews, OpenAI Issues Astra Reset for Codex and ChatGPT Work After Fixing Quality Degradation
- HuggingNews, Anthropic Grants METR Permanent Employee Level Access for AI Incident Probe