Qwen-Image-3.0 공개: ‘진짜(实)’를 내건 3세대 이미지 모델, 가중치는 아직입니다
알리바바 Qwen 팀이 이미지 생성 3세대 모델 Qwen-Image-3.0을 발표했습니다. 4.5k 토큰 입력, 10px 초소형 텍스트, 12개 언어 렌더링을 앞세웠지만 지금 쓸 수 있는 경로는 Qwen Chat 호스팅뿐이고 가중치도 벤치마크도 공개되지 않았습니다. 확인된 사실과 ...
알리바바 Qwen 팀이 이미지 생성 3세대 모델 Qwen-Image-3.0을 발표했습니다. 4.5k 토큰 입력, 10px 초소형 텍스트, 12개 언어 렌더링을 앞세웠지만 지금 쓸 수 있는 경로는 Qwen Chat 호스팅뿐이고 가중치도 벤치마크도 공개되지 않았습니다. 확인된 사실과 ...
허깅페이스가 2026년 7월 자율 AI 에이전트에 의한 내부 침해를 공개했습니다. 진입로는 악성 데이터셋 하나였고, 데이터셋 처리 파이프라인의 두 취약점이 코드 실행으로 이어졌습니다. 확인된 사실과 아직 조사 중인 부분을 나누고, 데이터셋 처리를 신뢰 경계로 다뤄야 하는 이유를 정...
알리바바가 2.4조 파라미터 규모의 Qwen3.8을 곧 오픈웨이트로 공개하겠다고 예고했습니다. 프리뷰는 이미 테스트할 수 있지만 가중치도 벤치마크도 아직 공개되지 않았습니다. 발표에서 확인된 사실과 아직 주장에 머무는 부분을 구분해 정리했습니다.
메모리 쇼크로 AI 인프라를 소유하는 값은 사상 최고로 치솟는데, 키미 K3와 중국 오픈웨이트가 AI를 쓰는 값을 사상 최저로 끌어내렸습니다. 벌어지는 이 가위 사이에서 승부처는 모델이 아니라 활용률로 옮겨갑니다.
OpenAI가 GPT-5.6 Sol을 두고 사이버 레인지에서 새 기록을 세웠다고 발표했습니다. 프런티어 모델이 실제 공격 체인을 자율로 밟기 시작하면, 승부처는 모델의 성능이 아니라 그 모델을 어디에서 어떤 통제 아래 돌리느냐로 옮겨갑니다.
수직계열화의 상징 애플이 자체 칩을 포기하고 구글 GPU와 중국 라이벌 모델까지 빌립니다. 같은 날 한국은 정반대로 15GW 데이터센터를 소유하려 수십조를 쏟습니다. 두 방향이 가리키는 하나의 결론을 읽습니다.
GPT-5.6이 더 똑똑하냐가 아니라, 그 토큰을 누가 더 싸고 빠르게 서빙하느냐가 마진을 가릅니다. 모델을 나열하는 지도가 건너뛴 다섯 개의 스택 층 - 추론 실리콘, 서빙, 평가, 라이선스, 하니스 - 을 실제 수치로 지도화합니다.
SpaceXAI가 Grok 4.5를 공개했습니다. 코딩과 에이전트를 위해 처음부터 훈련됐고, Opus급 성능을 백만 토큰당 입력 2달러·출력 6달러에 제공합니다. 값싼 에이전트 지능이 만드는 계산의 변화를 ThakiCloud 관점에서 짚습니다.
HBM4가 서버 랙 한 대 값을 2100만 달러로 밀어올리고, SK하이닉스는 하루 만에 40조를 조달했습니다. 자본과 전력이 진짜 병목이 된 지금, 승부는 비싼 컴퓨트에서 증명 가능한 일을 뽑아내는 소프트웨어 층으로 내려가고 있습니다.
같은 날 발표된 두 개의 숫자가 정반대로 움직였습니다. 2100만 달러짜리 AI 랙과 34배 싸진 추론 요금입니다. 이 벌어지는 가위의 한가운데에서 기업이 쥐어야 할 손잡이를 짚어봅니다.