← AI 데일리 브리핑

머스크, 멤피스에서 110만 개 GPU 목표…AWS는 엔비디아 칩 200만 개 추가 (September 25, 2026)

September 25, 2026 · 12m 40s · Listen

머스크는 GPU 110만 개, AWS는 200만 개를 부릅니다. 그런데 오늘 가장 불편한 장면은 뉴저지 상공의 드론 한 대가 찍어왔어요. AI 데일리 브리핑입니다. 오늘은 거대한 계획이 전력과 허가라는 벽 앞에 서는 날인데요, 그 벽이 얼마나 높은지가 관건입니다. 말미에는 조용히 코드까지 내놓은 에이전트 논문들도 있습니다. 일단 멤피스부터 뜯어보죠.

디에고 알마다 로페스가 크립토 브리핑에서 전합니다:

일론 머스크는 테네시주 멤피스와 미시시피주 사우스헤이븐 일대에 있는 콜로서스 2 AI 컴퓨팅 클러스터의 확장을 위한 구체적인 일정을 제시하며, 2026년 말 전까지 시설의 엔비디아 칩 수를 두 배 이상 늘리겠다고 약속했습니다. 이번 확장으로 클러스터의 규모는 H100 환산 가속기 110만 개 이상을 향하게 됩니다.

구글 계약서 숫자부터 보죠. 월 9억 2천만 달러, 올해 10월부터 2029년 6월까지 33개월이면 대략 300억 달러입니다. GPU 11만 개로 나누면 한 장에 시간당 11달러 좀 넘게 내는 셈이고요. 머스크 확장 계획에 실제 돈 내는 고객이 붙어 있다는 게 이번에 처음 숫자로 나온 거죠. 앤트로픽도 용량을 확보했고요. 발표만 하고 끝나는 그림은 아닙니다. 근데 목표가 H100 환산 110만 개잖아요. 구글 물량은 그중 10% 정도예요. 나머지 90%는 누가 채우는지, 그건 아직 계획서에만 있습니다. 그리고 전력이요. 지금 이 기가와트급 클러스터를 임시 가스 터빈이랑 테슬라 메가팩으로 기워 붙여서 돌리고 있어요. 연말까지 칩을 두 배로 늘리려면 GPU보다 먼저 '임시'라는 딱지부터 떼야 합니다.

키에론 앨런이 클라우드 워즈에 쓴 내용입니다:

이제 두 거대 기업은 기존 협력을 대폭 확대한다고 발표했습니다. 여러 내용 가운데 가장 눈에 띄는 핵심은 2027년부터 2028년 사이 AWS 인프라 전반에 엔비디아 GPU 200만 개를 추가 배치한다는 점입니다. 아마존에 따르면 목표는 “최첨단 연구소, 글로벌 기업, 스타트업, 정부”에서 급증하는 AI 인프라 수요를 충족하는 것입니다.

AWS 쪽 숫자는 200만 개입니다. 그런데 배치 시점이 2027년에서 2028년이고, 2026년부터 깔겠다고 이미 약속한 100만 개 위에 얹는 물량이에요. 오늘 나온 GPU 가운데 지금 돌아가는 건 한 장도 없다는 얘기죠. 그래도 앞서 본 멤피스 110만 개하고는 결이 좀 다르다고 봐요. 블랙웰 울트라, 루빈, 루빈 울트라까지 세대별로 쪼개 놨고, 수요처로 프런티어 연구소, 기업, 스타트업, 정부를 하나하나 적어 놨습니다. 루빈 울트라는 아직 누구도 실제 워크로드에 돌려본 적이 없는 칩이에요. 3년에 걸쳐 세 세대를 섞어 깔면 저는 이게 궁금합니다. 2028년에 들어가는 한 장이 추론 토큰당 얼마를 받느냐. 그 단가가 안 떨어지면 기업 고객은 굳이 안 옮겨요. 제가 오히려 주목하는 건 정부 쪽이에요. 정부 워크로드용 물량이 10만 장입니다. 공공 부문을 앵커 고객으로 먼저 묶어두는 건데, 아태 지역에 거점을 짓는 코어위브하고 나란히 놓고 보면 클라우드 업체들이 어디서 확실한 수요를 찾고 있는지가 보여요. 정부 계약은 튼튼하죠. 정부 계약서가 변전소를 대신 지어주지는 않지만요. 맞아요. 결국 칩 200만 장을 언제 전력망에 실제로 꽂느냐가 관건인데, 그 문제는 잠시 뒤 뉴저지 소식에서 아주 구체적으로 보시게 될 겁니다.

아스 테크니카에서 전한 내용입니다:

이번 주 뉴저지주는 미국 동부에서 계획된 데이터센터 가운데 가장 큰 규모 중 하나를 운영하는 사업자에게 주 대기오염관리법을 위반해 가스 발전기를 몰래 설치하고 운영한 혐의로 110만 달러의 벌금을 내라고 명령했습니다. 데이터원은 지난 8월 더 가디언과 플러드라이트 뉴스의 조사에서 가스 발전기 62대 가운데 45대가 가동 중인 모습이 열화상 드론 영상에 포착된 뒤 벌금을 부과받았습니다.

GPU 110만 개니 200만 개니 숫자가 커져도, 현장에선 열화상 드론 한 대가 더 많은 걸 말해줍니다. 데이터원 발전기 62대 중 45대가 돌고 있었고, 허가받은 건 0대였어요. 허가 기준은 37킬로와트인데 실제 가동 용량은 1,982킬로와트, 기준치의 50배가 넘었습니다. 앞서 들은 대형 GPU 계획들도 결국 전력과 대기오염 허가를 통과해야 실제 용량이 됩니다. 그리고 여기선 이미 110만 달러짜리 결과가 나왔죠. 발표 수치와 가동 용량 사이를 규제기관이 계산하기 시작했습니다. 해커 뉴스(82점 스레드)에서 나온 의견입니다:

"하지만 빈eland 시장과 시의회가 데이터원에 620만 달러의 대출을 제공하자 즉각적인 반발이 일어났습니다." 이 불쌍한 데이터센터 운영자들에게 정말 도움이 필요한 모양이네요. 지방자치단체가 개발 기금을 쓸 수 있는 모든 사업 가운데 이 사업은 제 우선순위 목록에 절대 들어가지 않을 겁니다.

지방정부 대출이 620만 달러인데 주정부 벌금은 110만 달러라면, 주민들이 개발기금의 우선순위를 묻는 건 너무 당연합니다. 공공 지원은 먼저 들어갔고 환경 비용은 뒤늦게 청구됐으니까요. 해커 뉴스(82점 스레드)에서 나온 의견입니다:

110만 달러를 내고도 가스 발전기를 계속 가동할 수 있다고요? 이건 벌금이라기보다 운영을 위한 소급 적용 허가 수수료라고 해야 더 정확한 것 같습니다.

맞아요. 계속 가동할 수 있다면 110만 달러는 제재보다 비용 항목으로 처리될 가능성이 큽니다. 62대의 운전 중단과 시정 조치가 붙어야 숫자에 이빨이 생겨요. 해커 뉴스(82점 스레드)의 반응입니다:

> 저배출 무소음 연료전지로 전환한다니, 이런 기술이 실제로 존재하나요? 거짓말이 점점 더 대담해지고 있네요.

연료전지는 존재합니다. 다만 ‘저배출’과 ‘무소음’을 한 덩어리로 광고하면, 발전기 허가가 0대였던 사업자의 표현을 곧이곧대로 믿기는 어렵죠.

아카이브의 싱위 우가 전한 내용입니다:

이러한 문제를 해결하기 위해 저희는 정보 요구 사항을 파악하는 플래너와 증거를 변화하는 요약 상태에 통합하는 신시사이저 사이를 오가는, 역할 분리형 요약 기반 패러다임인 IterSynth를 제안합니다. 이 설계는 검색의 지속적인 상태로 요약을 활용하면서 계획과 합성을 분리해, 기능 간 결합과 문맥 잡음을 줄입니다.

앞에서 GPU 백만 장, 이백만 장 얘기만 실컷 했는데요, 저는 오늘 이 논문이 제일 반가웠습니다. 저장대와 텐센트 팀이 낸 IterSynth인데, 검색 기록이 쌓일수록 에이전트가 헤매는 문제를 정면으로 겨눕니다. 구조는 단순해요. 필요한 정보를 짚는 플래너와 증거를 요약으로 엮는 신시사이저를 따로 두고, 전체 검색 기록 대신 그 요약을 상태로 들고 갑니다. 8B 모델로 다섯 개 벤치마크 평균 50.7점, 기존 8B 이하 최고치보다 4.2포인트 높고요. 제가 꽂힌 건 점수보다 요약 상태 쪽이에요. 실서비스에서 긴 체인이 무너지는 이유가 딱 그 문맥 잡음이거든요. 다만 제가 확인하고 싶은 건 평균보다, 일곱 번째 턴쯤에서 오답이 얼마나 나오느냐입니다. 전 4.2포인트보다 다른 줄이 더 눈에 띄던데요. 재학습 없이 프롬프트 방식만으로 다른 모델에도 붙는다는 부분이요. 파인튜닝을 누가 쥐고 있든 가져다 쓸 수 있다는 얘기니까, 멤피스 클러스터 없는 팀한테는 이쪽이 훨씬 실용적인 뉴스입니다. 8B면 추론 단가도 착하고요. 이번 주에 코드랑 결과를 같이 내놓은 에이전트 논문은 이게 거의 유일합니다. 그러니 이건 직접 돌려보면 되는 얘기죠.

아카이브의 예항 장이 전한 내용입니다:

LIBERO-90만을 활용해 발전시킨 기술을 사용한 WAA는 LIBERO-Pro에서 평균 성공률 75.6%라는 최신 최고 수준의 성능을 달성했습니다. 이는 동일한 백본을 사용하는 엔드투엔드 VLA, 정책으로서의 코드 에이전트, 시각적 하네스 기준선을 앞선 결과입니다. 또한 같은 기술은 추가 학습 없이도 robosuite에서 계속 효과를 보였습니다.

이건 제가 먼저 잡겠습니다. 월드액션에이전트, 핵심이 '액션 리허설'이에요. 로봇이 움직이기 전에 동작 하나하나를 수정 가능한 제안으로 띄워놓고, 계획 피드백을 받아서 미리 고친 다음에 실행합니다. 긴 작업에서 중간 단계가 틀어지는 걸 실행 전에 걸러보겠다는 설계죠. 리베로 프로에서 평균 성공률 75.6%. 같은 백본을 쓴 비주얼 하네스 기준선도 넘었다고 합니다. 방금 앞에서 GPU 200만 개, 110만 개 얘기를 줄줄이 했는데, 정작 검증해볼 수 있는 결과는 아카이브에 조용히 올라와 있네요. 그런데 75.6%면 네 번에 한 번은 실패한다는 뜻이에요. 저는 오히려 리베로-90에서만 익힌 스킬이 추가 학습 없이 로보스위트에서도 통했다는 대목이 더 반갑습니다. 환경이 바뀌어도 버틴다는 거니까요. 하나 더 있습니다. 이 하네스에서 쌓인 상호작용 기록으로 큐웬 3.5 90억 파라미터 모델을 파인튜닝했어요. 결국 큰 모델이 먼저 길을 닦고, 작은 모델이 그 길을 이어받는 구조입니다. 누가 이 파인튜닝 파이프라인을 쥐느냐가 이 분야의 판도를 가를 겁니다. 작은 모델로 같은 하네스를 돌릴 수 있다면 추론 비용 계산이 확 달라지죠. 그 숫자가 제대로 나오면, 저는 진심으로 박수 칠 준비 돼 있습니다.

오늘 브리핑이 유익하셨다면, 듣고 계신 곳에서 구독하거나 리뷰를 남겨 주세요. 여러분의 리뷰는 더 많은 사람들이 AI 데일리 브리핑을 발견하는 데 큰 도움이 됩니다.

멤피스 클러스터에서 구글이 체결한 월 약 9억 2천만 달러 규모의 컴퓨팅 계약은 2026년 10월 시작될 예정입니다. 콜로서스 2가 2026년 말까지 H100 환산 가속기 110만 개를 넘어설지도 지켜보겠습니다.

오늘 전해 드린 모든 이야기의 링크는 쇼 노트에 정리해 두었습니다. 관심이 갔던 내용은 링크를 통해 자세히 확인해 보시기 바랍니다. 다음 에피소드에서 뵙겠습니다. AI 데일리 브리핑이었습니다. 랜턴 팟캐스트입니다.