← AI 데일리 브리핑

GPT-6 아스트라, ARC-AGI-3 기록 두 배…독일 콜리브리 오픈 웨이트, AMD 헬리오스 첫 12억 달러 주문 (2026년 10월 5일)

2026년 10월 5일 · 8분 3초 · 에피소드 듣기

지난 7월에 세운 최고 기록을 두 배 넘게 뛰어넘은 점수가 나왔습니다. 그런데 그 평가를 한 번 돌리는 데 2만 6,000달러 가까이 들었다고 하네요. 월요일 AI 데일리 브리핑, 용규입니다. 오늘은 GPT-6 아스트라의 ARC-AGI-3 점수에 이어, 독일 알레프 알파의 오픈 웨이트 모델 콜리브리, 엔비디아에 도전하는 AMD 헬리오스 랙의 첫 대형 주문, 그리고 한국 투자자들도 이름을 올린 GMI 클라우드의 자금 조달까지 살펴봅니다. 오늘 방송이 도움이 되셨다면 팔로우해 주세요. 먼저 오픈AI의 새 모델부터 보죠.

스타트업 포춘 보도입니다:

ARC 프라이즈는 표준 하니스에서 GPT-6 아스트라를 ARC-AGI-3 세미 프라이빗 부문에서 62.7%로 평가했습니다. 전체 평가를 한 번 수행하는 데 약 2만 6,000달러가 들도록 모델을 최대 추론 모드로 실행한 결과입니다. 이 점수만으로도 이전 프런티어 모델의 기록을 두 배 이상 웃돕니다. 클로드 오퍼스 5는 7월에 30.2%로 잠시 선두를 차지했고, 오픈AI의 직전 주력 모델인 GPT-5.6 솔은 7.8%를 기록했습니다.

정리하면, 7월에 클로드 오퍼스 5가 30.2퍼센트로 잠시 선두에 섰고, 이번에 아스트라가 62.7퍼센트로 그 기록을 두 배 넘게 끌어올렸습니다. 오픈AI 직전 주력 모델인 GPT-5.6 솔은 7.8퍼센트였고요. 저는 숫자 하나가 더 눈에 들어와요. 최대 추론 모드로 돌려서 전체 평가 한 번에 약 2만 6,000달러입니다. 점수가 두 배인 건 인상적이지만, 실제 서비스에서는 그 비용을 누가 내느냐가 먼저예요. 같은 문제를 훨씬 싸게 푸는 모델이 나오면 기업 계약은 그쪽으로 갑니다. 저도 벤치마크 순위표는 늘 조심해서 봅니다. 다만 이번 점수는 오픈AI가 자체 발표한 게 아니라 ARC 프라이즈가 표준 하니스에서 직접 평가한 결과라는 점에서 무게가 다릅니다. 직전 주력 모델과 비교하면 7.8에서 62.7로 뛴 셈이니까요. 결국 남은 질문은 이 능력이 여러분이 실제로 맡기는 일에서도 그만큼 나아지느냐입니다. 그건 점수표가 아니라 직접 써 본 사람들이 답하겠죠.

트레이토리의 분석입니다:

허용적인 라이선스, 허깅페이스의 전체 체크포인트, 100만 토큰 컨텍스트, 이중언어 토크나이저는 입증 가능한 부분입니다. 입증되지 않은 부분은 이 모델이 활성 규모가 최대 네 배인 모델들과 경쟁한다는 주장으로, 콜리브리가 가장 강하게 내세우는 근거이기도 합니다.

독일의 알레프 알파가 10월 3일 토요일, 독일 통일의 날에 맞춰 공개한 모델입니다. 영어와 독일어를 함께 다루는 혼합 전문가 구조로, 전체 매개변수는 780억 개지만 활성 매개변수는 30억 개입니다. 가중치는 허깅페이스에 전부 공개됐고, 아파치 2.0 라이선스로 쓸 수 있습니다. 활성 매개변수 30억 개라면 돌리는 비용은 꽤 가벼울 겁니다. 그 크기로 덩치가 몇 배 큰 모델과 겨룬다는 게 회사 주장인데, 트레이토리 지적처럼 그건 아직 입증되지 않았어요. 자체 평가표만 들고 나온 성능 주장은 저도 일단 보류입니다. 알레프 알파가 내세우는 건 성능보다 주권입니다. 공공 행정, 산업, 항공우주처럼 규제가 많은 분야의 핵심 업무용으로 만들었고, 독일어와 추론, 수학, 에이전트 기능에 특화했다고 밝혔습니다. 저는 오픈이냐 폐쇄냐보다 미세조정과 추론 인프라를 누가 쥐느냐가 중요하다고 보는데, 유럽 공공기관 입장에서는 바로 그 통제권이 핵심이겠죠. 개발 과정도 흥미롭습니다. 먼저 총 300억 개 매개변수에 컨텍스트 6만 5,000토큰짜리 콜리브리 오리진으로 학습 파이프라인을 검증하고, 같은 파이프라인으로 콜리브리를 만들었다고 해요. 외부 검증 결과가 나오면 다시 짚어 보겠습니다.

스토리지리뷰 보도입니다:

HPE가 AMD 헬리오스 AI 랙의 첫 주문을 확보했습니다. 벌트르가 미국 내 자사 클라우드 데이터센터에 72 GPU 랙을 배치하기로 약정한 금액은 12억 달러입니다.

HPE는 9월 30일 수요일 이 계약을 발표했고, 같은 날 미국 증권거래위원회 공시에도 올렸습니다. 지금까지 사양과 협력 발표로만 존재하던 헬리오스가 처음으로 실제 상업 고객을 얻은 셈입니다. HPE는 AMD 컴퓨팅에 개방형 소프트웨어, 이더넷 네트워킹, 액체 냉각, 배포 서비스까지 묶은 통합 랙을 공급합니다. 핵심은 비교 대상이죠. 엔비디아의 베라 루빈 NVL72도 GPU 72개를 하나의 랙 단위 컴퓨팅으로 묶습니다. 차이는 연결 방식인데, 엔비디아는 NVLink 같은 독자 기술로 스택을 더 많이 쥐고 있고, AMD와 HPE, 주니퍼, 브로드컴은 표준 이더넷을 더 개방적인 길로 내세웁니다. 기사도 이 차이가 단일 최고 성능 수치보다 중요하다고 봅니다. 랙 단위 시스템은 가속기, 메모리, 네트워크, 냉각, 소프트웨어까지 한꺼번에 안정적으로 돌아가야 하니까요. 지난 토요일에도 말씀드렸지만, 저는 모델 발표보다 이런 인프라 이야기가 더 오래 간다고 봅니다. 다만 12억 달러는 시작일 뿐이에요. 개방형 연합이 실제 프로덕션 클라우드에서 엔비디아만큼 매끄럽게 돌아가는지는 벌트르 고객들이 써 보고 나서야 알 수 있습니다.

로보틱스비즈니스뉴스 보도입니다:

고성능 GPU 인프라와 추론 서비스를 제공하는 AI 네이티브 클라우드 기업 GMI 클라우드는 6억 6,800만 달러 규모의 신규 자금 조달을 발표했습니다. 여기에는 2억 2,300만 달러 규모의 시리즈 B 지분 투자와 CTBC가 주도한 4억 4,500만 달러 규모의 신용 대출이 포함됩니다. 시리즈 B 투자는 AI와 로보틱스에 특화된 샌프란시스코 기반 신생 투자사 아카이브가 주도했으며, 엔비디아도 참여했습니다.

국내 청취자분들이 눈여겨볼 대목은 투자자 명단입니다. 아시아·태평양 투자자들이 대거 참여했는데, DSC인베스트먼트, 트렌드마이크로, KB인베스트먼트, 교보생명, KT 등이 이름을 올렸습니다. 자금은 미국과 대만, 아시아·태평양 지역의 용량 확대, 그리고 추론 서비스와 채용에 쓰인다고 합니다. 성장 수치도 공개했어요. 계약 기준 연간 반복 매출이 2025년 말보다 9배 넘게 늘었고, 실제 운영 중인 매출도 4.5배 넘게 늘었답니다. 추론 플랫폼이 처리하는 토큰은 일주일에 약 4조 개고요. 그런데 6억 6,800만 달러 가운데 3분의 2가 대출이라는 점도 같이 보셔야 합니다. 엔비디아가 투자에 참여했다는 점도 짚어 두죠. 지난 토요일 전해드린 엔비디아의 텍사스 데이터센터 임차 보도처럼, 엔비디아가 GPU 클라우드 생태계에 직접 돈을 넣는 그림입니다. 오늘 두 인프라 소식을 나란히 놓으면, 한쪽은 엔비디아가 클라우드 기업에 투자하고, 다른 쪽은 AMD 진영이 클라우드 기업의 12억 달러짜리 약속을 얻어 낸 셈이고요. 순환 투자 우려가 여기서도 떠오르긴 합니다. 다만 GMI는 파이어웍스, 오픈라우터, 노스 리서치 같은 실제 고객을 공개했으니, 매출이 계속 따라오는지 지켜보면 되겠죠.

오늘 브리핑이 유익하셨다면, 듣고 계신 앱에서 짧은 리뷰를 남겨 주세요. 더 많은 분들이 이 프로그램을 찾는 데 큰 힘이 됩니다.

오늘 다룬 모든 이야기의 링크는 쇼노트에 정리해 두었습니다. 관심이 가신 소식은 원문도 함께 읽어 보세요. 내일 화요일에 다시 찾아오겠습니다. 한 주 힘차게 시작하세요. 지금까지 AI 데일리 브리핑이었습니다. 랜턴 팟캐스트입니다.