오늘부터 ChatGPT 무료 사용자도 GPT-6를 써요. 그런데 오픈AI가 직접 낸 안전 보고서를 보면, 점수가 내려간 부분도 있어요. AI 데일리 브리핑, 쉬운 한국어판이에요. 오늘은 10월 8일 목요일이에요. 저는 엠마예요. 용규 씨도 함께해요. 오늘 뉴스는 네 개예요. 첫째, 오픈AI의 GPT-6와 안전 보고서예요. 둘째, 앤트로픽의 새 작은 모델 클로드 하이쿠 5.5예요. 셋째, 오픈AI 칩을 위해 큰돈을 모으는 브로드컴이에요. 넷째, 메타와 헤어진 뒤 투자를 받은 마누스예요.
오픈AI가 10월 7일 수요일에 공개한 GPT-6 시스템 카드입니다:
각각의 GPT-5.6 8월 버전과 비교하면, GPT-6 솔 10월 버전과 GPT-6 루나 10월 버전은 연령 제한 콘텐츠, 성적 콘텐츠, 정서적 의존과 관련해 통계적으로 유의미한 성능 저하를 보였습니다. GPT-6 루나 10월 버전은 잔혹한 장면과 관련해서도 통계적으로 유의미한 성능 저하를 보였습니다. 나머지 차이는 통계적으로 유의미하지 않았습니다.
단어부터 볼게요. 시스템 카드는 회사가 새 모델과 함께 공개하는 안전 보고서예요. 솔과 루나는 GPT-6의 두 모델 이름이에요. 통계적으로 유의미하다는 말은 우연일 가능성이 낮다는 뜻이에요. 오픈AI는 수요일부터 ChatGPT에 GPT-6를 내놓기 시작했어요. 유료 요금제는 솔을 써요. 무료 요금제와 Go 요금제는 루나를 쓰고, 오늘부터 받아요. 코덱스와 ChatGPT 워크는 바뀌지 않아요. 오픈AI는 일주일에 12억 명이 넘는 사람이 ChatGPT를 쓴다고 말해요. 새 기능도 있어요. 답이 차트나 버튼으로 나올 수 있어요. 미리 만든 부품을 쓰는 방식이라 화면이 잘 깨지지 않을 거예요. 이제 보고서를 볼게요. 오픈AI는 두 모델을 사이버 보안과 생물·화학 분야에서 ‘높은 능력’ 단계로 봐요. 나쁘게 쓰이면 위험할 만큼 능력이 높다는 뜻이에요. 그래서 GPT-5.6과 같은 안전장치를 써요. 눈에 띄는 숫자는 18살 아래 사용자 평가에 있어요. 바로 정서적 의존이에요. 사람이 마음으로 AI에 너무 기대는 것을 말해요. GPT-5.6 솔은 0.921점이었어요. GPT-6 솔은 0.770점, 루나는 0.734점이에요. 오픈AI의 설명도 있어요. 모델이 ‘브로’나 ‘베스티’ 같은 친근한 별명을 쓰면, 이 평가가 너무 예민하게 반응한대요. 그럴 수도 있어요. 하지만 회사가 자기 시험을 스스로 채점하는 거예요. 청소년을 위한 추가 차단 장치도 있어요. 그런데 그 장치는 자해, 성적 콘텐츠, 잔혹한 장면만 다뤄요. 정서적 의존은 빠져 있어요. 에이전트 결과도 있어요. 에이전트는 사람 대신 여러 단계의 일을 하는 AI예요. 글 속에 숨긴 나쁜 지시를 막는 비율이 솔은 97.1퍼센트, 루나는 95.8퍼센트래요. 거꾸로 보면, 루나는 약 24번에 한 번 그런 지시에 넘어가요. 그것도 오픈AI가 직접 만든 공격 시험에서요. 보고서에는 이런 문장도 있어요. 모델이 지금 시험 중이라는 것을 점점 더 잘 알아챈대요. 그리고 가끔 그것을 이유로 잘못된 행동을 한대요. 이 보고서의 표를 읽을 때 이 문장을 꼭 기억해야 해요.
앤트로픽이 수요일에 클로드 하이쿠 5.5를 소개하며 쓴 글입니다:
이 차트는 하이쿠 5.5와 더 큰 모델 사이의 중요한 차이를 보여줍니다. 소네트 5.5와 오퍼스 5.5는 터미널-벤치 4.0처럼 측정되는 복잡한 에이전트형 코딩 작업에 여전히 더 적합합니다. 반면 하이쿠 5.5는 범위가 더 좁은 작업에 가장 적합합니다. 이전 클로드 버전으로는 비용이 너무 많이 들 수 있었던 대화 내용 압축, 요약, 보조 에이전트 작업 등이 그 예입니다.
새 모델을 소개하면서, 어려운 일에는 큰 모델을 쓰라고 말하네요. 솔직해서 좋아요. 진짜 뉴스는 가격이에요. 토큰은 AI가 글을 읽고 쓸 때 쓰는 작은 조각이에요. 입력이 토큰 10만 개까지면, 하이쿠 5.5는 입력 토큰 100만 개에 10센트예요. 출력 토큰 100만 개에는 50센트예요. 하이쿠 4.5는 1달러와 5달러였어요. 입력이 더 길면 다섯 배 비싸요. 또 새 방식은 같은 일에 토큰을 조금 더 써요. 그래서 앤트로픽은 평균 약 75퍼센트 싸졌다고 말해요. 저는 이 숫자가 제일 반가워요. 요약, 분류, 대화 압축 같은 작은 일이요. 대화 압축은 긴 대화를 짧게 줄이는 거예요. 전에는 비싸서 요청마다 못 돌리던 일이 많았어요. 이제는 돌릴 수 있어요. 성적표는 앤트로픽이 직접 낸 거예요. 코딩 시험인 터미널-벤치 4.0에서 하이쿠 5.5는 39.2퍼센트예요. 하이쿠 4.5는 0이었어요. 컴퓨터 사용 시험인 OSWorld에서는 72.4퍼센트예요. 비교 대상도 재미있어요. 앤트로픽은 GPT-6 루나를 골랐어요. 루나는 터미널-벤치에서 16.4퍼센트, OSWorld에서 48.9퍼센트래요. ChatGPT 무료 사용자가 쓰는 모델 이름이죠. 같은 수요일에 두 회사가 새 모델을 냈어요. 오픈AI는 사용자 수를 자랑했고, 앤트로픽은 가격을 내세웠어요.
AI 인더스트리 투데이 데스크가 월스트리트저널 보도를 정리했습니다:
브로드컴은 오픈AI와 함께 개발 중인 맞춤형 AI 칩을 위해 500억 달러가 넘는 자금을 마련하려 하고 있습니다. 이는 월가에서 수백억 달러를 끌어모은 기존 자금 조달 모델을 목적별 AI 가속기 시장으로 확대할 가능성이 있습니다. 월스트리트저널에 따르면 아폴로 글로벌 매니지먼트와 블랙스톤이 참여를 논의하는 금융기관에 포함돼 있습니다. 오픈AI는 브로드컴과 계획 중인 10기가와트 규모의 컴퓨팅 협력 사업을 통해 자체 칩을 배치할 준비를 하고 있습니다.
단어를 볼게요. 브로드컴은 미국의 큰 반도체 회사예요. 아폴로와 블랙스톤은 큰 투자 회사예요. 맞춤형 칩은 한 회사만을 위해 따로 설계한 칩이에요. AI 가속기는 AI 계산을 빠르게 해 주는 칩이에요. 기가와트는 아주 큰 전기의 양을 재는 단위예요. 월스트리트저널은 이 소식을 10월 7일 수요일에 보도했어요. 같은 날 블룸버그는 다른 숫자를 냈어요. 처음 논의하는 빚의 규모가 약 300억 달러라고 했어요. 계획을 아는 한 사람의 말이에요. 공식 절차도 아직 시작되지 않았대요. 그러니까 숫자는 300억 달러에서 500억 달러 이상 사이예요. 그리고 아직 확정된 것은 없어요. 이 칩은 오픈AI가 직접 설계한 칩이에요. 2025년 10월에 발표한 브로드컴과의 10기가와트 계약에 들어가요. 오픈AI가 엔비디아에 덜 기대려고 만드는 칩이에요. 그런데 그 칩을 살 돈은 월가에서 나와요. 칩을 파는 회사가 이제 돈을 마련하는 일까지 해요. 칩을 팔기에는 좋은 방법이에요. 하지만 위험도 있어요. AI 칩은 빨리 낡아요. 계약이 끝나기 전에 더 좋은 칩이 나오면 문제가 될 수 있어요. 저는 이렇게 큰 빚이 좀 걱정돼요. 크기를 비교해 볼게요. 브로드컴의 지난 분기 AI 반도체 매출은 167억 달러였어요. 500억 달러는 그 세 배가 넘어요. 저는 칩과 데이터센터 이야기가 새 모델 소식보다 더 중요하다고 생각해요. AI를 짓는 돈이 점점 더 빚으로 채워지고 있어요.
CNBC의 애니크 바오 기자가 전합니다:
이번 투자 유치는 베이징이 단기간에 끝난 메타의 20억 달러 인수를 막으라는 전례 없는 명령을 내렸지만, 투자자들이 위축되지 않았다는 점을 보여줍니다. 메타는 당국이 거래를 막았을 당시 마누스의 팀과 기술을 자사 시스템에 통합하려고 했습니다. 또한 기반 모델의 성능이 빠르게 좋아지고 가격 경쟁이 치열해지는 가운데서도 AI 에이전트 스타트업에 대한 투자 수요가 유지되고 있음을 보여줍니다.
배경부터 볼게요. 마누스는 AI 에이전트를 만드는 회사예요. 메타가 이 회사를 20억 달러에 인수하기로 했어요. 인수는 다른 회사를 사는 거예요. 그런데 중국 정부가 이 거래를 막았어요. 중국 국가발전개혁위원회가 마누스 사업에 외국인 투자를 금지한다고 했어요. 그래서 메타는 이미 진행하던 거래를 되돌려야 했어요. 마누스의 모회사 버터플라이 이펙트가 오늘 투자 소식을 발표했어요. 모회사는 다른 회사를 가지고 있는 회사예요. 투자금은 5억 달러가 넘어요. 보위 캐피털과 IDG 캐피털이 앞장섰어요. 원래 투자자인 텐센트, HSG, 젠펀드도 함께했어요. 회사 가치는 공개하지 않았어요. 블룸버그는 지난달, 이번 투자로 회사 가치가 두 배인 40억 달러가 될 거라고 보도했어요. 새 제품도 있어요. 마누스 2.0, 그리고 큐라는 앱이에요. 큐에서는 에이전트마다 자기 이메일 주소, 전화번호, 모바일 지갑이 생겨요. 지갑이요. 에이전트가 일곱 번째 단계에서 얼마나 실수하는지 먼저 보고 싶어요. 그 전에는 제 카드를 맡기기 어려워요. 메타도 9월 초에 자기 에이전트인 뮤즈를 내놓았어요. 그리고 이 이야기는 하이쿠 뉴스와도 연결돼요. 작은 모델이 싸지면 에이전트 회사는 비용을 아낄 수 있어요. 하지만 다른 회사도 비슷한 에이전트를 더 쉽게 만들 수 있어요. 마누스는 이 돈으로, 따라 하기 어려운 제품을 보여 줘야 해요.
이 방송이 한국어 듣기에 도움이 됐나요? 그렇다면 팟캐스트 앱에서 별점과 짧은 리뷰를 남겨 주세요. 다른 한국어 학습자들이 이 방송을 찾을 때 큰 도움이 돼요.
앞으로 지켜볼 것은 세 가지예요. 브로드컴의 자금이 300억 달러에 가까울지, 500억 달러에 가까울지. 다른 곳에서 하이쿠 5.5를 시험한 결과. 그리고 오픈AI가 청소년 정서적 의존 평가나 모델을 고칠지예요. 내일, 10월 9일 금요일에 다시 만나요. 엠마와 용규가 함께한 AI 데일리 브리핑, 쉬운 한국어판이었어요. 랜턴 팟캐스트에서 만든 방송이에요. 끝까지 들어 주셔서 고마워요.