리플렉션AI, GPU 임대료 73억 달러 계약…첫 모델 '빔'은 그중 3% 미만 사용, 가중치는 무료 공개

빔의 학습 비용은 게시된 클라우드 요금 기준으로 리플렉션AI가 약정한 73억 달러 GPU 임대료의 3% 미만이다. 자체 벤치마크 표에서는 중국 선두 모델들에도 뒤진다. 이 회사는 250억 달러 기업가치를 등에 업고 이달 가중치를 무료 공개한다.

원문 읽기

Vincent JiangVincent Jiang · 3 min read
Share
CES에서 발언하는 엔비디아 창업자 겸 최고경영자(CEO) 젠슨 황
1 / 6Slide 1 of 6
엔비디아 창업자 겸 CEO 젠슨 황. 엔비디아는 GB300을 판매하고, 리플렉션AI 지분을 보유하며, 네모트론 연합(Nemotron Coalition)을 주도하고 있다.

250억 달러짜리 연구소, 첫 모델을 '무료'로 내놓다

리플렉션AI$2.1B — 리플렉션AI, private, latest valuation $2.1B가 마침내 모델을 갖게 됐다. 10월 5일 공개된 '빔(Beam)'은 총 파라미터 5010억 개를 담고 토큰당 230억 개만 활성화하며, 코딩과 에이전트 작업용으로 설계됐다12. 현재는 대기자 명단을 통해 이용할 수 있고, 이달 안에는 아파치 2.0(Apache 2.0) 라이선스로 가중치가 무료 공개된다12.

그 뒤에 놓인 73억 달러의 GPU 임대료

리플렉션AI는 스페이스X와 6월 맺은 63억 달러 규모 컴퓨트 계약으로 콜로서스 2(Colossus 2)의 엔비디아−0.57% — 엔비디아, down 0.57 percent today GB300 용량을 확보했고, 7월에는 클라우드 업체 네비우스−1.23% — 네비우스, down 1.23 percent today를 통한 10억 달러 계약을 추가했다3. 출시 배경에는 6월 투자 라운드에서 매겨진 프리머니 기준 250억 달러 기업가치가 있다. 주주 명단에는 엔비디아, 세쿼이아캐피탈, 시티그룹이 이름을 올렸다34. 플래그십 모델이 무료인 데다 서빙 비용까지 싸다면 임대료 리스크는 이 계약들의 상대방인 스페이스X−0.07% — 스페이스X, down 0.07 percent today와 네비우스, 그리고 250억 달러로 평가된 리플렉션AI 지분 보유자에게 넘어간다.

학습 비용은 청구서의 '반올림 오차' 수준

리플렉션AI가 공개한 수치로는, 빔의 학습 전체 비용은 약정액 앞에서 푼돈이다. 사전학습에는 GB300 6144장이 4주 미만, 강화학습에는 1만500장이 4주 투입됐다1. GPU시간으로 최대 약 1120만 시간이다. 6월 말 클라우드 업체들은 GB300 용량을 GPU시간당 3.02~18달러에 내놨다5. 이 요금으로 학습 전체를 환산하면 약 3400만~2억100만 달러다. 가장 비싼 게시 요금을 적용해도 약정액 1달러당 3센트 미만이 드는 셈이다. 73억 달러는 빔을 사는 돈이 아니다. 아직 존재하지 않는 모델들을 사는 돈이며, 리플렉션AI는 더 큰 후속 모델이 이미 학습 중이라고 말했다13.

청구서를 줄이려 설계했지만, 자체 스코어보드에선 뒤처져

빔이 토큰당 활성화하는 파라미터는 230억 개다. GLM-5.2는 40억 개, 딥시크 V4 Pro는 49억 개, 키미 K3는 104억 개다26. 리플렉션AI는 빔의 추론 컴퓨트가 GLM-5.2보다 3~4배 적다고 주장한다. 다만 이는 측정값이 아니라 회사가 스스로 '근사치'라고 못 박은 수치다12.

빔, 토큰당 활성 파라미터 230억 개…키미 K3의 4분의 1 미만

0B50B100B150B키미 K3104B딥시크 V4 Pro49BGLM-5.240B빔23B빔이 줄이려고 설계된 청구서
Data
Value
키미 K3104B
딥시크 V4 Pro49B
GLM-5.240B
빔23B
토큰당 활성 파라미터 수. 토큰당 추론 비용을 좌우하는 핵심 변수로, 적을수록 서빙 비용이 싸다. 빔은 리플렉션AI 발표 값(Implicator.ai 인용), GLM-5.2는 Implicator.ai, 딥시크 V4 Pro와 키미 K3는 AI 매거진 기준. 2026년 10월.2,6

리플렉션AI가 발표한 자체 비교표에서도 빔은 터미널벤치(Terminal Bench) v2.1에서 80.1점으로 8개 중 6위에 그쳤다. 딥시크 V4.1 Flash, 키미 K3, GLM 5.3에 밀렸다. DeepSWE에서는 44.4점으로 Flash의 74.2점에 뒤졌다1.

빔, 자체 표에서는 서구 오픈 모델 중 최고…그래도 8개 중 6위

020406080100딥시크 V4.1 Flash90.6키미 K388.3GLM 5.388.2Qwen 3.8 Max86.6GLM 5.281빔80.1서구 오픈 모델 중 최고Inkling63.8네모트론 3 Ultra56.4
Data
Value
딥시크 V4.1 Flash90.6
키미 K388.3
GLM 5.388.2
Qwen 3.8 Max86.6
GLM 5.281
빔80.1
Inkling63.8
네모트론 3 Ultra56.4
터미널벤치 v2.1 점수. 높을수록 좋으며 모두 리플렉션AI가 2026년 10월 5일 공개한 자체 발표표에 실은 값이다. 리플렉션AI가 집계하지 않은 모델은 빠져 있다.1

빔에 대한 독립적 평가는 아직 공개된 바 없다2.

그래도 청구서에는 이유가 있다

리플렉션AI에 투자한 세쿼이아캐피탈의 스테파니 잔 파트너는 에이전트의 성패는 모델당 컴퓨트가 아니라 태스크당 컴퓨트가 가른다고 주장한다7. 업체가 제공한 접근 권한으로 테스트한 아티피셜 애널리시스(Artificial Analysis)는 빔을 지금까지 본 오픈 모델 가운데 토큰 효율이 가장 뛰어난 모델 중 하나로 꼽았다2. 컴퓨트 단위당 성능이 곧 상품이라면, 임대료는 모순이 아니라 전략이다.

이달 가중치 공개, 다음 달 IPO

엔비디아는 어느 쪽으로든 수익을 챙긴다. GB300을 팔고, 임차인인 리플렉션AI 지분도 보유하고 있으며, 오픈 가중치를 앞세운 네모트론 연합도 이끈다36. 다음 달 어쩌면 역대 최대가 될 IPO로 상장할 예정인 앤스로픽$350B — 앤스로픽, private, latest valuation $350B은 투자자들에게 숙제 하나를 안긴다7. 최신 도전자가 공짜로 일하는 폐쇄형 모델 사업의 가치를 매기라는 것이다. 가중치가 공개되는 대로 독립 벤치마크 결과를 주목할 일이다2.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio