주간복기라이브테크경제국제롱제비티
MYOSU
구독
구독멤버십

묘수의 관점테크경제국제롱제비티

주간 복기라이브 자료AI 대화록팟캐스트

투자의 묘수

투자유형검사글로벌 메가캡

묘수의 관점 · 투자 매거진

묘수의 관점

혼란스러운 세상의 변화를 이해하고 싶습니다. 매일의 라이브, 매주의 복기, 매일의 매거진.

콘텐츠주간 복기라이브팟캐스트
투자의 묘수투자유형검사글로벌 메가캡
멤버멤버십로그인
정책개인정보처리방침이용약관

MYOSU VIEW

본 콘텐츠는 정보 제공·교육 목적이며, 특정 종목의 매매를 권유하는 투자 자문이 아닙니다. 투자 판단과 그 결과의 책임은 이용자 본인에게 있습니다.

© 2026 묘수의 관점. All rights reserved.

핵심은 무료로, 전문은 멤버에게.

← 테크

원글2026.09.13

포지트론, HBM 없는 추론 칩에 8억 7,500만 달러

글쓴이오레놀 대덕2026.09.13

미국 추론 칩 스타트업 포지트론 AI가 9월 10일 8억 7,500만 달러를 조달했다고 발표했습니다. 투자 후 기업가치는 50억 달러로, 고대역폭 메모리(HBM) 대신 휴대폰과 노트북에 쓰이는 LPDDR5X 메모리를 대량으로 붙인 칩 설계에 자금이 모였습니다.

포지트론이 공개한 차세대 추론 칩 아시모프. 이미지: Positron AI 제품 페이지 (보도용 제품 이미지)
포지트론이 공개한 차세대 추론 칩 아시모프. 이미지: Positron AI 제품 페이지 (보도용 제품 이미지)

두 갈래로 모은 8억 7,500만 달러

포지트론의 보도자료에 따르면 이번 자금은 두 차례로 나뉩니다. 투자 전 기업가치 35억 달러로 3억 7,500만 달러를 받은 시리즈 C에는 NEA, 아트레이디스 매니지먼트, 밸러 에쿼티 파트너스, 안드라 캐피털, 세미애널리시스 캐피털이 공동으로 참여했습니다. 최대 5억 달러 규모의 후속 C-1 라운드는 NEA와 넷스케이프 공동창업자 짐 클라크가 이끌었습니다. 야후 파이낸스 보도에 따르면 회사는 2월에 2억 3,000만 달러를 조달하며 기업가치 10억 달러를 인정받았는데, 일곱 달 만에 그 다섯 배가 됐습니다. 아트레이디스의 개빈 베이커와 세미애널리시스의 딜런 퍼텔은 이사회에 합류합니다.

자금은 차세대 칩 아시모프의 개발과 생산에 쓰입니다. 회사 제품 페이지에 적힌 사양을 보면 아시모프는 TSMC N3P 공정으로 만들고, 칩 하나에 LPDDR5X 메모리를 288GB에서 2,304GB까지 붙이며, 소비 전력은 약 400와트입니다. 올해 말 설계를 파운드리에 넘기는 테이프아웃을 거쳐 2027년 하반기에 양산하는 것이 목표입니다. 칩 4~8개를 묶은 서버 타이탄은 파라미터 16조 개가 넘는 모델과 1,000만 토큰이 넘는 입력을 한 대에서 처리하도록 설계했다고 회사는 설명했습니다. 지금 판매 중인 1세대 제품 아틀라스는 오라클 클라우드에 50개 넘는 랙이 들어가 있고, 점프 트레이딩과 추론 서비스 업체 파라셀 등이 쓰고 있습니다.

가속기 1개당 탑재 메모리 용량. 아시모프는 설계 사양의 최소~최대 범위
가속기 1개당 탑재 메모리 용량. 아시모프는 설계 사양의 최소~최대 범위

추론 속도가 메모리에 묶이는 구조

AI 모델은 답을 만들 때 단어 조각인 토큰을 하나씩 차례로 생성합니다. 토큰 하나를 만들 때마다 모델의 가중치와 앞서 오간 대화 내용을 메모리에서 다시 읽어 와야 하기 때문에, 계산 능력보다 메모리에서 데이터를 꺼내 오는 속도가 먼저 한계에 걸리는 경우가 많습니다. 메모리 용량이 모자라면 모델 하나를 여러 칩에 나눠 올려야 하고, 이때는 칩 사이 통신이 또 다른 병목이 됩니다.

엔비디아는 이 문제를 HBM으로 풀어 왔습니다. HBM은 D램을 여러 층으로 쌓아 GPU 바로 옆에 붙이는 메모리로, 한 번에 주고받는 데이터 폭이 넓은 대신 만들기 어렵고 값이 비쌉니다. TSMC의 CoWoS 같은 첨단 패키징을 거쳐야 해서 공급량도 제한됩니다. 엔비디아가 공개한 루빈 사양을 보면 GPU 하나에 HBM4 288GB가 들어가고 대역폭은 초당 최대 22TB입니다.

포지트론은 용량 쪽을 택했습니다. LPDDR5X는 범용 메모리여서 같은 용량을 HBM보다 싸게 확보할 수 있고 첨단 패키징 없이 기판에 붙일 수 있지만, 한 번에 읽어 오는 속도는 느립니다. 회사는 GPU가 추론 작업에서 이론 대역폭의 일부만 실제로 활용하는 반면 아시모프는 90% 이상을 쓴다고 설명하며, 엔비디아 루빈과 비교해 달러당 토큰과 와트당 토큰이 각각 5배라고 주장합니다.

아시모프 칩을 얹은 포지트론의 서버 보드. 이미지: Positron AI 제품 페이지 (보도용 제품 이미지)
아시모프 칩을 얹은 포지트론의 서버 보드. 이미지: Positron AI 제품 페이지 (보도용 제품 이미지)

시뮬레이션에서 나온 성능 수치

아시모프의 성능 수치는 실제 칩으로 측정한 적이 없고, 회로 시뮬레이션으로 계산한 값입니다. 임플리케이터의 분석에 따르면 칩은 테이프아웃 전이고, 양산 목표도 당초 2027년 초에서 하반기로 밀렸습니다. 오라클에 들어간 아틀라스는 FPGA에 HBM과 DDR5를 붙인 이전 설계여서, 지금 팔리는 제품이 아시모프의 설계를 검증해 주지는 않습니다.

대역폭 격차도 남아 있습니다. 회사가 제시한 아시모프의 실현 대역폭은 초당 2.76TB입니다. 영국 IT 매체 더 레지스터는 지난 2월 GPU가 대역폭의 30%만 쓴다고 가정해도 루빈이 아시모프보다 2.4배 빠르다고 계산했습니다. 성능 비교에 쓰인 GPU 벤치마크가 세미애널리시스의 자료에서 나왔는데, 이 회사의 투자 부문이 이번 라운드를 공동으로 이끌었고 대표가 이사회에 들어간다는 점도 함께 따져볼 부분입니다.

칩 하나의 메모리 대역폭. 루빈 30% 가정치는 더 레지스터 계산
칩 하나의 메모리 대역폭. 루빈 30% 가정치는 더 레지스터 계산

HBM 밖으로 넓어지는 메모리 수요

이번 투자에서 눈여겨볼 대목은 추론 칩 설계가 어떤 메모리를 쓰느냐에 따라 갈라지기 시작했다는 점입니다. HBM 공급이 소수의 메모리 회사와 TSMC 패키징 라인에 묶여 있는 동안, 용량이 큰 범용 메모리로 우회하려는 설계에 자본이 붙고 있습니다. 긴 문맥을 다루는 에이전트 작업이 늘수록 칩 하나에 올릴 수 있는 메모리 양이 중요해지고, 그 수요는 HBM과 함께 서버용 LPDDR로도 번질 수 있습니다.

국내 메모리 업체 입장에서는 HBM 점유율 경쟁과 별도로 서버용 LPDDR가 새 판매처로 자라는지가 확인할 항목입니다. 다만 아시모프가 회사가 제시한 효율을 실제로 내는지는 2027년 하반기 양산 이후에야 확인할 수 있습니다.

다음 읽기

  • 2026.09.14아모데이, AI 개발 속도 조절 제안→
  • 2026.09.11오라클 계약 잔고 6,640억 달러, 설비투자 세 배→
테크 전체 보기 →