Tuesday, September 15, 2026
AI 인프라 · 뉴스 & 분석
반도체·하드웨어리포트
반도체·하드웨어 · 리포트

AMD가 훈련된 모델을 실리콘에 새기는 AI 추론 칩 스타트업 Taalas를 인수; 데모는 초당 최대 17,000 토큰 처리

AMD가 모델별 최적화를 실리콘에 직접 내장하며 추론 효율성에서 Nvidia와 경쟁하면서 칩 레이스가 심화되고 있다
통신사Slicast · 2026년 8월 6일 20:05 UTC · 미국 · 출처: CNBC
중요도 95

드밴스드 마이크로 디바이시스(Advanced Micro Devices)는 클라우드 기업들이 구할 수 있는 모든 고급 AI 칩을 사들이면서, 데이터 센터 성장의 대부분을 그래픽 처리 장치(GPU)가 주도하기를 기대하고 있다. 그러나 생성형 인공지능 붐이 4주년을 향해 다가감에 따라 GPU가 모든 것을 수행하지는 않는다는 사실이 명확해지고 있다.

목요일 AMD는 추론(inference)용 칩을 만드는 토론토 기반 스타트업인 Taalas를 인수하기로 합의했다고 발표했다. 범용 GPU와 달리 Taalas의 가속기는 단일 AI 모델을 위해 맞춤 설계되고 하드웨어적으로 고정되어 있다. 이러한 유연성 상실을 대가로 Taalas의 기술은 기존 GPU보다 특정 모델의 출력을 수천 배 더 빠르게 생성할 수 있는 저비용 칩을 약속한다. AMD는 구매 가격을 공개하지 않았다. Taalas는 2023년 설립 이후 벤처 자금으로 총 2억 1,900만 달러를 조달했다.

이번 거래는 엔비디아(Nvidia)가 고성능 AI 칩 디자이너인 Groq로부터 자산을 200억 달러에 인수한 지 7개월도 채 지나지 않은 시점에 이루어졌다. 이는 엔비디아 역사상 최대 규모의 거래였다.

Taalas의 현재 칩은 메타(Meta)의 Llama 3.1 모델 소형 버전을 실행하며, 회사는 더 크고 정교한 모델을 위한 칩 개발도 진행 중이다. 이 칩은 구형 TSMC(Taiwan Semiconductor Manufacturing Co.) 공정으로 제조되며 칩 자체에 고속 SRAM 메모리를 사용한다. CEO 리비사 바지치(Ljubisa Bajic)는 회사 웹사이트에서 Taalas가 "어떤 AI 모델이든 맞춤형 실리콘으로 변환하는 플랫폼을 개발했다"며 "이전에 보지 못한 모델이 수신되는 순간부터 하드웨어로 구현하는 데 단 두 달이 걸린다"고 밝혔다.

Taalas와 Groq와 같은 대체 칩들은 AI 모델의 첫 응답 시간이 중요한 '저지연(low-latency)' 애플리케이션에 특히 중요하다. AMD의 CEO 리자 수(Lisa Su)는 7월 제품 출시 행사에서 "칩과 관련하여 만능 해결책은 존재하지 않는다고 굳게 믿는다"고 말했다. 그녀는 여전히 새로 개발된 AI 모델을 지원할 만큼 충분히 유연하기 때문에 GPU가 AI 칩 시장의 대부분을 차지할 것으로 예상한다고 덧붙였다.

AMD의 인수는 선도적인 GPU 제조사들이 단순 프로세서뿐만 아니라 다양한 구성 요소와 칩을 갖춘 통합 시스템을 제공해야 하는 중요성이 높아지고 있음을 반영한다. AMD는 최근 메타와 마이크로소프트 등 고객에게 엔비디아의 통합 서버 랙에 대응하는 최초의 랙 규모 경쟁 제품인 Helios를 배송하기 시작했다.

AMD는 Taalas의 칩과 기술을 중앙 처리 장치(CPU) 및 인스팅트(Instinct) GPU가 탑재된 시스템에 포함하여 자체 로드맵에 통합할 것이라고 밝혔다. 또한 회사는 다른 보완적 가속기도 지원하고 있는데, 7월 AMD는 Cerebras와의 파트너십을 발표하여 그 AI 칩을 자사 시스템에 통합하겠다고 밝혔다.

AMD는 Helios 랙용 구성 요소를 구축하기 위해 적극적으로 인수 활동을 펼쳐 왔다. 2024년 AMD는 AI 모델을 개발하는 Silo AI로부터 6억 6,500만 달러를 지불했고, 랙 규모 기술 기반을 보유한 ZT Systems를 49억 달러에 인수했다. 작년 AMD는 추론 소프트웨어를 제작한 MK1을 포함한 여러 소규모 AI 기업들을 인수했다.

원문 보기
AMD가 훈련된 모델을 실리콘에 새기는 AI 추론 칩 스타트업 Taalas를 인수;… · Slicast