Advanced Micro Devices는 AI 추론을 획기적으로 가속화하기 위해 인공 지능 모델을 실리콘에 직접 연결하는 토론토 기반 스타트업인 Taalas를 인수하기로 최종 합의했습니다. 2026년 8월 6일에 발표된 이 거래는 AMD가 Cerebras와 별도의 계약을 체결하고 AI 하드웨어에서 Nvidia의 지배력에 도전하려는 공격적인 추진을 신호한 지 불과 몇 주 만에 이루어졌습니다.

이번 인수는 기업들이 AI 모델을 실행하기 위해 더 저렴하고 빠른 방법을 추구함에 따라 반도체 환경이 얼마나 빠르게 변화하고 있는지를 반영합니다. 현재 진행 중인 AI 산업 보도에서 칩 전쟁이 현장을 재편하고 있기 때문에 AI Buzz Wire는 모든 주요 움직임을 추적하고 있습니다.

Taalas가 실제로 하는 일

Taalas는 소위 메모리 벽(GPU가 숫자 처리를 시작하기 전에 메모리에서 데이터가 도착할 때까지 유휴 상태로 대기하는 병목 현상)에 대해 색다른 접근 방식을 취합니다. 별도의 메모리 뱅크에서 모델의 가중치를 가져오는 대신 Taalas는 해당 가중치를 개별 트랜지스터에 물리적으로 배선합니다.

스타트업의 독점 디지털 아키텍처는 4비트의 데이터를 저장하고 단일 트랜지스터를 사용하여 수학 연산을 실행할 수 있습니다. HC1 칩은 양자화된 4비트 모델 가중치에 대해 가능한 모든 16가지 제품을 영구적으로 사전 계산하는 공유 하드웨어 블록을 갖추고 있습니다. 가능한 모든 수학적 결과가 이미 칩 전체에서 실시간으로 발생하고 있기 때문에 개별 트랜지스터는 계산기가 아닌 물리적 라우터 역할을 합니다.

AI 모델의 각 특정 가중치는 단일 마스크 ROM 트랜지스터로 표시됩니다. 제조 과정에서 미세한 금속층이 에칭되어 해당 트랜지스터를 미리 계산된 16개의 제품 라인 중 하나에 물리적으로 연결됩니다. 데이터가 칩을 통해 흐를 때 트랜지스터는 미리 계산된 정확한 채널을 선택하고 그 결과를 가산기에 전달합니다. 본질적으로 회로는 메모리와 프로세서가 결합된 것입니다.

회사에 따르면 그 결과는 엄청납니다. HC1 칩은 사용자당 초당 약 16,000~17,000개의 토큰을 생성할 수 있습니다. 이 접근 방식은 유사하게 AI 모델 가중치를 빠른 온칩 SRAM에 직접 구워 메모리 병목 현상을 우회하는 Groq LPU를 연상시킵니다.

중요한 점: 단일 모델용으로 제작된 칩

절충안은 중요합니다. 모델의 무게가 실리콘에 물리적으로 새겨져 있기 때문에 각 Taalas 칩은 설계된 특정 AI 모델에 대해서만 작동합니다. 프로그래밍 가능한 범용 가속기가 아닙니다. 이는 메모리에 로드된 모든 모델을 실행할 수 있는 GPU와 근본적으로 다른 제안입니다.

업계 분석가들은 Taalas의 기술이 AMD의 광범위한 랙 규모 시스템 내에서 전용 디코드 가속기 역할을 할 수 있으며 대기 시간에 민감한 두 번째 추론 단계를 처리하는 동시에 Cerebras 기반 Helios 시스템과 같은 보다 유연한 하드웨어가 사전 채우기 단계를 처리할 수 있다고 추측했습니다. AMD는 아직 Taalas의 칩이 자사 제품 로드맵에 어디에 포함될지 정확히 설명하지 않았습니다.

탈라스를 만든 사람

Taalas는 토론토에 설립되어 현재 산타클라라에 본사를 둔 AI 칩 제조업체인 Tenstorrent의 전직 AMD 직원 및 리더 세 명이 2023년에 설립했습니다. 창립 팀에는 공동 창립자이자 전 CEO, 최고 기술 책임자, Tenstorrent 사장인 Ljubisa Bajic CEO가 포함됩니다. COO Lejla Bajic; 그리고 CTO Drago Ignjatovic.

이 회사는 2024년에 Quiet Capital과 베테랑 반도체 투자자 Pierre Lamond로부터 5천만 달러의 자금을 조달한 사실을 공개하면서 잠복 상태에서 벗어났습니다. 2026년 초에는 Fidelity가 포함된 그룹으로부터 1억 6,900만 달러를 추가로 지원한다고 발표했습니다. Taalas는 종종 1~2년이 걸리는 업계 표준과 비교하여 단 2개월 만에 새로운 맞춤형 칩을 출시할 수 있다고 주장했으며 소프트웨어 기반 칩보다 수천 배 더 효율적인 하드웨어를 생산할 수 있다고 확신했습니다.

AMD 인수에 따른 재정적 조건은 공개되지 않았습니다. 거래는 종료 조건과 규제 승인의 대상이 됩니다.

AMD가 지금 구매하는 이유

AMD는 Taalas를 AI 추론 데이터 흐름을 최적화하고 범용 아키텍처와 관련된 컴퓨팅 및 메모리 병목 현상을 크게 줄이는 기술을 갖춘 전문 AI 추론 실리콘의 선구자라고 설명했습니다.

AMD AI 그룹 수석 부사장인 Vamsi Boppana는 보도 자료에서 "Taalas의 기술과 세계적 수준의 엔지니어링 팀은 차별화된 추론 성능과 효율성을 제공함으로써 우리의 AI 포트폴리오를 강화합니다"라고 밝혔습니다.

이번 거래는 더 넓은 패턴으로 확장됩니다. AMD와 Cerebras의 이전 계약은 후자의 웨이퍼 스케일 엔진을 곧 출시될 Helios 랙 스케일 시스템에 통합하여 막대한 양의 메모리와 컴퓨팅을 상호 연결된 단일 실리콘 시트에 배치합니다. Taalas를 추가하면 AMD는 자체 Instinct GPU 및 Cerebras 파트너십과 함께 추론 무기고에 세 번째로 뚜렷한 무기를 갖게 됩니다.

AMD의 경우 매력은 분명합니다. Nvidia는 GPU 생태계를 통해 계속해서 AI 훈련 및 추론을 장악하고 있으며 도전자들은 범용 컴퓨팅 분야에서 경쟁하기 위해 고군분투하고 있습니다. AMD는 근본적으로 다른 아키텍처(웨이퍼 규모 엔진, 하드와이어 모델 실리콘)를 갖춘 회사를 인수함으로써 특수 하드웨어가 Nvidia의 일률적인 GPU가 효율적으로 제공할 수 없는 수익성 있는 틈새 시장을 개척할 것이라고 확신하고 있습니다.

변화하는 추론 시장

이번 인수는 또한 더 넓은 산업 변화를 의미합니다. AI 모델이 더 커지고 추론 비용이 급증함에 따라 이를 범용 GPU에서 실행하는 데 따른 경제성이 압박을 받고 있습니다. 특수 추론 칩은 동일한 모델이 수백만 번 실행되는 대량 배포에 대한 극적인 비용 절감을 약속합니다.

AMD가 Taalas의 하드와이어 접근 방식을 성공적으로 상용화할 수 있다면 클라우드 제공업체와 기업은 단일 모델을 기반으로 구축된 실리콘에 전념할 의향이 있는 경우 기존 GPU보다 훨씬 적은 비용과 대기 시간으로 인기 모델을 실행할 수 있는 방법을 제공할 수 있습니다.

칩 전쟁에서 앞서 나가세요

AI 하드웨어 패권을 위한 싸움은 점점 더 치열해지고 있으며, 인수할 때마다 힘의 균형이 바뀌고 있습니다. 차세대 인텔리전스를 주도하는 실리콘에 대해 자세히 알아보려면 최신 AI 개발을 따르세요.

AI 뉴스 자세히 보기 →