Advanced Micro Devices đã đạt được thỏa thuận dứt khoát để mua lại Taalas, một công ty khởi nghiệp có trụ sở tại Toronto chuyên cung cấp các mô hình trí tuệ nhân tạo trực tiếp vào silicon, trong một động thái nhằm tăng tốc đáng kể khả năng suy luận AI. Thỏa thuận được công bố vào ngày 6 tháng 8 năm 2026, diễn ra chỉ vài tuần sau khi AMD ký một thỏa thuận riêng với Cerebras và báo hiệu một nỗ lực mạnh mẽ nhằm thách thức sự thống trị của Nvidia trong lĩnh vực phần cứng AI.
Việc mua lại phản ánh bối cảnh bán dẫn đang thay đổi nhanh như thế nào khi các công ty theo đuổi những cách rẻ hơn, nhanh hơn để chạy các mô hình AI. Để tiếp tục đưa tin về ngành AI về các cuộc chiến chip đang định hình lại lĩnh vực này, AI Buzz Wire đang theo dõi mọi động thái lớn.
Taalas thực sự làm gì
Taalas thực hiện một cách tiếp cận độc đáo đối với cái gọi là bức tường bộ nhớ - nút cổ chai nơi GPU không hoạt động chờ dữ liệu đến từ bộ nhớ trước khi chúng có thể bắt đầu xử lý các con số. Thay vì lấy các trọng số của mô hình từ một ngân hàng bộ nhớ riêng biệt, Taalas gắn các trọng số đó vào các bóng bán dẫn riêng lẻ.
Kiến trúc kỹ thuật số độc quyền của công ty khởi nghiệp này có thể lưu trữ 4 bit dữ liệu và thực hiện các phép toán bằng cách sử dụng một bóng bán dẫn. Chip HC1 của nó có các khối phần cứng dùng chung giúp tính toán trước vĩnh viễn tất cả 16 sản phẩm có thể có cho trọng lượng mô hình 4 bit được lượng tử hóa. Bởi vì mọi kết quả toán học có thể xảy ra đều đã diễn ra trực tiếp trên chip nên bóng bán dẫn riêng lẻ hoạt động như một bộ định tuyến vật lý chứ không phải là một máy tính.
Mỗi trọng lượng cụ thể của mô hình AI được biểu thị bằng một bóng bán dẫn Mask ROM duy nhất. Trong quá trình sản xuất, một lớp kim loại cực nhỏ được khắc để kết nối vật lý bóng bán dẫn đó với một trong 16 dòng sản phẩm được tính toán sẵn. Khi dữ liệu truyền qua chip, bóng bán dẫn chỉ cần chọn đúng kênh được tính toán trước và chuyển kết quả đến bộ cộng. Về bản chất, mạch là sự kết hợp của cả bộ nhớ và bộ xử lý.
Theo công ty, kết quả thật đáng kinh ngạc: chip HC1 có thể tạo ra khoảng 16.000 đến 17.000 mã thông báo mỗi giây cho mỗi người dùng. Cách tiếp cận này gợi nhớ đến Groq LPU, tương tự, đưa trọng lượng mô hình AI trực tiếp vào SRAM trên chip nhanh để vượt qua tắc nghẽn bộ nhớ.
The Catch: Một con chip được xây dựng cho một mô hình
Sự đánh đổi là đáng kể. Vì trọng lượng của mô hình được khắc vật lý vào silicon nên mỗi chip Taalas chỉ hoạt động cho mô hình AI cụ thể mà nó được thiết kế. Nó không phải là một máy gia tốc có mục đích chung, có thể lập trình. Điều đó làm cho nó trở thành một đề xuất khác về cơ bản với GPU, vốn có thể chạy bất kỳ mô hình nào được tải vào bộ nhớ của nó.
Các nhà phân tích trong ngành đã suy đoán rằng công nghệ của Taalas có thể đóng vai trò như một bộ tăng tốc giải mã chuyên dụng trong các hệ thống quy mô giá đỡ rộng hơn của AMD — xử lý giai đoạn suy luận thứ hai, nhạy cảm với độ trễ — trong khi phần cứng linh hoạt hơn như hệ thống Helios do Cerebras hỗ trợ sẽ xử lý giai đoạn nạp trước. AMD vẫn chưa nêu chi tiết chính xác vị trí chip của Taalas sẽ được đưa vào lộ trình sản phẩm của mình.
Ai đã xây dựng Taalas
Taalas được thành lập vào năm 2023 bởi bộ ba cựu nhân viên AMD và lãnh đạo tại Tenstorrent, nhà sản xuất chip AI có trụ sở tại Toronto, hiện có trụ sở tại Santa Clara. Nhóm sáng lập bao gồm Giám đốc điều hành Ljubisa Bajic, người đồng sáng lập và cựu giám đốc điều hành, giám đốc công nghệ và chủ tịch của Tenstorrent; COO Lejla Bajic; và CTO Drago Ignjatovic.
Công ty nổi lên từ tình trạng tàng hình vào năm 2024, tiết lộ khoản tài trợ 50 triệu đô la từ Quiet Capital và nhà đầu tư bán dẫn kỳ cựu Pierre Lamond, cùng những người khác. Trước đó vào năm 2026, họ đã công bố thêm 169 triệu USD từ một nhóm bao gồm Fidelity. Taalas tuyên bố họ có thể tung ra một con chip tùy chỉnh mới chỉ trong vòng hai tháng, so với tiêu chuẩn ngành thường kéo dài đến một hoặc hai năm và đặt cược rằng nó có thể sản xuất phần cứng hiệu quả hơn hàng nghìn lần so với các đối tác dựa trên phần mềm.
Các điều khoản tài chính của việc mua lại AMD không được tiết lộ. Giao dịch vẫn phải tuân theo các điều kiện kết thúc và phê duyệt theo quy định.
Tại sao AMD lại mua ngay bây giờ
AMD mô tả Taalas là công ty tiên phong về silicon suy luận AI chuyên dụng với công nghệ tối ưu hóa luồng dữ liệu suy luận AI và giảm đáng kể các tắc nghẽn về tính toán và bộ nhớ liên quan đến kiến trúc đa năng.
Vamsi Boppana, phó chủ tịch cấp cao của nhóm AI của AMD, cho biết trong một thông cáo báo chí: “Đội ngũ kỹ thuật đẳng cấp thế giới và công nghệ của Taalas củng cố danh mục AI của chúng tôi bằng cách mang lại hiệu suất và hiệu quả suy luận khác biệt”.
Thỏa thuận mở rộng một mô hình rộng hơn. Thỏa thuận trước đó của AMD với Cerebras sẽ tích hợp Công cụ quy mô wafer của Cerebras vào hệ thống quy mô giá đỡ Helios sắp ra mắt, hệ thống này đặt một lượng bộ nhớ khổng lồ và tính toán trên một tấm silicon duy nhất được kết nối với nhau. Việc bổ sung Taalas mang lại cho AMD vũ khí khác biệt thứ ba trong kho vũ khí suy luận của mình, cùng với GPU Bản năng của riêng họ và mối quan hệ đối tác Cerebras.
Đối với AMD, lời kêu gọi rất rõ ràng. Nvidia tiếp tục thống trị hoạt động đào tạo và suy luận AI với hệ sinh thái GPU của mình và những kẻ thách thức đã phải vật lộn để cạnh tranh trên lĩnh vực điện toán có mục đích chung. Bằng cách mua lại các công ty có kiến trúc khác nhau về cơ bản - động cơ quy mô wafer, silicon mô hình có dây cứng - AMD đang đánh cược rằng phần cứng chuyên dụng sẽ tạo ra những ngóc ngách sinh lợi mà GPU một kích cỡ phù hợp cho tất cả của Nvidia không thể phục vụ hiệu quả.
Thị trường suy luận đang thay đổi
Việc mua lại cũng nói lên sự thay đổi trong ngành rộng lớn hơn. Khi các mô hình AI phát triển lớn hơn và chi phí suy luận tăng cao, tính kinh tế của việc chạy chúng trên các GPU đa năng đang chịu áp lực. Các chip suy luận chuyên dụng hứa hẹn giảm đáng kể chi phí khi triển khai số lượng lớn, trong đó cùng một mô hình được chạy hàng triệu lần.
Nếu AMD có thể thương mại hóa thành công phương pháp kết nối dây cứng của Taalas, thì họ có thể cung cấp cho các nhà cung cấp đám mây và doanh nghiệp một cách để chạy các mô hình phổ biến với chi phí và độ trễ thấp hơn so với GPU truyền thống – miễn là họ sẵn sàng cam kết sử dụng silicon được xây dựng xung quanh một mô hình duy nhất.
Luôn dẫn đầu trong cuộc chiến chip
Cuộc chiến giành ưu thế về phần cứng AI đang ngày càng gay gắt, với mỗi thương vụ mua lại đều định hình lại cán cân quyền lực. Theo dõi những phát triển AI mới nhất của chúng tôi để tìm hiểu sâu hơn về silicon thúc đẩy thế hệ trí thông minh tiếp theo.
Đọc thêm tin tức về AI →