Hardware de IA
54 articles
Jio, de Mukesh Ambani, abre serviço de PC em nuvem para toda a Índia, transformando computadores antigos em máquinas prontas para IA
A Reliance Jio expandiu o JioPC além de sua base de banda larga, transmitindo até 8 vCPUs e 16 GB de RAM para computadores antigos por cerca de US$ 11 por dois meses.
OpenAI está comprando Mac minis e Mac Studios às dezenas de milhares para treinar agentes de IA
A informação relata que a OpenAI comprou dezenas de milhares de Mac minis e Mac Studios para treinar agentes de uso de computadores, transformando o silício da Apple em infraestrutura de IA.
A Apple foi pega de surpresa pela demanda de IA empresarial enquanto o Mac Studio e o Mac Mini estavam esgotados
A demanda empresarial por IA pegou a Apple desprevenida, relata The Information, deixando as versões Mac Studio e Mac mini fora de estoque por meses em meio ao boom local de IA.
Nvidia aposta US$ 3,5 bilhões na MediaTek enquanto NVLink Fusion abre a porta para chips de IA personalizados
A Nvidia investiu US$ 3,5 bilhões em títulos conversíveis da MediaTek enquanto a fabricante de chips adota o NVLink Fusion para trazer XPUs personalizados para fábricas de IA em escala de rack.
Barreiras de robôs e drones dos EUA não resolverão a diferença de escala com a China, alertam analistas
As empresas chinesas construíram 86% dos novos robôs humanóides do mundo no início de 2026. Analistas dizem que as tarifas e proibições dos EUA não eliminarão essa vantagem de escala.
Hugging Face lança MicroDuck, um pato robô de código aberto de US$ 399 que você pode treinar sozinho
O MicroDuck da Hugging Face é um pato robô de código aberto de US$ 399 que aprende novos truques por meio do aprendizado por reforço – e será lançado antes do Natal de 2026.
O chip MTIA 400 da Meta divide seu cérebro entre treinamento de IA e veiculação de anúncios
A Meta detalhou seu acelerador MTIA 400 no Hot Chips 2026: um chip de treinamento LLM de 3 nm construído em Broadcom IP que também alimenta os anúncios que pagam as contas.
O chip Jalapeño da OpenAI supera a Nvidia Blackwell nos primeiros benchmarks de inferência
A OpenAI afirma que seu chip Jalapeño, construído pela Broadcom, oferece mais tokens por usuário e por quilowatt do que a Nvidia Blackwell nos primeiros benchmarks InferenceX.
Apple lança chips M6 e M5 Ultra nos novos Mac Mini e Mac Studio desenvolvidos para IA no dispositivo
O primeiro chip M6 de 2 nm da Apple e o M5 Ultra quad-die estreiam nos novos Mac mini e Mac Studio, com até 512 GB de memória unificada para executar modelos gigantes de IA localmente.
Intel abre Hot Chips 2026 com Crescent Island: GPU de inferência de IA com até 480 GB de memória
A Intel detalhou sua GPU de data center Crescent Island no Hot Chips 2026 – uma placa PCIe de 350 W construída para inferência de IA agente com até 480 GB de LPDDR5X.
Xiaomi lança chips Xring O3, O100 e D100 mais AI Cube executando modelos 120B localmente
A Xiaomi lançou três chips Xring de desenvolvimento próprio para telefones, IA e carros – e um mini PC AI Cube que executa modelos de parâmetros 120B localmente.
Groq 3 LPX da Nvidia entra em produção total com 3.400 tokens por segundo para Agentic AI
O acelerador de inferência Groq 3 LPX da Nvidia está em plena produção, postando um recorde de 3.400 tokens por segundo em contexto de 100K na plataforma Vera Rubin.
Taiwan indicia nove, incluindo gerente da Nvidia, por servidores de IA contrabandeados com destino à China
Os promotores de Taiwan indiciaram nove pessoas, incluindo um gerente da Nvidia e dois ex-funcionários da Supermicro, por contrabandear 74 servidores Blackwell AI para a China.
O mega acordo de dívida de IA da Broadcom pode chegar a US$ 100 bilhões para financiar chips para a Anthropic
A Broadcom está em negociações para levantar dívidas de até US$ 100 bilhões para chips de IA que a Anthropic irá alugar, no que seria o maior acordo de financiamento de IA de todos os tempos.
Starcloud levanta US$ 250 milhões com avaliação de US$ 2,3 bilhões para construir data centers de IA em órbita
A Nvidia se junta à rodada de US$ 250 milhões da Starcloud com uma avaliação de US$ 2,3 bilhões enquanto a startup compete com a SpaceX para colocar data centers de IA em órbita, com lançamento em janeiro.
Nvidia Customers Face Server Price Hikes Above 15% as Memory Costs Soar
Bloomberg reports Nvidia AI server prices will rise over 15% as memory costs climb, hitting Vera Rubin and Grace Blackwell systems due early next year.
Anthropic contrata o arquiteto de TPU do Google, Amir Salek, para acelerar seu impulso de silício personalizado
A Anthropic contratou o ex-chefe de chips do Google, Amir Salek, que entregou sete gerações de TPU, enquanto constrói uma iniciativa interna de semicondutores.
Micron destina US$ 10 bilhões ao Boise Research Labs para perseguir a próxima geração de memória de IA
O Micron Research Labs gastará US$ 10 bilhões na próxima década em Boise em memória pós-DRAM, empacotamento avançado e tecnologia de fabricação para a era da IA.
Google contrata Marvell para chips de IA personalizados em acordo de garantia de US$ 12,2 bilhões
O Google assinou com a Marvell para ajudar a construir seus chips TPU AI personalizados, concedendo um mandado no valor de até US$ 12,2 bilhões. As ações da Marvell saltaram enquanto a Broadcom caiu 5%.
Cerebras CS-4 é lançado com WSE-3 Turbo: inferência de IA em escala de rack com velocidade de GPU de 30x
Cerebras lança CS-4 com wafers WSE-3 Turbo e arquitetura de rack Nexus, alegando inferência 30x mais rápida do que GPUs, pois desafia o domínio da Nvidia.
O Google supostamente recorre à AMD para uma TPU de próxima geração com CPU pesada, construída para aprendizado por reforço
Uma nota da SemiAnalysis diz que o Google pode combinar a tecnologia de CPU AMD com seus aceleradores TPU em um novo design voltado para aprendizado de reforço e IA de agente.
Nvidia reduz garantia de data center OpenAI de US$ 250 bilhões para menos de US$ 120 bilhões
A Nvidia reduziu sua garantia planejada para o data center da OpenAI em Ohio de US$ 250 bilhões para menos de US$ 120 bilhões após preocupações dos investidores, relatam o WSJ e a Reuters.
Cerebras capacita o novo modo ultrarrápido da OpenAI: GPT-5.6 Sol atinge 750 tokens por segundo
Cerebras e OpenAI revelam modo ultrarrápido para GPT-5.6 Sol, entregando 750 tokens de saída por segundo sem perda de qualidade.
Cerebras e OpenAI revelam GPT-5.6 Sol Ultrafast: 750 tokens por segundo sem perda de qualidade
O modo Ultrafast da Cerebras oferece até 750 tokens de saída por segundo para o GPT-5.6 Sol da OpenAI, rodando 11x mais rápido que Claude Fable 5 com precisão comparável.
TSMC registra receita recorde em julho, aumento de 44,7% com aumento da demanda por chips de IA
A receita de julho da Taiwan Semiconductor atingiu NT$ 467,58 bilhões devido à forte demanda por chips de 2 nanômetros, com a empresa prevendo um crescimento de 40% para 2026 impulsionado por aplicações de IA.
Nvidia recorre a gigantes de Wall Street para um impulso de financiamento de infraestrutura de IA de US$ 500 bilhões
Apollo, Blackstone, BlackRock, Brookfield, Goldman Sachs e KKR estão em negociações com a Nvidia sobre um pacote de financiamento de infraestrutura de IA de US$ 500 bilhões, enquanto as ações da Nvidia caíam com a notícia.
Microsoft lançará chip Maia 300 AI de próxima geração já em setembro
A Microsoft está se preparando para revelar publicamente seu novo chip Maia 300 AI neste outono, potencialmente em setembro, enquanto trabalha para reduzir sua forte dependência das caras GPUs da Nvidia.
O alto-falante inteligente da OpenAI custará até US$ 400 e usará peças móveis para se sentir vivo
O próximo alto-falante inteligente ChatGPT da OpenAI, projetado com LoveFrom de Jony Ive, pode custar entre US$ 300 e US$ 400 e apresentar peças móveis que são animadas quando ele responde.
A capacidade de memória de 2027 está supostamente esgotada à medida que a demanda de IA desencadeia um novo 'RAMageddon'
A capacidade de memória para 2027 está totalmente esgotada à medida que a demanda de IA por HBM e DRAM aumenta. A SK Hynix planeja uma expansão fabulosa de US$ 38 bilhões, mas o alívio está a anos de distância.

Lumilens sai do sigilo com US$ 900 milhões para reconectar data centers de IA com luz
A startup de interconexão óptica Lumilens foi lançada com mais de US$ 900 milhões em financiamento e uma avaliação de US$ 5,5 bilhões, com o objetivo de substituir a fiação de cobre entre GPUs em data centers de IA.
AMD adquire Taalas, a startup que conecta modelos de IA diretamente ao silício
A AMD adquiriu a Taalas, uma startup de Toronto que grava pesos de modelos de IA em silício para grandes acelerações de inferência, semanas após seu acordo com a Cerebras.

Lumilens sai do sigilo com US$ 900 milhões para conectar data centers de IA com luz
A Lumilens levantou mais de US$ 900 milhões em uma avaliação de US$ 5,5 bilhões para substituir o cobre por interconexões ópticas e resolver o gargalo de conectividade da GPU da IA.
SpaceX e Tesla comprometem US$ 16,8 bilhões para construir fábrica de chips Terafab no Texas
A SpaceX e a Tesla de Elon Musk confirmaram um investimento inicial de US$ 16,8 bilhões para a fábrica de semicondutores Terafab no condado de Grimes, Texas, perto de College Station.
Anthropic constrói uma equipe interna de design de chips para capacitar Claude com silício personalizado
A Anthropic confirmou que está contratando uma equipe de silício personalizada para co-projetar chips de IA para Claude, juntando-se à OpenAI e ao Google na corrida para controlar o hardware de IA.
Musk compromete a SpaceX com GPUs Nvidia 'exclusivamente', enviando ações para cima e AMD para baixo
Elon Musk disse que a SpaceX usará chips Nvidia exclusivamente daqui para frente, com um sistema Vera Rubin NVL72 otimizado programado para ser lançado no espaço no próximo ano.
A receita do segundo trimestre da AMD aumenta à medida que as vendas de data centers dobram, mas as ações caem devido às altas expectativas
A AMD relatou um crescimento de receita de 50% no segundo trimestre de 2026, à medida que as vendas de data centers mais que dobraram devido à demanda de GPU Instinct, mas as ações caíram devido às expectativas altíssimas de Wall Street.
SK hynix e SanDisk revelam primeiro gargalo de memória de IA com foco em flash padrão de alta largura de banda
SK hynix e SanDisk publicaram a primeira especificação aberta High Bandwidth Flash (HBF), prometendo até 3 TB/s de largura de banda para aliviar os custos de memória de inferência de IA.
Jensen Huang, da Nvidia, prevê indústria de semicondutores de US$ 7,9 trilhões alimentada pela IA Agentic
O CEO da Nvidia, Jensen Huang, diz que a indústria global de semicondutores pode crescer para US$ 7,9 trilhões à medida que a inteligência artificial impulsiona uma demanda sem precedentes por hardware de computação.
DeepSeek V4 Flash é executado em uma única GPU AMD MI300X, sem necessidade de Nvidia
Um desenvolvedor obteve o modelo Flash V4 de 304 bilhões de parâmetros da DeepSeek rodando em um único AMD MI300X a 168 tokens por segundo, provando que a AMD pode servir modelos de fronteira sem Nvidia.
Lenovo Googlebook Leak revela PCs Gemini com uma chave de IA dedicada e um novo sistema operacional
Imagens vazadas para a imprensa mostram o primeiro laptop Googlebook da Lenovo e tablet 2 em 1 com uma tecla Gemini dedicada, faixas de luz e Gemini AI integrados em um novo sistema operacional que substitui o ChromeOS.
AI Chip Startups OLIX e DeepX arrecadam bilhões à medida que a corrida global para desafiar a Nvidia se intensifica
A OLIX de Londres arrecadou US$ 312 milhões com uma avaliação de US$ 3,3 bilhões e a DeepX da Coréia atingiu US$ 2,2 bilhões, enquanto startups em todo o mundo apostam que podem superar a Nvidia em hardware de inferência de IA.
AMD lança Instella-MoE: um modelo 16B totalmente aberto treinado do zero em suas próprias GPUs Instinct
O Instella-MoE-16B-A3B da AMD é um modelo de mistura de especialistas totalmente aberto, treinado inteiramente em GPUs Instinct MI300X e MI325X, com todos os pesos de treinamento, dados e configurações liberados.

Kimi da Moonshot funciona com 20.000 chips Nvidia H200 alugados do Alibaba
A Bloomberg relata que a Moonshot AI treinou seus modelos Kimi em um cluster Nvidia H200 de 20.000 chips fornecido pela Alibaba, expondo a dependência da China do silício ocidental.
Eliyan se torna um unicórnio com US$ 145 milhões da Série C para consertar o gargalo chip a chip da IA
A startup do Vale do Silício, Eliyan, levantou US$ 145 milhões em uma avaliação de US$ 1 bilhão para construir interconexões eletro-ópticas que desobstruam o gargalo de dados que desacelera os gigantescos clusters de chips de IA.
Brookfield e NextEra revelam data center de IA de 100 bilhões de dólares em antigo local de urânio no Kentucky
Uma coalizão liderada pela Brookfield e pela NextEra Energy planeja um campus de data centers de IA de 100 bilhões de dólares, financiado com capital privado, no local de Paducah do Departamento de Energia no Kentucky, com até 4,6 gigawatts de geração de energia dedicada.

Um modelo de linguagem com 28,9 milhões de parâmetros agora é executado em um microcontrolador de US$ 8
Um projeto de código aberto executa um LLM de 28,9 milhões de parâmetros em um chip ESP32-S3 barato a cerca de 9 tokens por segundo, usando um truque de memória emprestado de Gemma do Google.

Nvidia investe US$ 1,5 bilhão em embalagens de chips de IA dos EUA com acordo da Amkor
A parceria Amkor de US$ 1,5 bilhão da Nvidia expande embalagens e testes avançados de chips no Arizona, visando um gargalo crescente nas cadeias de fornecimento de semicondutores de IA.
Uma única linha de energia derrubada expôs a ameaça do data center de IA à rede dos EUA
Quando uma linha de energia caiu perto de Washington, D.C., mais de 3 gigawatts de data centers de IA foram desconectados de uma só vez, aumentando a tensão na rede PJM. Especialistas dizem que é um alerta de que o pior está por vir.

NAVER, NVIDIA e Brookfield ampliarão a fábrica nacional de IA da Coreia para 200 megawatts
NAVER, NVIDIA e Brookfield expandirão a fábrica soberana de IA da Coreia em GAK Sejong para 200 megawatts até 2028, com a NVIDIA investindo US$ 1 bilhão e a Brookfield financiando até US$ 9 bilhões.
Nvidia e SK Group revelam aliança de US$ 500 bilhões enquanto Jensen Huang declara uma ‘era de ouro da IA’ para a Coreia do Sul
O CEO da Nvidia, Jensen Huang, forjou uma aliança de US$ 500 bilhões com o SK Group da Coreia do Sul em uma cúpula nos EUA com o presidente Lee e Jay Y. Lee da Samsung, declarando uma “era de ouro da IA” para o país.
Samsung fecha acordo de US$ 200 bilhões com a Broadcom para fabricar chips de IA na maior vitória em fundição até o momento
A Samsung Electronics ganhou um acordo de US$ 200 bilhões para fabricar chips de IA para a Broadcom, o maior pedido de fabricação por contrato de sua história e um grande esforço para fechar a lacuna com a TSMC.
Microchip Technology adquirirá a Hailo, expandindo o portfólio de chips AI de ponta à medida que o mercado de inferência esquenta
A Microchip Technology assina um acordo definitivo para adquirir a Hailo, fabricante de processadores de IA de ponta, expandindo significativamente seu portfólio de hardware de IA.
AI Chip Startup Etched fecha US$ 300 milhões com avaliação de US$ 10,3 bilhões, dobrando em sete meses
Etched, a startup de chips de inferência fundada por três que abandonaram Harvard, fechou uma Série C de US$ 300 milhões liderada pela Sequoia com uma avaliação de US$ 10,3 bilhões, após registrar US$ 1 bilhão em pedidos.
O humanóide de Londres se torna o primeiro unicórnio da robótica humanóide da Europa com uma rodada de US$ 152 milhões
A startup britânica Humanoid levantou US$ 152 milhões com uma avaliação de US$ 1,35 bilhão, apoiada pela Bosch e pela Schaeffler, apostando que os robôs com rodas podem superar os rivais bípedes nas fábricas.
