Cerebras leva debate sobre limites do scaling ao Disrupt 2026

Cerebras leva debate sobre limites do scaling ao Disrupt 2026

O CEO e cofundador da Cerebras Systems, Andrew Feldman, vai subir ao palco do TechCrunch Disrupt 2026 para enfrentar uma das perguntas mais caras da indústria de tecnologia: até onde a inteligência artificial consegue continuar escalando. A sessão, batizada de "Can AI Keep Scaling?", foi anunciada pela TechCrunch em 30 de setembro de 2026.

O executivo ficará diante de fundadores, investidores e líderes técnicos que precisam decidir para onde vai o dinheiro de infraestrutura de IA nos próximos anos.

A conversa deve abordar a demanda crescente por computação, energia e infraestrutura. Também deve tratar de como a Cerebras ataca essas restrições e do que vem depois, caso o hardware disponível hoje atinja seu limite.

Uma aposta que contraria o consenso dos chips

Fundada em 2015, a Cerebras passou a última década contestando uma premissa básica da computação para IA. A premissa é que modelos cada vez mais capazes dependem, obrigatoriamente, de arquiteturas de chip convencionais.

Em vez de fatiar uma lâmina de silício em chips individuais, a empresa desenvolveu um processador construído sobre a própria wafer. O desenho foi pensado especificamente para cargas de trabalho pesadas de IA.

Segundo a TechCrunch, a companhia fornece capacidade de computação por meio de sistemas instalados no cliente, no modelo on-premise, e também de sua plataforma em nuvem.

Feldman chegou a esse ponto com um histórico longo em infraestrutura de computação. Antes da Cerebras, cofundou e liderou a SeaMicro, fabricante de microservidores de baixo consumo energético adquirida pela AMD em 2012.

Também ocupou cargos de liderança na Force10 Networks e na Riverstone Networks.

Os números por trás da expansão

A dimensão da operação ajuda a explicar o interesse pelo tema. De acordo com o material, a Cerebras levantou US$ 5,5 bilhões em seu IPO realizado em maio.

A empresa assinou um acordo de vários anos com a OpenAI para implantar 750 megawatts de sistemas Cerebras entre 2026 e 2028. Em agosto, apresentou o CS-4, a geração mais recente de sua infraestrutura de IA em escala de wafer.

O lançamento indica que a aposta na arquitetura segue viva e sendo renovada geração após geração.

Energia, data centers e fabricação

Processadores mais rápidos, sozinhos, não resolvem o problema de escala. Esses sistemas exigem data centers, eletricidade, refrigeração e capacidade industrial para serem produzidos em volume.

É nesse terreno que a Cerebras vem tentando se antecipar. Ainda em agosto, a companhia informou ter mais de 600 megawatts de capacidade de data center já em operação ou sob contrato para entrega até o fim de 2027.

A empresa disse estar ampliando sua capacidade de fabricação em mais de dez vezes ao longo de 2026. Também planeja colocar no ar sua primeira capacidade de data center na Europa ainda neste ano e chegar a 200 megawatts no continente até o fim de 2027.

Por que isso importa

A discussão deixou de ser apenas técnica e virou decisão de negócio. Para fundadores, investidores e gestores de tecnologia, entender onde a demanda por computação está indo é o tipo de informação que define apostas bilionárias em data centers, contratos de energia e cadeias de suprimento de semicondutores.

O mesmo vale para o que é necessário para sustentar essa demanda e para o ponto em que o hardware atual pode encontrar seus limites.

Ao levar Feldman ao palco, o evento coloca frente a frente o discurso do scaling aparentemente infinito e as restrições físicas. Entre elas estão energia, capacidade de fabricação e tempo de construção, que nenhum modelo consegue contornar sozinho.

A trajetória da Cerebras funciona como um teste de estresse dessa tese. Uma empresa que apostou, há mais de uma década, em um caminho que muitos consideravam pouco prático chega a 2026 com IPO realizado, um contrato de porte com a OpenAI e um plano agressivo de expansão física.

Se essa combinação de arquitetura alternativa e infraestrutura em larga escala dará conta da próxima geração de modelos é justamente o que Feldman deve responder no Disrupt Stage.

Fontes e links

Matéria publicada originalmente em TechCrunch

Últimas Notícias

OpenAI e Meta apostam em "Tamagotchis" de IA para vender hardware
Jev: o modelo que decide sem gerar texto chega ao LangChain
Gemini 4 Argon: Google lança modelo de fronteira com 1M tokens
Anthropic lança verificação para uso de IA em ciências da vida