Um chip brasileiro
para revolucionar a IA.

Computação analógica de ponta, projetada do zero no Brasil. Um servidor de IA na sua rede privada, muito mais veloz que uma GPU e muito mais barato que a nuvem.

Chip próprioarquitetura nova, não uma GPU adaptada
Computação analógicaa conta é feita pela física, com uma fração da energia
Projeto 100% brasileirotecnologia projetada e validada no Brasil
Chip da Linear Compute sobre uma placa iluminada

Tecnologia de ponta: a memória é o processador.

Uma GPU gasta a maior parte do tempo e da energia movendo o modelo entre a memória e o processador. Nosso chip é uma arquitetura nova, desenvolvida no Brasil: o modelo fica parado no silício e a corrente que passa por ele já é a resposta.

  • Multiplicar é deixar a corrente passar

    Cada peso conduz mais ou menos corrente. Entrada vezes peso sai pronto.

  • Somar é um fio

    Milhares de termos se somam no mesmo condutor, sem instrução.

  • Ler é um instante

    A camada inteira vira número de uma vez. Por isso é rápido e gasta pouco.

  • Feito aqui

    Projeto, simulação e validação no Brasil, com processo de fabricação aberto. Primeiro silício em 2027.

Muito mais rápido que uma GPU.

Um modelo de 8 bilhões de parâmetros, um usuário, a mesma pergunta. A GPU responde a ~100 tokens por segundo. O nosso chip, a ~5.000.

5.000tokens por segundoLinear Compute, projeção
100tokens por segundoGPU de consumo topo de linha
15 Wde consumoLinear Compute, projeção
350 Wde consumoGPU de consumo topo de linha
Uma página inteira em 0,1 s. Uma resposta de 500 palavras leva mais tempo para ler do que para gerar.
Dezenas de pessoas ao mesmo tempo. A vazão de um chip atende um escritório inteiro sem fila.
Sem sala refrigerada. 15 W é menos que uma lâmpada. Fica em cima da mesa, em silêncio.

Linear Compute: projeção de engenharia para um modelo de 8B, um usuário, a 25 °C, com base nas medidas da célula no processo real. Serão substituídos pelos números medidos no primeiro silício, em 2027. GPU: valores públicos típicos de uma placa de consumo topo de linha rodando o mesmo modelo quantizado.

Muito mais barato que nuvem.

A nuvem cobra por usuário, todo mês, para sempre. A GPU local custa caro, pesa na conta de luz e perde velocidade conforme mais gente usa. O chip da Linear Compute é um custo só, atende dezenas de pessoas ao mesmo tempo e gasta a energia de uma lâmpada.

IA na nuvem

R$ 150.000/ano

100 pessoas × R$ 125 por mês, sem contar API

  • Cobra por usuário, para sempre
  • Seus dados saem da empresa
  • Depende de internet e de terceiros

GPU local

~R$ 2.700/ano só de energia

350 W ligados o dia inteiro, a R$ 0,90 o kWh

  • Dados ficam na empresa
  • Hardware caro, esquenta, faz barulho
  • Poucos usuários: a velocidade cai conforme mais gente usa

Linear Compute

~R$ 120/ano de energia

15 W ligados o dia inteiro. Hardware pago uma vez.

  • Dados e prompts nunca saem da rede
  • Sem assinatura, sem custo por token
  • Dezenas de usuários ao mesmo tempo

Exemplos de conta. Nuvem: assinatura típica de US$ 25 por usuário, a R$ 5 por dólar. Energia: consumo contínuo a R$ 0,90 por kWh. O preço será divulgado com a lista de reserva.

Quer ser dos primeiros?

Tecnologia brasileira de ponta, primeiro silício em 2027. Estamos montando a lista de empresas e pessoas que vão receber os primeiros chips.

Entrar na lista