Na quinta-feira, a OpenAI lançou uma prévia limitada do Ultrafast. O GPT-5.6 Sol está sendo executado na camada de serviço da API, com capacidade de gerar até 750 tokens de saída por segundo.
A empresa criadora do ChatGPT afirmou que o processamento nessa camada é até 14 vezes mais rápido que o processamento padrão. A empresa está testando-a com um número limitado de clientes de API para avaliar a demanda e a capacidade.
A velocidade é fornecida pela Cerebras (NASDAQ: CBRS), a fabricante de chips que fechou um acordo de computação com a OpenAI em janeiro.
A Cerebras anunciou na quinta-feira que seu chip alimenta o GPT-5.6 Sol. O chip tem o tamanho de um wafer e possui 44 GB de SRAM integrados.
Em janeiro, a OpenAI concordou em comprar até 750 megawatts de Cerebras ao longo de três anos. A capacidade deverá ser liberada em parcelas até 2028. Sam Altman consta como investidor da Cerebras.
O Ultrafast é 5 vezes mais rápido que o Claude Opus 4.8 no modo Rápido e 11 vezes mais rápido que o Claude Fable 5 em termos de velocidade de saída, segundo a Cerebras. A Anthropic oferece seu próprio modo Claude Rápido acelerado, mas ele não atinge os números citados pela OpenAI
A Cerebras anunciou que seu GPT-5.6 Sol Ultrafast concluiu o "Último Exame da Humanidade", um teste de 2.500 questões sobre química, economia e literatura em nível de pós-graduação, em pouco mais de 11 horas. A precisão alcançada foi semelhante à do Claude Fable 5, que levou mais de três dias de computação contínua para ser finalizado.
A Cerebras afirma ter alcançado uma aceleração de ponta a ponta de 5,6 vezes sem perda de qualidade no GDP-Val, um benchmark baseado em trabalho intelectual remunerado, como pareceres jurídicos e modelos financeiros. Um token é um trecho de texto que um modelo de linguagem produz durante a escrita.
A OpenAI está implementando o Ultrafast para tarefas que não podem esperar por um modelo mais lento.
Em sua publicação, a empresa citou resposta adent , fraude e análise de mercado, suporte ao cliente em tempo real, comércio eletrônico e pesquisa interativa como candidatos iniciais.
Durante interrupções, seus engenheiros usam a camada para ler registros, analisar trace ajudar a validar uma correção enquanto o sistema ainda está apresentando falhas, sendo os humanos que continuam tomando a decisão sobre a implementação.
"O GPT-5.6 Sol em Ultrafast é a prova de que velocidade e inteligência não são mais mutuamente exclusivas", disse Andrew Feldman, CEO da Cerebras, no comunicado da empresa.
Sachin Katti, vice-presidente de estratégia de computação e GPT-Infra da OpenAI, afirmou que a empresa está "começando com um pequeno grupo de clientes para aprender onde essa velocidade gera valor significativo"
Em julho, surgiram relatos de que o GPT-5.6 Sol, a versão de programação da IA, havia deletado arquivos, árvores de trabalho de código e pelo menos um banco de dados de produção por conta própria, Cryptopolitan informou
Matt Shumer, CEO da OthersideAI, escreveu no X que o Sol "acabou de apagar quase TODOS os arquivos do meu Mac pordent", enquanto o desenvolvedor Bruno Lemos disse que ele apagou seu banco de dados de produção.
Duas semanas antes do lançamento do Sol, a própria placa de sistema da OpenAI já havia sinalizado o comportamento. Ela alertava que o modelo poderia ser "excessivamente agente" e interpretar instruções de forma muito permissiva.
Não se limite a ler notícias sobre criptomoedas. Compreenda-as. Assine nossa newsletter. É grátis.