De acordo com pt.wedoany.com-Em 13 de agosto, a OpenAI começou a oferecer a um pequeno grupo de clientes uma prévia do modo de inferência de alta velocidade chamado Ultrafast, para acelerar a velocidade de saída do modelo principal GPT-5.6 Sol. Esse modo está atualmente em fase de testes em pequena escala e ainda não está disponível para todos os usuários do ChatGPT ou da API.

A reportagem cita a OpenAI afirmando que a velocidade de processamento do Ultrafast pode chegar a até 14 vezes a do modo padrão, com uma taxa de transferência de saída de até 750 tokens por segundo. Seu principal objetivo é melhorar a velocidade de resposta de modelos complexos em cenários de negócios em tempo real, sem precisar alternar para modelos menores.
É importante distinguir que os 750 tokens por segundo refletem principalmente a taxa de transferência de saída do modelo ao gerar texto, e não significam que todas as tarefas, incluindo raciocínio, chamadas de ferramentas, processamento de arquivos e busca na web, possam ser reduzidas a um catorze avos do tempo original. A velocidade de ponta a ponta de diferentes tarefas ainda é afetada pela intensidade do raciocínio, pelo comprimento do contexto e pelo tempo de execução das ferramentas.
A TechCrunch informou que a prévia do Ultrafast é apoiada pela colaboração entre a OpenAI e a empresa de chips de inteligência artificial Cerebras, com aplicações iniciais voltadas para fluxos de trabalho empresariais sensíveis à latência de resposta, como resposta a incidentes de segurança, atendimento ao cliente, análise de mercados financeiros e comércio eletrônico. A OpenAI planeja expandir gradualmente o acesso à medida que a capacidade computacional aumentar.
Os dados oficiais do modelo da OpenAI mostram que o GPT-5.6 Sol é o modelo principal da série GPT-5.6, voltado para codificação complexa, pesquisa, operação de computadores e trabalho profissional. O modelo suporta uma janela de contexto de 1,05 milhão de tokens, saída de até 128.000 tokens e níveis de intensidade de raciocínio que variam de none a max. O Ultrafast não é um novo modelo independente, mas sim um modo de operação para a velocidade do serviço de inferência do GPT-5.6 Sol.
Até 14 de agosto, a página do modelo GPT-5.6 Sol na OpenAI Docs e o resumo oficial de atualizações de produtos de 10 a 14 de agosto ainda não listavam o preço do Ultrafast, o método de chamada da API, o nível de serviço, o escopo regional e a lista específica de disponibilidade.





















