Modelos e plataformas de IA
OpenAI lança Decisions API em beta público, alimentado pelo GPT-6 Luna

A OpenAI lançou a Decisions API em beta público em 6 de outubro de 2026, introduzindo um endpoint que devolve respostas tipificadas a perguntas definidas pelos desenvolvedores sobre entradas de texto e imagem. O registro de alterações da API da OpenAI registra o lançamento em beta com gpt-6-luna, atendido por um dedicado POST /v1/decisions endpoint.
A OpenAI afirma que o novo endpoint produz essas respostas cerca de 10 vezes mais rápido que a Responses API. Segundo a documentação da Decisions API, a API pode ser testada no Playground, onde os desenvolvedores podem experimentar perguntas e entradas antes de escrever código.
O lançamento segue a introdução da API no DevDay 2026, onde esteve disponível em pré‑visualização limitada. A recapitulação do DevDay da OpenAI afirmou que a API aplica o raciocínio do modelo Luna a um conjunto de perguntas definidas pelo usuário, cada uma com um conjunto finito de respostas predefinidas, permitindo que os desenvolvedores forneçam contexto de texto ou imagem e recebam resultados que podem conduzir à classificação de conteúdo, roteamento de solicitações ou à próxima ação de um agente. A OpenAI disse na época que um lançamento amplo estava planejado para os próximos dias.
O endpoint funciona com o GPT-6 Luna, um modelo de raciocínio que a OpenAI lançou ao lado do GPT-6 Sol em 22 de setembro de 2026. Ambos os modelos aceitam entradas de texto e imagem e geram texto por meio das APIs Responses e Chat Completions.
Como funciona a Decisions API
Cada solicitação tem três partes. O campo model seleciona o modelo de avaliação; atualmente, apenas gpt-6-luna é suportado. O campo input transporta evidências compartilhadas para as perguntas, seja como uma string de texto ou como mensagens de usuário contendo texto e imagens. O array questions especifica o que o modelo deve avaliar: o tipo de cada pergunta, suas instruções e quaisquer opções permitidas ou níveis de pontuação. A resposta contém um array answers, e cada pergunta possui um nome exclusivo que a API devolve junto com sua resposta.
Uma pergunta predicativa verifica uma condição, como dano visível em um produto ou se uma passagem é relevante, e devolve uma estimativa de probabilidade de 0 a 1 de que a condição seja verdadeira. No exemplo do guia, uma foto de produto é inspecionada em busca de rachadura, rasgo ou amassado, e uma resposta ilustrativa retorna uma probabilidade de 0,92; uma aplicação pode sinalizar fotos para revisão assim que o valor ultrapassar um limite definido pelo desenvolvedor.
Uma pergunta de escolha seleciona um valor de um conjunto fixo de opções fornecidas, cada uma com uma descrição explicando quando se aplica. A resposta contém o valor selecionado, um array probabilities que cobre todas as opções, e um campo de confiança separado. O exemplo de roteamento do guia envia uma reclamação de cliente sobre cobrança duplicada para a opção de faturamento antes das alternativas técnicas, de envio e outras. A orientação da OpenAI é adicionar um valor de fallback, como other para entradas que as categorias não antecipam; a aplicação pode encaminhar esse resultado de fallback para uma fila de revisão geral.
Uma pergunta de pontuação avalia uma entrada em relação a níveis ordenados, como a gravidade de um problema, dispostos do mais baixo ao mais alto. A pontuação retornada é a média ponderada por probabilidade dos índices dos níveis, que começam em 0, de modo que o resultado pode ficar entre dois níveis definidos. No exemplo trabalhado, probabilidades de 0,1, 0,7 e 0,2 em três níveis de gravidade produzem uma pontuação de 1,1 com confiança de 0,55.
Para saídas além desses três tipos de resposta, a documentação direciona os desenvolvedores para Structured Outputs com a Responses API quando precisam de um objeto que siga um esquema JSON personalizado, e para function calling quando um modelo deve solicitar uma chamada de ferramenta com argumentos.
Orientações de uso e limites de entrada
As imagens devem ser enviadas como URLs de dados base64 embutidos; o endpoint não suporta URLs de imagens hospedadas via HTTP ou HTTPS nem entradas file_id. Para avaliar uma imagem junto com instruções ou outro contexto, os desenvolvedores colocam as partes input_text e input_image juntas em uma única mensagem de usuário.
Perguntas independentes podem compartilhar o array questions de uma única solicitação, e cada pergunta pode usar um tipo diferente, de modo que uma aplicação possa verificar uma foto de produto quanto a danos e classificar a categoria do produto em uma única chamada. Quando uma decisão depende de uma resposta anterior, a aplicação deve enviar solicitações separadas, usando o primeiro resultado para condicionar a sequência, como confirmar dano antes de solicitar uma categoria de reparo.
A orientação de autoria da documentação centra‑se em critérios observáveis: mantenha preocupações distintas em perguntas separadas, atribua a cada escolha um significado distinto e defina níveis de pontuação de forma que os níveis vizinhos diferam claramente. Quanto à interpretação, a orientação é calibrar os limites contra exemplos rotulados da aplicação em produção, ponderando os custos relativos de falsos positivos e falsos negativos.
Preços, controles de dados e voz
O preço do endpoint com gpt-6-luna é de US$0,10 por 1 milhão de tokens de entrada. Apenas os tokens de entrada são cobrados: leituras de cache, gravações de cache e tokens de saída não têm custo. Prêmios de processamento regional e multiplicadores de preço para entrada de longo contexto ainda se aplicam, enquanto solicitações gpt-6-luna fora /v1/decisions seguem o preço aplicável ao modelo e ao nível de processamento.
A API oferece Retenção Zero de Dados e uso conforme HIPAA para clientes elegíveis, com residência de dados e processamento regional disponíveis nos Estados Unidos e na Europa (a Área Econômica Europeia e a Suíça). Para aplicativos controlados por voz, a delegação de cliente com a Live API permite que um agente escolha ações a partir de solicitações de voz e reporte os resultados ao usuário.
A OpenAI diz que espera que a Decisions API alcance a disponibilidade geral nas próximas semanas.












