Construir con IA

OpenAI lanza la API Decisions para clasificación y enrutamiento rápidos

OpenAI ha liberado la API Decisions en beta pública, ofreciendo respuestas tipadas como probabilidades y opciones a partir de imágenes o texto mediante el modelo gpt-6-luna.

Un prisma de vidrio dividiendo la luz en tres trayectorias representando los tipos de preguntas de la API
Ilustración generada para este artículo

Traducido automáticamente del original en inglés.

OpenAI ha presentado la API Decisions, una nueva herramienta diseñada para convertir texto e imágenes en decisiones estructuradas para aplicaciones de software. Lanzada en beta pública el 6 de octubre de 2026, este endpoint utiliza el modelo gpt-6-luna para evaluar entradas y devolver respuestas tipadas significativamente más rápido que los métodos anteriores. El lanzamiento se dirige a desarrolladores que necesitan clasificar contenido, enrutar solicitudes o priorizar trabajo sin generar largas respuestas en lenguaje natural.

Qué ha ocurrido

La API Decisions está disponible ahora mediante un endpoint dedicado POST /v1/decisions. Actualmente se encuentra en beta pública, con OpenAI esperando un lanzamiento de disponibilidad general en las próximas semanas. El único modelo compatible en el lanzamiento es gpt-6-luna. Para usar las nuevas funciones, los desarrolladores deben actualizar sus SDKs de OpenAI a versiones mínimas específicas: Python 3.26.0, JavaScript 7.30.0, Go 3.73.0, Ruby 0.101.0 y Java 4.78.0.

Esta API difiere de las completions de chat estándar al centrarse en la evaluación en lugar de la generación. En vez de escribir párrafos, el modelo devuelve tipos de datos específicos como probabilidades, opciones categóricas o puntuaciones numéricas. OpenAI afirma que este enfoque ofrece respuestas aproximadamente diez veces más rápidas que la API Responses. El servicio admite Retención Cero de Datos y cumplimiento HIPAA para clientes elegibles, con opciones de residencia de datos en Estados Unidos y Europa.

Cómo funciona

Una solicitud a la API Decisions consta de tres partes principales: el modelo, la entrada y las preguntas. El campo model especifica gpt-6-luna. El campo input contiene la evidencia compartida, que puede ser una cadena de texto o mensajes de usuario incluyendo imágenes. La matriz questions define qué debe evaluar el modelo, incluyendo instrucciones y salidas permitidas. Cada pregunta debe tener un nombre único, que la API refleja en la respuesta para ayudar a emparejar las respuestas con las consultas.

Los desarrolladores pueden elegir entre tres tipos de pregunta según la lógica de decisión requerida. Un tipo predicate verifica si una condición es verdadera, devolviendo una probabilidad entre 0 y 1. Esto es útil para comprobaciones binarias como detectar daños visibles en una foto. Un tipo choice selecciona una opción de un conjunto fijo, como categorizar un ticket de soporte por departamento. Un tipo score califica la entrada contra niveles ordenados, como la gravedad del problema. Los niveles de puntuación comienzan en el índice 0, donde 0 significa cosmético, 1 significa que existe una solución alternativa y 2 significa completamente bloqueado. La puntuación devuelta es un promedio ponderado por probabilidad de estos índices, lo que permite resultados matizados como 1.1.

Para flujos de trabajo complejos, los desarrolladores pueden incluir múltiples preguntas independientes en una sola solicitud. Por ejemplo, se puede verificar una foto de producto por daños y clasificarla por categoría simultáneamente. Sin embargo, si una decisión depende de una respuesta anterior, se recomiendan solicitudes separadas. OpenAI aconseja redactar preguntas basadas en criterios observables y establecer umbrales según el costo de falsos positivos y negativos en su aplicación específica.

Detalles clave

  • La API Decisions es aproximadamente 10x más rápida que la API Responses para tareas de evaluación.
  • Los costos de entrada para gpt-6-luna en este endpoint son de $0.10 por 1 millón de tokens.
  • No hay cargos por lecturas de caché, escrituras de caché ni tokens de salida en este endpoint.
  • Aún se aplican primas de procesamiento regional y multiplicadores de precios de entrada de contexto largo.
  • La API admite Retención Cero de Datos y uso HIPAA para clientes elegibles en EE. UU. y Europa.
  • Las puntuaciones se calculan como promedios ponderados por probabilidad de índices de nivel, que comienzan en 0.

Por qué importa

Para equipos de ingeniería que construyen funciones de IA en producción, la latencia y el costo son restricciones críticas. Los modelos de lenguaje grandes tradicionales a menudo generan explicaciones verbosas incluso cuando se necesita un simple sí/no o etiqueta de categoría. La API Decisions elimina esta sobrecarga, proporcionando datos estructurados que se integran directamente en la lógica de la aplicación. Esto reduce la necesidad de pasos de post-procesamiento para analizar salidas en lenguaje natural, simplificando la base de código y mejorando la confiabilidad.

La capacidad de manejar tanto texto como imágenes en un solo paso de evaluación abre nuevas posibilidades para el control de calidad automatizado y la triage. Los sistemas de soporte pueden enrutar tickets automáticamente basándose en puntuaciones de urgencia derivadas de mensajes de clientes. Las plataformas de comercio electrónico pueden marcar bienes dañados a partir de fotos subidas por usuarios sin revisión humana. Al exponer niveles de confianza y distribuciones de probabilidad, la API permite a los desarrolladores construir mecanismos de respaldo más robustos, asegurando que las decisiones de baja confianza sean dirigidas a agentes humanos.

Qué puedes hacer

  • Actualiza tu SDK de OpenAI a la versión requerida para tu stack de lenguajes antes de probar.
  • Usa el Playground para experimentar con diferentes tipos de preguntas y formatos de entrada.
  • Define criterios claros y observables para cada pregunta para mejorar la precisión del modelo.
  • Establece umbrales personalizados para decisiones de enrutamiento basados en tu tolerancia al error.
  • Combina múltiples preguntas independientes en una solicitud para reducir llamadas a la API.
  • Revisa los requisitos de residencia de datos si operas en Europa o manejas datos de salud.

Herramientas de la Tienda de Bytechap

$79

WorkBento

Suite de RR. HH. y gestión del entorno laboral impulsada por IA que puedes alojar tú mismo.

Demo en vivo

Seguir leyendo

Todos los artículos