Nuevo · OpenAI Decisions API (beta pública, 06/10/2026)

OpenAI entró en la IA de decisión. Compárala con Jev.

La misma pregunta, dos motores. Mira qué cambia en tipos de pregunta, imagen, rechazo, precio y latencia — y convierte tus solicitudes de un formato a otro sin reescribir nada.

Decisions × Jev: la API de decisiones de OpenAI y Jev lado a lado
En resumen

OpenAI lanzó la Decisions API: envías un texto o una foto con preguntas cerradas y recibes solo la respuesta — sí/no, una opción de tu lista o una nota — con la probabilidad, sin texto corrido. Es la misma idea de Jev, el modelo de decisión que INEMA ya estudia. Este proyecto explica las diferencias con la fuente de cada dato y trae un puente en Python que convierte las preguntas de un formato a otro y compara las respuestas. Para estudiar basta con leer y ejecutar la demostración sin conexión; para llamar a las APIs de verdad, necesitas tus propias claves.

Qué es

Decisión, no conversación

Un modelo de decisión no escribe: elige. Tu sistema hace la pregunta, define las opciones válidas y recibe una respuesta lista para usar en código — y una probabilidad para saber cuándo llamar a una persona.

Los seis puntos de la comparación: predicate/noul, choice, score, imagen, rechazo y puente sin conexión

📚 Comparación con fuente

Cada línea indica de dónde viene: documentación oficial de OpenAI, el código del proyecto Jev o lo que midieron los autores de dos videos. Nada se presenta como medición nuestra.

🔁 Puente Jev ↔ OpenAI

Convierte la solicitud de un formato a otro (noul ↔ predicate, criteria ↔ choices/levels) y normaliza las dos respuestas en un solo formato.

🧪 Demo sin conexión y pruebas

Tres casos ficticios con respuestas simuladas se ejecutan sin clave ni costo; 12 pruebas garantizan la conversión. El modo en vivo solo se ejecuta cuando tú lo autorizas.

Comparación

Qué es igual y qué cambia

Ambos responden a las mismas tres formas de preguntar. Las diferencias están en la entrada, el rechazo y el precio.

OpenAI Decisions APIJev (TypeSafe)
Sí o nopredicate → probabilidad de 0 a 1noul → probabilidad de 0 a 1
Una opción de la listachoice + choices, con confidencechoice + criteria, con confidence
Nota en una escalascore + levels (índice desde 0)score + criteria en lista
EntradaTexto e imagen (solo base64)Solo texto
RechazoPuede responder refusalSiempre elige entre las opciones
Modelogpt-6-luna (único)~typesafe/jev-latest
Precio (entrada)US$ 0,10 por 1M de tokens, sin cobro de salidaUS$ 0,042 por 1M de tokens
SituaciónBeta pública desde 06/10/2026Disponible, sin lista de espera

Fuentes: guía oficial de OpenAI (developers.openai.com/api/docs/guides/decisions) y el proyecto inematds/jev. Detalles en docs/comparacao.md (en portugués).

Lo que midieron los videos

Dos creadores probaron las APIs justo en el lanzamiento. Los números de abajo son suyos, con pocas preguntas y fáciles — sirven como indicio, no como benchmark.

💰 Precio

Jev salió cerca de un 58% más barato por token de entrada; en la prueba de incidentes, el costo total quedó cerca de la mitad.

⏱️ Latencia

Promedio de 146 ms (OpenAI) contra 155 ms (Jev); la mediana fue levemente mejor en Jev. En una prueba de integración, una llamada tardó ~300 ms, el doble de lo anunciado.

🎯 Acierto

Empate: los dos acertaron todo en las pruebas de los autores. Con fotos, OpenAI distinguió producto dañado, intacto y caja cerrada.

Fuentes: video "OpenAI's Decisions API just dropped. Here's how it compares to Jev" y un segundo video, en español, que integró la API en un triaje de clínica veterinaria (recibido solo como transcripción).

Cómo funciona

Formula una vez, ejecuta en los dos

El puente traduce las preguntas, llama a cada proveedor en su formato y devuelve las respuestas lado a lado, con alerta de revisión cuando la confianza es baja o hubo rechazo.

Pregunta en formato Jev→ el puente convierte→ OpenAI (+ foto) y Jev→ respuestas normalizadas→ ¿coinciden? ¿revisar?
Requisitos previos

Muy poco

El puente usa solo la biblioteca estándar de Python. Las claves solo son necesarias en el modo en vivo.

Python 3.10+ y Git

No hay dependencias que instalar.

git clone https://github.com/inematds/decisions-jev.git
cd decisions-jev

Clave de OpenAI

Solo para el modo en vivo. Se crea en la plataforma de OpenAI; se cobra aparte de cualquier suscripción.

export OPENAI_API_KEY=...

Clave de OpenRouter

Solo para el modo en vivo, para llamar a Jev a través de OpenRouter.

export OPENROUTER_API_KEY=...
Guía de uso · paso a paso

Del ejemplo a tu comparación

Empieza sin conexión. Llama a las APIs solo cuando la pregunta esté bien formulada.

1

Ejecuta la demostración sin conexión

Tres casos ficticios — guardia de mascotas, incidente de checkout y un rechazo — con respuestas simuladas. Muestra el formato de la comparación, sin clave y sin costo.

python3 -m ponte demo
2

Mira la misma pregunta en el formato de OpenAI

El puente transforma noul en predicate, criteria en choices o levels, y el nombre de cada pregunta en name.

python3 -m ponte converter jev-openai exemplos/plantao-pet.jev.json
3

Adjunta una foto (solo la usa OpenAI)

La imagen se convierte en una data URL base64 dentro del mensaje. En el sentido contrario, el puente avisa que Jev recibirá solo el texto.

python3 -m ponte converter jev-openai exemplos/plantao-pet.jev.json --imagem foto.jpg
python3 -m ponte converter openai-jev exemplos/devolucao-foto.openai.json  # avisa: 1 imagen descartada
4

Compara en vivo (llamada de pago)

Llama a los dos proveedores con la misma pregunta y muestra respuestas, latencia y costo. Exige PERMITIR_API=1 para no gastar por error. Este modo aún no ha sido ejecutado por INEMA.

PERMITIR_API=1 python3 -m ponte ao-vivo exemplos/plantao-pet.jev.json
5

Pídele a tu agente que lo integre

El prompt listo le indica al agente que lea la documentación oficial en Markdown antes de programar, que haga las preguntas en una sola llamada, que marque la confianza inferior a 0,6 como "revisar" y que trate el rechazo sin romperse.

# copia el bloque de texto de
docs/prompt-integracao.md
6

Verifica con las pruebas

12 pruebas cubren conversión en los dos sentidos, ida y vuelta, imagen, rechazo, revisión y el bloqueo del modo en vivo.

python3 -m unittest discover -s testes
Cuál usar

Elige según tu caso, no según el titular

Para una persona que espera, unos milisegundos no hacen diferencia. Pesan la entrada, el volumen y qué hacer con la duda.

📷 ¿Tienes imagen?

Decisions API. La foto de un producto, de una herida o una captura de pantalla entran en la misma llamada. Jev todavía solo lee texto.

📈 ¿Mucho volumen, solo texto?

Jev. El precio de entrada es menos de la mitad; en millones de registros, la diferencia se nota en la cuenta.

🛑 ¿Tema sensible?

OpenAI puede rechazar con refusal. En Jev, incluye una opción "insuficiente". En ambos, un rechazo o una confianza baja va a una persona.

Roadmap

Próximos pasos

Lo que ya existe y lo que falta medir.

v1.0
Puente, comparación y demoConversión en los dos sentidos, normalización, política de revisión, 3 casos simulados, 12 pruebas, guía en PT/EN/ES.
Próximo
Comparación medida por INEMAEjecutar el modo en vivo en un conjunto propio en portugués, con referencia humana, midiendo acierto, calibración, costo y latencia — depende de la autorización para usar las dos APIs.
Después
Puente en el Jev Decision LabLlevar el proveedor OpenAI al laboratorio y a los paquetes del proyecto jev, junto a OpenRouter y TypeSafe.