API multimodal compatible con el estándar OpenAI, con los principales modelos gratuitos. Esto es lo que es real, cuáles son los límites y cuáles son los riesgos.

Agnes AI, de Sapiens AI (Singapur), ofrece modelos propios de texto, visión, imagen y video mediante una API compatible con OpenAI. «Gratis» significa que no se cobra por token ni generación; no implica uso irrestricto o garantizado, ni que sea adecuado para producción crítica.
Texto, imagen y video actualmente a US$ 0 — incluso vía API. Una de las ofertas gratuitas más agresivas de 2026.
El mismo formato de llamada de los SDK de OpenAI: intégralo en n8n, Python, Node, agentes y apps existentes cambiando solo la URL base y la clave.
Sin garantía de uptime, los límites pueden cambiar y, en el plan gratuito, tus datos pueden entrenar los modelos (salvo opt-out). No lo uses como único proveedor en un sistema crítico.
Una sola clave y un solo gateway (apihub.agnes-ai.com) para texto/visión, imágenes y video.
Texto, visión y agentes. Conversación, razonamiento, código, llamadas a herramientas, streaming y visión mediante URL de imagen. Contexto declarado de 512K tokens (los catálogos externos mencionan 256K; haz una prueba antes de enviar contextos enormes). US$ 0 por millón de tokens.
POST https://apihub.agnes-ai.com/v1/chat/completions model: agnes-2.0-flash
Texto→imagen, imagen→imagen, rediseño, edición mediante instrucciones, respuesta en URL o Base64, resoluciones de 1K a 4K en las proporciones 1:1, 16:9, 9:16, 4:3, 3:4, 2:3, 3:2 y 21:9. US$ 0 por imagen.
POST https://apihub.agnes-ai.com/v1/images/generations model: agnes-image-2.1-flash
Texto→video, imagen→video, keyframes, control de cámara/movimiento mediante prompt, 480p/720p/1080p, generación asíncrona. Hasta 441 frames por solicitud (fórmula 8n+1). US$ 0 por segundo.
POST https://apihub.agnes-ai.com/v1/videos GET .../agnesapi?video_id=ID
| Proporción | 1K | 2K | 3K | 4K |
|---|---|---|---|---|
| 1:1 | 1024×1024 | 2048×2048 | 3072×3072 | 4096×4096 |
| 16:9 | 1312×736 | 2624×1472 | 3936×2208 | 5248×2944 |
| 9:16 | 736×1312 | 1472×2624 | 2208×3936 | 2944×5248 |
| 4:3 | 1152×864 | 2304×1728 | 3456×2592 | 4608×3456 |
| 3:4 | 864×1152 | 1728×2304 | 2592×3456 | 3456×4608 |
Las dimensiones fuera de la tabla (p. ej., 1920×1080) pueden convertirse automáticamente. Para una miniatura de YouTube: pide "size":"2K","ratio":"16:9" y redimensiona a 1920×1080.
Como la API es compatible con OpenAI, el camino es el de siempre — y la arquitectura más segura usa Agnes como capa gratuita de alto volumen, nunca como único cerebro.
Tareas gratuitas y de alto volumen: miniaturas por lotes, resúmenes, clasificación, agentes de prueba, videos experimentales.
Gemini / GLM / DeepSeek como ruta alternativa cuando Agnes no esté disponible o tenga limitaciones.
OpenAI / Claude para lo que exige calidad predecible, SLA y validación amplia.
El plan gratuito se anuncia como gratis por tiempo indefinido, pero sin garantía contractual: la disponibilidad, las cuotas y las políticas pueden cambiar. Los planes pagos compran principalmente velocidad y prioridad, no «uso ilimitado».
| Recurso | Límite efectivo |
|---|---|
| Texto | 20 req/min |
| Imágenes 1K | 20 img/min |
| Imágenes 2K | 10 img/min |
| Imágenes 3K / 4K | 1 img/min |
| Video | 1 req/min |
Teóricamente 28.800 llamadas de texto/día y 1.200 imágenes 1K/hora — pero las colas, el fair use y la capacidad reducen el volumen real. Sin SLA.
| Plan | Precio/mes* | Texto / 5h | Texto / semana |
|---|---|---|---|
| Starter | US$ 4 | 1.500 | 15.000 |
| Plus | US$ 10 | 7.500 | 75.000 |
| Pro | US$ 50 | 30.000 | 300.000 |
Todos los Token Plans: hasta 1.000 RPM en texto, 4.000 imágenes/día, 500 s de video/día, 100 RPM (1K) / 80 RPM (2K) en imagen, 5 RPM en video. *Precios vistos en una fuente de la comunidad — confírmalos en el checkout. Detalle extraño: el plan de pago aumenta la velocidad, pero introduce cuotas temporales explícitas que el free no publica.
Puedes combinar: la clave gratuita y la clave Token Plan usan pools separados; cuando se agota el plan de pago, la clave gratuita sigue funcionando con los límites gratuitos. Crear varias claves de la misma categoría no multiplica los límites (comparten el mismo pool).
Todo mediante el endpoint compatible con OpenAI. Cambia $AGNES_API_KEY por tu clave.
Regístrate en la campaña oficial — agnes-ai.com/campaign — y genera una clave gratuita. Guárdala como variable de entorno — nunca en el código.
# acceso: https://agnes-ai.com/campaign export AGNES_API_KEY="sua-chave-aqui"
Completaciones de chat en formato OpenAI, con streaming y llamadas a herramientas.
curl https://apihub.agnes-ai.com/v1/chat/completions \ -H "Authorization: Bearer $AGNES_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"agnes-2.0-flash","messages":[{"role":"user","content":"Resuma o que é a Agnes AI em 3 frases."}]}'
En Python (o Node), basta con cambiar base_url — el resto del código no cambia.
# pip install openai from openai import OpenAI client = OpenAI(base_url="https://apihub.agnes-ai.com/v1", api_key="$AGNES_API_KEY") r = client.chat.completions.create(model="agnes-2.0-flash", messages=[{"role":"user","content":"Olá!"}]) print(r.choices[0].message.content)
Ej.: miniatura 16:9 en 2K (después redimensiónala a 1920×1080).
curl https://apihub.agnes-ai.com/v1/images/generations \ -H "Authorization: Bearer $AGNES_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"agnes-image-2.1-flash","prompt":"thumbnail de YouTube sobre IA gratuita, estilo tech dark","size":"2K","ratio":"16:9"}'
Crea el job, recibe un video_id y consulta hasta que esté listo. Los frames siguen la fórmula 8n+1 (máx. 441).
# crear curl https://apihub.agnes-ai.com/v1/videos \ -H "Authorization: Bearer $AGNES_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"agnes-video-v2.0","prompt":"drone sobrevoando cidade futurista ao entardecer","resolution":"720p"}' # consultar el resultado curl "https://apihub.agnes-ai.com/agnesapi?video_id=SEU_ID" \ -H "Authorization: Bearer $AGNES_API_KEY"
En el plan gratuito, los prompts y archivos pueden usarse para entrenar los modelos, salvo que desactives esta opción — disponible dentro del servicio o a través del soporte. Nunca envíes datos sensibles (CPF, pacientes, contratos, claves, datos LGPD) con el plan gratuito.
# canal de soporte para excluir el uso en entrenamiento
support@agnes-ai.com
No es teoría: surgió de ~70 llamadas reales a la API, comparando lo que la documentación promete con lo que había observado. El registro completo —parámetros aceptados, los que provocan un error HTTP 400, cuota, costo y puntos pendientes— está en NOTAS-API.md.
No es una cuestión de calidad (están empatados), sino del filtro de contenido: en portugués, bloquea generaciones legítimas con un error HTTP 400. Escribe el prompt en inglés, incluso para contenido en PT.
Cualquier animal con cola en pose frontal sale con dos. La solución es especificarlo en el prompt: ONE SINGLE bushy tail. Se aplica a la configuración general: lo que no especifiques, el modelo lo duplica.
Cerca de el 34% de las llamadas falla con 503 — y el reintento recupera prácticamente el 100%. Sin reintentos, concluyes, equivocadamente, que la API «no funciona».
Descriptores como fur, expressive eyes o children's book inyectan personajes en un prompt que era solo de escenario. En el descriptor de estilo, usa solo términos estéticos.
1K tarda ~32s; 4K tarda ~153s y falla mucho más. La resolución no cuesta nada adicional (todo cuesta US$ 0), pero sí tiempo y una tasa de error; genera en 1K cuando el volumen importa.
La URL de retorno es temporal. Guarda el archivo en el mismo paso de la generación; no conserves el enlace pensando que podrás recuperarlo después.
response_format en el nivel raíz del JSON devuelve HTTP 400 — solo funciona dentro de extra_body. Peor aún: los parámetros desconocidos se descartan en silencio (el gateway usa drop_params), así que un 200 OK no demuestra que tu parámetro se usó. Y no existe seed ni fine-tuning/LoRA.
curl https://apihub.agnes-ai.com/v1/images/generations \ -H "Authorization: Bearer $AGNES_API_KEY" -H "Content-Type: application/json" \ -d '{"model":"agnes-image-2.1-flash","prompt":"...","size":"1K","ratio":"16:9", "extra_body":{"response_format":"url"}}'
La evidencia es buena en agentes y razonable en imagen; en video, el modelo está lejos de los líderes. Faltan benchmarks amplios e independientes de texto (SWE-bench, GPQA, MMLU-Pro, etc.).
Claw-Eval: Pass³ 60,9% — 9.º lugar (líder del snapshot: Claude Opus 4.6 con 70,4%). Benchmark legítimo de 300 tareas reales verificadas por personas. Es competitivo, pero no lidera, y un solo benchmark no demuestra superioridad general en código, portugués, matemáticas o precisión factual.
~1.178–1.184 Elo en evaluaciones de edición: funcional y competitivo. Ideal para alternativas de miniaturas, banners, fondos y pruebas A/B; para piezas premium (manos, tipografía, logotipo exacto), revisa o termina el trabajo con un modelo más potente.
Posiciones ~61 (T2V) y ~63 (I2V) en los rankings — por debajo de los líderes en realismo y movimiento complejo. Antes del free, costaba ~US$ 0,30/min en gateways. A US$ 0, vale la pena probarlo intensamente para escenas de apoyo y volumen.
La oferta es demasiado buena como para ignorarla en pruebas, contenido, agentes y automatizaciones no críticas. Pero no la uses como único proveedor de un sistema comercial crítico.
Aplicação ↓ Roteador de modelos ├── Agnes AI: tarefas gratuitas e alto volume ├── Gemini/GLM/DeepSeek: segunda opção └── OpenAI/Claude: tarefas críticas ou complexas