Dos vídeos con el mismo gancho — «esto te ahorra una fortuna en IA» — señalando a dos cosas distintas: un catálogo gratuito de modelos de primer nivel que casi nadie usa, y una diferencia de precio real pero exagerada entre proveedores. Los separamos.
NVIDIA NIM: más de 100 modelos gratis, sin tarjeta de crédito, con un matiz de letra pequeña
NVIDIA NIM (build.nvidia.com) es un servicio real, gratuito y operativo desde 2024: expone una API compatible con OpenAI en integrate.api.nvidia.com/v1 que da acceso a un catálogo de modelos de primer nivel — MiniMax M2.7, Kimi K2.5, DeepSeek 3.2, GLM 5.1, GPT-OSS-120B entre otros — con solo registrarse con email y verificación de teléfono, sin tarjeta de crédito. Al ser compatible con el SDK de OpenAI, se conecta a Cursor, OpenCode o cualquier cliente existente cambiando solo base_url y api_key, sin tocar el resto del código.
Dos matices que el vídeo original no menciona: el catálogo ya supera los 100 modelos, no los 80 que suele citarse (una cifra desactualizada que sigue circulando); y «sin límite de tiempo» es una lectura optimista — los créditos gratuitos (1.000 al registrarse, ampliables a 5.000) no caducan, pero sí se consumen por llamada, y existe además un límite de 40 peticiones por minuto compartido entre todos los modelos. Suficiente para desarrollo y pruebas, no para producción sin plan de pago.
DeepSeek V4 Pro frente a Claude: la diferencia de precio es real, la cifra viral necesita contexto
Un segundo vídeo compara en directo el consumo de dos APIs recargadas con la misma cantidad de dinero: DeepSeek V4 Pro y Claude, ambas conectadas a través de OpenCode. El titular es que DeepSeek consumió menos de 1 dólar en 78 millones de tokens durante dos días de uso intensivo con agentes de código, mientras que Claude gastó el 30% del saldo en una sola consulta. La comparación de fondo es correcta: los precios oficiales sitúan a Claude Sonnet muchas veces por encima de DeepSeek V4 (una diferencia de entre 21 y 54 veces según se mire entrada o salida de tokens).
La cifra concreta de «78 millones de tokens por menos de un dólar», sin embargo, solo es matemáticamente posible con caching agresivo: DeepSeek cobra hasta un 98-99% menos por los tokens de contexto que se repiten entre llamadas — el caso típico de un agente de código que reenvía el mismo repositorio como contexto en cada iteración. Sin ese caché, el mismo volumen de tokens con DeepSeek V4 Pro rondaría los 100-200 dólares, no menos de uno. El ahorro es real; la cifra exacta depende de un mecanismo que el vídeo no explica.
Cómo lo aplicamos nosotros
Antes de migrar un flujo de trabajo entero a un proveedor «gratis» o «barato», comprobamos dos cosas que casi nunca aparecen en el vídeo que lo anuncia: los límites reales del plan gratuito (créditos, rate limits) y si el ahorro depende de una condición técnica concreta — como el caching — que hay que configurar a propósito, no que viene solo.
Si estás valorando qué modelo de IA usar en tus flujos de desarrollo o automatización y quieres una comparación honesta de coste real, hablemos. Contacta con nosotros.