Tres anuncios de modelos y motores de IA de la misma quincena, con un nivel de precisión muy distinto entre ellos: uno impecable, otro con dos matices concretos, y un tercero que suena a rumor y es, en realidad, un producto oficial verificable.

Sakana Fugu: no es un modelo, es quien elige el modelo

Fugu, de la japonesa Sakana AI, no compite como modelo propio — es un sistema multiagente que recibe la petición por una única API compatible con OpenAI, decide qué modelo frontera es mejor para esa tarea concreta, y redirige a otro si el elegido se atasca. Las cifras que circulan (19 movimientos frente a 21 para resolver un cubo de Rubik, 6 minutos frente a 20 para construir un juego) proceden del propio material de demos de Sakana, y son exactas para esos casos concretos — aunque conviene recordar que son comparaciones autoevaluadas por el fabricante, no benchmarks de un tercero independiente. El caso del cubo, además, es puntual: la media real sobre 300 pruebas (19,72 frente a 19,76 movimientos) es muchísimo más ajustada que el ejemplo destacado en el vídeo.

Nex-N2-Pro: gratis de verdad, con el nombre y la base equivocados en el anuncio

Nex-N2-Pro es un modelo real de mezcla de expertos (17.000 millones de parámetros activos sobre 397.000 millones totales, contexto de 262.000 tokens) disponible gratis en OpenRouter sin necesidad de tarjeta — confirmado por varias fuentes independientes. El vídeo que lo presenta acierta en casi todo salvo dos detalles: lo llama «Nexen 2 Pro» (el nombre real es Nex-N2-Pro) y dice que está construido sobre Qwen 2.5, cuando la base real es Qwen3.5. El «sin límites» también exagera: el nivel gratuito de OpenRouter sí tiene límites de peticiones diarias, no es acceso ilimitado.

El plugin de OpenAI que corre dentro de Claude Code: verificado punto por punto

Este es el caso más llamativo y, a la vez, el mejor confirmado: OpenAI publicó un plugin oficial (openai/codex-plugin-cc) que añade comandos de Codex — /codex:review, /codex:adversarial-review, /codex:rescue, entre otros — directamente dentro de Claude Code, el editor de su competidor directo. El plugin no sustituye a Claude como editor: añade subagentes especializados de Codex que Claude invoca bajo demanda para revisar o ejecutar tareas concretas. GPT-5.6 «Sol» tampoco es una distorsión fonética sin sentido — es el nombre real de la variante de mayor capacidad de esa familia, lanzada el 9 de julio de 2026. Lo único impreciso es la cifra de «tres veces más caro» en modo ultra: el coste real varía mucho más según el nivel de esfuerzo de razonamiento elegido, desde céntimos hasta más de 48 céntimos por la misma petición.

Cómo lo aplicamos nosotros

Este último caso, de hecho, ya forma parte de nuestro propio flujo de trabajo: usamos ese mismo plugin para pedir una segunda opinión de Codex sobre cambios de código sensibles antes de darlos por buenos, precisamente porque combinar dos modelos de proveedores distintos reduce puntos ciegos que un solo modelo no detecta por sí mismo.

Si quieres integrar varios modelos o proveedores de IA en tu flujo de trabajo con criterio — no solo por moda — hablemos. Contacta con nosotros.