Nex AGI rompe las barreras del software libre con Nex-N2-Pro, un modelo MoE de 397B parámetros que rivaliza con GPT-5.5 en capacidades agénticas y coding.
El 2 de junio de 2026 quedará marcado en la historia de la inteligencia artificial. Nex AGI ha lanzado oficialmente Nex-N2-Pro, un modelo que no solo busca competir con los gigantes cerrados de la industria, sino que redefine lo que esperamos de un modelo de pesos abiertos. No estamos ante una simple actualización incremental; estamos ante un salto generacional que posiciona al código abierto en la misma liga que GPT-5.5 y Claude Opus 4.7.
La llegada de Nex-N2-Pro responde a una demanda creciente de los desarrolladores: la necesidad de modelos con capacidades de razonamiento profundo y ejecución de herramientas que no dependan de APIs propietarias costosas o restrictivas. Con una arquitectura optimizada y una capacidad agéntica nativa, este modelo promete transformar el flujo de trabajo de ingenieros de software y científicos de datos en todo el mundo.
El corazón de Nex-N2-Pro es su sofisticada arquitectura Mixture of Experts (MoE). A diferencia de los modelos densos tradicionales, Nex-N2-Pro utiliza un total de 397 mil millones de parámetros, pero gracias a su diseño de expertos, solo activa 17 mil millones de parámetros por token procesado. Esto permite un equilibrio casi perfecto entre una capacidad de conocimiento masiva y una eficiencia de inferencia excepcional.
El modelo ha sido post-entrenado sobre la base Qwen3.5-397B-A17B, lo que le otorga una comprensión lingüística y lógica de primer nivel. Además, su ventana de contexto es masiva, permitiendo procesar hasta 262K tokens de entrada y generar hasta 256K tokens de salida, lo que lo hace ideal para analizar repositorios de código completos o documentación técnica extensa.
Los números no mienten. Nex-N2-Pro ha alcanzado el estado del arte (SOTA) en benchmarks críticos para el desarrollo de software, superando a sus predecesores y a la mayoría de los modelos cerrados. En el Terminal-Bench 2.1, que mide la capacidad de interacción con entornos de comandos, el modelo ha obtenido una puntuación impresionante de 75.3.
Para tareas de flujo de trabajo de larga duración, su puntuación de 1585 en GDPval demuestra una estabilidad y coherencia que pocos modelos poseen. Además, ha establecido nuevos récords en SWE-Verified, SWE-Pro y DeepSWE, consolidándose como la herramienta definitiva para la resolución de problemas de ingeniería de software complejos.
Lo que realmente diferencia a Nex-N2-Pro es su capacidad de 'Agentic Thinking'. El modelo no solo predice el siguiente token, sino que opera en un bucle cerrado de razonamiento: comprensión, planificación, implementación, feedback, depuración e iteración. Esta capacidad le permite utilizar herramientas, ejecutar código en terminales y corregir sus propios errores de forma autónoma.
Para optimizar el coste computacional, Nex AGI ha implementado un sistema de razonamiento adaptativo. A diferencia de los modelos de 'chain-of-thought' que siempre consumen tokens de pensamiento, Nex-N2-Pro ajusta la profundidad de su razonamiento según la complejidad de la tarea. Esto reduce el uso de tokens de pensamiento entre un 30% y un 50%, acelerando la respuesta sin sacrificar la precisión.
Gracias a su versatilidad, Nex-N2-Pro es ideal para una amplia gama de aplicaciones avanzadas. En el ámbito del desarrollo, su integración nativa con herramientas como Claude Code, Cursor y OpenClaw lo convierte en el motor perfecto para agentes de codificación autónomos. También es excelente para RAG (Retrieval-Augmented Generation) de alta complejidad debido a su ventana de contexto.
Para los desarrolladores que prefieren el control total, el modelo puede ejecutarse localmente mediante llama.cpp u Ollama. Además, para quienes buscan escalabilidad inmediata, está disponible a través de Hugging Face, ModelScope, SiliconFlow (acceso temprano serverless) y OpenRouter. Para proyectos ligeros, Nex AGI también ha liberado la variante Nex-N2-mini.
Si eres un desarrollador listo para experimentar con el futuro, tienes múltiples vías de acceso. Puedes descargar los pesos directamente desde Hugging Face para un despliegue local o utilizar servicios serverless para pruebas rápidas. La disponibilidad en OpenRouter garantiza que puedas integrar el modelo en tus aplicaciones actuales mediante una API estandarizada.
Se recomienda comenzar utilizando la variante mini para prototipado rápido de prompts y luego escalar a la versión Pro para flujos de trabajo que requieran razonamiento profundo o ejecución de herramientas complejas.