Últimas noticias, tutoriales y perspectivas sobre IA
DeepSeek AI lanza DeepSeek V2.5, un modelo MoE de 236B parámetros que fusiona capacidades de codificación y chat general bajo licencia MIT.
AI21 Labs presenta Jamba 1.5, un modelo de código abierto que combina Mamba y Transformers para contextos masivos y velocidad sin precedentes.
Microsoft lanza Phi-3.5, un modelo de 4B parámetros con arquitectura MoE y ventana de contexto de 128K, optimizado para dispositivos móviles y razonamiento avanzado.
xAI lanza Grok-2 en agosto 2024. Rivaliza con GPT-4o y Claude 3.5. API, benchmarks y uso en X.
Naver lanza su modelo más avanzado con 104B parámetros y ventana de contexto de 100K tokens, diseñado específicamente para el ecosistema coreano.
Black Forest Labs lanza FLUX.1, un modelo de 12B parámetros que supera a los líderes propietarios en calidad de imagen y eficiencia.
Mistral AI lanza Mistral Large 2 con 123B parámetros y pesos abiertos. Un análisis técnico profundo.
Meta AI lanza Llama 3.1, un hito histórico con 405B parámetros y ventana de 128K tokens, estableciendo nuevos estándares en inteligencia artificial abierta.
Mistral AI y NVIDIA presentan NeMo, un modelo de 12B parámetros optimizado para hardware eficiente con ventana de contexto de 128K.